TGViewer
🤖 Датаист 🤖 Датаист @andre_dataist · 4.07K subscribers
Post #324 262
Модели решений могут изменить архитектуру ИИ-агентов

Сейчас большие языковые модели используют почти для всего.

Нужно написать текст, выбрать инструмент для агента или принять решение — вызываем LLM. Хотя во многих таких задачах сложного рассуждения вообще не требуется.

По сути, мы зовем профессора математики решить, на какую кнопку нажать.

И, похоже, для таких задач начинает формироваться отдельный класс ИИ-моделей — модели решений.

Они не генерируют текст, а получают описание текущей ситуации и возвращают конкретное решение с вероятностью.

Один из примеров — Jev от TypeSafe AI. Компания называет такие модели System One Models — по аналогии с «Системой 1»: быстрым автоматическим мышлением без длинной цепочки рассуждений.

Но мне здесь интереснее не сама Jev, а новый подход к принятию решений агентами.

Раньше мы выбирали между обычным условием, например «if amount > 10000», и большой языковой моделью.

Теперь появляется третий вариант: «if P("операция подозрительна") > 0.9».

Условие остается частью программы, но становится вероятностным. И экономика уже позволяет использовать такие решения массово.

TypeSafe указывает цену Jev $0,042 за миллион входных токенов, выход отдельно не тарифицируется, а заявленная задержка — 70–500 мс.

Если одно смысловое решение становится настолько дешевым, ИИ можно запускать почти на каждом событии в системе.

Пришло письмо — определили срочность и важность, или появился лид — оценили вероятность сделки. И такой подход уже начали использовать.

Уже можно создать браузерного агента, где Jev выбирает следующее действие. Есть pg-jev для PostgreSQL, позволяющий прямо внутри SQL задавать смысловые условия вроде «клиент сильно недоволен». Jev также можно использовать как модель-судью для проверки работы других агентов.

Jev в собственных тестах TypeSafe до 193 раз быстрее и до 444 раз дешевле языковых моделей.

Но независимый тест показал 0,33 секунды против 1,17 у GPT-5.6 Terra и $0,015 против $0,609 за тысячу решений. При этом на более сложной задаче точность Jev была 78,8% против 84%.

Я тоже провел эксперимент: прогнал сотню писем и попросил определить их срочность, важность и несколько других признаков.

Jev обработал их меньше чем за секунду и $0,01, а GPT-5.6 Luna потребовалось около 30 секунд и $0,07. Это, конечно, не независимый бенчмарк, но хорошо показывает возможную экономию.

Поэтому Jev — это не «GPT, только в сто раз дешевле». Мне кажется, так на подобные модели смотреть неправильно.

Самый интересный сценарий — каскад разных уровней интеллекта:
• Сначала обычный код решает все, что можно определить точно;
• Затем модель решений обрабатывает дешевые смысловые задачи;
• Если она не уверена — подключается небольшая языковая модель;
• Потом более сильная модель рассуждения;
• И только в самых сложных случаях — человек.

Можно собрать сотню примеров с правильными ответами, прогнать их через Jev и большую модель, на отдельной выборке определить порог уверенности и все спорные случаи передавать более сильной модели или человеку.

Конечно, модели решений не заменят LLM.

Структурированный ответ еще не означает правильный ответ. Для стратегии, исследований, программирования и планирования большие модели по-прежнему подходят намного лучше. Но сам ИИ-стек может поменяться.

Причем всего через несколько дней после Jev уже появилась открытая модель Laya с похожим подходом.

Пока рано говорить о новом полноценном рынке. Но, похоже, действительно начинает формироваться отдельная технология — модели решений.

Большая языковая модель может остаться «мозгом» агента, а модели решений заберут его «рефлексы».

👉 Полная статья

#технологии
Датаист / Технологии Jev может изменить архитектуру ИИ-агентов — и вот почему Появился новый класс моделей. Jev от TypeSafe AI не пишет текст, а за доли секунды возвращает готовое решение: выбрать, оценить, дать вероятность. Разбираю, как такой слой снимает с GPT и Claude сотни мелких решений внутри ИИ-агентов, где он уже работает…
  • ❤ 6
  • 👍 6
  • ⚡ 4
  • 🔥 1
  • 🏆 1
More from @andre_dataist
  1. Sep 21, 2026Что изменилось в ИИ для бизнеса за год: технологии уже готовы, а бизнес — еще нет Я изучил…
  2. Sep 17, 202610 млрд ИИ-агентов, одноразовый софт и атаки на ваш счет: каким Gartner видит ближайшее бу…
  3. Sep 11, 2026Расскажу чуть подробнее о платформе, через которую я проводил экзамен по разработке продук…
  4. Sep 11, 2026Как быть зачетным преподом в эпоху ИИ Начался новый учебный год, и я снова в роли препода…
  5. Sep 5, 2026GPT-6 Astra достигла AGI? Разбираемся без хайпа OpenAI представила GPT-6 Astra и заявила о…
  6. Sep 4, 2026Если ИИ делает роботов сильнее, может ли он сделать сильнее человека? Выше отправил новост…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →