TGViewer
Владилен: IT в эпоху AI Владилен: IT в эпоху AI @vladm · 39.3K subscribers
Post #1620 5.89K
Самая мощная модель нужна далеко не каждому запросу

Недавно писал про OpenClaw и то, сколько всего сейчас происходит не столько с самими моделями, сколько вокруг них: память, инструменты, браузер, работа с контекстом. Так вот, вышла новость о том, что похожую архитектурную логику теперь можно увидеть и в Alice AI, которая теперь сама выбирает модель под запрос.

Простому вопросу — быстрый ответ. Если же нужно сопоставить несколько документов, что-то посчитать и учесть кучу условий, система может подключить режим «Эксперт».

Логика понятна. Гонять каждый запрос через самую тяжёлую модель — дорого и долго, а будет ли ответ от этого лучше, ещё вопрос.

Под капотом тут две отдельные задачи. Роутер решает, какой модели отдать запрос. Харнесс уже организует саму работу: передаёт контекст, даёт доступ к поиску и файлам, позволяет вызывать инструменты и использовать результаты этих вызовов на следующих шагах.

Например, если надо сравнить несколько документов, недостаточно просто скормить модели один промпт. Нужно разобрать файлы, найти нужные куски, при необходимости что-то посчитать, а потом собрать всё это обратно в один ответ. И вот эта часть вокруг модели сама по себе довольно большая инженерная задача.

Для пользователя это выглядит так: загружаешь файлы и описываешь, что нужно сделать. «Эксперт» может включиться автоматически, но его можно выбрать и вручную. По ходу видно, какие шаги выполняет Алиса и к какой информации обращается.

В интервью Forbes Валерий Стромов объяснил экономику этой схемы: значимая часть запросов просто не требует самого дорогого и мощного интеллекта. Поэтому роутер должен сам понимать, какая модель справится с задачей за минимальную стоимость.

До «Эксперта» на своих реальных рабочих задачах я пока не добрался, поэтому про качество судить не буду. Но подумал вот о чём: если собираешь свой AI-продукт и что-то работает не очень, я бы теперь не первым делом бежал менять модель на более дорогую. Сначала стоит посмотреть, что именно она видит, какие инструменты ей дали и не теряется ли по дороге нужный контекст.

Вполне возможно, что чинить надо вообще не модель.
  • ❤ 17
  • 😁 14
  • 💔 3
More from @vladm
  1. Sep 28, 2026Посмотрел доклад с deep tech night от Ивана Сапожкова, руководителя группы базовой ML-инфр…
  2. Sep 27, 2026Математик МГУ: «Нейросети уже умнее меня» Полтора года назад Саша Вотяков скинул мне докла…
  3. Sep 26, 2026Подкаст уже на финальном рендере Один из любимейших и полезных разговоров за все время вед…
  4. Sep 25, 2026Кто контролирует работу AI-агента? Вчера вечером еду на дачу и за рулем, с телефона решил…
  5. Sep 24, 2026У бизнеса появился ещё один канал, в котором важно быть заметным — ответы нейросетей. Поль…
  6. Sep 23, 2026Дамы и господа, приглашаю на МИТАП В Москве 27 сентября в 13:00 у нас пройдет живой митап…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →