Сегодня побывал на Сберовской конференции AI R&D Day для исследовательских команд и создателей AI-систем. Делюсь тем, что запомнилось.
Понравился доклад про компактные языковые модели. Большие LLM-ки умеют воспроизводить значительные фрагменты книг про Гарри Поттера, что, конечно, впечатляет. Но для многих прикладных задач такая эрудиция избыточна. Гораздо полезнее точно отвечать по предоставленному контексту и замечать, когда данных для ответа не хватает.
Команда AIRI показала Optimal Cognitive Core – семейство небольших моделей, которые развивают именно в этом направлении. По их тестам OCC-RAG с 1.7 млрд параметров в ряде задач на рассуждение по контексту и соответствие ответа источникам обходит существенно более крупные модели. Отмечу, что я пользовался подобными small language models от Microsoft на моем скромном MacBook Air M1, и результат меня приятно удивил.
К конференции приурочили открытие доступа к GigaCode Universal Agent. Его интерфейс командной строки очень напоминает Claude Code. Уже поставил, пока разбираюсь.
Заодно удалось пообщаться с руководителем разработки про безопасность агентов. Спросил, какой путь выбирает Сбер: bundled, когда защиту обеспечивает сам поставщик агентной платформы, или unbundled, когда ее подключают отдельно, от других разработчиков. Мой собеседник описал их выбор иначе: между полной защитой и полным отсутствием защиты есть шкала, и команда выбрала на ней определенную точку. В самом GigaCode защиту строят в несколько слоев: инструкции для модели, ограничения в харнессе и проверка действий отдельной моделью-судьей. В принципе, здравый подход.
Также на конференции не раз возвращались к недавно выпущенной GigaChat 3.5 Reasoning. Сбер заявляет ее как первую российскую модель с полноценным режимом рассуждений и открытыми весами. А вот мне как раз не хватило возможностей предыдущих моделей Сбера для своего исследования, поэтому жду, когда получится попробовать новую. Пока через API Сбера она недоступна, но 21 сентября доступ к ней обещал Cloud.ru.
В целом впечатление от конференции осталось позитивное. А вводный доклад про тренды в AI прям понравился - когда появится запись, рекомендую посмотреть.
Post #41
107