Нашел такой интересный проект FutureHouse - AI-агенты для автоматизации исследований в науке. Проект финансирован Эриком Шмидтом, основателем Google.
У них очень понятный птичий набор агентов:
🐦⬛️ Crow - Q&A агент общего вида по научной литературе
🦅 Falcon - ревью-агент для научных статей
🌟 Owl - отвечает только на один вопрос "Кто-то такое уже делал?"
🐤 Phoenix в альфе для химических исследований
Мне нравится что ребята делают задачи с четким скоупом который можно хорошо интегрировать в работу и измерить. Не "агент помогающий в науке", а "сова которая говорит делал ли кто-то или нет". Берите пример.
Ребята сами строят бенчмарки, и потом сами же пытаются их побить. Это вовсе не признак нечестной игры, это стандарт для серьёзных игроков. Построить бенч сейчас чуть ли не важнее самого решения.
Проект нон-профит, но как мы знаем OpenAI тоже как бы нон-профит 😏
https://www.futurehouse.org/research-announcements/launching-futurehouse-platform-ai-agents
Post #232
3.75K