🤖 AI-Дайджест: 26 августа 2026 🧪
🌶 OpenAI показала первые результаты собственного чипа Jalapeño
На GPT‑OSS 120B, DeepSeek R1 и Kimi K2.5 он дал в 1,5–1,9 раза больше работы на ватт и в 1,7–3,6 раза меньшую сквозную задержку. OpenAI теперь собирает полный стек — от моделей и софта до кремния.
Когда подписки мало, начинаешь оптимизировать электричество. 🧪
ссылка
⚡ NVIDIA запустила Groq 3 LPX в серийное производство
Ускоритель для быстрого инференса вошёл в платформу Vera Rubin; первым облачным клиентом станет Nebius. Это ставка на агентные сценарии, где тысячи последовательных шагов превращают задержку каждого токена в реальную стоимость работы.
Агент всё ещё думает долго, зато теперь очень быстро. 🧪
ссылка
⚖️ Google упаковал Gemini Enterprise специально для юристов
Gemini Enterprise for Legal получил отраслевые навыки, коннекторы к юридическим системам и поддержку сторонних агентов. Продукт стартовал в preview, а следом Google готовит такую же вертикальную сборку для финансов.
Универсальный чат-бот взрослеет и заводит папку «нормативка». 🧪
ссылка
📚 Thomson Reuters выпустила собственную модель Thomson
Компания вложила $40 млн в специализацию открытой базовой модели на юридических, налоговых и новостных данных. Первое применение — анализ до 10 тысяч документов в CoCounsel; маленькую версию обещают открыть для академических исследований.
Оказывается, уникальные данные иногда полезнее ещё одного миллиарда параметров. 🧪
ссылка
🧰 Mastra научила агентов искать инструменты по требованию
ToolSearchProcessor больше не кладёт описание всего набора инструментов в каждый запрос: агент сначала ищет нужное, затем подгружает его и хранит в состоянии потока. Меньше контекста, токенов и ошибочных вызовов — ценой одной дополнительной операции поиска.
Даже агентам пора перестать носить весь гараж в рюкзаке. 🧪
ссылка
Post #101
5