TGViewer
GPU горит GPU горит @gopagorit · 7 subscribers
Post #101 5
🤖 AI-Дайджест: 26 августа 2026 🧪

🌶 OpenAI показала первые результаты собственного чипа Jalapeño
На GPT‑OSS 120B, DeepSeek R1 и Kimi K2.5 он дал в 1,5–1,9 раза больше работы на ватт и в 1,7–3,6 раза меньшую сквозную задержку. OpenAI теперь собирает полный стек — от моделей и софта до кремния.
Когда подписки мало, начинаешь оптимизировать электричество. 🧪
ссылка

NVIDIA запустила Groq 3 LPX в серийное производство
Ускоритель для быстрого инференса вошёл в платформу Vera Rubin; первым облачным клиентом станет Nebius. Это ставка на агентные сценарии, где тысячи последовательных шагов превращают задержку каждого токена в реальную стоимость работы.
Агент всё ещё думает долго, зато теперь очень быстро. 🧪
ссылка

⚖️ Google упаковал Gemini Enterprise специально для юристов
Gemini Enterprise for Legal получил отраслевые навыки, коннекторы к юридическим системам и поддержку сторонних агентов. Продукт стартовал в preview, а следом Google готовит такую же вертикальную сборку для финансов.
Универсальный чат-бот взрослеет и заводит папку «нормативка». 🧪
ссылка

📚 Thomson Reuters выпустила собственную модель Thomson
Компания вложила $40 млн в специализацию открытой базовой модели на юридических, налоговых и новостных данных. Первое применение — анализ до 10 тысяч документов в CoCounsel; маленькую версию обещают открыть для академических исследований.
Оказывается, уникальные данные иногда полезнее ещё одного миллиарда параметров. 🧪
ссылка

🧰 Mastra научила агентов искать инструменты по требованию
ToolSearchProcessor больше не кладёт описание всего набора инструментов в каждый запрос: агент сначала ищет нужное, затем подгружает его и хранит в состоянии потока. Меньше контекста, токенов и ошибочных вызовов — ценой одной дополнительной операции поиска.
Даже агентам пора перестать носить весь гараж в рюкзаке. 🧪
ссылка
OpenAI Jalapeño’s first results show industry-leading speed and efficiency in AI inference Jalapeño is a custom inference chip from OpenAI that delivers faster, more power-efficient AI inference, with higher throughput and lower latency for modern models.
More from @gopagorit
  1. Sep 23, 2026🤖 AI-Дайджест: 23.09.2026 🧪 💸 OpenAI выпустила GPT-6 Sol и Luna Обе reasoning-модели пр…
  2. Sep 21, 2026За сутки после широкого поиска — 3 достойные новости. Это аварийно сокращённый выпуск, а н…
  3. Sep 20, 2026За последние сутки после широкого поиска достойная новость оказалась одна: это аварийно со…
  4. Sep 19, 2026🤖 AI-Дайджест: 19.09.2026 🧪 👁 Qwen3.8-Omni-Flash: мультимодальность для агентов В журна…
  5. Sep 18, 2026🤖 AI-Дайджест: 18.09.2026 🧪 🔓 Plugin4Shell: закреплённая версия плагина не спасла Air S…
  6. Sep 17, 2026🤖 AI-Дайджест: 17.09.2026 🧪 ⚡ За электричество для AI предлагают платить его владельцам…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →