✔️ Google анонсировала 8-е поколение TPU
Google и DeepMind разделили новую линейку тензорных процессоров на 2 чипа: TPU 8t для обучения и TPU 8i для инференса. Оба работают в связке с Arm-процессорами Google Axion. Причина разделения - рост агентных нагрузок, при которых универсальная архитектура проигрывает специализированной.
Суперпод TPU 8t содержит 9600 чипов, 2 ПБ HBM и выдаёт 121 экзафлопс пиковой производительности. Оптическая коммутация изолирует сбойные узлы без остановки кластера и держит goodput выше 97%.
TPU 8i заточен под инференс MoE-моделей с низкой задержкой. На борту 288 ГБ HBM и утроенный объём накристальной SRAM (384 МБ). Этого хватает, чтобы активный контекст модели лежал прямо на чипе, без обращений к внешней памяти. Новая топология межсоединений и жидкостное охлаждение дают 2х прирост энергоэффективности к прошлому поколению.
blog.google
✔️ Anthropic расследует утечку доступа к Mythos
Anthropic проверяет сообщение о несанкционированном доступе к Mythos через стороннего подрядчика. Доказательств того, что доступ распространился за пределы вендора, у компании пока нет. Триггером расследования стала публикация Bloomberg о том, что несколько человек делились доступом к модели.
Сообщество кибербезопасности оценивает Mythos двойственно: одни опасаются, что неконтролируемое распространение модели запустит волну атак, другие рассчитывают, что ограниченные релизы как раз дадут фору защитникам.
Это второй инцидент с утечкой у Anthropic за месяц - ранее в сеть утекли исходники Claude Code.
wsj.com
✔️ OpenAI создает компанию-интегратора DeployCo
Компания создаёт совместное предприятие с частными инвестфондами и вложит в него до $1.5 млрд, первый транш - $500 млн. Структура под рабочим названием DeployCo будет внедрять ИИ в портфельные компании фондов-партнёров. Контрольный пакет будет у OpenAI, руководить структурой будет бывший COO компании Брэд Лайткэп.
Цель DeployCo - сократить разрыв между тем, что умеют современные модели, и тем, что бизнес у себя внедрил. Сейчас узкое место в энтерпрайзе - не возможности моделей, а сложность их развёртывания на стороне заказчика. Собственный интегратор должен снять этот барьер и помочь OpenAI удерживать долю корпоративного рынка в конкуренции с Anthropic и другими игроками.
ft.com
✔️ Xiaomi открыла бету модели MiMo-V2.5-Pro
Новый флагман обучили под долгие агентные сценарии с множеством вызовов внешних инструментов без потери контекста. На демо модель написала компилятор на Rust за 4.3 часа и собрала десктопный видеоредактор на 8000 строк за 11.5 часов.
Отдельно Xiaomi выделяет автоматизацию проектирования аналоговых микросхем: задачи, на которые у инженеров уходят дни, модель закрывает за час. По бенчмаркам самой Xiaomi, MiMo-V2.5-Pro расходует на 40–60% меньше токенов, чем Opus 4.6, Gemini 3.1 Pro и GPT-5.4 на сопоставимых задачах.
На период тестирования доступ открыт по API. Исходники всей серии MiMo-V2.5 обещают открыть в ближайшее время. Попробовать модель можно в веб-студии.
mimo.xiaomi.com
✔️ Odyssey представил модель мира Odyssey-2 Max
Стартап, основанный выходцами из индустрии беспилотных автомобилей, выпустил вторую версию своей модели мира. Odyssey-2 Max построена на авторегрессионном DiT, который предсказывает кадр за кадром и реагирует на пользовательский ввод в реальном времени.
По параметрам модель в 3 раза больше предыдущей версии, по объёму обучающих данных - в 10 раз. На VBench 2 новинка обошла NVIDIA Cosmos-Predict2.5-14B по точности физических симуляций.
Доступ - в закрытой бете для партнёров из робототехники, геймдева, оборонки и интерактивных систем.
odyssey.ml
@ai_machinelearning_big_data
#news #ai #ml
Post #9966
19.7K