#дайджест
Дайджест AI/ML за неделю 31 августа – 6 сентября 2026
Anthropic: Claude Fable 5.1 и Mythos 5.1Ура, у нас новая SOTA! Антропик обновили большие модели. Fable 5.1 получают все, Mythos 5.1 друзья антропик. Позициронируется с упором на науку, особенно биологию. Mythos на Terminal-Bench 4.0 набирает 60.9%, Fable 55.8%, Astra между ними с 57.9%.
Fable 5.1 подросла вдвое на научной версии Terminal-Bench, с 24.7% до 52.6%.
Контекст 1М, выход 128К, $10/$50, кэш $0.25 против $1 у Astra. Требования к безопасности такие же драконовские
Блогпост,
ДокументацияOpenAI: GPT-6 Astra и GPT-6 ProУра, у нас новая SOTA! Компания объявила что это AGI. Тут сложно сказать, но в среднем посильнее Fable 5.1: Terminal-Bench 4.0 57.9% против 55.8% у Fable 5.1. Хотя например на Humanity's Last Exam наоборот: Fable 65%, Astra 57.2%.
Контекст 1М, выход 128К. Цена $10/$50, кэш $1. При >272К контекста вход дорожает вдвое, выход в полтора раза. А еще теперь каждый tool call идет через отдельную систему мониторинга безопасности. Доступна в PRO подписке.
Блогпост,
API ,
лимитыGoogle: Gemini 3.8 FlashGoogle видимо выпускает по Flash на каждый свой спринт. Третий за шесть недель. По бенчам немного хуже Opus/Sol при цене в 7 раз ниже, Есть подозрение что только по бенчмаркам.
Контекст 1М, выход 64К, все как обычно очень мультимодально. $0.75/$3.75 до конца года.
Блогпост,
Model CardWorld Labs: AtlasAtlas учили сразу на тексте, картинках, видео и 3D, и она может делать из коробки разное: видео с заданной траекторией камеры, реконструкция пространства по одной или сотне фотографий и продолжение сцены во времени.
При реконструкции на выходе облака точек и гауссины, которые дальше правятся в обычном 3D-софте. Ранний доступ по заявке.
Блогпост
Mostik: модели общаются без текстаСтартап с простой идеей - для общения друг с другом модели сейчас передают токены, а могли бы напрямую латентные состояния, не теряя гору информации. Здесь же модели модели сшиваются с помощью отдельно обучаемого Mostikа™ как человеческая многоножка.
В демо GLM-5.2 на 753B отдает латенты в Qwen-3.5 на 4B, и 4B закрывает половину разрыва до большой модели.
В общем, будем умирать от не интерпретируемых моделей еще дешевле и эффективнее.
Mostik ,
подробности,
XRunway: GWM Worlds 2Слоп-игровой движок. Модель стримит видео 720p при 24 fps со звуком 48 кГц, а игрок по ходу крутит камеру, переписывает сцену текстом, разговаривает с персонажами и может позвать второго человека в тот же мир. Конечной длины нет: мир продолжается авторегрессией через скользящий KV-кэш. Проблемы расползания мира со временем присутствуют.
Research preview, публичного API нет.
ИсследованиеRunway: SolarisСлоп-вэб-интерфейс. Рисует UI покадрово как интерактивное видео в 720p и реагирует на клики, перетаскивания и набор текста. Логику берет на себя LLM, которая решает, что должно произойти, а Solaris только показывает результат.
Мелкий текст, длинные сессии пока не держатся, доступ по заявке.
БлогпостAlibaba/AMAP: DreamX-CreatorОткрытый видеогенератор от подразделения китайских карт AMAP (лол). Из первого кадра и промпта 7B-модель делает пять секунд при 24 fps с аудиодорожкой, а отдельный 5B-рефайнер удваивает разрешение до 2K.
GitHub,
Веса,
Статья
Менее значительные релизы:Alibaba: Qwen3.8-Max-0902 - минорное обновление закрытого Qwen3.8-Max. лучше в коде, мультиагентных сценариях и разборе графиков с документами.
МодельinclusionAI: LLaDA-Image - Очередная новая Image модель. 6B, рисует, редактирует, есть референсы и читаемый текст. 50 шагов в базе, 2–4 в Turbo, 53.53 на Qwen-Image-Bench. Обещают скоро выкатить рецепт обучения
GitHub,
ВесаViggle: Viggle-Animate - пересадка движения из видео на нового персонажа с одного отредактированного кадра. Внутри файнтюн MiniMax H3 на 33.1B, в 6.1 раза быстрее Wan2.2-Animate-14B.
ВесаDeemosTech: Hyper3D WorldGen - из одной картинки собирает сцену, где передний план разложен на отдельные меши, а фон сделан через Gaussian Splatting. Объекты двигаются и заменяются, все экспортируется в Blender. Уже доступно на Hyper3D.
WorldGen,
DeemosTech