TGViewer
Борис опять Борис опять @boris_again · 17.6K subscribers
Post #4092 5.75K
#дайджест
Дайджест AI/ML за неделю 31 августа – 6 сентября 2026

Anthropic: Claude Fable 5.1 и Mythos 5.1
Ура, у нас новая SOTA! Антропик обновили большие модели. Fable 5.1 получают все, Mythos 5.1 друзья антропик. Позициронируется с упором на науку, особенно биологию. Mythos на Terminal-Bench 4.0 набирает 60.9%, Fable 55.8%, Astra между ними с 57.9%.
Fable 5.1 подросла вдвое на научной версии Terminal-Bench, с 24.7% до 52.6%.
Контекст 1М, выход 128К, $10/$50, кэш $0.25 против $1 у Astra. Требования к безопасности такие же драконовские
Блогпост, Документация

OpenAI: GPT-6 Astra и GPT-6 Pro
Ура, у нас новая SOTA! Компания объявила что это AGI.  Тут сложно сказать, но в среднем посильнее Fable 5.1: Terminal-Bench 4.0 57.9% против 55.8% у Fable 5.1. Хотя например на Humanity's Last Exam наоборот: Fable 65%, Astra 57.2%.
Контекст 1М, выход 128К. Цена $10/$50, кэш $1. При >272К контекста вход дорожает вдвое, выход в полтора раза. А еще теперь каждый tool call идет через отдельную систему мониторинга безопасности. Доступна в PRO подписке.
Блогпост, API , лимиты

Google: Gemini 3.8 Flash
Google видимо выпускает по Flash на каждый свой спринт. Третий за шесть недель. По бенчам немного хуже Opus/Sol при цене в 7 раз ниже, Есть подозрение что только по бенчмаркам.
Контекст 1М, выход 64К, все как обычно очень мультимодально. $0.75/$3.75 до конца года.
Блогпост, Model Card

World Labs: Atlas
Atlas учили сразу на тексте, картинках, видео и 3D, и она может делать из коробки разное: видео с заданной траекторией камеры, реконструкция пространства по одной или сотне фотографий и продолжение сцены во времени.
При реконструкции на выходе облака точек и гауссины, которые дальше правятся в обычном 3D-софте. Ранний доступ по заявке.
Блогпост

Mostik: модели общаются без текста

Стартап с простой идеей - для общения друг с другом модели сейчас передают токены, а могли бы напрямую латентные состояния, не теряя гору информации. Здесь же модели модели сшиваются с помощью отдельно обучаемого Mostikа™ как человеческая многоножка.
В демо GLM-5.2 на 753B отдает латенты в Qwen-3.5 на 4B, и 4B закрывает половину разрыва до большой модели.
В общем, будем умирать от не интерпретируемых моделей еще дешевле и эффективнее.
Mostik , подробности, X

Runway: GWM Worlds 2
Слоп-игровой движок. Модель стримит видео 720p при 24 fps со звуком 48 кГц, а игрок по ходу крутит камеру, переписывает сцену текстом, разговаривает с персонажами и может позвать второго человека в тот же мир. Конечной длины нет: мир продолжается авторегрессией через скользящий KV-кэш. Проблемы расползания мира со временем присутствуют.
Research preview, публичного API нет.
Исследование

Runway: Solaris
Слоп-вэб-интерфейс. Рисует UI покадрово как интерактивное видео в 720p и реагирует на клики, перетаскивания и набор текста. Логику берет на себя LLM, которая решает, что должно произойти, а Solaris только показывает результат.
Мелкий текст, длинные сессии пока не держатся, доступ по заявке.
Блогпост

Alibaba/AMAP: DreamX-Creator
Открытый видеогенератор от подразделения китайских карт AMAP (лол). Из первого кадра и промпта 7B-модель делает пять секунд при 24 fps с аудиодорожкой, а отдельный 5B-рефайнер удваивает разрешение до 2K.
GitHub, Веса, Статья

Менее значительные релизы:

Alibaba: Qwen3.8-Max-0902 - минорное обновление закрытого Qwen3.8-Max. лучше в коде, мультиагентных сценариях и разборе графиков с документами. Модель

inclusionAI: LLaDA-Image - Очередная новая Image модель. 6B, рисует, редактирует, есть референсы и читаемый текст. 50 шагов в базе, 2–4 в Turbo, 53.53 на Qwen-Image-Bench. Обещают скоро выкатить рецепт обучения GitHub, Веса

Viggle: Viggle-Animate - пересадка движения из видео на нового персонажа с одного отредактированного кадра. Внутри файнтюн MiniMax H3 на 33.1B, в 6.1 раза быстрее Wan2.2-Animate-14B. Веса

DeemosTech: Hyper3D WorldGen - из одной картинки собирает сцену, где передний план разложен на отдельные меши, а фон сделан через Gaussian Splatting. Объекты двигаются и заменяются, все экспортируется в Blender. Уже доступно на Hyper3D.
WorldGen, DeemosTech
Anthropic Introducing Claude Fable 5.1 and Claude Mythos 5.1 Our most advanced models for coding and knowledge work. Their research capabilities also offer an early glimpse of how AI models will contribute to scientific progress.
  • 👍 6
  • 🔥 6
  • ❤ 5
More from @boris_again
  1. Sep 21, 2026tl;dr: Research Engineers, Berkeley, $230k-930k/year Какие новости в AI Safety? Например,…
  2. Sep 19, 2026Коллеги, мы сейчас пытаемся заставить ллм продвигать математику. В нашем проекте CayleyPy…
  3. Sep 19, 2026На волне ряда сравнений разных харнессов я пересел на pi. Он отличный, всем рекомендую. Но…
  4. Sep 18, 2026Принёс вам хорошее, чтобы не пришлось открывать твиттер
  5. Sep 15, 2026#дайджест Дайджест AI/ML за неделю 7–13 сентября 2026 OpenAI: уравнения Навье-Стокса Драма…
  6. Sep 14, 2026Вышел подробный туториал по Perseus – фреймворку от команды Т-Технологий для обучения моде…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →