TGViewer
Machinelearning Machinelearning @ai_machinelearning_big_data · 278K subscribers
Post #9998 24.8K
✔️ Anthropic отчиталась о причинах падения качества ответов в Claude Code

Компания опубликовала разбор месячной деградации Claude Code, Agent SDK и Cowork. К падению качества привели 3 независимых изменения, наложившихся друг на друга. На API инциденты не распространялись.

Первое - 4 марта дефолтную глубину ризонинга в Claude Code снизили с high до medium ради скорости отклика. Откатили 7 апреля. Второе - баг в кешировании: вместо разовой очистки старого контекста в долгих сессиях алгоритм затирал историю рассуждений модели при каждом новом запросе. Модель теряла нить, повторялась, путалась в инструментах. Исправили 10 апреля. Третье - правка системного промпта с жёстким лимитом на длину ответа ударила по генерации кода. Откатили 20 апреля.

Все фиксы вошли в свежий релиз v2.1.116. Лимиты использования для всех подписчиков обнулили. Anthropic пообещала ужесточить тестирование системных промптов и перевести сотрудников на публичные сборки вместо внутренних.
anthropic.com

✔️ Сингапур превратился в тихую гавань для ИИ

ИИ-компании переносят в Сингапур бизнес и интеллектуальную собственность, чтобы не зависеть от геополитического давления США и Китая. В стране уже работают OpenAI, к запуску готовится офис Anthropic.

Для китайских стартапов переезд - способ вывести технологии из-под юрисдикции Пекина и обойти экспортные ограничения. Американским компаниям Сингапур решает кадровую задачу: США тормозят найм иностранцев через H-1B, тогда как сингапурские власти выдают рабочие визы IT-специалистам за несколько дней.

Нейтральный статус начинает размываться. США и Китай перекрывают обходные маршруты для технологий через такие юрисдикции. Пекин уже ограничивает выезд фаундерам проектов, переехавших в Сингапур.
reuters.com

✔️ OpenAI выложила в открытый доступ тесты для мониторинга CoT

OpenAI опубликовала набор тестов, которые измеряют, насколько хорошо одна модель может отследить проблемное поведение другой по её цепочке рассуждений до финального ответа.

В наборе 13 проверок: реакция на подмену вводных, попытки взлома наград, обход правил безопасности на этапе рассуждения и другие сценарии.

Эти тесты OpenAI применяла при оценке GPT-5.4 Thinking. На сценариях скрытого недоброжелательного поведения ИИ-агента монитор детектирует почти 100% случаев.
OpenAI на Github

✔️ Xiaomi запустила бесплатное бета-API для TTS-моделей MiMo 2.5

Вслед за недавним релизом языковой модели, Xiaomi открыла доступ к семейству синтеза речи MiMo 2.5. Заявлены английский и китайский языки плюс несколько региональных диалектов. Эмоциональным окрасом речи управляют промпты на естественном языке . Для пауз, вздохов и смеха предусмотрены отдельные звуковые теги.

В серии три модели. Базовая MiMo-V2.5-TTS - генерация голоса с режимом пения. VoiceDesign создаёт голос по текстовому описанию — пол, возраст, акцент, характер диктора, без аудиореференса. VoiceClone делает клонирование по короткому образцу: копирует тембр, интонации, ритм и характерные паттерны дыхания спикера.

На время публичной беты доступ к API бесплатный. Попробовать можно в MiMO Studio.
xiaomi.com

✔️ Канадская Cohere поглощает немецкий стартап Aleph Alpha

Aleph Alpha - стартап, который называли главным европейским конкурентом OpenAI. Объединённая компания с двумя штаб-квартирами займётся суверенным ИИ для госсектора, финансов и медицины. Хостинг и вычислительные мощности для моделей Cohere предоставит немецкий облачный провайдер STACKIT.

Сделка ставит точку в попытках Aleph Alpha создать независимую европейскую LLM. Не выдержав гонки бюджетов с американскими гигантами, прошлой осенью стартап свернул обучение базовых моделей.

Компания пыталась сменить бизнес-модель, но после волны сокращений и недавнего ухода из стартапа его основателя, продажа активов канадским конкурентам стала единственным выходом для бывшей главной ИИ-надежды Германии.
ft.com

@ai_machinelearning_big_data

#news #ai #ml
  • 🤔 66
  • ❤ 41
  • 👍 32
  • 💯 11
  • 👏 5
  • 🔥 2
  • 😁 2
More from @ai_machinelearning_big_data
  1. Oct 8, 2026✔️ Организатора схемы накрутки ИИ-музыки приговорили к 18 месяцам тюрьмы Федеральный суд С…
  2. Oct 8, 2026📌Baseten выпустила бесплатный учебник по инженерии инференса Платформа, которая хостит мо…
  3. Oct 8, 2026✔️ Anthropic даёт стартапам год Claude Team и 1000 долларов на API Программу Claude for St…
  4. Oct 7, 2026⚡ Anthropic представила Claude Haiku 5.5 Claude Haiku 5.5 - самая быстрая и доступная моде…
  5. Oct 7, 2026🌟 MIT CSAIL опубликовала модель разметки анатомии на рентгеновских снимках MIT вместе с к…
  6. Oct 7, 2026GPU, токены и деньги: как балансировать на ИИ-арене? 15 октября на ежегодной конференции O…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →