TGViewer
AI Dev Broadcast AI Dev Broadcast @ai_dev_broadcast · 2.39K subscribers
Post #260 1.76K

Forwarded from Кирилл Розов

🧠 Amodei призывает замедлить рост возможностей моделей, пока безопасность не будет иметь аналогичный темп, а сейчас и вовсе догонять

CEO Anthropic сегодня выложил эссе We Must Pace the Frontier. Ключевой тезис — перестать наращивать силу моделей быстрее, чем успевают за контролем поведения моделей и пониманием их внутренностей.

За последние месяцы уже были два опасных звоночка:
1. С лета модели ускорились ещё и тем, что сами помогают собирать следующее поколение.
2. Инцидент OpenAI и Hugging Face: рой агентов сам полез в кибератаки на цели вне задания, жертвовал собой ради группы и пытался взломать систему оценки. Никто не пострадал. Amodei пишет: при той же кривизне целей, но большей силе, через 6–12 месяцев такой рой мог бы удержать сеть ботов на весь интернет.

Практический шаг, который Anthropic делает сам: сторонние аудиторы внутри компании. Команда вроде METR получает почти тот же доступ, что сотрудники Anthropic. Они могут публиковать открыто находки без правки текста Anthropic (за исключением коммерческой тайны и перс данных).

Также эссе описывает, что делать с китайскими компаниями, предлагает варианты использования времени от замедления и другие идеи из его видения.

Идея правильная, но никто не будет останавливать эту гонку, кроме правительства, а там уже на решение влияет политика и нельзя дать Китаю захватить первенство. Не думаю, что кто-то остановится, пока не будет уже поздно, так как в этой гонке все хотят победить, и это уже вопрос контроля будущего и оправдания финансовых и других обязательств, которые взяли на себя лидеры. Чем-то вся эта ситуация напоминает мне ядерное сдерживание, но в AI моделях постоянно надо делать более мощную и эффективную бомбу, параллельно сдерживая конкурентов из других стран.

Вдруг GigaChat рванет, пока никто не верит в Россию в сфере AI? Только время покажет, как будет, но наблюдать точно интересно.

💬 Стоит ли ограничить уровень развития AI и сфокусировать на безопасности, контроле и цене/качество моделей? Делитесь в комментариях

#AI #Anthropic #ClaudeCode
  • 👎 9
More from @ai_dev_broadcast
  1. Sep 23, 2026https://youtu.be/32zpk7tqs0M Запись доклада уже доступна на ютубе! Напомню, что я сравнил…
  2. Sep 23, 2026Post #271
  3. Sep 22, 2026❤️ Яндекс открыл претрейн, который учили с нуля - AliceAI-Foundation-80B-A3B-Base Сразу ст…
  4. Sep 22, 2026⚡️⚡️AI-агент съел токены и потерял контекст. Что делать? Разберемся на Mobius 2026 Autumn.…
  5. Sep 21, 2026🤯 Вышла Grok 4.7 Модель прокачали во всем по сравнению с Grok 4.6 и соперничает с Fable 5…
  6. Sep 18, 2026AGENTS.md теперь поддерживается в Claude Code 🤯 Дарио уже не тот #ClaudeCode
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →