TGViewer
sh | ИИ sh | ИИ @shneural · 3.37K subscribers
Post #1185 1.42K
Модели тупеют?

В LLM-сообществе постоянно всплывает тема деградации моделей после релиза. Якобы GPT-5.5, Gemini 3.1 Pro и Claude Opus 4.8 на релизе были умные, а потом их по-тихому занерфили, и сейчас это уже не те модели. Причём говорят так почти про каждый крупный релиз уже на протяжении нескольких лет. Реальных пруфов у этого нет.

Если бы компании реально тихо ухудшали свои модельки, конкуренты и независимые бенчмаркеры моментально выпустили бы кучу материалов с наглядными тестами и пруфами на эту тему. Такого нет. Единственный случай, когда за такими жалобами что-то стояло — история с Opus 4.6, это было в апреле. Сеньор-директор из AI-отдела AMD тогда выкатила гитхаб-ишшуе с разбором нескольких тысяч своих сессий, где видно, как просел ризонинг. Anthropic всё признали в официальном разборе и откатили. Но сама модель не менялась — это была единичная проблема Claude Code

А всякие «GPT-5.5 отупела!!!» обычно появляются когда модель не справилась с новой задачей. Хотя на релизе она не справилась бы с ней точно так же. Плюс требования у юзера со временем растут, он кидает модели всё более сложные задачи, и ошибок естественно становится больше. Ну и банально рандом, ИИ может решать одну и ту же задачу каждый раз по-разному.
  • 👍 18
  • ❤ 7
  • 🤬 5
  • 😁 4
  • 🍌 1
More from @shneural
  1. Oct 6, 2026Post #1413
  2. Oct 6, 2026День второй релизного месяца OpenAI. Обещали каждый день либо заметные улучшения в Codex/W…
  3. Oct 6, 2026В итоге сегодня вышла Banana 2.1. Неплохая модель для генерации картинок, со своим характе…
  4. Oct 6, 2026Google сегодня что-то выпустит? Вчера в их сервисе Flow появилась Nano Banana 2.1, она уже…
  5. Oct 6, 2026Этот пост чисто новостной и почти полностью написан Claude (извините! не было сил писать с…
  6. Oct 5, 2026SemiAnalysis опубликовали большой разбор лимитов ИИ-подписок. Они отправляли через каждую…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →