TGViewer
AI for Devs AI for Devs @ai_for_devs · 17.3K subscribers
Post #380 11.1K
Исследователи оценили размер закрытых LLM через вопросы с фактическими ответами разной редкости: от общеизвестных фактов до совсем нишевых.

Чем больше модель, тем больше редких фактов она знает: зависимость оказалась лог-линейной.

Оценки получились такие:
* GPT 5.5 — около 10T параметров
* Claude Opus 4.x — 4–5T
* Grok 4 — 3T
* Gemini 3.1 Pro использовали как якорную точку калибровки, прямой оценки для него нет, но судя по всему — больше 10T


При этом самые редкие факты не знает ни одна модель. Это значит, что все они могли бы стать лучше просто за счёт большего объёма обучающих данных без изменения архитектуры.

Для сравнения: Kimi K2.6 имеет около 1T параметров суммарно, а DeepSeek-V4 1.6Т.

@ai_for_devs​​​​​​​​​​​​​​​​
  • 🔥 40
  • 👍 16
  • ❤ 15
  • ⚡ 5
More from @ai_for_devs
  1. Sep 28, 2026⚡️ OpenClaw удалили 400 тысяч строк тестов, которые ничего не проверяли Мы уже разбирали C…
  2. Sep 26, 2026⚡️ Low, medium, high или max: выбираем effort для модели Инженер Anthropic разобрал на при…
  3. Sep 25, 2026⚡️ OpenAI готовят ChatGPT Pro Max за $500 в месяц По утечке, упоминания тарифа нашли в код…
  4. Sep 24, 2026⚡️ Облачные сессии Claude Code стали доступны всем Anthropic вывели облачные сессии из пре…
  5. Sep 22, 2026⚡️ OpenAI выпустили GPT-6 Sol и Luna — более быстрые и дешёвые версии Astra Обе модели сто…
  6. Sep 22, 2026⚡️ Anthropic выпустили Claude Opus 5.5 По бенчмаркам новинка обошла всех основных конкурен…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →