TGViewer
Всеволод Викулин Всеволод Викулин @vikulin_ai · 5.28K subscribers
Post #24 1.39K
В ИИ сменилась парадигма. Она с нами навсегда.

В сентябре OpenAI прервал нейминг GPT - вышла модель o1. Не GPT-4.5, не GPT-5.
Назвали так не случайно. C выходом o1 сменилась парадигма - мы теперь не только растим обучение модели, мы растим ее предсказание. Это будет мощнейший тренд на 2025.

Почему это важно?
В прошлых постах я рассказывал, что масштабирование обучения переживает не лучшие времена. Во-первых, кончаются данные для обучения. Во-вторых, кончается терпение инвесторов: год-два требуется, чтобы построить кластер, много месяцев на тренировку моделей. Но стартапам нужно скорее показывать прирост в качестве, чтобы тебя не назвали жалким пузырем и не выкинули с техно небосклона. Решение есть!

Test-time compute. Оно же масштабирование предсказаний, оно же "давайте заставим модель подумать". Не торопите модель, дайте ей время и вычисления, чтобы она порассуждала и вывела правильный ответ. Почему это круто:

1) Для этого не нужны огромные кластера. Просто запрос в модель будет сильно дольше обрабатываться. Расходы переведем на пользователя ^^

2) У этого есть эффект низкой базы: мы совсем не исследовали эту область, каждое улучшение дает огромный вклад в качество модели.

3) У этого такие же приятные законы, как и для масштабирования обучения. Это видно на картинке, где показаны графики с масштабированием обучения и предсказания для o1. Ты можешь заранее прикинуть, какое у тебя будет качество, приложив логарифмическую линейку (ке-ке-ке)

Следствие этих 3 причин - выходит модель o1, она унижает по метрикам GPT-4. Спустя 3 месяца после o1 выходит o3 и теперь унижают уже o1. Масштабирование обучения отстает: GPT-5 мы 2 года ждем и инвесторы уже беспокоятся...

Почему вы этого не заметили?
Все это унижение происходит только в сложных технических задачах - математике, программировании и тд. Почему? Потому что там проще всего построить систему оценки - какое рассуждение правильное, а какое нет. Когда понятно, какое правильно - дальше уже можно научить модельку правильное генерировать (так кстати весь ИИ работает, если вы не знали, да). Для более общих дисциплин улучшения скорее нет. Пойди пойми как правильно писать "сочинение как я провел лето". Думаю, что OpenAI над этим уже работают и вскоре это поменяется. Школьники ждут.

Вместо вывода
Noam Brown, один из авторов o1, в интервью рассказал, что он и Суцкевер не верили в AGI ближайшее время, потому что у нас нет алгоритмов масштабирования предсказания. Что ж, теперь они есть. И с ними нас ждет очень интересный 2025.

Если хотите, чтобы я подробнее разобрал как обучать такие модельки, ставьте реакции, пишите комменты ^^
И шарьте пост своим ИИ-друзьям)
  • 👍 29
  • ❤ 10
  • 🔥 8
  • 🐳 2
  • 😱 1
More from @vikulin_ai
  1. Sep 21, 2026Кому можно вайбкодить и как это делать Управление AI-агентами очень похоже на управление л…
  2. Sep 16, 2026Кто управляет разработкой AI-проекта Несколько лет назад во время очередного релиза я поня…
  3. Sep 8, 2026Всеобъемлющая статья про инференс LLM Многие у меня спрашивают, как посчитать GPU и как по…
  4. Aug 30, 2026Как стать AI-native компанией AI всегда был гонкой инфраструктуры. Если вы хотите крутые A…
  5. Aug 25, 2026Первый обзор научной статьи в этом канале Я не фанат читать свежие статьи. Сам когда-то за…
  6. Aug 18, 2026Вам LLM побыстрее или подешевле? Выберите только одно Почему-то во всех командах, где я ра…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →