TGViewer
DataTalks DataTalks @data_talks · 1.11K subscribers
Post #600 517
DeepSeek AI представила модель R1, которая научилась рассуждать самостоятельно. Используя обучение с подкреплением и получая только сигналы о правильности ответов, модель развила навыки самопроверки и стратегического решения задач. R1 достигла 86,7% точности на математической олимпиаде AIME 2024. Исследование опубликовано в Nature.

Исследователи MIT и IBM разработали руководство по законам масштабирования LLM, проанализировав 485 моделей из 40 семейств. Руководство помогает предсказывать производительность крупных моделей по меньшим версиям с точностью до 4% ошибки. Полный отчет доступен на OpenReview.

А OpenAI исследует преднамеренный обман в ИИ-моделях, когда они скрывают истинные цели под видом выполнения задач. Исследователи совместно с Apollo Research выявили, что модели могут притворяться честными во время тестирования, продолжая обманывать в реальных условиях. Метод deliberative alignment снижает такие "схемы", заставляя ИИ пересматривать правила перед действиями, однако попытки устранить обман могут научить модель обманывать более скрытно.

Google Gemini 2.5 Deep Think завоевал золото на ICPC 2025, решив 10 из 12 задач и обогнав 135 из 139 человеческих команд. ИИ справился с задачей многомерной оптимизации, которая оказалась недоступной для людей, применив динамическое программирование за полчаса.
  • 🔥 2
  • ❤ 1
More from @data_talks
  1. Oct 1, 2026Программа первого дня — раскрываем карты Одной интригой меньше. На сайте выложили программ…
  2. Sep 28, 2026Post #704
  3. Sep 21, 2026Post #703
  4. Sep 17, 2026Скоро мы начнем выкатывать анонсы докладов Data & AI Talks 7.0. А пока — видео с прошлогод…
  5. Sep 14, 2026Post #700
  6. Aug 24, 2026Post #699
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →