TGViewer
контекст rot контекст rot @contextrot · 290 subscribers
Post #840 370
Друзья, у меня вот был собственный бенчмарк. Мой близкий кореш в аспирантуре по направлению адовой математики занимается неведомыми мне вещами.

Я форвардил от него задачки или комментарии к ллмкам с ~прошлого года. Опус 4.5 совершенно ничего полезного выдать не мог. Дальше становилось лучше, ллмки хотя бы понимали доменную область но пользы рисерчу дать не могли.

Астра - первая модель которая принесла ЗАМЕТНОГО ИМПАКТА в этой сложной задачке.

Мне теперь непонятно как сравнивать интеллект моделек, у меня бенчмарк переполнился можно сказать💀
  • 👀 6
More from @contextrot
  1. Oct 8, 2026photo post
  2. Oct 8, 2026photo post
  3. Oct 8, 2026Счас многие слышат, как ЛЛМ решают сложнейшие задачи, дают им что-то свое и удивляются: мо…
  4. Oct 8, 2026photo post
  5. Oct 7, 2026photo post
  6. Oct 7, 2026Я думаю, что математики наиболее глубоко чувствуют и осознают, насколько ИИ революционная…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →