TGViewer
Valuable AI / Валентин Малых Valuable AI / Валентин Малых @valuableai · 2.36K subscribers
Post #692 3.51K
что коллеги из OpenAI всегда умели делать хорошо - это хайповать; группа математиков основала инициативу First Proof для проверки способности современных ИИ-систем решать математические задачи; для этого они выпустили 5 февраля статью, где собрали 10 уже решенных задач из своей работы, но результаты еще не были опубликованы

14 февраля (в день ENIAC) OpenAI выступили c заявлением, что решили 6 из 10 задач (на картинке), и выложили сами решения

последовала жаркая дискуссия в твиттере (резюме - тут), в ходе которой выяснилось, что две из заявленных задач решены неправильно; 2 должны были быть решены; пятая вроде как решена с ошибкой, а вот шестая - решена правильно, но без ссылок на источники, которые были опубликованы 15 лет назад; но самое важное, они нарушили заявленное правило - отсутствие человеческого контроля

по итогам можно сказать, что работа математика - тоже в чем-то рутинная, часть ее уже можно переложить на ИИ

P.S. аналогично обсуждали в воскресенье на Мостике про физиков

@valuableai
  • ❤ 10
  • 🔥 2
More from @valuableai
  1. Sep 21, 2026На выходных (почему новости от Anthropic всегда приходят по выходным?) пришла новость, что…
  2. Sep 20, 2026всем привет, я таки смог победить отельный интернет и залить свежий выпуск, ведем как всег…
  3. Sep 19, 2026в свете последних новостей не мог не запостить для тех, кто пропустил, этот мозг встроили…
  4. Sep 18, 2026с утра говорили про философию, а тут коллеги организуют конференцию, на ней будет дискусси…
  5. Sep 18, 2026наши творцы и американские проявляют завидное единодушие в следовании тому, что ИИ не заме…
  6. Sep 17, 2026Привет! Рады сообщить, что 🦜 ODS совместно с Международным университетом информационных т…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →