В 2016 году с 9 по 15 марта в Сеуле проходил матч по Go между системой DeepMind AlphaGo и Ли Седолем – на тот момент 18-кратным чемпионом мира. Он закончился со счетом 4:1 в пользу искусственного интеллекта.
Особенно всем тогда запомнилась вторая партия, которая проходила 10 марта: в ходе нее AlphaGo, играя белыми, на 37-м ходу сделала крайне нестандартный ход, который эксперты сначала даже сочли ошибкой. Но в итоге он перевернул ход партии, и Седоль сдался на 211 шаге.
Этот легендарный "37 ход" вошел в историю как символ ИИ-креативности и победы стратегического "мышления" машины над человеком.
По случаю 10-летия DeepMind и Демис Хассабис даже выпустили рестроспективную статью. Пишут, что именно AlphaGo и 37 ход показали потенциал подобных моделей и вдохновили ученых дальше развивать линейку, в которую вошли AlphaZero/AlphaFold/AlphaProof и тд. Ведь если ИИ смог разбираться в чудовищном пространстве состояний в Go, его можно пустить и на реальные научные задачи со сходной комбинаторной сложностью.
В итоге, спустя 10 лет:
– Прямой наследник архитектуры AlphaGo – AlphaProof – в связке с AlphaGeometry 2 выходят на уровень серебра на Международной математической олимпиаде.
– За AlphaFold 2 дают нобелевку, и модель предсказывают структуры всех ~200 млн известных белков.
– Gemini Deep Think (тоже вдохновленный структурой поиска из архитектуры AlphaGo) берет золото на IMO 2025 и решает открытые математические задачи Эрдеша.
Сегодня прорыв 37 хода продолжает определять нашу работу по созданию AGI. Мы верим, что AGI станет самой значимой технологией, когда-либо изобретенной, и, возможно, высшим инструментом для ускорения прогресса в науке, медицине и производстве.
Кстати, про AlphaGo есть документалка. Самое время ее посмотреть: https://youtu.be/WXuK6gekU1Y
