AlphaEvolve
идея как и у всех Alpha* статей deepmind - давайте возьмем проблему которую достаточно легко и быстро можно проверять автоматически, а затем напишем некоторый бейзлайн код решения этой проблемы. Далее даем код агенту, вливаем 1e6 попыток решения и получаем небольшое улучшение которое мало что меняет, но позволяет показывать SOTA(какой сота в математике гспди)
Из отличий от прошлых частей: теперь Gemeni в качестве LM + агентность тк кодовая база разрослась, так же используют эволюционное обновление мета промптов(читать тут )
white paper
интересно что будет если ценник токенов на компьют+людей вбухать в одно небизвестное математическое пту на арбате
Post #9314
9.81K

- 😁 56
- 👍 7
- 🥴 5
- ❤🔥 2
- 💩 2
- 🔥 1