Инженеры OpenAI не смогли объяснить 30 тысяч строк кода, сгенерированного нейросетью для их нового чипа 😀
Ситуация вскрылась во время тестирования чипа на бенчмарке InferenceX, когда специалисты изучали файл объёмом около 30 тысяч строк с кодом кернела Multi-head Latent Attention, механизма внимания из модели DeepSeek R1.
Код кернела написан на специализированном языке Gluon для программирования графических процессоров. Топовые специалисты OpenAI честно признались, что прекрасно понимают архитектуру чипа и общие принципы работы, но если спросить их о назначении конкретной строчки в сгенерированном массиве, никто не даст точного ответа. Команда скормила задачу автономным агентам, прогнала готовый результат через бенчмарки и решила не погружаться в детали, раз всё и так прекрасно компилируется и выдаёт отличную производительность 😐
🥸 godnoTECH - Новости IT
Post #12067
974

- 👍 5