Большие языковые модели — органичная часть нашей жизни, но многие из нас продолжают совершать всё те же ошибки. Одни относятся к ИИ как к «волшебной таблетке» и ждут от него верных ответов на любые вопросы, другие после пары неудачных попыток, например, с кодом, заносят технологию в «сырые» и бесполезные.
А как на самом деле?
И первая, и вторая крайности похожи: они приписывают нейросети свойства, которых у нее нет, отмечает эксперт по разработке программного обеспечения в YADRO Валерия Пузикова. Математика, которой она заинтересовалась еще в детстве, задолго до наступления эпохи ИИ, сегодня помогают ей лучше понимать, как устроена работа нейросетей и как выстраивать с ней «продуктивные отношения» без разочарований.
В чем секрет?
Математик видит в нейросети не «разум», а гигантский аппроксиматор, статистическую модель, обученную, говоря языком профессионалов, минимизировать функцию потерь. Их сильная сторона — поиск закономерностей в данных, но это не то же самое, что инженерное понимание корректности алгоритма или логики программы.
Математик отдает себе отчет, что никакого анализа корректности в инженерном смысле у нейросети нет — есть статистическая интерполяция, то есть способность «достраивать» ответ на основе уже виденных примеров. И чем больше модель «узнала» при обучении и смогла «сохранить в своих весах», тем точнее будет эта интерполяция.
Именно поэтому в сложных, нестандартных или узкоспециализированных ситуациях — например, при анализе плотно оптимизированных участков кода — модель может «галлюцинировать».
Но значит ли это, что инструмент не рабочий? Совсем нет.
В новой статье разбираем, как математическое мышление помогает инженерам не только лучше понимать нейросети, и выбирать эффективные подходы для решения других сложных задач.
Читать статью ➡️
#база_знаний
@ultimate_engineer
