📊 Ученые из T-Bank AI Research повысили безопасность и точность ответов ИИ до 15%
Исследователи из T-Bank AI Research представили на топовой конференции по обучению представлениям (ICLR) в Сингапуре новый способ обучения LLM.
🌟 Благодаря улучшенной методике Trust Region, качество ответов ИИ выросло до 15% по пяти показателям: точность, связность, стиль, логика рассуждений и информативность.
➡️ В чем суть?
При долгом обучении ИИ может «потерять себя»: например, стать чрезмерно вежливым, но бесполезным — это называется избыточной оптимизацией. Ученые предложили периодически обновлять «настройки по умолчанию» модели. Предложенный метод позволяет модели отмечать ключевые «ориентиры» на своем пути, что помогает избежать отклонений и быстрее достичь целевой точки.
В тестах на бенчмарке AlpacaEval 2.0 метод дал прирост качества от 2.3 до 15.1 процентных пунктов по сравнению с классическими подходами — модели стали давать полезные и уместные ответы значительно чаще.
➡️ Что это дает?
Разработанный метод может быть применен в любых областях, например, в создании виртуальных ассистентов и чат-ботов в различных сферах: от образования до медицины.
В перспективе метод Trust Region будет играть значимую роль в развитии более эффективных языковых моделей и создании основы для новой парадигмы в развитии ИИ.
💬 Тест Тьюринга. События в сфере ИИ. Подписаться
#новостьдня
Post #1904
574

- ❤ 2
- 👍 1