TGViewer
ТЕХНО: Яндекс про технологии ТЕХНО: Яндекс про технологии @techno_yandex · 224K subscribers
Post #3790 25.7K
🤖🧠 Яндекс запустил бета-версию Нейроэксперта — сервиса для работы с пользовательскими данными. В него можно загрузить ссылки из интернета, документы, PDF, аудио- и видеофайлы, а нейросеть создаст из них базу знаний и поможет найти в ней ответ. А ещё Нейроэксперт умеет пересказывать, делать выводы, сравнивать и писать тексты на основе загруженных данных — и всё это благодаря методу RAG. Вот как он работает.

Что такое RAG?

Языковые модели отвечают, исходя из данных, на которых их обучали. Чтобы модель использовала другую информацию, её можно дообучить, но проще использовать RAG (Retrieval Augmented Generation) — генерацию с внешними знаниями. Этот метод позволяет дополнить ответы данными, которые не были заложены при обучении.

Что это за данные?

🔸 Специализированные материалы — документация проекта, база знаний компании, учебные материалы и тому подобное.

🔸 Актуальная информация из интернета. Например, RAG используется в Поиске с Нейро для генерации ответа нейросетью с опорой на источники из интернета.

Как это работает?

Подключённые к RAG-системе данные разбивают на небольшие фрагменты — чанки (англ. chunk — кусок). Каждый чанк превращают в эмбеддинг — векторное представление, сохраняющее смысл данных. Пользовательский запрос тоже превращают в эмбеддинг, и система ищет в базе данных подходящие по смыслу фрагменты. Затем они вместе с запросом подаются в нейросеть, которая генерирует финальный ответ.

Пользовательский запрос → преобразование запроса в вектор → поиск релевантных данных в базе знаний → объединение найденной информации с запросом → генерация итогового ответа языковой моделью.

Что даёт RAG в сравнении с другими методами?

Метод позволяет обновлять знания языковой модели без её дообучения. А ещё RAG снижает вероятность галлюцинаций по сравнению с генерацией «из головы», то есть без доступа к внешним данным.

Ещё один способ снизить частоту галлюцинаций — загрузить в модель все данные вместе с запросом пользователя. Но для этого она должна уметь обрабатывать длинные тексты, а искать нужную информацию в большом объёме данных будет непросто. RAG же даёт модели только релевантные фрагменты, не перегружая её лишней информацией — получается быстрее и дешевле.

Подписывайтесь 👉 @techno_yandex
  • 👍 118
  • 🔥 15
  • ❤ 10
  • 🥱 5
  • 👎 2
  • 😁 2
More from @techno_yandex
  1. Sep 29, 2026🔴 А что, если мечтать — это не наивность, а первый шаг к будущему? Иногда взрослым сложно…
  2. Sep 29, 2026🔍 означает «найти», 💾 — «сохранить», а ✨ всё чаще подразумевает «пусть ИИ сделает за мен…
  3. Sep 28, 2026В Китае мать погибшего геймера через суд получила право на 87 его игровых аккаунтов. В Инд…
  4. Sep 28, 2026🤖 ИИ может начать разгонять сам себя Такой сценарий уже вызывает беспокойство даже у сами…
  5. Sep 28, 2026Технолоджия #14 Разбираемся, зачем Microsoft снова перестраивает Xbox, сможет ли Googleboo…
  6. Sep 27, 2026🤖 Технодайджест недели Google и пять производителей представили первые Googlebook. Это но…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →