TGViewer
BOGDANISSSIMO BOGDANISSSIMO @bogdanisssimo · 6.96K subscribers
Post #195 6.32K
RAG: Retrieval Augmented Generation

Значит, дошли у Богдана руки наконец сделать один проектик с чат-ботом поверх базы знаний. Кто уже работал с knowledge-augmented chatbots – приглашаю в комментарии похвастаться, какой самый крутой конструктор лего собирали. Кто не работал – рассказываю как это заводить.

Проблема следующая: у ChatGPT, как и у других больших языковых моделей, контекст ограничен. Например, у GPT-3.5 он 4K токенов, у GPT-4 он 8К токенов (кто не знает, токен – это символ, слово или часть слова; например, посмотреть, на какие запчасти ChatGPT разбирает ваш промпт перед ответом, можно здесь; в английском 1000 токенов ≈ 750 слов). Размер контекста – это сколько текста может переварить модель перед ответом. Ясно, что в такое малое число токенов не запихать какую-то большую, длинную и специализированную базу знаний, с оглядкой на которую мы хотим чтобы модель отвечала.

Какие варианты решения проблемы?

Вариант №1 (долго-дорого-сложно): дообучить модель на свои данные

Вариант №2 (быстро-дёшево-легко): подтягивать релевантные контексты по запросу

Естественно, нас интересует второй вариант. Как он работает?

#LLMOps
  • 🔥 24
More from @bogdanisssimo
  1. Sep 22, 2026Для Speaking пользовался Fluently от @rebrykblog и ChatGPT Voice Mode
  2. Sep 22, 2026Как и просили, 2.0 версия скилла для Claude/Codex для benchmaxxing английского Рекомендую…
  3. Sep 21, 2026Writing, конечно, надо бы пересдать
  4. Sep 19, 2026мы просто жертвы маркетинга, проходите мимо
  5. Sep 18, 2026Андромеда и её сосед, карликовая галактика M32
  6. Sep 18, 2026M81 при более чистом небе и М110
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →