TGViewer
Вайб-кодинг Вайб-кодинг @vibecoding_tg · 64.3K subscribers
Post #2927 11.2K
Как сделать RAG в 32 раза более эффективным по памяти 😨

Существует простая техника, широко используемая в индустрии, которая делает RAG примерно в 32 раза более эффективным по памяти.

Perplexity использует её в своём поисковом индексе. Azure в своём поисковом пайплайне. HubSpot в своём AI-ассистенте

Чтобы в этом разобраться, вот гайд, где ты построишь RAG-систему, которая выполняет запросы к 36M+ векторам за <30 мс.

И техника, которая это обеспечит, называется бинарная квантизация.
More from @vibecoding_tg
  1. Oct 9, 2026OpenAI завезли GPT-6.1 Sol Ultrafast. Команда постепенно запускает его в API, Codex и Chat…
  2. Oct 9, 2026Post #4055
  3. Oct 8, 2026photo post
  4. Oct 8, 2026Для тех кто просил, пак эмодзи для вайбкодеров 👇 https://t.me/addemoji/VajbkodimHttpstmeZ…
  5. Oct 8, 2026ChatGPT теперь работает на GPT-6. Главное нововведение — Intelligent UI. Теперь вместо обы…
  6. Oct 8, 2026А вот и реальный факап: парень запускал Opus с отключёнными запросами разрешений и в итоге…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →