TGViewer
immers.cloud | Облако с GPU immers.cloud | Облако с GPU @immers_cloud · 944 subscribers
Post #566 802
🧠 Зачем нужен Semantic Chunking для RAG приложений

При построении AI-агентов, работающих с пользовательскими данными, Retrieval-Augmented Generation — это одна из основных технологий наряду с LLM, на которых строится разработка Gen-AI приложений.
Тем более важно понимать, как именно использовать данные в RAG-пайплайнах и от чего зависит эффективность их использования.

📌 Ключевой момент — подготовка данных для загрузки в индекс перед их использованием в RAG-системах.
В библиотеках типа Langchain уже реализованы абстракции, которые делают что-то с данными “под капотом“.

Фактически данные — изначально большие куски текста — разбиваются на куски поменьше, так называемые чанки.
И здесь всё становится сложнее и интереснее:

- Можно разбить текст по переносу строки, если превышен фиксированный лимит символов (так делает CharacterSplitter в Langchain)
- Можно применить чуть более сложный Recursive Chunking

🤔 Но как не потерять изначальный контекст при таком делении?

Для решения этой проблемы в индустрии появился Semantic Chunking и его вариации.
По сути, этот метод вычисляет сходство между векторами разных предложений и объединяет их в один чанк либо, наоборот, разделяет на основе некоторого порога сходства.

Таким образом, не теряются семантические связи при делении текста на чанки, и это очень важный момент для эффективного RAG.

⚙️ Технически Semantic Chunking сложнее, особенно при использовании моделей-эмбеддингов.
Можно:

- Обучить такую модель на наших GPU immers.cloud и собственных данных
- Взять готовую с HuggingFace
- Или воспользоваться API OpenAI

@ruslandevlive — мысли о современных AI/ML-технологиях
  • ❤ 3
  • ⚡ 3
  • 🏆 3
More from @immers_cloud
  1. Oct 9, 2026Трамп советуется с Grok, а кто управляет вашим ИИ? 📰 По сообщению TIME, Трамп спрашивал G…
  2. Oct 8, 20265 ИИ-моделей для одной RTX 4090 Подобрали модели для создания ИИ-помощников, программирова…
  3. Oct 6, 2026Qwen3.8-Flash-Next: гибридное внимание для ИИ-агентов 👋 Qwen3.8-Flash-Next — эксперимента…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →