TGViewer
Артифишл Артифишл @artyfishl · 69 subscribers
Post #8 80
Индекс строит 9B, запрос кодирует 0.6B

Perplexity выложили pplx-embed-v2-late: две ColBERT-модели, 0.6B и 9B. Каждый токен кодируется вектором на 128 чисел.

Самое интересное не размер, а общее пространство. Документы можно один раз проиндексировать тяжелой 9B, а запросы кодировать маленькой. Цена запроса не меняется, потому что документы все равно в оффлайне считать.

На текстовых доменных задачах такая схема дает +1.6 пункта, это примерно половина разрыва между моделями. При этом на текст у 0.6B работает около 240M активных параметров, остальное эмбеддинги токенов и визуальная часть.

Техрепорт обещают позже. Как мы знаем минус ColBERT подхода, что индекс растет с длиной документа. Что они делают с этим, пока не сообщается.

Веса · блог
Perplexity AI Multimodal embeddings beyond a single vector A new family of late-interaction models for text and image retrieval, with a shared embedding space across model sizes.
  • 🔥 1
More from @artyfishl
  1. Oct 9, 2026Обрезать эмбеддинги можно и без MRL Чем больше эмбеддер, тем лучше он обычно ищет. Но с мо…
  2. Oct 8, 2026Что не видно в анонсе FRIDA-Decisions Если вы пришли со стрима, что такое FRIDA-Decisions,…
  3. Oct 8, 2026Две вещи, которые эмбеддер не вытянет одним вектором Эмбеддер сжимает запрос в один вектор…
  4. Oct 8, 2026Артифишл pinned «Привет, это «Артифишл» Я Артём, техлид ML R&D. Шесть лет учу машины наход…
  5. Oct 8, 2026Привет, это «Артифишл» Я Артём, техлид ML R&D. Шесть лет учу машины находить нужное в текс…
  6. Oct 8, 2026Channel photo updated
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →