Привет, это «Артифишл»
Я Артём, техлид ML R&D. Шесть лет учу машины находить нужное в текстах на русском.
Если вы собирали RAG или поиск по документам, возможно, вы уже пользовались нашей работой. С командой мы сделали эмбеддер FRIDA и бенчмарк ruMTEB, на котором сравнивают русскоязычные эмбеддеры. Сейчас делаем поискового агента SMITH и FRIDA-Decisions, модель, которая принимает решения по тексту без генерации. Все лежит в открытом доступе с лицензией MIT.
Что здесь будет:
— как устроены эмбеддинги, поиск и агенты, с честными минусами;
— мои эксперименты с цифрами, включая неудачные;
— тренды и обзоры новых технологий по моей теме;
— кухня R&D: как делаются модели, которыми вы пользуетесь;
— обсуждения с вами в комментариях: как вы применяете AI и чего вам не хватает.
Последнее для меня самое важное. Напишите в комментариях, чем занимаетесь и что у вас сейчас не работает. Буду строить посты на ваших ответах.
Post #3
1.65K
- 👍 6