Autolabel: авторазметка текстового датасета
Если задачи NLP вам набили оскомину:
— кластеризация документов (Сlassification);
— распознавание именованных сущностей (Named Entity Recognition);
— связывание именованных сущностей (Entity Matching);
— оценка эмоциональной окраски (Sentiment Analysis);
— поиск ответа в тексте и проч.
И тут помогут LLM. Библиотека Autolabel решает эти задачи быстро и условно бесплатно, причём какой именно моделью — остаётся вашим решением.
Репозиторий проекта на GitHub
#библиотека
Post #3156
3.99K