Всем привет!
Не освещала в своих постах кажется проблему галлюцинаций моделей, так что пора это сделать. То, что LLM галюцинируют — пожалуй основная проблема, которая мешает использовать LLM во многих доменах. Сегодня вышла статья у коллег, в которой они рассматривают проблему на уровне спанов (слов или фраз), а не предложений, как это делается во многих других статьях. Также интересно то, что эта работа потверждает довольно интуитивную мысль, что модели должны ошибаться примерно в одних и тех же местах (например, путать даты, адреса или какие-то конкретные детали) и это можно использовать для поиска галлюцинаций.
Post #36
576