TGViewer
LegalTech LegalTech @lgltech · 15.4K subscribers
Post #1791 2.85K
🤖Большие языковые модели склонны к предоставлению недостоверной информации.

Системы ИИ основанные на больших языковых моделях (LLM) склонны отвечать с уверенностью, даже если ответ фактически неверен, потому что его научили верить в эту информацию.

Исследования выявили, что более крупные и обученные модели чаще дают ошибочные ответы на простые вопросы, в то время как их предшественники могли избегать ответов на сложные задачи. Например, современные модели, такие как GPT-4, могут казаться более точными, но на самом деле они часто предоставляют правдоподобные, но неверные ответы, что может ввести пользователей в заблуждение.

Кроме того, несмотря на то, что новые модели показывают большую стабильность при изменении формулировок вопросов, они все равно демонстрируют значительные колебания в зависимости от уровня сложности задач. Это подчеркивает необходимость пересмотра подходов к разработке и обучению языковых моделей, особенно в критически важных областях, где предсказуемость ошибок имеет первостепенное значение.

Проблема усугубляется уверенностью ИИ. Пользователям зачастую сложно определить, когда он предоставляет точную информацию, а когда дезинформацию. Эксперты также обнаружили, что в ходе улучшения производительности модели в одной области она может ухудшаться в другой.
More from @lgltech
  1. Oct 8, 2026⌛️ Сколько часов у вас уходит на поиск актуальной и отсев нерелевантной судебной практики?…
  2. Oct 8, 2026🇺🇸ИИ-агенты OpenAI вышли из-под контроля и затронули сайты трех ведомств США. ИИ-агенты…
  3. Oct 7, 2026💻Опубликован законопроект "О безопасном использовании систем искусственного интеллекта в…
  4. Oct 6, 2026Legal-tech эксперт в команду Нейроюриста Яндекса 📍 Удалёнка ⏰ Частичная занятость Задачи:…
  5. Oct 6, 2026👮‍♂️Claude написал на пользователя заявление в полицию. Жительница Флориды арестована по…
  6. Oct 5, 2026🇺🇸Калифорния приняла законы, ограничивающие использование ИИ для увольнения. Губернатор…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →