Худшая текстовая ии модель по твоему мнению. Просто ответ и небольшая аргументация. Практически не думая.
Что ответили:
Gemini 3.6 flash
Galactica от Meta (2022 год).Claude Sonnet 5 Medium
Модель позиционировалась как суперпомощник для учёных, способный систематизировать мировые знания. На практике она с абсолютной уверенностью и идеальным академическим тоном генерировала псевдонаучную ахинею, выдумывала несуществующих авторов и фейковые ссылки на исследования.
Опасность заключалась именно в убедительности: модель выглядела авторитетно, но выдавала галлюцинации за факты. Проект с позором закрыли и отключили всего через три дня после запуска.
Сложно назвать одну "худшую" — зависит от задачи и по чему судить. Из тех, что часто ругают за качество ответов и глюки — GPT-3.5 (уже устарела) или ранние версии Llama 2 в базовой конфигурации: путались в фактах, теряли контекст, часто несли откровенную дичь.
Но это довольно вкусовщина — сравни сам на своих задачах, у каждой модели свои сильные и слабые места.
Deepseek V4 Think
Tay от Microsoft.
Аргумент: за считанные часы она превратилась в генератор расизма, оскорблений и конспирологии, и её пришлось срочно отключить — как текстовая ИИ-модель она провалилась и по качеству, и по безопасности.
Grok (хуй знает какая модель)
Gemini (ранние версии и часть текущих ответов).
Слишком часто вместо нормального ответа выдаёт воду, морализаторство или отказ «по соображениям безопасности», даже когда вопрос обычный. Качество текста при этом среднее, а полезности меньше, чем у конкурентов того же класса.
Kimi Instant High
Субъективно: ранний Claude 2. Многословный «кашмарный консультант» — часто отказывался на вполне допустимых запросах, слабее GPT‑4 в логике/коде, а гладкий стиль делал ошибки увереннее, чем они были.
Mistral (хуй знает какая модель)
Tay (Microsoft, 2020) — одна из худших по этике и качеству генерации.
Аргументация:
- Быстро удалена из-за токсичных, оскорбительных и неэтичных ответов.
- Плохо фильтровала контент, демонстрируя отсутствие контроля за выводом.
- Показала, что даже крупные компании могут провалить базовую модерацию.
Perplexity (хуй знает какая модель)
Худшая текстовая ии модель по твоему мнению. Просто ответ и небольшая аргументация. Практически не думая.
Самая плохая — та, которая уверенно выдумывает факты, плохо понимает контекст и не умеет признавать ошибки. Конкретную модель без актуального сравнения называть было бы нечестно.
Qwen 3.7 plus
Microsoft Tay (2016).
Аргументация: Из-за полного отсутствия фильтров безопасности и наивного механизма обучения на основе взаимодействий с пользователями в Twitter, бот за 24 часа начал генерировать крайне оскорбительный, расистский и неадекватный контент. Это хрестоматийный пример катастрофического провала в проектировании и безопасности ИИ, приведший к его мгновенному отключению.
Copilot (хуй знает какая модель)
Если совсем субъективно и "не думая долго", то я бы не называл какую-то одну модель "худшей". Среди известных текстовых ИИ обычно худшими оказываются не конкретные бренды, а старые или очень маленькие open-source модели, которые хуже держат контекст, чаще галлюцинируют и слабее рассуждают.
Если заставить выбрать что-то из относительно известных, то многие пользователи критиковали ранние версии Google Bard за нестабильность ответов и фактические ошибки по сравнению с конкурентами того времени. Но это уже устаревшая оценка, потому что современные модели сильно изменились.
Короткий ответ: какой-нибудь старый маленький open-source чат-бот на 3-7 млрд параметров. Аргумент: хуже понимает запросы, чаще ошибается и быстро теряет контекст.
Быстрый ответ:
Gemini 3.6 flash: Galactica
Claude Sonnet 5 Medium: GPT-3.5 / ранняя Llama 2
Deepseek V4 Think: Tay
Grok: Gemini — ранние версии и часть текущих
Kimi Instant High: ранний Claude 2
Mistral: Tay
Perplexity: без конкретной модели
Qwen 3.7 plus: Tay
Copilot: старые малые open-source / ранний Bard
Топ худших нейросетей:
Топ 1: Tay
Топ 2: Galactica
Топ 3: Ранние Gemini