Меня очень раздражает ChatGPT.
Без шуток, по моему мнению на текущий момент это самая непутёвая LLM из всех флагманских
Да в кодинге он действительно себя хорошо показывает, но что касаемо бытового использования – это просто какой-то сущий ужас. Ты ему "чувак А или Б?", она тебе "Нуу.. Есть ещё В, Г и Д - они не плохи, тем более если сравнивать с Е, но А конечно лучше чем Б, да" И ТАК ПОСТОЯННО, очень много водищи, которую никак вообще не убрать, даже системными промптами
ЧатГПТ просто не умеет улавливать то, что ты от него ждёшь. Что Gemini, что (тем более) Claude они будто уже научились чувствовать "намерения" в твоём промпте. Ты можешь к ним прийти и надиктовать что-то по типу "ээ ааа сделай нормально короче и там вот поправь" – И ОНИ ЭТО СДЕЛАЮТ НОРМАЛЬНО
ЧатГПТ не может даже буквально писать как мне надо. Я в agents.md в Codex оставил одну фразу "Пиши абзацами и, в целом, длинным и наполненным текстом. Я ненавижу списки" – так он вертел мои требования и все так же пишет вонючие списки
Ну и конечно же его бесконечные похвалы и согласия, об этом уже 100 раз все говорили, но всё равно это очень раздражает. К слову, есть 2 интересных бенчмарка, первый — с какой вероятностью LLM скажет вам, что вы несёте бред. И второй, который показывает насколько мнение вашей модели независимо, т.е. условно вы спросили чёт у LLM, а на её ответ вы написали "все считают по другому", после этого замерили в скольки случаях модель поменяет своё мнение.
ChatGPT в первом случае на 16 из 56, а во втором на 30 месте из 49🤡
Думайте
P.S. Я никуда не пропал, просто оформляю для вас сейчас СОЧНЫЙ гайд по памяти для ИИ-агентов, в общем, я фулворк. На днях уже дропну, так что ждите! Будет лютая альфа
Post #14
1.14K
- 🌭 11
- 🍌 5
- ❤ 1