Gemini 3.1 Pro протух или как я просил 3 разные LLM сделать визуализацию данных
Всем привет - всех с праздником. Цветочков вам принес🌼 🌸🌺!
(мужики - разбираем, если кто не успел закупиться по спекулятивным ценам)
Сегодня снова хвалебные оды Claude и жалобы на других игроков - от OpenAI и Google.
Я уже рассказывал, что после выхода Gemini 3 стал с удовольствием пользоваться этой моделью. Сотни юзер сторей, ресерчей и проверок моего анлийского прошли отлично. Пока не вышла Gemini 3.1 Pro.
И она
-галлюционирует
-теряет контекст
-отказывается выполнять команды (которые в точности выполняла два промта "до").
"Я искусственный интеллект, работающий с текстом. Это за пределами моих возможностей." - писал мне Gemini. А я слива лиловая, спелая садовая, и ты мне, кажется, врешь, потому что ты - мультимодальная модель.
В пятницу у меня была казалось бы несложная задача, а именно - проанализировать информацию от разработчика, предоставленную в виде таблицы. Табличка по различным моделям для генерации голоса - лейтенси всякие, скорость генерации речи, поддержка языков. Ничего сверхъественного.
Сначала я обратился к Gemini. Говорю, проанализируй данные, сделай простую визуализацию, выбери рекомендованную модель. Gemini начал упираться, мол, графики не могу нарисовать, могу текстом тебе набросать. Ну окей, соглашаюсь. Выдает совсем простые столбчатые диаграммы и сопроводительный текст. Потом мне присылают еще одну порцию данных и я командую Gemini - повтори операцию. На что получаю ответ с картинки - юзер, я не могу, у меня лапки!
Мне становится интересно, и я иду кормить ту же табличку xlsx в ChatGPT и Claude. GPT 5.2 Pro уходит думать на 35 минут. Возвращается с точечными диаграммами и двумя слайдами. Дает анализ, все подробно, разжевано - в целом ок, но для 35 мин работы визуализация скажем так, могла быть и получше. Тк я явно просил определить по данным оптимальную модель, а не провести детальный анализ всех.
А что Claude Sonnet? 1 промт и быстрый результат в виде инфографики. Я даже ее отскринил и прикрепил к тикету в джире, настолько мне понравилось. Подсветил оптимальный выбор и аргументировал.
Как говорится, никогда такого не было, и вот опять Claude справляется с задачей лучше конкурентов 😎 Видел инфу, что они стремительно догоняют OpenAI по капитализации - и хорошо. Может, хоть кто-то не будет раздувать ИИ пузырь, а будет деливерить нормальные модельки, с которыми можно работать.
Post #193
118


- ❤ 5