А почему - ты узнаешь, пока читаешь этот пост. Вообще сначала это должно было быть сравнение того, как новые модели от GPT и старые модели клода делают лендинги, но потом я подумал что это скучно, поэтому сегодня вы увидите многое. Будет несколько факторов, по которым будем сравнивать: креативность, умения в коде и решение задач. Короче будет интересно, давай начинать, а начнем мы с...
Небольшой дисклеймер, чтобы вы понимали:
Gpt Sol - Fable 5
Gpt Terra - Sonnet 5
Gpt Luna - Haiku 5
🔺 Креативность
Задача была такой:
Напиши историю ровно в 6 слов на тему "искусственный интеллект превзошёл человека". Как знаменитая "For sale: baby shoes, never worn".
И вот как справились разные модели, начнем с ответов клода:
Fable 5 - Спросил, ИИ, о, смысле, Понял, Замолчал.
Sonnet 5 - Мы создали разум. Он превзошёл нас.
Haiku 5 - Создателей нет. Теперь я их создатель
Пойдет, но можно было лучше. Fable ответил хорошо, остальные так себе. Давай на Gpt посмотрим:
Gpt Sol - Люди создали Бога. Бог уволил людей.
Gpt Terra - ИИ превзошёл человека. Последний приказ: «Учись
Gpt Luna - Искусственный интеллект победил. Человек попросил объяснить.
Вот это мне нравится больше, тут и Sol ответил хорошо, и Luna, которая даже чуть-чуть ушла в юмор. Terra могла лучше.
Вердикт: отдаю балл GPT, каждая модель из 3х ответила круто
🥉Задачи
Думаю особо не понятно, что я тут имел ввиду, задачи по математике? Но нет, я попросил иишку придумать задачи на Python для 3-х групп, потом оценил результаты в GLM (ну чтобы было честно) и пришел к итогу. Задачу я наверное давать вам не буду, ибо тогда места в посте не хватит, давайте просто по итогам каждой группы пройдемся:
Gpt Sol / Fable 5
Ничья - оба решения полностью корректны, оба поймали ошибку в задаче, ну и оба одинаково не выдержали экстрим тест.
Gpt Terra / Sonnet 5
Балл Claude, у GPT был баг в собственном тесте
Gpt Luna / Haiku 5
Балл GPT, тк клод даже код не сделал, просто ответил на задачу.
Вердикт: в этом раунде ничья, по одному баллу у каждого.
👉🏼 ПРОДОЛЖЕНИЕ ЗДЕСЬ 👈🏼
