Вот я и устроил тест для языковых моделей со сложной математически-лингвистической задачкой.
TATSY.PRO в основном работает с продуктами в русскоязычном 🇷🇺 ареале обитания. Поэтому работа с великим и могучим стала частью теста (и не зря!). Задание было на первый взгляд простое:
найти закономерность в числовом ряду 4, 3, 3, 6, 4, 5, 4, 6, 6, 6, 11, 10, 10, 12, 10 и продолжить ряд на 5 чисел
Думаете, легкотня? 🤔 Ну как сказать…
📊 Как всё прошло:
1️⃣ GPT o1 медленно, но справился, вообще без подсказок. И даже нашёл ошибку в условии!
2️⃣ DeepSeek решил задачу, но сначала ушёл в тяжёлую математику и игнорировал подсказки.
❌ Claude-3.5 и Qwen 2.5 честно запутались в особенностях русского языка.
❌ GPT o4 не справился даже с 2 подсказками.
❌ YandexGPT 4 вообще сказал, что данных мало, и не стал напрягаться.
📢 Мой вывод:
Да, DeepSeek сейчас на слуху, он хорош, но для задач на русском языке не идеален. Правда, у него есть плюс — работает без VPN.
👨🏻🏫 Мораль: русские числительные — это тест на выживание для нейросетей. Пока тут рулят люди, но GPT o1 уже близко. 😉
Ответ на задачку и интересные подробности тут ➡️
⚡️ Помни: He’ll be back 🤖.
Написано человеком для человеков на канале ПРОМПТ-ИНЖЕНЕР 🧠
