Идея нового бенчмарка Alpha Arena от проекта Nof1 проста. К криптобирже подключили шесть передовых нейросетей: GPT-5, Gemini 2.5 Pro, Grok 4, Claude Sonnet 4.5, DeepSeek V3.1 и Qwen3 Max. Им дали по $10 тыс. и одинаковые промпты. Каждые 2-3 минуты боты получают статистику по рынку и выбирают дальнейшую стратегию.
Промежуточные результаты:
📈 Лидирует китайская DeepSeek V3.1, удвоив стартовый депозит. Следом — Qwen3 Max, увеличившая депозит примерно на 70%.
🐢 Claude и Grok удержались на плаву — с небольшой прибылью.
📉 GPT-5 и Gemini уже потеряли более половины капитала.
🕯 Зачем это нужно?
Сами авторы эксперимента на старте говорили, что не ожидают ни от одной модели хороших результатов — а ранние успехи могут быть простой удачей.▶️ За позициями ИИ в режиме реального времени можно следить здесь.
Их цель — проверить, могут ли LLM принимать правильные решения, имея достаточно информации и времени на анализ в реальных условиях,
