Но предварительные выводы уже все поняли, да? Если модель работает без обвязки - важно насколько она держит агентский сценарий и умеет разными подходами добиваться конечного результата. А если у неё есть нормальные правила и MCP - важно насколько модель может при этом держать контекст и следовать инструкциями. Именно поэтому при наличии MCP и правил GPT модели показывают себя даже лучше Claude, в то время как без них - очевидно сильно проигрывают.
Ну и да, первые результаты opus 5 уже в бенчмарке. Он прекрасен :)
Post #1992
1.83K

- 👍 3
- 🔥 2
- 👀 2
- ❤ 1