😵💫 Одна и та же модель стала почти втрое умнее благодаря обвязке
В тесте OpenAI GPT‑5.6 Sol набрала на ARC‑AGI‑3 всего 13,3% со стандартной архитектурой агента. После сохранения рассуждений между шагами и сжатия длинного контекста результат вырос до 38,3% — при этом выходных токенов потребовалось примерно в шесть раз меньше.
Для тебя вывод простой: качество агента определяется не только моделью. Грамотное управление памятью и контекстом может дать больший эффект, чем очередная замена LLM.
Пруф: технический разбор OpenAI от 13 августа 2026 года
#ai #aiagents #llm #contextmanagement #agentarchitecture #evaluation
@data_engi
Post #1230
110