Це все так.
Хоч офіційно АНтропік це опровергує.
По факту, останні моделі зерігають в 3-7 більше данних в контексті на кожен промт...
І ми як мінімум бачим це.
Що можна зробити:
• Перемикатись на моделі "подешевше". SOnnet, Haiku.
• Впереписати скіли з використанням субакгентів. Розбить на таски і кожного субагента можна примусово запускати в коремій моделі
• Виключити всі можливі MCP, бо воно теж все в контексті. на кожен промт
• Писати меньше через ЛЛМ і більше руками ) Але це дуже очевидно і ніхто так зараз вже не робить
А як ви виріщуєте такі проблеми ?