И я не про локальные LLM
Последнее время кстати начал замечать, как Cursor очень сильно жрет ресурсы ноута
Он не стесняется лагать на M4 Pro, и даже заставляет раскрутить куллер и подогреть клавиатуру 🫨
Приличный вклад делает запущенный dev server nextjs, ребилдящий часть модулей каждый мелкий edit от агента.
Особенно, если прогнать через один чат около 540млн токенов (IO + IO Cache + Output) по курсору.
На Grok-code-1-fast это сейчас бесплатно, а за деньги стоило бы 1.53$
Я же говорил, что он почти бесплатный?))
К слову Summarize - не дает бесконечный контекст.
Есть какие-то критерии, которые ограничивают бесконечное рекурсировное сжатие контекста, так что в какой-то момент/summarizeне будет снижать загрузку контекста ниже 40% на 200к окне при повторных вызовах, что приводит все равно к переполнению контекста, а следование правилам ухудшается, так например у меня строгий запрет типизации any снова начинает нарушаться моделью.
Но не смотря на это - очень сильно расширяет возможности.
