TGViewer
pickyouragent.dev pickyouragent.dev @pickyouragent · 97 subscribers
Post #4 205
Короч, есть такой тест для моделей как "поиск иголки в стоге сена". Он показывает насколько модель "забывает" данные из контекста.

Моя основная модель сейчас GLM 4.7, у которой эффективный контекст около 100к-120к токенов. Всё что дальше имеет куда хуже качество.
Но провайдер предоставляет контекстное окно около 200к токенов. И вот ни один агент не предоставляет возможность ограничить контекстное окно или же запускать автокомпакт раньше лимита провайдера.

И вот этой фичи нет ни у кого из тестируемых агентов. Такое чувство, что люди не особо используют модели, отличные от моделей антропика, гугла или опенаи.
  • 👍 3
  • 🤔 1
More from @pickyouragent
  1. Feb 3, 2026pickyouragent.dev Codex наконец-то добавил plan mode. И он вполне неплох. Пользоваться мож…
  2. Feb 3, 2026pickyouragent.dev Небольшое обновление по агентам: claude code подрос с 57.5 до 61 балла,…
  3. Feb 1, 2026https://pickyouragent.dev Основная задача - это понять какой агент лучше. Я разметил фичи…
  4. Jan 31, 2026https://pickyouragent.dev Обещанно прошёлся по клод коду. Изменения такие: Plan Mode: - ✅…
  5. Jan 31, 2026Рефакторинг продолжается. Я решил, что надо заполнять не только поддержку, но и то как пол…
  6. Jan 30, 2026Ну, рефакторинг завершился немного раньше чем я ожидал. Ничего не изменилось на страницах.…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →