TGViewer
Channel Public Channel
SimpleAGI

SimpleAGI

@simple_agi

Здесь ты найдешь понятные лайфхаки и примеры использования LLM в повседневной жизни и бизнесе.

Подпишись, чтобы вместе шаг за шагом разбираться в технологиях, которые уже меняют наше будущее.
Subscribers
342
Photos
91
Videos
0
Links
75

Showing posts older than #180 · Back to latest

Older Posts 20 shown
Post #177 273
SimpleAGI Продолжение истории с effort и WebSearch. В claude-code есть issue #79798: alwaysThinkingEnabled не превращается в thinking: {type: "adaptive"}. Сессия молча идёт без thinking, а на xhigh WebSearch падает с 400. Весь тред до этого был про Opus 4.8, Windows…
В версии 2.1.221 баг исправили. Буду считать, что моё участие повлияло максимально)
Post #176 270
Иногда хочется обмануть и назвать свой режим - медитативным work-life balance,
но не получается)
Вы обращаете внимание на свою статистику и "объемы" своих активностей?
Воскресенье и пятница - дни моей минимальной активности.
Подобные бесполезные "открытия" мне всегда интересны)
  • 😱 2
Post #175 227
Когда неделя начинается не в Понедельник ⌨️
  • 😁 5
  • ❤ 1
  • 🤣 1
Post #174 252
Всё же как любопытно переносить со сферы на сферу типовые модели рассуждений. Это работает очень хорошо и комично) у меня почему-то флешбеки🐆

#meme
  • 😁 6
Post #173 268
Ревью своего кода субагентом - это ревью самим собой. Просто с чистым контекстом.

Контекст свежий, да. Модель та же. Училась на том же, ошибается там же. Слепые пятна автора она наследует целиком - потому что она и есть автор.

Ага. А ревьюер другого вендора - нет.

В claude-code-harness v1.20.0 добавил интеграцию с Codex CLI. Он подключается к Claude Code как MCP-сервер. Кит отдаёт не совет «позови вторую модель», а скилл - как звать, с каким промптом, что потом делать с ответом.

Внутри дисциплина:
- промпт на опровержение, а не на «посмотри, всё ли ок»
- read-only sandbox
- вывод чужой модели - сырьё для анализа, а не список задач
- каждую находку воспроизводишь своим падающим тестом
- критерий остановки, иначе цикл ревью бесконечный

Важно: это апгрейд для тех, у кого второй вендор уже стоит. Не повод заводить его ради галочки.

Гейт механический. Кит смотрит, зарегистрирован ли Codex как MCP-сервер. Не зарегистрирован - опция не упоминается вообще. Дефолтная ступень верификации остаётся нативной.

⸻

/plugin update claude-code-harness
GitHub GitHub - nikitaCodeSave/claude-code-harness: Claude Code harness kit — designs, bootstraps, audits, and extends a project's .claude/… Claude Code harness kit — designs, bootstraps, audits, and extends a project's .claude/ + root CLAUDE.md. Under a capable model, less harness yields more productivity. - nikitaCodeSave/clau...
  • ❤ 4
Post #172 212
Подключил codex через mcp к Claude code и теперь у меня полноценно отрабатывает Review этап с не то, что агентом с чистым контекстом, а другим семейством моделей.

Нужно будет оформить этот апдейт в claude-code-harness
Post #171 247
Открыл рядом два окна с лимитами подписок. И залип.

OpenAI: "Осталось 72%".
Anthropic: "25% used".


Смысл один, формулировка зеркальная.
И полоска работает наоборот: у OpenAI закрашено то, что ещё есть, у Anthropic - то, что уже сжёг. Один и тот же синий прямоугольник означает противоположные вещи.

Стакан наполовину полон против стакана наполовину пуст, только в биллинге.

Просто забавный момент, как ребята стараются не быть похожими😡
  • 😁 3
Post #170 256
Появилась возможность потрогать Codex с нормальными лимитами. У меня он совсем ванильный и без всяких harness примочек.

Дай, думаю, попробую переписать архитектурные блоки проекта из состояния "Нужно, чтоб работало хоть как-то"
в приличную модульную структуру, чистенько.

Сессии 2 ушло на формирование плана и всяких особенностей. Потом несколько сессий на подготовительные работы и сбор анамнеза пациента😫

И вот он самостоятельно шпилит уже 8 час. Судя по коду - это может быть даже не в пустую потраченное время.

Мне понравилось поведение и дефолтные подходы к работе с большой кодовой базой, то как решаются проблемы возникающие в процессе разработки.

Культурный шок от того, что "Запустил и работает хорошо"
С Клодом немного другие эмоции)
  • ❤‍🔥 1
Post #169 240
Продолжение истории с effort и WebSearch.

В claude-code есть issue #79798: alwaysThinkingEnabled не превращается в thinking: {type: "adaptive"}. Сессия молча идёт без thinking, а на xhigh WebSearch падает с 400. Весь тред до этого был про Opus 4.8, Windows Desktop и macOS.

Написал туда большой комментарий. Что он добавляет:

Opus 5 в scope. Теперь у мейнтейнеров есть репро на текущей дефолтной модели и на 2.1.220 - в треде максимум был 2.1.218. Плюс третья платформа: Linux CLI.

Снят неверный воркэраунд. effort: high во frontmatter агента не работает. Это уточнение к совету из #76689, проверял на скилле. Без него люди чинили бы себе не тот слой.

Объяснение чистых репро. Почему часть попыток воспроизвести возвращается зелёной: env-блок в settings перебивает --effort, и вся матрица по факту меряет high. Сам сидел на этом двое суток - так что в тред ушло как предупреждение, а не как теория.
И способ найти прошлые молчаливые потери - греп с глобом на уровень глубже. Ошибка не помечается is_error, обычным поиском её не видно.
___
Просьба.
Если тема близка - зайдите и поставьте реакцию на комментарий. Мейнтейнеры сортируют по реакциям, а не по длине текста.

https://github.com/anthropics/claude-code/issues/79798#issuecomment-5081189474
GitHub [BUG] alwaysThinkingEnabled not translated to thinking:{type:"adaptive"} on Opus 4.8 — sessions silently run without thinking;… Summary On Opus 4.8, Claude Code does not translate "alwaysThinkingEnabled": true (settings.json) into thinking: {type: "adaptive"} on outgoing API requests. Per the effort docs...
  • ❤ 1
Post #167 328
На Opus 5 любая сессия выше high(effort) теряет WebSearch — включая ultracode и /effort max.

Держу в курсе
  • ❤ 2
  • 😁 1
Post #166 254

Forwarded from Pavel Zloi

Как и обещал, выкладываю самый полный курс про Cursor AI

Собирал несколько недель. 14 модулей, почти 70 уроков. Начинается с установки и оплаты из России, заканчивается автономными агентами, которые сами доводят задачу до конца.

Что разбираем:
- как устроен агент, токены, контекст, цикл с инструментами;
- работа в IDE, Tab, Ctrl+K, чат, композер, режимы и модели;
- контекст, правила проекта, MCP-серверы;
- скиллы, хуки, команды, субагенты;
- Cursor CLI и запуск агента в CI/CD;
- ACP, BDD и сквозной проект от плана до деплоя.

Курс текстовый, со скриншотами из живого проекта, а не из документации. Каждый урок самодостаточный, порядок изучения любой. После модуля вопросы на проверку и практика в своём проекте.

Забирайте, делитесь, не стесняйтесь задавать вопросы если вдруг что-то непонятно.

>>> Пройти курс бесплатно, на Stepik

PS. Кому удобнее читать офлайн, весь курс собрал в PDF-книгу на Boosty.
  • 🔥 4
  • ❤ 2
  • 🤡 1
Post #164 274
Давно обещаю выложить наработки по harness для Claude Code. 🥺

Два плагина. Одна репа.

claude-code-harness - проектирует и аудирует .claude/ в проекте.
Удаляет так же охотно, как добавляет: показываешь ему свой .claude/ -
получаешь список мёртвого груза.

devlog - память проекта между сессиями. Новая сессия открывается
не холодной, а с последними записями и незакрытой работой.

Даже презентацию сделал - ссылка .
  • ❤ 8
  • 🔥 3
  • 🤩 2
Post #162 330
Словить 5 часовой лимит на MAX подписке в процессе workflow - ВЫПОЛНЕНО

😈 как горит, уф ☹️
  • 🔥 4
Post #161 332
К сожалению не получится зафиналить полноценный "пак" для вас, пока думаю, как с пользой собрать обвязку, чтоб каждому было потенциально полезно и за одну сессию с клодом доработать под себя.
А пока пытаюсь работу работать, тяжко)

P.S. Fable 5 крутая, но как же мало лимитов и долго "думает". Кто и так использует API , Я вам сочувствую, потому что с этой иглы вы не слезете и будете стучаться к Fable вне зависимости от стоимости,
пу-пу-пу
  • 🔥 4
Post #160 360
Знакомая спрашивает, нужна ли кому работа с "Адекватным работодателем и оплатой по рынку"

Ищут человека оценивать генерации мультимодальных моделей — видео, аудио, речь, музыка. По факту ты смотришь, что нагенерила модель, ставишь оценки по чек-листам (насколько попало в промпт, реалистичное ли движение, не разъезжается ли картинка между кадрами, естественная ли речь, липсинк и т.д.) и объясняешь, где она врёт. Из твоих оценок собирают preference-данные, на которых модель потом дообучают через RLHF.

Условия: удалёнка/гибрид, контракт на 6 месяцев с возможным продлением, 3–6 лет опыта, подчинение напрямую CAO. Стек — Label Studio, Scale, Surge, Appen, Excel.
https://www.linkedin.com/jobs/view/4434694805/
Linkedin Klyp hiring Foundation Model Training Specialist (Video, Audio & Multimodal AI) in California, United States | LinkedIn Posted 11:26:43 PM. Workplace type: Remote / Hybrid Employment type: Contract (6 months, extension possible based on…See this and similar jobs on LinkedIn.
  • 😁 2
Post #159 293
182 дня до нового года, уже меньше половины до долгих выходных.

Fable 5 вернули*
*На неделю по подпискам, а далее ток по api.

Постараюсь закончить сборку под harness или хотя бы справочных файлов.
Чтоб и вы тоже смогли "успеть" донастроить Claude code под ваши кодинг задачи и сократить количество
"Ну ты чо творишь? Мне нужно иначе и вообще верни всё в зад"

Астрологи объявили неделю fable 5.
Успеть закрыть все мета - задачи
  • ❤ 3
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →