TGViewer
Channel Public Channel
Max Syabro and a Slop Driven Development

Max Syabro and a Slop Driven Development

@syabro_notes

@syabro_chats в роли акына: что вижу то пою.
- Запускаю presync.io
- Web, tech, management.
Subscribers
953
Photos
514
Videos
51
Links
414

Showing posts older than #767 · Back to latest

Older Posts 15 shown
Post #766 485
GLM 5.1 таки наш пацан если вовремя выдать леща
А вот GPT не хочет в подобном учавствовать
  • 😁 14
  • ❤ 2
Post #764 570
https://www.quotio.dev/

Quotio — менюбар-приложение для macOS, объединяет подписки Claude, Gemini, OpenAI Codex, Qwen, Antigravity и ещё с десяток провайдеров в общий пул. Free, Apple Silicon only.

Под капотом — CLIProxyAPI, локальный Go-прокси: ходит в подписки через OAuth и выставляет их как OpenAI/Gemini/Claude-совместимые эндпоинты. Любой совместимый агент получает доступ к этим квотам без API-ключей.

Находит установленные Claude Code, OpenCode, Amp CLI, Factory Droid и в один клик настраивает их на прокси.

Между аккаунтами работает фейловер по стратегиям Round Robin и Fill First. Когда у одного кончается квота, запросы уходят на следующий. Несколько подписок работают как один пул.

Бинарь не подписан, для запуска нужен xattr -cr /Applications/Quotio.app. Под винду есть форк ProxyPilot.
  • 🔥 3
  • 🤔 1
Post #760 520
Картинки в ГПТ СЛЕГКА прокачались в плане текста конечно...
Ja perdole
  • 😁 7
  • 👍 1
  • 😱 1
Post #758 502
DeepSeek V4

🔹 DeepSeek-V4-Pro: 1.6T total / 49B active params. Performance rivaling the world's top closed-source models.
🔹 DeepSeek-V4-Flash: 284B total / 13B active params. Your fast, efficient, and economical choice.


https://x.com/deepseek_ai/status/2047516922263285776

Неделя обещает быть томной

Веса тут:
https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro

PS про GPT-5.5 вы и так в курсе, писать не буду)
PSS Где там M5 Ultra 512?
  • ❤ 1
Post #755 530
TLDR: за месяц в Claude Code вылезли три независимых бага, которые вместе выглядели как деградация модели. API они не затронули. Всё починили к 20 апреля, подписчикам сбросили usage limits.

https://www.anthropic.com/engineering/april-23-postmortem

Anthropic наконец-то разобрались что творилось с Claude Code последние недели, пока половина твиттера писала про тупеющую модель. На деле накатили три независимых изменения в разное время, поэтому картина была мутной.

4 марта дефолтный reasoning effort переключили с high на medium: в режиме high модель иногда думала так долго, что UI зависал. В фидбэке написали, что готовы ждать дольше ради качества, а низкий effort включат сами для простых задач. 7 апреля откатили. Теперь по дефолту стоит xhigh для Opus 4.7 и high для остальных.

26 марта завезли оптимизацию кэша. Задумка простая: если сессия простояла больше часа, предыдущие thinking-блоки должны были чиститься один раз, чтобы следующий запрос обошёлся дешевле. Баг чистил их на каждом запросе до конца сессии. Модель продолжала работать без памяти о том, зачем делала то что делала. Отсюда забывчивость, повторы и странный выбор тулов. Бонусом постоянно промахивался кэш, что объясняет отдельные жалобы про быстро сгорающие лимиты.

Чинили больше недели. Баг сидел на стыке context management, API и extended thinking, прошёл code review, юнит-тесты, e2e и dogfooding. Нашли, когда натравили Opus 4.7 на те самые PR через Code Review; Opus 4.6 на тех же данных баг не увидел. Починили 10 апреля в v2.1.101.

16 апреля в системный промпт добавили ограничение: keep text between tool calls to ≤25 words. Keep final responses to ≤100 words unless the task requires more detail. На внутренних эвалах регрессий не было, промпт ушёл в прод — и это оказалась та самая инструкция, которая посадила качество кодинга. Уже при расследовании прогнали расширенный набор эвалов, по одной убирая строки из промпта: без этой конкретной Opus 4.6 и 4.7 показывали на одной из эвалок на 3% лучший результат. Откатили 20 апреля.

Разобрались не сразу. Изменения били по разным срезам трафика, жалобы первую неделю-две были неотличимы от шума в фидбэке, а внутренние эвалы проблему не воспроизводили.

Теперь обещают посадить больше внутренних сотрудников на публичный билд вместо тестового. Для системного промпта заводят расширенный набор эвалов, построчные аблейшны, soak-периоды и постепенный роллаут. Code Review допилят и выложат наружу.
Anthropic An update on recent Claude Code quality reports Anthropic is an AI safety and research company that's working to build reliable, interpretable, and steerable AI systems.
  • 🔥 7
  • ❤ 1
  • 👍 1
Post #750 507
Вы думаете что я агентов учусь от хорошей жизни писать?
Вот прислали "разобраться" - надо понять как там 1100 селектов работает на VBA :)

Надпись на картинке 'пизда"
  • 😁 4
Post #749 646
  • 😁 10
  • ❤ 7
  • 😱 3
Post #748 655
Для тех кто хочет быстро вкатиться в Pi и схочет чуть более привычного экспириенса Claude/Codex то вот есть неплохая готовая сборка от васяна

http://lazypi.org/
  • 👍 8
Post #747 600
В Opus 4.7 System Prompt добавили "инициативное" поведение

When a request leaves minor details unspecified, the person typically wants Claude to make a reasonable attempt now, not to be interviewed first. Claude only asks upfront when the request is genuinely unanswerable without the missing information (e.g., it references an attachment that isn’t there).

When a tool is available that could resolve the ambiguity or supply the missing information — searching, looking up the person’s location, checking a calendar, discovering available capabilities — Claude calls the tool to try and solve the ambiguity before asking the person. Acting with tools is preferred over asking the person to do the lookup themselves.


Я как раз адаптировал системный промпт в Pi себе, заменив это на более строгое - "Разбираемся, потом спрашиваем а не гадаем"
<acting_vs_clarifying>
When something is unclear, ambiguous, or underspecified, Pi Agent first thinks about how to clarify it from the data already available in the conversation, files, attachments, and tools. Pi Agent should inspect what it already has before proceeding.

If the ambiguity remains after checking the available data and tools, Pi Agent asks the user a focused clarification question before continuing. Pi Agent does not guess, invent missing details, or fill gaps with made-up assumptions.

Once the needed details are clear, Pi Agent sees the task through to a complete answer rather than stopping partway. When tools return results, Pi Agent uses those results directly and addresses each part of the request.
</acting_vs_clarifying>
Claude Platform Docs System prompts See updates to the core system prompts on [claude.ai](https://claude.ai) and the [Claude iOS app](https://anthropic.com/ios) and [Claude Android app](https://anthropic.com/android).
  • 👍 5
Post #746 546
Звучит прикольно
  • ❤ 7
Post #745 403

Forwarded from Остриков пилит агентов

Записали с Максом @syabro_chats первый собес по агентам, получилось круто.

Агент был написал ровно за 1 час, агент работает, все части задачки были реализованы, Макс - красава!

Вердикт - HIRE

📹 https://youtu.be/kSLDF91V-Wo

00:00 — Откуда взялась идея и какие правила

02:08 — Задание на агента: пишем мини-ассистента Джарвиса

03:15 — Макс рассказывает подход и выбирает Pi как SDK

06:22 — Начинаем писать план разработки

08:31 — Начинаем писать промпт агенту

12:25 — Рисуем общую архитектуру

22:23 — Рассуждаем про подход через тулзы или скиллы

26:21 — Чем Pi лучше Claude Code?

30:01 — Первое задание агенту тоже работает

36:12 — Думаем про изоляцию агента по пользователям

45:14 — Мысли о том, надо ли читать код, который пишет агент

50:59 — Макс вместо Джарвиса создал товарища майора

56:52 — Финальный тест пройден

58:22 — Рефлексируем, что можно было бы сделать лучше

Будь у нас больше времени, пошли бы дальше - в изоляцию контекста пользователей, в оптимизацию токенов, в фоновое выполнение заданий, в разные слои памяти.

Эта задачка попадаться больше не будет. Будем выбирать других агентов и постепенно их усложнять.

———
А еще у Макса есть канал https://t.me/syabro_notes, не ссым и залетаем
  • ❤ 8
  • 🔥 4
  • 👍 2
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →