TGViewer
Channel Public Channel
Max Syabro and a Slop Driven Development

Max Syabro and a Slop Driven Development

@syabro_notes

@syabro_chats в роли акына: что вижу то пою.
- Запускаю presync.io
- Web, tech, management.
Subscribers
948
Photos
514
Videos
51
Links
414

Showing posts older than #833 · Back to latest

Older Posts 14 shown
Post #832 618
https://fixupx.com/miclivs/status/2060115468531499224?s=46

https://github.com/Michaelliv/pi-dynamic-workflows

За что я люблю пи это за то что на любой чих со стороны Клода или кодекса в течение суток появляется «ххх есть у нас дома»

Вот workflows запилили уже )

Но мобильный кодекс все еще охуенен как и опус
🧵 Thread • FixupX Michael Livs (@micLivs) introducing pi-dynamic-workflows This is probably going to be a bigger token burner than pi-goal, BUT, dynamic workflows is the first implementation of subagents that i don't hate, mainly because it's "code mode" for subagents. agent writes a js-based workflow…
Post #831 886
Цитата из соседнего чата
Сама концепция сабагентов — бестолковая. Идея классная, но на передаче информации от агента сабагентам и обратно теряется куча токенов, и это убивает весь смысл.
Сейчас можно сделать компакт, перечитать новую задачу, и контекст будет в порядке. Сабагент не понадобится.


Сабагенты — норм концепция. Просто не для каждой задачи. Если таких задач нет, это не концепция бестолковая - это задач под неё нет. Или более эффективного решения (на сейчас)

Если нужно распараллелить работу, изолировать контекст или отдать кусок работы дешёвой модели — они вполне на месте. Плюс один важный кейс: не срать в основной контекст промежуточными результатами. Всякие черновые поиски, логи, тулколы, длинные выкладки и промежуточные выводы спокойно умирают в отдельной ветке.

Компакт не заменяет это полностью. Компакт — это «ну вроде выкинули лишнее и оставили саммари». Но ты не контролируешь, что именно туда протекло и что потом начнёт аффектить выполнение.

Пока агент сам плохо рулит своим контекстом и фокусом внимания — не умеет нормально выбирать, что держать перед глазами, а что выкинуть сабагенты остаются полезным тулом и чуток костылём.
  • ❤ 7
  • 🔥 4
  • 👍 1
Post #828 1.03K
‼️Тлдр: сносите GSD asap ‼️

https://www.reddit.com/r/ClaudeAI/comments/1tktl4w/if_you_use_the_get_shit_done_gsd_ai_tool_you_need/

Автор регпульнул хомяков на $500 000 со своим $GSD токеном, удалил соцсети и бросил проект. Старые npm-пакеты всё ещё под его контролем, а GSD — агентская обвязка с доступом к shell/bash. Что там автор ещё выкатить может - хер знает. Или кому продать доступ к пакету.

Комьюнити сделало форк get-shit-done-redux и прогнало security sweep.

У меня уже не стоит удален давно. Если у вас установлен - сносите нахуй
  • 👍 8
  • 😁 5
Post #827 773
https://github.com/can1357/oh-my-pi

С первого взгляда OhMyPiVasyanEdition, но там поглубже: качество кодинг-агента упирается не в только модель, а в интерфейс между моделью и средой.

Например в обычном str_replace модель должна дословно угадать старый кусок текста и новый кусок. Частенько "таких строк несколько" или "строка не найдена"

В hashline-правках каждая строка получает короткий хеш-якорь. Модель говорит не “найди вот этот текст”, а “замени строку с этим якорем”. Если файл изменился после чтения, хеши не сходятся, и правка отклоняется до того, как что-то сломается. По бенчу автора Grok Code Fast 1 на таком формате поднялся с 6.7% до 68.3%.

Это полезнее, чем просто “давайте модель попизже, и как-нибудь само починится”.

Дальше у omp это везде примерно про то же: меньше магии, больше точек опоры для агента

Агенту дают обратную связь от IDE: форматтер, LSP-диагностику, rename refs и code actions после правок. Он не редактирует код вслепую и не узнаёт о поломке через десять сообщений.

Мне нравится, что GitHub, PR, issue, diff, skill, вывод сабагента и merge conflict там сведены к одной метафоре путей: pr://, issue://, agent://, skill://, conflict://. Агент использует обычные read/search/write, а не учит двадцать отдельных API.

Сабагенты разводятся по git worktree, чтобы параллельные воркеры не топтали одну рабочую директорию.

Большой набор tools не висит целиком в промпте. Скрытый индекс подтягивает нужные tools по BM25, когда задача до них дошла.

Правила тоже не обязаны всегда жрать контекст. TTSR ловит regex-паттерн прямо в stream output и подкладывает правило только при срабатывании. Мелочь, но это как раз тот тип душнины, из которого собирается нормальный harness.

Отдельно понравился подход к ревью: не стена возможных улучшений, а приоритеты P0–P3, confidence и вердикт, можно ship или нет.

Из вторичного я бы ещё вытащил debugger как tool, Python/JS runtime с доступом к agent tools, память через retain/recall/reflect и автоматическое разбиение грязного working tree на атомарные commits. SDK/RPC/ACP — уже скорее для тех, кто хочет встраиваться глубже.

Хороший coding harness начинается не с “модель + bash”, а со слоя, который даёт модели нормальные ручки: адресуемые правки, быстрый feedback loop, изоляцию, предпросмотр опасных действий и единый способ читать всё вокруг проекта.
  • 👍 15
Post #826 599
https://vitest-evals.sentry.dev

А вот это интересное решение - загнать харнесс в vitest контракт для тестовю

Вот прям на днях было что-то когда true/false не работало надо было по score оценивать. Но уже не помню 🙁

Ну и под пи есть 🙂
https://vitest-evals.sentry.dev/docs/harnesses/pi-ai/


import { expect } from "vitest";
import {
createJudge,
describeEval,
type JudgeContext,
} from "vitest-evals";
import { qaHarness } from "./qaHarness";

const CapitalJudge = createJudge(
"CapitalJudge",
async ({ output }: JudgeContext<string, string>) => ({
score: output.toLowerCase().includes("paris") ? 1 : 0,
}),
);

describeEval("capital questions", { harness: qaHarness }, (it) => {
it("knows the capital of France", async ({ run }) => {
const result = await run("What is the capital of France?");

expect(result.output).toContain("Paris");
await expect(result).toSatisfyJudge(CapitalJudge);
});
});
vitest-evals Pi Harness Adapt Pi agents and runtime-compatible entrypoints for eval runs.
  • 🔥 2
  • ❤ 1
Post #820 646
Кроме gemini 3.5 flash на IO выпустили antigravity 2.0 + antgravity CLI
https://antigravity.google/

В котором уже есть 3.5 Flash

Купил Pro подписку (за $0 первый месяц) - работает!
Post #814 665
https://clawpatch.ai

Команда OpenClaw потратили $1м в токенах за 30 дней.

Выкатили Clawpatch чтобы меньше тратить меньше на ревью, ибо я так понял с их темпом - ничего руками не ревьюится.

В пн попробую натравить на рабочий B2E проект, у нас там 10 лет питона + жс

Clawpatch — инструмент автоматического код-ревью, выходящий за рамки традиционных линтеров. Он разбивает репозиторий на семантические рабочие единицы, отправляет ограниченный контекст провайдеру на проверку и сохраняет находки для аудита и дальнейшей работы.

В отличие от сканеров на уровне файлов, clawpatch анализирует feature-записи: точки входа, связанные файлы, ближайшие тесты и границы доверия. Каждая находка содержит уровень серьёзности, уверенности, доказательную базу и рекомендацию.
Clawpatch Clawpatch — Automated Code Review That Lands Fixes Automated code review that lands fixes. Maps codebases into semantic features, reviews for bugs and quality, and records explicit fixes.
  • 🔥 5
  • ❤ 4
  • 👎 1
Post #813 555
Codex mobile из коробки выглядит идеально

Аккуратно, что надо скрыть - скрыто. Задачи показывает. Прям очень
  • 👍 4
  • 🔥 2
Post #812 589
надо бы сделать канеш
  • 🤣 33
  • 😁 4
  • ❤ 1
Post #811 537
Post #810 713
  • 😁 17
  • 🤣 3
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →