TGViewer
Циничный AI Циничный AI @cinicai · 234 subscribers
Post #181 341

Forwarded from Anton

Итак, плотно пощупал в связке DS 4.1 флеш оркестратор, воркер, эксплорер, GLM 5.3 Flash бриферы и оба верификатора(прямой и адверсальный). Выводы очевидны:
1) токенов DS генерит больше на ~20% на моих задачах, контекст пухнет быстрее, надо учитывать, в оркестраторе это прямо заметно. Порог в 34 диспатча воркеров как бы оркестрации держится для вменяемой работы, но на соплях уже.
2) В думлуп как предшественник пока ни разу не впал.
3) Опасался, что будет битва двух якодзун флешей на приемке результата(верификатор то вообще другой флеш, нет одинаковых слепых пятен), но на удивление все отлично, претензии всегда по существу, и более того-когда GLM 5.3 Flash был воркером реворков было больше! Что заставило поплотнее изучить вопрос-а с фига ли. Обнаружилось, что в матрице знаний по конкретно TS(а проект, на котором я гоняю сейчас флеши-пилен на TS) у DS 4.1 на тестах индекс выше, чем у GLM 5.3 Flash(проще говоря код на TS DS пишет лучше).
4) Опасался галлюцинаций, но явную поймал только одну при кодгене-с какого-то бодуна воркер на DS докинул функционал, который и нафиг не нужно было делать-и который прямой верификатор сходу забраковал как INVENTED. К слову-подобной херней, только я бы даже сказал в бОльшем объеме страдал и его предшественник. Понимаю, что разные архитектуры у DS 4.1 и 4.0-но повадки в некоторых моментах похожи. Для понимания глубины проступка-воркеру дается исчерпывающая карта сигнатур и поведения, что эти сигнатуры должны делать, но DS 4.1 непонятно откуда выколупал вообще левое поведение. Наверняка были и более мелкие, но это прямо заметный косячище.
5) DS 4.1 в ~1.9 раза дешевле на вызов чем GLM 5.3 Flash у Ollama Cloud в моем пайплайне(из-за стоимости работы с токенами в кеше как я понимаю). А это как бы все таки плюс весомый, хотя реальный выигрыш возможно меньше, т.к. DS на моих задачах чуть больше суетный, чем GLM 5.3 Flash(предшественник вообще электровеником носился зря, DS 4.1 более адресно работающий и создает меньше суеты).
6) Разное поведение в оркестрации у DS 4.1 c GLM 5.3 Flash. Последний более цепкий в доведении до результата оркестратором(опять таки в моем пайплайне), а вот DS 4.1 в одной из сессии буквально выдал-21 диспатчей воркеров, до порога 34 диспатча далеко, но я решил, что надо делать хандофф и продолжить в новой сессии, т.к. качество будет выше. Зайцевый флеш всегда копает от забора и до обеда, его скорее надо наоборот парковать вовремя, если контекст слишком толстый для оркестрации. Фактически DS проигнорировал правило моего пайплайна-что если не стоит явный флаг автономности пайплайна, то счетчик диспатчей носит статистический характер для сбора метрик, не более. Итог-прогон пайплайна раскорячился без моего управления и не был закончен, как я ожидал, желая увидеть по утру законченную задачу.
И подытожу-флеши теперь будут трудиться бок о бок, экперимент мне понравился и фактически тройной бонус-токеномика, отсутствие одинаковых слепых пятен у моделей на разных ролях, и меньше реворков. Минус-своеобразие DS 4.1 в оркестрации, возможно верну обратно GLM 5.3 Flash, но пока еще посмотрю, как дальше прогоны пайплайна идти будут.
  • 🔥 11
More from @cinicai
  1. Sep 25, 2026😴 Подписок Claude и Codex комбинирования пост: 1. Планирование. 1.1. Основной агент Opus…
  2. Sep 25, 2026😎 Скайнета приближения пост Не думал, что Skynet окажется настолько точным попаданием не…
  3. Sep 24, 2026photo post
  4. Sep 24, 2026🚬 Мини-эвала Opus 5 vs 5.5 и Sol 5.6 vs 6 пост Пока был занят адским трудом вышли новые O…
  5. Sep 20, 2026Сделал EPUB-версию под Kindle, чтобы увеличить шансы добраться почитать вникнуть
  6. Sep 16, 2026DS 4.1 Flash из параллельной оркестрации множеством параллельных циклов агентов убран(несм…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →