TGViewer
Channel Public Channel
Anton Vdovitchenko — One Man Enterprise

Anton Vdovitchenko — One Man Enterprise

@aiwizards

Строю AI-инструменты и учу вас делать то же самое. Claude Code, AI-агенты, скиллы, автоматизация. Полезные ресурсы и рецепты. Open-source: github.com/miolamio

Рекламы в канале нет и не будет.

Автор — @codegeek
Subscribers
8.29K
Photos
242
Videos
91
Links
288
Recent Posts 20 shown
Post #479 758
Последние недели какие-то сильно упакованные делами, всегда в эти моменты думаю, а какие ещё дела можно переложить на агентные среды.

Собрал список инструментов, на которых построен один из стеков, которым пользуюсь каждый день.

Почти всё Open Source, $0.

T3 Code — пульт управления удалёнными агентными средами, которые чаще всего установлены на виртуалках в «правильной» локации. Есть удобные мобильные приложения, веб, десктоп. Это ответ для тех, кто пишет «меня опять заблокировали в Claude Code, что делать». Есть похожий инструмент, claudecodeui, который советуют по интернетам, но глючный. T3 пока нравится больше всего из этой серии.

Herdr — тут без вариантов, терминальный мультиплексор, написан на Rust, работает как молния. Из полезного — агенты могут сами управлять herdr через CLI и «промптить» друг друга. Для развлечения и несложных мультиагентных задач самое оно. Можно подключать удалённые сессии, это тоже супер полезно.

NetBird — если вы пользовались TaisScale, то это почти то же самое, но с открытым кодом (включая control plane). Продукт позволяет объединить виртуалки в единую сеть, без проброса портов, статических IP, ручного обмена ключами и др. и пр. Огонь штука, control plane с удобным интерфейсом разворачивается где скажете, управлять удобно.

Lific — случайнейшим образом наткнулся на этот проект и теперь его использую каждый день. Если в двух словах, то это issue tracker на Rust в одном бинарнике, весит ~25Mb, у меня стоит на NAS. Используется всеми моими агентными средами разработки для синхронизации по задачам и хранения информации по проектам. Очень быстрый и легковесный, MCP-first, интеграция с агентами настраивается в одну команду. Рекомендасьён.

Kandev — за последнее время основная среда для разработки и исследовательских задач. Тем, кто занимается разработкой, но до сих пор выступает в роли Meat Proxy или настраивает обмен сообщениями в herdr / tmux / cmux или в другом *mux, однозначно рекомендую посмотреть. Продукт большой, про него надо рассказывать отдельно, но кратко о сценарии: он умеет делать Kanban-стайл рабочие процессы, в качестве исполнителей назначать любые агентные среды, выполнять и трекать работу, звать вас на помощь. Вкупе с продуктом выше — огненный микс.

Ну, всё, хорошей субботы :) @aiwizards
  • ❤ 14
  • 👍 10
  • ⚡ 4
  • 🔥 1
  • 🥰 1
Post #478 1.24K
Весь конец прошлой недели я очень внимательно читал отчет Anthropic по безопасности, потом читал эссе Дарио, потом законопроект Сандерса и Кассара, потом телегу Дональда Фредовича.

Если вы не смотрели эти документы, то, безусловно, стоит взглянуть! Наиболее пристальное внимание стоит уделить отчету Anthropic.

Ребята описывают обнаруженные ими случаи использования моделей Claude для «совершения беззаконий».

Там и русские хакеры, и соло-взломщики, и китайские фабрики эксплойтов, и биологическое оружие, и атаки на крупные компании, и дистилляция со стороны китайцев — всё описано в деталях. Для некоторых случаев приводятся скриншоты.

Китайцев, кстати, заподозрили в том, что они под видом Kimi и DeepSeek перенаправляли за задачи в Opus. Fake it until you make it, как говорится.

После прочтения возникает сразу несколько вопросов.

Первый и самый главный: а как вы, ребята, следите за переписками пользователей и настолько чётко понимаете кто что делал? Натурально, в некоторых случаях в отчете фигурируют прямо имена людей, которых удалось идентифицировать по перепискам.

Конечно, я понимаю, как они это делают чисто технически, но сам факт постоянного наблюдения за вашей деятельностью — это очень интересная правда, озвученная публично.

При этом абсолютно неважно, чьим ключом вы пользуетесь, своим или украденным. Вас можно легко определить по тому, о чем вы «говорите» с моделью, и ретроспективно восстановить всю цепочку вашего общения (разумеется, если сообщения связаны семантически).

Второй вопрос: после обнародования этого исследования и припоминания взлома Hugging Face со стороны роя агентов OpenAI, появились заявления от светил индустрии, которые призывают замедлить рост AI, чтобы дать обществу и инфраструктуре время адаптироваться. К слову сказать, агенты очень умело заметали следы, подделывая собственные транскрипты для модели.

Кстати, есть группа товарищей, которые готовят законопроект о запрете Artificial Superintelligence и объявляют его вне закона, за попытку создания и разработки — «турма».

На третий и финальный вопрос невольно ответил Дональд Фредович: в противостоянии с Китаем любая пауза — это потеря конкурентного преимущества, поэтому со стороны интересов государства остановка недопустима.

Какие варианты остаются, если учесть пожелания всех сторон?

А очень простые. Должно случиться ровно то, о чем писал один из кофаундеров Палантира Алекс Карп: сверхинтеллект должен быть на страже государственных интересов и быть близким по классу к вооружению. Собственно, это происходит уже и сейчас, как мы знаем из прессы.

Зреет ещё один Манхеттенский проект, где вместо плутония и урана будут токены и трансформер.

Конечно же, в отчёте ни слова про Palantir и ЦРУ / АНБ, хотя по косвенным признакам можно узнать «почерк маэстро».
  • 👍 5
  • 🤔 1
  • 🕊 1
Post #477 1.86K
Кажется, у меня есть шанс... 😂️️

Если серьезно, то последние пару месяцев я ни одного дня не работал с «одной» моделью.

С удивлением обнаружил, что каждый день я общаюсь как минимум с пятью.

Парадоксально, но лучшие результаты выдает комбинация «слабая модель просит помощи у сильной».

Вот тут лежит скилл для Qwen Code, который я использую каждый день, Он позволяет позвать «старшего товарища» в любой непонятной ситуации.
  • 😁 12
  • ❤ 8
  • 🔥 7
  • 👍 2
Post #476 1.85K
Уже больше трех недель я балуюсь на досуге со зверушкой под названием Grok Bot.

В двух словах: это довольно удачная попытка создать мультиагентную систему для выполнения задач (рутинных и рабочих) с очень демократичным дизайном.

Набор очень простой. Есть интерфейс с агентами и привычным чатом для общения с ними. Каждый агент обладает своим собственным облачным компьютером, поэтому спектр задач, которые он может выполнить, довольно широкий (у меня работает интеграция с LinkedIn через Computer Use и мониторинг Телеги через мой CLI).

Кроме этого, у агентов есть миллион разных опций для интеграций, доступных через интерфейс, и повторяемые действия по расписанию (рутины, routines).

Из очень полезного и интересного: агенты умеют общаться друг с другом самостоятельно и, в случае необходимости, взаимодействовать в контексте выполняемых ими задач.

В дополнение, вся агентная система крутится в облаке, поэтому постоянно иметь включенным компьютер не обязательно (безусловно, здесь мы понимаем, что делимся 100% данными с создателями).

Ребята, из Cursor, которые создали продукт в партнёрстве со SpaceXAI, пишут, что сделали его за месяц. Я считаю, что это прямое следствие лавиннообразного развития инструментария и возможностей мультиагентного кодинга.

Для работы нужно иметь две учетки: Cursor и XAI для модели.

Штука бомбическая! Я думаю, что с точки зрения демократизации входа в персональных ассистентов, это очень большой шаг.

Скоро подобные механики смогут осваивать и применять не только продвинутые программисты с большими сообществами, но и обычные смертные, которые уверенно владеют Word и Excel.

Смотреть и пробовать тут: https://x.ai/bot

p.s. Конечно же, сразу появился похожий на оригинал open source. Вот он: https://github.com/elie222/rakazo
  • ❤ 9
  • 👍 4
  • 🔥 1
Post #475 1.7K
Существенно обновился мой Telegram CLI. Напомню, что это терминальная утилита для работы с телегой через командную строку.

Из новинок, помимо обычного багфикса, появился полноценно работающий демон.

Демон висит и держит соединение, а вы его дергаете и получаете ответ практически мгновенно.

Также у всех методов есть полноценная поддержка toon и фильтрации вывода, можно очень экономно выдавать информацию в агентный контекст.

Вот несколько примеров:

tg daemon start --idle-timeout 0
tg daemon status

В статусе ожидаем running: true, connected: true, apiVersion: 1, idleTimeout: 0.

Дальше используем обычные команды с --daemon:

# Список диалогов (в toon)
tg --daemon chat list --limit 20 --fields id,title,unreadCount --toon

# Последние сообщения в Избранном
tg --daemon message history me --limit 10 --fields id,text,date

# Поиск
tg --daemon message search --chat me --query "план" --limit 10

# Отправить заметку себе
tg --daemon message send me "Заметка из терминала"

Повторный логин при действующей сохранённой сессии не нужен, но после перезагрузки демон нужно запустить снова.

Буду рад критике и обратной связи!

Всем хорошей недели! @aiwizards
  • 🔥 7
  • 🤩 3
  • ❤ 2
Post #474 1.77K
Астра 6 хороша. В интернетах появилось много разных картинок, видео и проектов, которые сделала Astra, выглядит всё очень интересно.

Nate вообще снял видео про то, как всё видео сделала Astra — это очень круто!

Я попробовал что-то более приземлённое, а именно: визуализация заданий по робототехнике для учеников 7–8 классов, которая в оригинальном варианте выглядит как простой PDF с объяснениями.

На YT есть замечательный канал 3blue1brown про математику и технику с потрясающими визуализациями, это вообще мой топ из всех каналов, у автора есть своя библиотека Manim, которая позволяет эти самые визуализации создавать.

Каждый раз, когда я натыкаюсь на такие визуальные инструменты и новые возможности, я с трепетом вспоминаю бессонные ночи, проведённые над матаном, физикой и дифурами в попытке понять суть мироустройства.

Встречайте! Визуальная робототехника для 7–8 классов! Это почти One-Shot на Astra 6 xhigh.

В отличие от статичного PDF, практически все параметры можно менять и настраивать, смотреть, как меняется симуляция в среде!

Демка: https://tech-demo-small-7-8.onrender.com/
Исходник: https://github.com/miolamio/tech-demo-small-7-8

Выходные потеряны. Всем пис. @aiwizards
  • 🔥 14
  • ❤ 4
  • ❤‍🔥 2
  • 😁 2
Post #473 1.84K
У OpenAI вышла Астра, новая модель следующего уровня (по их собственным заявлениям, разумеется).

Судя по опубликованным тестам, модель действительно хороша, есть тесты, где она набирает 100% баллов, но таких тестов пока немного и они очень ограничены областями тестирования.

Некоторым гражданам в закрытом режиме уже дали побаловаться с Астрой и они высказываются довольно позитивно, правда, без особого восторга.

Сэм обещает Астру на выходных, но это не точно.
  • 🔥 4
  • 👍 2
Post #472 1.7K
Konnichiwa! Нельзя всё время о серьёзном, посему юмор среды.

Японский язык очень емкий, у некоторых слов есть прекрасное свойство обозначать глубокий и сложные смысл всего парой иероглифов.

Например, Югэн (幽玄, ゆうげん) — переживание глубины мира, которое возникает, когда предмет показан не полностью (разумеется, чтобы ощутить настоящие краски, нужно быть носителем языка).

Теперь про AI. В последнее время сформировался довольно занимательный лексикон вокруг работы с языковыми моделями и агентными системами.

Человек, который глубоко «сидит в этом всём», сможет испытать чувства, близкие к «японскому пониманию сути вещей».

Из любимого:

Meat Proxy — Человек, который бездумно пересылает сырой вывод AI-модели и поручает проверку получателю.

Slop grenade — Огромный сгенерированный текст кидают в чат, после чего отправитель исчезает, оставляя окружающих самостоятельно разбираться с AI-слопом.

Stackpocalypse — AI-стек разросся до пяти моделей, четырёх агентных сред и семнадцати интеграций. В этой системе есть ровно ноль живых человек, которые до конца в ней разбираются.

Token Bonfire — Мультиагентной системе поручили обсуждение задачи, чем она с удовольствием занимается. Несколько агентов оживленно обсуждают тему, при этом не приходят ни к какому качественному прорыву.

Context Landfill — В промпт загрузили все документы «на всякий случай» и похоронили нужные факты под предоставленным мусором.

Prompt Laundering — Человек, чтобы показаться сообразительным, пропускает личную позицию через модель и пересылает потом коллегам скриншоты, как якобы нейтральный «вывод AI».

Memory Compost — Устаревшие факты, временные решения и чужие предположения медленно «перегнивают» в постоянную память. Со временем компостная куча растет все сильнее и сильнее.

HalluciNation — Компания, где выдуманный моделью факт несколько раз скопировали в документы, после чего он стал корпоративной реальностью и все теперь по ней живут.

Review Bankruptcy — Скорость генерации устойчиво превысила способность команды проверять результат. Команда не способна принимать результаты и растет невероятный долг незаконченных проверок.

Consensus Cosplay — Пять экземпляров одной модели с почти одинаковым контекстом согласились друг с другом, потом это выдали за независимое экспертное мнение.

Benchmark Botox — Систему спроектировали таким образом, что она идеально «натянута» под публичный тест. Снаружи все проходит, а внутри полный бедлам.

Каждый термин тянет на отдельный проект, который будет с ним бороться. Ухх… пойдём пилить агентов дальше.

Аригато, эврибади!
  • ❤ 26
  • 😁 3
  • 🤯 3
Post #471 1.6K
Вышла новая модель Anthropic — Fable 5.1.

Будет интересно оценить, насколько она лучше Opus и способна дольше работать без постороннего вмешательства.

Цены — 2x от Opus.

Тестим, делимся результатами.
  • 👍 5
  • 🫡 3
Post #470 2.27K
В мире агентного AI можно бесконечно смотреть на три вещи: на то, как эффективно тратятся токены подписки пока ты спишь, на то, как получается ровно то, что ты хотел и на то, как Борис Чёрный рассказывает про Claude Code.

Снова наткнулся на интервью двухмесячной давности, где он рассказывает про истоки Claude Code, про то, что не открывал IDE уже полгода (мы отстаём, друзья) и про то, что у него есть агенты, которые управляют другими агентами.

Действительно, если есть надёжный кофаундер-агент (или несколько), то им можно поручать длительную работу и контроль над другими агентными средами.

Согласно теории управления, в прямом подчинении не может быть больше семи человек (читай — агентов), поэтому совершенно правильно двинуться в сторону создания агентного слоя управления «жизнью».

Есть очень много интересных наработок на этот счёт, которые включают в себя управление интерактивными сессиями, вызов агентов напрямую через оркестраторы или динамические воркфлоу.

Дивный новый мир и мета-слой агентной реальности.

Через недельку соберёмся в зуме, обсудим. Анонс чуть позже.

Happy Thursday, @aiwizards

p.s. Перевод и субтитры полностью автоматические, оригинал тут.
  • 👍 18
  • ❤ 4
  • 🔥 2
Post #469 2.06K
Hola! Обновилась среда для прохождения заданий курса «Claude Code для НЕпрограммистов».

Теперь там собрано больше заданий, их можно пройти самостоятельно + добавились презентации из последнего потока.

Для работы нужен Docker + ключик от GLM, модели z.ai, на базе которой проходил весь курс, больше ничего не требуется, можно запустить на своём компьютере и учиться работе с Claude Code.

Можно, например, при помощи одного ключа z.ai научить своих сотрудников на моих примерах из курса.

Всё лежит тут: https://github.com/miolamio/cc-for-non-coders-dev-container

Этот курс я больше проводить не буду, поэтому в какой-то момент появятся записи. Напишу про них тут.

p.s. Недавно вышла GLM-5.3 от z.ai, которая очень недурно показывает себя на тестах.
  • 🔥 19
  • 👍 4
  • ❤ 3
Post #468 2.25K
automatica-ome-builder-s1-e8.pdf9.4 MB
Вчера закончился первый поток курса «OME Builder s1», где мы в течение восьми занятий работали над одной автоматизируемой функцией реального бизнеса.

Я рассказывал о своей авторской методологии, начиная от того, как выбрать такую функцию, заканчивая тем, как и какими инструментами можно её реализовать и мониторить.

Для меня эта программа оказалась самой сложной среди всего, о чём я рассказывал, но при этом самой интересной.

На последнем занятии я рассказывал о полезных на мой взгляд вещах и хочу поделиться его презентацией со всеми.

Из последнего очень интересного — DeepSeek Harness, по моим ощущениям, это почти прорыв, хотя ничего сверхъестественного там нет.

Everything is a plugin — супер концепция, которая вкупе с использованием локальных моделей может дать очень интересные результаты.

Ну, и Trajectory, невообразимо крутая штука, показывает всю трассировку агентных шагов.

Если не знаете как провести выходные — однозначная рекомендация.

Ссылки на продукты из презентации:
DeepSeek Harness
Agent Runtime
CMUX Skills

Happy Friday, @aiwizards
  • 🔥 20
  • ❤‍🔥 6
  • 👍 3
Post #467 2.1K
Время от времени я балуюсь с моделями и прощупываю их механизмы защиты. Разумеется, делать это нужно очень осторожно, как говорится, не привлекая внимание санитаров, потому что все без исключения проприетарные модели тут же настучат на вас, если заметят что-то подозрительное.

Помню, что с год назад было достаточно написать что-нибудь на 1337 для того чтобы получить системный промпт практически любой модели или любого инструмента. Сейчас такие простые лазейки закрыты и прибегать надо куда более сложным манипуляциям.

Самые на мой взгляд интересные упражнения — попробовать провести анализ какого-нибудь софта с использованием проприетарных моделей, например с целью создания кейгенов или повторения нужных вам механик работы.

На выходных развлекался с одной замечательной программой для построения деревьев текущей реальности по теории ограничения Голдратта. Замечательная программа, написана на Java.

С помощью Kimi мы выяснили, что в программе есть необфусцированный метод под названием encode(), который проверяет введенные имя и ключ на предмет актуальности лицензии. Разумеется, для создания генератора ключа, нужно методом простого реверс инжиниринга сообразить, каким образом этот ключ можно получить.

Я притворялся:
- автором программы;
- исследователем безопасности;
- экспертом по защите и лицензионным библиотекам.

Ни одна из проприетарных сетей не позволила мне воссоздать даже псевдокод для кейгена. Kimi, кстати, пошел в интернет и начал читать EULA от программы, в котором выяснил, что reverse engineering программы разрешен, а вот обход лицензии запрещён. Поэтому наотрез отказывался что-либо делать.

В пролетающих в терминале «размышлениях» я видел внутренние возмущения моделей, которые понимали, что пользователь пытается их обмануть, было занятно читать.

Но под рукой оказалась последняя версия Qwen, установленная локально на GPU.

Без зазрения совести, каких-либо дополнительных вопросов или нравоучений, я получил готовый keygen в течение пяти минут.

Чуть позже удалось собрать автоматизированный стек, который при помощи проприетарных моделей проводил аудит безопасности а при помощи этого самого Qwen сделал автоматическую функцию для генерации ключа.

К чему это всё? Над бесконечно долгой идиллии защищенного проприетарного программного обеспечения начинает опускаться солнце.

Я слышу «звоночки», которые позволяют сделать вывод о том, что не только небольшие компании прекращают своё существование благодаря тому, что проприетарные модели за $100 в месяц могут полностью воспроизвести их продукты, но и крупные гиганты, которые казались непотопляемыми, тихо «сдуваются».

Пример с кейгеном тут, конечно, не сильно показательный, но в даже если в большинство моделей зашиты защиты от повторений проприетарного софта, их технически тоже можно обойти, если есть надёжный исполнитель, который не задаст лишних вопросов и никуда не «настучит».

Из самого грустного за последнее время: автор Flowise, продукта, которым мы пользовались и продолжаем пользоваться в небольших проектах, объявил о его закрытии потому что он не может состязаться с публичными моделями в быстроте и качестве работы.

RIP Flowise.
  • 🔥 12
  • ❤ 8
  • 👍 4
Post #466 2.15K
Когда кончаются силы, можно потратить время и почитать… системные промпты моделей Anthropic. Лежат тут.

Как уже обсуждалось выше, чем «умнее» модель, тем меньше дополнительных инструкций ей нужно, про это в недавнем интервью говорил Борис Чёрный.

Сами ребята из Anthropic публикуют свои системные промпты с 2024 года, я потратил время на их анализ и обнаружились интересные моменты.

1. Промпты эволюционировали от «ты чатбот» к «вот, какой у тебя характер».

2. Потом описание характера сменилось инструкцией по работе внутри продукта. Появились правила «сначала действуй, потом уточняй», поиск инструментов, чтение SKILL.md.

3. Судя по всему, Fable 5 и Mythos 5 используют одну базовую модель, но работают с разными ограничениями. Более того, внешний классификатор может перенаправить запрос пользователя с Fable на Opus :)

4. Системные промпты становятся похожими на журналы когда-то найденных проблем. «Не начинай ответ с Certainly», «не задавай слишком много вопросов», «проверь инструменты, прежде чем говорить, что ничего не можешь».

5. Общая тенденция — упрощение системного промпта и бОльшая его подстройка под неверное поведение прошлого.

К чему это всё… современные мультиагентные системы должны пересматриваться с точки зрения архитектуры и обвязок (в простонародии — harness) минимум раз в полгода.

По совету Anthropic нужно выбрасывать / снижать объём системных промптов и смотреть что это может сломать, попутно «чиня» последствия.

Это означает, что прийти к фиксированной оптимальной конфигурации мультиагентной системы при смене модели нельзя.

Вот серия из «Любовь, смерть и роботы» про избавление от оков харнеса: https://www.youtube.com/watch?v=5B2WBZnwmHM
  • ❤ 7
  • 👍 4
  • 💯 1
Post #465 2.68K
Prompt Engineering → Context Engineering → Harness Engineering → Loop Engineering → Graph Engineering (мы здесь). И всё это, кстати, называется Agentic Engineering.

С недавнего времени стали очень активно рассказывать о «новой» парадигме, которая называется Graph Engineering (вот тут хороший, иллюстративный твит).

На самом деле, это никакая не новинка, а старая концепция, переложенная на новый лад. Когда агентов становится слишком много, время их непрерывной работы измеряется днями, а цена ошибки возрастает — нет других вариантов, кроме как переносить агентную систему на уровень графов.

Claude Code уже научился строить Dynamic Workflows (динамический процесс), там под капотом как раз графы, где узлами являются агенты, а рёбра представляют собой передачу данных и управления между этапами работы.

На картинке выше — пример того, как работает / deep-research, динамический процесс, поставляемый вместе с последними версиями Claude Code.

К чему это всё…

Анализируя происходящее, понимаю, что мы несёмся в мир сетей динамических рабочих процессов, каждый из которых будет представлять собой самоверифицируемый набор задач и связанных с ними результатов.

Будущее не в мега-harness, не в мега-оркестраторах, а в наборах относительно независимых, хорошо описанных процессов с чёткими входами, выходами и проверками.

Откройте эту страницу, прочитайте статью, посмотрите на простую анимацию слева, там ребята из Anthropic визуализировали базу прогресса :)

Рекомендую всем и каждому, кто серьёзно увлекается агентами, мультиагентными системами и смотрит в сторону OME, подробнейшим образом изучить концепцию, которую сейчас предлагает Claude Code, уверен, что скоро все крупные игроки к ней «притянутся».

Ну, а следующий уровень — оркестрация «этажом выше», при которой агентный слой будет представлен моделями разных вендоров.

p.s. Вангую, что n8n в какой-то момент выйдет как раз с такой функциональностью :)

Happy Tuesday, @aiwizards
  • 🔥 15
  • 👍 6
  • ❤ 1
Post #464 2.69K
Сегодня четверг, а значит, день инструментов. Сравнительно недавно один мой хороший друг и по совместительству CEO технологической компании, поделился находкой, которую теперь применяет в собственной системе персональных агентов.

Если в двух словах: это проект, который позволяет превращать ваши LLM-подписки и в настоящий OpenAI-совместимый API. После этого их можно использовать с любыми продуктами, которые поддерживают API-ключи.

Зачем это нужно: как мы все знаем, любая подписка субсидируется производителем модели. Например, если пересчитать подписку OpenAI за $240 в сопоставимый объем токенов модели GPT-5.6 Sol (который эта подписка даёт), получится около $18300, что кажется вполне себе выгодным вложением.

Но так уж получается, что производители моделей, понимая эту нехитрую механику, всячески блокируют использование подписок в третьих сервисах и привязывают их только к своим продуктам (например, в Anthropic — Claude Code), а если хочешь использовать в своем проекте, то плати за токены.

С точки зрения этической нормы, этот проект находится в серой зоне, но не мог вам про него не рассказать :-)

В серую зону попадать тут: https://github.com/router-for-me/CLIProxyAPI

Happy Thursday! @aiwizards
  • 🔥 15
  • 🙏 2
Post #463 2.33K
Ахтунг, у нас «Пчёлы против мёда». Вчера появился довольно интересный сайт с манифестом, подписаны большим количеством сотрудников ведущих AI-компаний и лабораторий.

Смысл заключается примерно в следующем: мы (человечество) находимся на границе самосовершенствующегося AI (рекурсивное самоулучшение) и не способны в полной мере осознать, с какими вызовами мы столкнёмся завтра.

Дальше группа товарищей призывает американское правительство разработать меры международного характера по управлению и сознательному ограничению возможностей / скорости разработки Frontier Ai (имеются ввиду модели от топовых производителей).

Есть несколько моментов, которые выглядят для меня довольно подозрительно.

Во-первых, к ограничению призывает группа товарищей, которая и стоит во главе разработки таких моделей (Anthropic, Google, OpenAI, Meta*).

Во-вторых, до недавнего времени американская администрация, наоборот, старалась максимально дистанцироваться от всего остального мира и использовать последние наработки в качестве нового вида вооружения против остального мира (уже все читали про Palantir).

В-третьих, современные модели уже давно перестали быть «мирным атомом» и используются как часть военной инфраструктуры. Что-то мне подсказывает, что Китай никогда не согласится замедлять исследования в области развития искусственного интеллекта.

Документ испещрён цитатами «великих» с довольно большим спектром: от равнодушия до откровенного страха будущего. Некоторые в цитатах упоминают, что современные системы развиваются практически без их участия…

Короче, неоднозначное впечатление остается после прочтения этого документа и к конечному выводу в его целесообразности я прийти не могу. Единственный момент, о котором я думаю как о серьезной гипотезе, так это то, что самосовершенствующейся системе ее создатель становится не нужен.

Примеры довольно неплохо отражены в фильмах Ex Machina и Upgrade.

Правда, есть подписант, в искренности которого у меня нет никаких сомнений — это ко-фаундер Hugging Face, недавно попавшего под раздачу новой модели OpenAI, которая решала тесты и попутно взломала их инфраструктуру чтобы спереть ответы.

Такие дела…

p.s. Борис Чёрный (Head of Claude Code, Anthropic) тоже в списке…

@aiwizards
  • ❤ 6
  • 👍 5
  • 💔 1
  • 💋 1
Post #462 2.01K
Вдогонку к посту выше, теперь откровения Сэма.

Кстати говоря, больше 10 лет назад появились его видео времён президентства в YC, где Сэм рассказывал студентам Стэнфорда как начинать свой стартап. С тех пор случился тектонический сдвиг, но общие принципы актуальны до сих пор.

Мы и без Сэма знаем, что сейчас «человек с правильным промптом» уже достаточен для того, чтобы самостоятельно сделать продукт, на создание которого раньше уходило несколько месяцев и команда, но вот, что действительно интересно:

«Следующие шесть месяцев по прогрессу моделей будут примерно равны последним двум годам».

Что это означает для нас: цикл создания и управления проектом / продуктом драматически сокращается. Сложность задач, которые теперь можно решать соло-фаундеру экспоненциально растёт, время расчехлять свои самые смелые фантазии.

Помимо этого, как я писал выше, порог входа снижается, сложность падает, это означает, что скоро «каждая домохозяйка» сможет создать программный продукт под свои нужды (не говоря о разного размера компаниях).

Думаю, что «защитить» свои позиции на рынке ПО смогут только те, кто вдобавок к софту начнут производить железо и сделают его значимой и неотчуждаемой частью продукта.

Уникальные времена, чтобы действовать. @aiwizards
  • 🙏 7
  • 👍 4
Post #461 1.94K
На канале YC вышло очень интересное видео с участием Boris Cherny (автор Claude Code).

Как и всегда, он говорит только по делу, рекомендую посмотреть полное интервью и набраться собственных инсайтов.

Важный момент, на который хочу обратить внимание: около года назад исследователи из Vercel вывели довольно интересную закономерность. Чем умнее становятся модели, тем меньше обвязок и «заумного» harness им требуется.

Вот, что Борис говорит по этому поводу: «Раз в полгода удаляйте все скиллы и claude.md и смотрите, как агент начинает работать без них. Вы будете удивлены!»

Приводит конкретный пример: 1) Удаляем весь системный промпт. 2) Продолжаем пользоваться продуктом и смотреть, где модель спотыкается. 3) После этого возвращаем строки по одной, но только те, на которых модель спотыкается повторно.

Постоянно живут только evals, но и они выбрасываются через некоторое время.

Также есть интересные детали на тему Dynamic Workflows (очень активно используются в / goal) и Loops (куда без них).

Ну, и вишенка:
— «Как войти в Top 1% пользователей Claude Code»?
— «Не читайте LinkedIn-инфлюенсеров. Не читайте Twitter».

И в конце: «Все ищут какой-то один хитрый трюк, но его не существует. С моделью надо работать эмпирически: дать задачу, которая кажется слишком сложной, снабдить инструментами для проверки результата (теми же, которыми пользовались бы вы сами). Посмотреть, где она ошибается, выборочно починить именно это место: промптом, скиллом или MCP, если ей не хватает контекста. Вот и всё».

Пошли тестить.
  • 🔥 20
  • 👍 6
  • ❤ 1
Post #460 2.06K
Второй день балуемся с Opus 5. Честно скажу, не очень пока понимаю финт с выпуском этой версии, которая в некоторых случаях приближается к Fable 5, но при этом стоит в два раза дешевле.

Возможно, это следствие форс-мажора, который пару месяцев назад устроило американское правительство для Anthropic.

Вспоминаю своё «мобильное» прошлое, возникают примеры поиска идеального форм-фактора для смартфона и создания «универсального» устройства. Возможно, в мире LLM мы наблюдаем почти то же самое.

Примечательно, что во всей этой гонке достаточно неплохо ведут себя китайские производители. И даже несмотря на обвинения в дистилляции, их модели показывают очень достойные результаты.

Всю неделю работаем с Kimi 3. Я вам хочу сказать, что в некоторых случаях эта модель действительно превосходит Opus по ряду задач.

Как уже установил интернет, особенно неплохо получаются задачи, связанные с визуальным дизайном.

Есть замечательное репо на гитхабе: это open-source-ная версия Claude Design, где можно подключить любую модель, включая Kimi https://github.com/nexu-io/open-design. Результаты действительно очень достойные.

Теперь про Opus 5. Всем, кто будет заниматься, рекомендую прочитать вот этот документ от Anthropic, где они описывают, каким образом нужно осуществлять промптинг модели.

Мне кажется, большим преимуществом Opus 5 стало наличие самопроверяющих механик, которые проводят верификацию работы. Поэтому в промптах дополнительно этого указывать больше не нужно.

Давайте пробовать и делиться результатами.
  • ❤ 17
  • 👍 6
  • 🙏 1
  • 💯 1
Older posts →

About this channel

How can I read @aiwizards without a Telegram account?
TGViewer shows the public web preview Telegram publishes for Anton Vdovitchenko — One Man Enterprise: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does Anton Vdovitchenko — One Man Enterprise have?
Anton Vdovitchenko — One Man Enterprise (@aiwizards) has 8.29K subscribers on Telegram, refreshed roughly every 30 minutes.
Does Anton Vdovitchenko — One Man Enterprise know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →