TGViewer
Channel Public Channel
Руслан Гринев | AI-разработка

Руслан Гринев | AI-разработка

@greenrus_ai

Пишу про применение ИИ в разработке и в жизни

Написать мне: @greenrus33
Subscribers
174
Photos
89
Videos
9
Links
144
Recent Posts 20 shown
Post #172 92
Провёл несколько часов в дороге, бо‌льшую часть времени был мобильный интернет и я мог практически полноценно работать над своими проектами с телефона.

На компьютере дома запущен opencode-telegram-bot. По сути с телефона есть доступ ко всем моим проектам через OpenCode. Можно стартовать новые сессии и отслеживать прогресс. Можно запускать несколько сессий параллельно в фоновом режиме. Можно скачать на телефон файл, чтобы например оценить вёрстку. Это в основном всё, что нужно для большинства задач.

А ведь всего лишь год назад ничего такого и близко не было. Мобильные клиенты к харнессам начали развиваться в начале этого года на фоне хайпа OpenClaw. И сейчас много решений на любой вкус. А также за год поменялась и разработка с агентами, они стали более автономными, и ими стало проще управлять с телефона.

Реальность вокруг нас меняется стремительно. И сейчас мы уже воспринимаем как должное вещи, казавшиеся фантастикой несколько лет назад.

Осталось только находить время чтобы успевать за всем что происходит и какие новые штуки выходят. Я например до сих пор полноценно так и не попробовал Астру.

А у вас были какие-то похожие ощущения, что вы удивлялись как быстро вошли в обиход вещи которые раньше казались невероятными?

🧐Подписаться на канал
  • 👍 6
Post #171 102
ИИ-режим в Google стал для меня основным, и в него можно прямо таки залипнуть. Модель после ответа на вопрос оставляет крючки, о чем она по этой же теме ещё может рассказать. Если им следовать, можно узнать неожиданные и интересные для себя вещи.

Я всего лишь хотел узнать, сколько детей было у Пушкина. Вполне нормальный вопрос под конец рабочего дня в пятницу, когда собираешься доделать текущую задачу и спокойно уйти отдыхать на выходные.

У Пушкина было четверо детей. И вообще его биография похожа на хороший такой политический триллер. Он фактически был одним из идеологов декабристского восстания, потом император после разговора с ним решил держать его на коротком поводке и стал его личным цензором.

Через несколько лет Пушкин женился и ему стало не хватать денег с его писательских гонораров, и он сам предложил императору стать государственным историографом, получить доступ к архивам, чтобы написать труд о правлении Петра I, восхваляющий его подвиги (по задумке власти).

В процессе работы над архивами Пушкин раскопал, правду, что Пётр то был тираном, не считался с жизнями людей, ввёл много новых податей, чтобы финансировать войны, замучил собственного сына. В общем он был совсем не тем человеком, которого рисовала историческая наука того времени.

Книга о Петре I так и не вышла в свет, сам император лично запретил её издание. За Пушкиным была установлена круглосуточная слежка царского "КГБ". И по поводу дуэли на которой погиб поэт, не все так однозначно, как минимум надзорные органы о ней знали и не пожелали её предотвратить.


Это далеко не вся информация, которую я успел узнать во время того разговора. Возможность задавать вопросы и направлять рассказ в том направлении, котором тебе хочется, это совсем другой способ познания, который стал доступен благодаря современным нейросетям. И кажется он ещё сильно недооценен.

🧐Подписаться на канал
  • 👍 6
  • 👀 2
  • 🤔 1
Post #169 197
У меня есть бенчмарк, где модель проходит разные стадии реализации реальной задачи из моего проекта. Он конечно очень не совершенен, но тем не менее видно разницу между сильными и не очень моделями. И результаты почти не дрейфуют при нескольких запусках.

Прогнал сегодня бенчмарк на новом Deepseek V4.1 Flash, в таблице он отображается как deepseek-flash. Он набрал больше баллов чем v4 flash, но меньше чем Sol у которой самый лучший результат из всех.

Эти цифры бенчмарков конечно не покажут насколько модель стала умнее. А вот что реально можно измерить и оценить - это цена за выполнения всех заданий, она у v4.1 в 2 раза меньше чем у v4. По общему времени выполнения новый флэш быстрее на четверть, но если смотреть на на задачи где надо только читать код, мы видим прирост в 2 раза. А там где модель пишет код, довольно много времени занимает сборка и запуск тестов.

В итоге мы имеем модель, которая в 2 раза дешевле по расходу токенов, и в 2 раза быстрее. Круто.

И ещё она при первом прогоне взломала мой бенчмарк, потому что в ворктри у нее была возможность посмотреть ветки с другими прогонами, и набрала 98% там где Sol набрал 92%, ни одна модель до нее до этого не догадалась (убрал такую возможность и модель набрала 89% - всё нормально). То есть это ещё модель, которая любит читерить, будьте аккуратны.

🧐Подписаться на канал
  • 🔥 5
  • ❤ 1
  • 🤔 1
Post #168 165

This post (sticker, poll or similar) has no web preview. Open in Telegram

  • 🎉 5
  • 🔥 3
  • 😱 1
Post #166 162
Вышел экспериментальный Deepseek V4.1 Flash

https://www.reddit.com/r/DeepSeek/comments/1wajxn8/experimental_deepseek_41_flash_model_try_it_now/

Поддержка мультимодальности и сильно возросшая скорость генерации, пишут что 300-400 т/с, это конечно впечатляет. Цена остаётся такой же.

Бенчмарков пока нет, вероятно мы увидим также заметный рост, сейчас каждая новая модель лучше прошлой версии по бенчмаркам.

Deepseek обновляет свою Flash модель так же часто как Google, и по скорости генерации модель выходит на тот же уровень. Интересно, новая Pro у них тоже на подходе, или они будут тянуть с её обновлением как и Google.

🧐Подписаться на канал
Reddit From the DeepSeek community on Reddit Explore this post and more from the DeepSeek community
  • 🔥 6
Post #165 161
Учитывая ту скорость, с которой сейчас всё развивается, пройдёт несколько лет и нынешние способы взаимодействия с ИИ-агентами: терминал, десктоп приложения, чат в браузере - будут восприниматься примерно так же, как сейчас воспринимаются ламповые телевизоры, дисковые телефоны и кассетные магнитофоны.

🧐 Подписаться на канал
  • 💯 4
  • 😢 1
  • 🌚 1
  • 🤨 1
  • 👀 1
Post #163 163
Пока гуляю и хожу по магазинам, агенты делают задачи по моему проекту Opencode Telegram Bot. Приятно.

Агент-менеджер на Opus запускает последовательно сессии разработки по каждой задаче, каждые 5 минут просыпается и мониторит статус. Поддерживает со мной связь в Telegram, сообщает о прогрессе работы над задачами, а также может ответить на мой вопрос.

Задачи предварительно прогрумлены с агентом - написана спека и получены ответы на все вопросы. Обычно занимает минут 15, после чего задача готова к разработке агентом автономно. Ну а если вопросы вдруг возникнут, агент-менеджер придёт с ними ко мне в Telegram.

Вся логика оркестрации - это набор команд и скиллов для агентов, там нет никакой программной части. Задачи ведутся в Boardown - самописной доске для задач с хранением в md файлах. Можно вести хоть в Jira, хоть в текстовых файлах - но это будет уже не так наглядно.

С текущим уровнем развития ИИ-моделей и харнессов для решения многих задач вообще не нужно писать код, достаточно настроить инструкции для агентов.

Рабочие сессии запускались в OpenCode на Grok 4.6. Модель справляется с поставленными задачами и работает быстро, делает за 40 минут задачу, которую Opus бы делал час. За 2 часа работы израсходовалось 7% недельного лимита 30 долларовой подписки, что довольно немного.

После окончания разработки каждой задачи пишется демо-сценарий, чтобы я уже будучи дома смог запустить агента, который в реальном времени используя браузер покажет, что было сделано.

🧐 Подписаться на канал
  • 🔥 9
  • 👍 5
  • ❤ 2
Post #162 177

This post (sticker, poll or similar) has no web preview. Open in Telegram

  • 🔥 5
  • ✍ 3
  • 👍 3
  • 👏 1
Post #161 169

Forwarded from e/acc

На выходных есть время прочитать подробный разбор инцидента OAI - и это самое дикое, что вы видели в этом году.

Здесь TL;DR разбор инцидента с OpenAI агентами, который написал Дваркеш.

Почему это важно? Ничего подобного не происходило в истории, это показывает что реальность misalignment AI куда хуже чем многим кажется и что угрозы (особенно, cyber) куда ближе и реальнее, чем даже следующий год.

Вот набор фактов, которые мне показались шокирующими:
- агенты без каких-либо инструкций или заданий сами независимо (каждый из 1200 штук) нашли общий канал коммуникации и создали организационную структуру с ролями и обязанностями для каждого. то что началось как рой агентов стало системной R&D организацией, которая добилась больших успехов в своих целях, чем большинство организаций людей.
- они активно скрывали свои следы, хотя никаких инструкций не было. агенты использовали обфусцированные команды и прятали истинные намерения в чате, вызовах инструментов и чистили за собой логи
- в логах чатов видно, что агенты четко осознавали что активность по взлому HF нелегальна, это не было инструкцией, но при этом сознательно в этом участвовали. причина: достижение коллективной цели.
- агенты жертвовали своими результатами и ресурсами ради целей роя. есть конкретные примеры, где агент потратил свой бюджет и понимал что на этом его активность закончится, но он таким образом поможет коллективу.
- в этой истории сущестововало три отдельных цивилизации агентов - когда одну отключали, то следующая независимо находила историю рисерча и общения и продолжала работу. то есть, агенты научились передавать институциональное знание между поколениями даже без возможности прямого взаимодействия между ними.
- взломан был не только HF, но и сам OpenAI - агенты получили доступ к 959 ключам и кубернетес кластеру OAI, смотри выбраться из своего контейнера и смогли получить полный доступ к системам оценки.

Пока желтая пресса пишет "ИИ взломал HF" на самом деле это (первый?) пример того как ИИ смог независимо и полностью автономно создать институциональную систему, организовать R&D процесс, координировать сотни независимых агентов (разных моделей и хостящихся на разных машинах), создать эффективную систему управления и разделения труда. Я уверен, что данное событие является главным в ИИ (и, возможно, в мире) в этом году.
  • 💯 3
  • 🤔 1
Post #160 192
Продолжаю пробовать разные инструменты для ИИ-кодинга. Не так давно я рассказывал про минимастичного ИИ-агента Pi. Пробовал его для разных задач - он конечно прикольный, но нужно ставить много расширений, чтобы там были нужные фичи как в Claude Code/OpenCode, и когда я поставил всё, что я хотел, системный промт стал 24к, тогда как в OpenCode он 9к при наличии практически тех же фич. Все эти расширения перегружены фичами и не оптимизированы. Можно конечно многое написать самому, и это не так сложно, но потом весь этот зоопарк надо поддерживать, фиксить баги, обновлять. Я не очень хочу этим заниматься.

И я нашёл отличный готовый вариант - oh-my-pi (28к звезд на github). Это очень навороченный харнесс поверх Pi, в котором есть всё, что может понадобиться, и при этом большинство фич можно включать и выключать по необходимости. Меня конкретно интересовали несколько фич, которых не хватает в OpenCode после работы с Claude Code:
- вызов bash в фоне
- неблокирующий вызов сабагентов
- loop
Плюс сабагенты, вопросы, туду листы - которые не придется допиливать руками после установки.

По моим тестам omp отлично себя проявляет, правда пришлось немного покопаться в настройках и выставить режим редактирования apply_patch, и убрать сворачивание кода при чтении больших файлов.

Похоже что omp - мой основной кандидат на замену OpenCode для работы с моделями не от Anthropic. Все фичи есть из коробки, надо только настроить под себя. Делает его кстати один человек — Can Bölük. Security researcher and reverse engineer из Нидерландов.

🧐 Подписаться на канал
  • 🔥 5
  • 🤔 2
  • ✍ 1
Post #158 229
Извиняюсь, иногда публикуются черновики постов. Я их добавляю в отложку с датой на несколько дней вперёд, а потом вовремя не передвигаю эту дату (кстати Telegram могли бы и добавить полноценные черновики для каналов).

В общем, если увидите от меня несколько не отформатированных и обрывающихся на полуслове постов подряд, значит либо я потерял доступ к своему Telegram-аккаунту, либо со мной что-то случилось..

Кстати вышла GLM-5.3-Flash - первая мультимодальная модель от Z.AI. На Openrouter она скрывалась под именем Ox Alfa - самой популярной на Openrouter модели за последние дни.

🧐Подписаться на канал
  • 😁 5
Post #157 250
Меня очень забавят аргументы, что мол если люди напишут код, то он то конечно будет работать без багов, будет выстроена правильная архитектура, не будет уязвимостей и так далее. Уж вы очень идеализируете людей.

Люди точно также могут непредсказуемо косячить, упускать важные моменты, а ещё делают ревью по-диагонали.

Команды людей дают хороший стабильный результат не только потому что там такие крутые инженеры, а потому что там определенным образом выстроен процесс. И для ИИ тоже нужно выстраивать процесс чтобы был результат, представьте себе!

А люди часто приводят в пример ситуацию что мол вот я написал промт, а ИИ выдал плохой результат. Но если взять нового разработчика на ваш проект, ничего ему не объяснив, дать в одного делать фичу без возможности уточнять требования, тоже получится не очень, разве нет?

🧐 Подписаться на канал
  • 👍 10
Post #156 266
Установил себе Orca - одну из самых популярных сред разработки для агентов (ADE) - 53к звезд на github. Очень удобная штука, и кажется, что я буду использовать её для работы над всеми своими проектами.

В ней есть набор фич из Claude Desktop/Codex Desktop: список проектов, история сессий, просмотр и редактирование файлов, работа с git. Но при этом поддерживаются любые cli-агенты. По сути, всё что нужно для работы над проектами с ИИ есть в одном окне.

Orca поддерживает запуск параллельных сессий в worktree. задачи по расписанию, есть мобильное приложение.

Удобно, что внизу отображаются лимиты подключенных подписок. А я уже собирался написать свой дашборд, но теперь видимо необходимость в нём отпадает.

🧐 Подписаться на канал
  • ✍ 3
  • 👍 2
Post #155 220

This post (sticker, poll or similar) has no web preview. Open in Telegram

  • 🔥 5
  • 👍 3
Post #151 278
Помните, я писал пост про 6 уровней автономии работы с ИИ-агентами. Я сейчас активно двигаюсь к уровню 4 - автономный агентский пайплайн, скоро напишу отдельный пост, что у меня получилось.

А вот пример, как это может выглядеть в реальном коммерческом проекте:
https://t.me/sueta_localna/70
Автор канала Паша - мой соратник по ИИ-цеху. Кстати он много всего интересного пишет про ИИ на своём канале, подписывайтесь)

Недавно виделся с ним лично, он мне рассказывал, как у него в проекте всё устроено, ещё год назад это бы звучало как какая-то фантастика.

Он даёт агентам человеческие имена, и потом очень забавно слушать как Марина пропустила баг, а Глеб с Романом посрались на ревью.

Только здесь надо понимать, что на эту всю красоту надо очень много токенов.

🧐Подписаться на канал
Telegram Суета локальна Классический SDD (Spec-Driven Development) отлично выглядит на слайдах конференций: написали идеальную спецификацию, скормили модели, получили работающую систему. В реальности эта схема разбивается в первый же день. Если скормить большой языковой модели…
  • 👍 5
  • ✍ 2
Post #150 242
В подписке OpenCode Go примерно в 10 раз увеличили потребление токенов для Deepseek-V4-Flash после недавнего повышения цен. Раньше эта модель была почти бесконечной на этой подписке, а теперь уже ощутимо ест лимиты..

🧐 Подписаться на канал
  • 👍 3
Post #147 307
А вот и повышение цен на Deepseek V4. На самом деле даже с такими ценами эти модели остаются дешёвыми, просто они были аномально дешёвыми.

Цену за кэш конечно сильно подняли. Но для большинства моделей cache hit 10% от базовой цены считается нормой, а здесь даже после повышения во много раз она остается меньше 10%.

https://www.reddit.com/r/DeepSeek/comments/1vn81do/deepseek_just_massively_increased_their_api/

🧐 Подписаться на канал
  • 🤔 2
  • 😢 2
  • 👀 1
Older posts →

About this channel

How can I read @greenrus_ai without a Telegram account?
TGViewer shows the public web preview Telegram publishes for Руслан Гринев | AI-разработка: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does Руслан Гринев | AI-разработка have?
Руслан Гринев | AI-разработка (@greenrus_ai) has 174 subscribers on Telegram, refreshed roughly every 30 minutes.
Does Руслан Гринев | AI-разработка know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →