TGViewer
Channel Public Channel
very vibe coding

very vibe coding

@veryvibecoding

Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Subscribers
119
Photos
460
Videos
126
Links
980

Showing posts older than #1440 · Back to latest

Older Posts 20 shown
Post #1439 44
very vibe coding У chatGPT в настройках для Luna есть уровень Max, который по умолчанию недоступен. Говорят, что моделька на этом уровне выступает очень даже сильно, при том, что стоит в разы дешевле Terra и Sol. Попробуйте
Совет использовать Luna для агентской работы был ошибкой - об этом говорят и разработчики из OpenAI. Нужно подниматься до Терры.
X (formerly Twitter) eric provencher (@pvncher) on X I understand there's a lot of desire to get Luna used as a sub agent. I do not recommend messing with your model catalog to force capabilities that are not natively exposed. Multi agents v2 requires proactive inter agent communication, which only Sol and…
Post #1437 53
На просторах интернета нашел программку, которая переводит экран браузера в темную тему - после того, как начал пользоваться терминалом, постепенно перешел на черный цвет везде..
Dark Reader Dark Reader — dark theme for every website Dark mode for every website. Take care of your eyes, use dark theme for night and daily browsing. For Chrome and Firefox, Edge and Safari.
Post #1436 51
У chatGPT в настройках для Luna есть уровень Max, который по умолчанию недоступен. Говорят, что моделька на этом уровне выступает очень даже сильно, при том, что стоит в разы дешевле Terra и Sol. Попробуйте
Post #1435 50
В таких харнесах, правда, есть проблема - их надо подключать по апи. Но можно использовать с GLM или DeepSeek, например.
Post #1434 49

Forwarded from AbstractDL

Ouroboros теперь SOTA на Terminal Bench, OSWorld и CL-bench

Мой любимый агентный луп на чистом питоне доэволюционорал до состояния лучшего харнесса для кодинга! На главных бенчмарках он теперь обходит Codex, Claude code, Cursor и Hermes.

Выходит, что в рисёрче, в computer use, в работе через терминал и в задачах на кодинг — уроборос сейчас является лучшим агентом. Так что с этого момента всю разработку и исследования я веду только через уробороса.

Для полной воспроизводимости результатов. Весь код, скрипты, трейсы я выложил в открытый доступ.

Напоминаю: лицензия MIT. Так что спокойно ломайте, форкайте, проверяйте трейсы, пишите что я где наврал. И кидайте issues и PR-ы! Все постараемся с уроборосом принять😋

P.S. Кошмар какие дорогие агентные бенчи. Прогнать весь набор стоит как квартиру купить (это не шутка!!)

GitHub, Хабр, установочники
  • 🔥 1
  • 👏 1
  • 🎉 1
Post #1433 42
Post #1432 49
Я эту модель в прошлом исполнении использовал для отдельных задач - это было выгодное предложение. А текущая модель по бенчам так и вообще сильнее старшей версии. Если нужна модель по апи - однозначно, один из лучших вариантов

https://t.me/data_analysis_ml/5531
Telegram Анализ данных (Data analysis) DeepSeek запустила официальный API модели V4-Flash и заметно улучшила её работу в агентных сценариях. По тестам компании, новая версия значительно опережает V4-Pro-Preview в задачах, связанных с кодом и автономными агентами. Что изменилось: - усилены возможности…
Post #1430 44
Post #1429 43
River AI: как обучить собственную GLM-5.2 без GPU

River AI — новый сервис для дообучения open-source моделей через LoRA и reinforcement learning. Можно взять базовую Qwen, Kimi или GLM-5.2 и получить специализированный checkpoint под конкретную задачу.

Создатель и CEO River — Игорь Бабушкин. Ранее он работал над ИИ в DeepMind, OpenAI и xAI; River позиционирует себя как инфраструктуру для персонального, контролируемого пользователем ИИ.

Что даёт сервис:
— дообучение модели на своих примерах;
— RL с собственной функцией награды;
— хранение checkpoint;
— инференс через OpenAI-совместимый API без своих GPU.

Цены для GLM-5.2 с контекстом 32k:
— обучение: $4,40 за 1 млн токенов;
— вход при инференсе: $1,46 / 1M;
— выход: $3,67 / 1M;
— хранение: $0,10/ГБ в месяц.

Пример: запрос с 5 тыс. токенов входа и ответом на 1 тыс. токенов будет стоить примерно $0,011.

Но актуальные знания и документы лучше оставлять в RAG. Дообучение полезнее для устойчивых вещей — формата ответа, стиля, классификации, последовательности действий и проверки результата.

За стиль простите, лень переписывать за кло..
Post #1428 35

Forwarded from Вайб-кодинг

WTF: Этот CLI вытаскивает дизайн-систему из любого сайта

Просто передаёте URL, а он достаёт цвета, типографику, отступы, границы, тени, компоненты, брейкпоинты, моушен-токены и даже генерирует DESIGN.md.

Фронтендеры, вайбкодеры и дизайнеры теперь могут закрыть DevTools. И открыть терминал. ✋

https://dembrandt.com
Post #1427 42

Forwarded from эйай ньюз

OpenAI сбросили цены на GPT 5.6

Luna теперь дешевле в пять раз, всего $0.2/$1.2 за миллион токенов, против $1/$6 на релизе. Цену Terra сбросили на 20%, до $2/$12 за миллион токенов. Понижение цен касается не только API, но и квоты в Codex/ChatGPT Work. Sol не получил понижения цены, но для него выпустили Fast режим, который в 2.5x быстрее по 2x цене, но про дату релиза Sol запущенного на железе Cerebras OpenAI всё ещё молчат.

@ai_newz
Post #1426 45
Очень впечатляющая история - своего рода первая ласточка. В Америке сейчас в связи с этим проходят конкурсы открытых писем и большой срач между конторами.

Ну и на этом фоне интересно, что проект Ильи Суцкевера по безопасным моделям не умер, а получил еще 5 ярдов от NVIDIA. Видимо, тема актуальна как никогда.

Да, есть ощущение, что и на рынке крипты как никогда много успешных атак. Очевидные жертвы
Telegram Denis Sexy IT 🤖 Вот пересказ этой истории по версии Hugging Face, много тех-терминов – но без них не перескахать Если коротко – агент OpenAI на новой модели не стал решать тест по кибербезопасности, а решил просто украсть ответы и украл 🗿 Таймлайн: 📔 9 июля – агент проходит…
Post #1425 51
Post #1424 52

Forwarded from Denis Sexy IT 🤖

В выходные потестировал еще один популярный скилл, который называется ponytail –
он пытается сделать из кодинг агента, такого душного чувака с хвостиком, который с самым большим ЧСВ на свете программирует бекенд какой-то корпорации за 300кк в секунду

И на удивление, оказалось, что если этот скилл подключить через хук (ну то есть, чтобы он вызывался всегда а не по настроению агента) – скилл правда экономит ~10% токенов, и даже больше иногда

Тут все детали:
https://blog.jetbrains.com/ai/2026/07/ponytail-skill-claude-tested/

(последний час теста, я анимировал хвостик на аватарке)

💎
🌝
The JetBrains Blog Ponytail Skill for Claude Code: Does It Really Cut Tokens Part 3 of a series where we take public "token saver" add-ons for coding agents and run the same paired A/B benchmark against each of them. Part 1 was the caveman skill (advertised −65%, measured −8.5
Post #1423 47
Post #1421 55
Post #1420 50

Forwarded from Федор

Агенты наконец-то перестают драться с человеком за браузер.

На GitHub сегодня резко выстрелил ego (lite) — отдельный Chromium-браузер для совместной работы человека и CLI-агента. Идея здесь не в очередной Playwright-обёртке: Claude Code, Codex или Cursor получают свой изолированный Space внутри того же браузера, пока мои обычные вкладки остаются нетронутыми. Можно параллельно отдать агенту несколько задач — например, собрать лиды из залогиненного CRM, пройти внутреннюю админку или сверить данные в SaaS — и не наблюдать, как он уводит мышь и закрывает нужные табы.

Технически агент работает через skill ego-browser: вместо длинной цепочки CLI-вызовов он отправляет JavaScript, который за один проход вызывает snapshot/fill/click/navigate. Авторы обещают меньше tool calls и приводят собственный benchmark до 2,5× быстрее против Vercel agent-browser — это именно их замеры, а не независимый тест.

Самая полезная и одновременно опасная часть — при онбординге можно перенести из Chrome профиль, cookies, расширения и активные логины. После этого агент реально способен работать там, где нет нормального API: в закрытой админке, CRM, почте, аналитике. Но это не «безобидный браузерный skill»: агент получает доступ к уже авторизованным сессиям. Для финансовых, продовых и личных аккаунтов я бы сначала завёл отдельный профиль с минимальными правами и оставил подтверждение на любые необратимые действия.

Пока только macOS; репозиторий и skill открыты под MIT, а сам браузер скачивается отдельно. Сегодня проект в GitHub Trending набрал около тысячи звёзд за сутки — хороший индикатор, что сценарий «агент работает в моей реальной веб-среде, но не ломает мои вкладки» становится отдельной категорией инструментов.

GitHub: https://github.com/citrolabs/ego-lite
Релиз v1.2.5: https://github.com/citrolabs/ego-lite/releases/tag/v1.2.5
Документация: https://lite.ego.app/document/en/docs/quick-start
GitHub GitHub - citrolabs/ego-lite: The fastest browser for AI agents to run browser automation, built for sharing your logged-in browser… The fastest browser for AI agents to run browser automation, built for sharing your logged-in browser state with your AI agents, like Codex or Claude Code, without disturbing you. Zero cost, zero c...
Post #1419 46

Forwarded from Вайб-кодинг

Я всё это смотреть не буду.


Теперь и не нужно — появился опенсорс скилл, который позволяет Claude разбирать видео по ссылке почти как человек. 🙄

Он работает с YouTube, Loom, TikTok, локальными файлами и всем, что поддерживает yt-dlp.

С его помощью агент может разобрать запуск конкурента по хукам, визуалу и структуре, найти баг по записи экрана, сделать краткое резюме длинного выступления с точными таймкодами или вытащить из продуктового видео только реальные изменения без маркетинга.

Под капотом yt-dlp сначала забирает доступные субтитры, а ffmpeg извлекает кадры с учётом смены сцен, чтобы не тратить токены на десятки одинаковых изображений. Claude получает кадры с таймкодами, а если субтитров нет, подключается Groq Whisper.

Для Claude Code:
/plugin marketplace add bradautomates/claude-video
/plugin install watch@claude-video


Для Codex, Cursor и Gemini CLI:
npx skills add bradautomates/claude-video -g


p.s. Для видео длиннее 10 минут лучше указывать нужный фрагмент через --start и --end, иначе полный разбор может заметно расходовать токены.
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →