TGViewer
Channel Public Channel
/skills.md

/skills.md

@skill9md

AI-Hub with skills for your agent by @ai_shny
Subscribers
1
Photos
29
Videos
18
Links
38
Recent Posts 12 shown
Post #60 1

Forwarded from Нейронавт | Нейросети в творчестве

Code2Skill

Превращает код из открытых репозиториев в скиллы кодинг-агентов. В отличие от скиллов из трейсов агента, исходники доступны до взаимодействия и их можно проверять после абстракции

• 1 006 822 проверенных скилла из 19 769 репозиториев с 500+ звезд
• три типа записей - атомарные операции, составные workflow и повторяющиеся паттерны
• каждая запись проходит проверку: реконструкция поведения без исходника и сверка с кодом
• скилл хранит условия применения, анти-цели, кейсы отказа и провенанс
• семантическая аннотация банка - мультишаговые процедуры, constraint reasoning

Где встраивается: планирование, первичная генерация, пост-ревью и coding RL. Планирование улучшило все 8 пар, пост-генерационная проверка - самый стабильный плюс

Гитхаб
HF

#code2skill
Post #59 1

Forwarded from Нейронавт | Нейросети в творчестве

miniface

Бесплатная система захвата движений лица и пальцев для VTuber и стримеров. Работает в браузере

• рилтайм трекинг лица - 52 blendshapes ARKit
• трекинг пальцев рук
• аватары Ready Player Me с Three.js
• запись анимации и экспорт в .glb (2-5 МБ) с костями и blendshapes
• физика волос и одежды на пружинах без движка

Гитхаб

#mocap #realtime #streaming

MAX
Post #56 1

Forwarded from Нейронавт | Нейросети в творчестве

Qwen Intelligence

Квен сорвался с цепи и не может остановиться

Персональная интеллектуальная система для смартфонов. Три агента - планирование, исполнение и креатив. Первый партнер - HONOR

• Mobile Planner Agent - разбивает сложную задачу на этапы и оркестрирует исполнение
• Mobile-Use Agent - делает дело: API-first с фолбэком на GUI
• Mobile Creative Agent - одна фраза на входе, готовая креативная работа на выходе

- Mobile Planner Agent: github.com/Tongyi-MAI/Qwe
- Mobile-Use Agent: tongyi-mai.github.io/Qwen-UI-Agent

#agent #mobile #browseruse

MAX
Post #55 2
Увлёкся немного с меню-баром для прилки

Особо не собирался ничего делать, кроме добавления локальной модели ориентированную на системные команды, но вот для меню выделил силы кодекса. Съело примерно несколько недельных лимитов у базовой версии. Спасибо Тибо за постоянные сбросы

Пришлось немного покумекать над понятием пространственной интерполяцией 🙂‍↕️ Но вышло неплохо для базовой версии, хотя уверен что можно сделать лучше.

На гитхаб залил.
Post #54 2
Увлёкся немного с меню-баром для прилки

Особо не собирался ничего делать, кроме добавления локальной модели ориентированную на системные команды, но вот для меню выделил силы кодекса. Съело примерно несколько недельных лимитов у базовой версии. Спасибо Тибо за постоянные сбросы

Пришлось немного покумекать над понятием пространственной интерполяцией 🙂‍↕️ Но вышло неплохо для базовой версии, хотя уверен что можно сделать лучше.

На гитхаб залил.
Post #53 4
Из мира вайбкодинга всё по-прежнему ок — каждую неделю по несколько ненужных фич

Пишу сюда редко. Хотелось бы чаще, но причина отсутствия довольно понятная — лень и большая часть нишевой информации успевает пройти несколько кругов обсуждения ещё до официального выхода новости. В итоге остаётся либо соревноваться в скорости публикации, либо подключить модель к написанию постов и клепать их каждый день. 

В общем, немного подытожу о проектах, который вайбкожу для себя & ради интереса & бесплатно для всех: 

– MacCleaner, (не)уникальное декстопное приложение для macOS на swift для аналитики устройства и его контроля.
– BrowserMonitor, расширение для браузера (пока только chrome). Анти-реклама, аналитика, инструменты – все для комфортной работы в браузере.
– Aishny, уже рассказывал про него ранее. В какой-то момент забросил, потому что решил, что тг читать всё-таки удобнее, но недавно снова продолжил вносить изменения.
– books-ai тоже никуда не делся. Идея всё ещё нравится и со временем к нему вернусь. Недавно начал поглядывать за приложением Language Model Builder (от билдера из антропиков). Очень понравилась реализация, от чего "появился" интерес к ковырянии в books.

BrowserMonitor до сих пор активно поддерживаю и использую сам. Там уже есть блокировка разного рода рекламы, контроль активности сайтов, инструменты, которые лично мне постоянно нужны — работа с cookies, сворачивание видео, удаление css элементов со страницы и т.д. + аналитика блокировок и статистика посещений сайтов — хотя бы можно наконец увидеть, где именно я трачу 90% времени впустую. Само расширение уже доступно в Chrome Web Store и на GitHub, плюс есть .dmg для macOS.

С MacCleaner решил немного усложнить себе жизнь и добавить небольшую локальную модель, которую отдельно адаптирую под задачи приложения. За основу взял Needle на 45M параметров, заточенную под выбор нужного действия и передачу ему корректных параметров.
Например, пользователь спрашивает о температуре компонентов, модель определяет, что ей нужен check_thermal_state, вызывает его и дальше уже работает с полученными данными. Заранее готовится датасет и после провожу дообучение через lora на cpu мака.
Под это отдельно готовлю датасет с пользовательскими запросами, затем дообучаю модель через LoRA прямо на CPU своего Mac. Что из этого получится, расскажу позже.

Это как раз те проекты, на которые мне не жалко тратить лимиты, пробуя разные подходы к работе с агентами и постепенно усложняя себе задачи.

Возможно, отдельно сделаю пост про маленькие локальные модели для узких задач. Сейчас их становится довольно много: модели для работы с офисными приложениями, мобильных устройств, tool calling, классификации и других сценариев, где тащить модель на несколько миллиардов параметров вообще не обязательно.

Недавно написал довольно большую статью про a/b-тестирование агента с инструментами и без них. Пока выложил только в LinkedIn.
Возможно, сюда тоже перенесу позднее.
GitHub GitHub - Jas952/MacCleaner: ... ... Contribute to Jas952/MacCleaner development by creating an account on GitHub.
Post #52 3
Заглянул, короче, в Hermes.

В первую очередь, интересовало как агент работает с памятью и какова оптимизация трат токенов внутри. Hermes использует концепцию трехуровневой памяти:

1️⃣ Markdown. Те самые .md файлы (user, memory, soul). Все последующие навыки, воспоминания и способы закрепления знаний происходят через призму этой базовой идентичности.
2️⃣Эпизодическая память (SQLite + FTS5). История сессий не в контексте постоянно, она лежит в локальной БД state.db. Когда агенту надо, он сам делает FTS5-поиск по базе и вытягивает ровно то, что ему нужно в данный момент.
3️⃣Глубокая память (External Providers). Hermes предлагает 8 провайдеров, которые обеспечивают агенту постоянные данные, сохраняющиеся между сессиями, помимо встроенных .md файлов. По-умолчанию, они выключены (none — built-in only).

Из примеров, honcho (диалектическая память), supermemory (изоляция контекстов) или holographic (ассоциативная алгебра). Больше вариантов можно посмотреть в их докс. Для старта подойдет holographic, ибо бесплатный и не просит подключать эмбеддинги и текстовые модели для полноценной работы.

Скиллы SKILL.md тожу тут. Чтобы много не кушать, агент видит только каталог с названиями навыков (~3k токенов) и использует его когда это надо. Раз в неделю агент (the Curator) просыпается для скана скиллов, чтобы удалить мусор и неиспользованные (>30 дней) скиллы.

> У хермеса есть уже встроенные включенные навыки в каталоге ~/.hermes/skills/ и по-умолчанию выключенные навыки. Но если хотите больше, то вот тут у них свой хаб с неофициальными скиллами от энтузиастов.

Вот что интересно, так это наличие конвейерного автономного оптимизатора от hermes на основе алгоритма GEPA (Genetic-Pareto Prompt Evolution), опубликованный как ICLR 2026 Oral paper (MIT лицензия). По сути, если агент начинает регулярно косячить в сложном навыке, вы включаете этот инструмент и показываете skill и логи ошибок. Алгоритм пыхтит, прогоняет симуляции и выдает вам вылизанный до идеала SKILL.md. Стоит отметить, на оптимизацию уйдет больше токенов, чем может быть в обычной сессии, но это выгодно, чем если бы скилл постоянно работал не так как вам надо на постоянной основе

Что также стоит внимания, а документация это расписывает:
[secrets] [security] – про env. секреты и 7-ми уровневую безопасность
[profiles] – можно сделать разные профили агента под разные задачи (программист, писатель, личные и тд). Можно отдать задачу напрямую в codex/claude.
[vision] [computer-use] – переняли фичи из Codex. Hermes считывает любой тип файлов, а Computer Use может управлять вашим устройством (пока только для MacOS).
[deliverable-mode] – хочешь pdf, сделает pdf. Захочешь Excel-формат и его получишь.
[goals] – /goal будет делать до тех пор, пока не достигнет первоначальной цели. Без постоянного ручного "продолжай".

В общем и целом есть множество других интересных вещей у агента, но все упирается в то, зачем он нужен. Объективно, если вы не айтишник или не инфльюенсер из X с 69 агентами, то как обычному работяге вам нужно либо обычного чата из chatgpt, либо же что-то из "узкого" использования в агенте.

🐱 Агент доступен как деcктоп, так и в веб/cli версии. Десктопная версия вышла недавно и она куда приятнее
Nousresearch Memory Providers | Hermes Agent External memory provider plugins — Honcho, OpenViking, Mem0, Hindsight, Holographic, RetainDB, ByteRover, Supermemory
Post #49 2

Forwarded from Нейронавт | Нейросети в творчестве

OmniScientist

ИИ-ученый для локального запуска на компе

Скармливаешь папку с данными и направление исследования. Он смотрит материалы, выдвигает гипотезу, пишет и запускает код, читает получившиеся графики и компилирует статью

- Воспринимает все как есть: изображения, сигналы, аудио, видео, 3D-сканы, поинт-клауды, траектории, таблицы, формулы
- Полный цикл: гипотеза → анализ → проверка → статья в PDF с фигурами, таблицами и реальными DOI
- Каждая цифра в черновике связана с исполнением: гейт пропускает статью, только если число реально появилось в stdout какого-то прогона
- Пустые результаты отправляются обратно на идейную доработку
- Три редакции: десктоп, CLI, skill для твоего агента

- Провел 36 реальных исследований, из них 5 полноценных статей
- Windows, macOS, Linux

Гитхаб

#research #agent #autoresearch #scientist
Post #46 18

Forwarded from Нейронавт | Нейросети в творчестве

Unlimited‑OCR

Модель от Baidu для однопроходного анализа документов с большим горизонтом обработки

• парсинг длинных документов, от отдельных изображений до многостраничных PDF
• работа с разноформатными источниками без дополнительной настройки

Гитхаб

#ocr
Post #44 16

Forwarded from Tips AI | IT & AI

Есть такой опенсурс проект под названием Cua Driver, это Computer Use, который может работать в фоне.

Так еще не рискуя за свой рабочий пк.

Обычно все Computer Use просто делают скрин экрана и отдают его в LLM.

Но у Cua работает по-другому, он возвращает вместе с картинкой еще и дерево доступности элементов приложения.

То есть агенту не нужно считать примерные координаты, он сразу понимает где расположена нужная кнопка.

Есть два режима:
1/ Управление реальными окнами на текущем рабочем столе
2/ То же самое управление только в отдельной изолированной среде

У него есть CLI и MCP, можно использовать вместе с Claude Code, Codex и любыми другими агентами.

Поддерживает macOS, Windows и недавно появился Linux.

Чтобы установить скормите своему агенту этот промт:
1. Прочитай документацию по ссылке ниже и установи cua-driver на мой компьютер.
2. После установки запусти его.
3. Настрой для Codex MCP и skill для cua-driver.
4. Открой калькулятор Windows для теста, посчитай 123*456=? и скажи мне результат.
https://cua.ai/docs/cua-driver/guide/getting-started/introduction


Я еще писал что в Windows версии Codex есть проблема, что Computer Use не может работать в фоне, Cua исправит, так что смело отправляйте своего агента взаимодействовать с UI.

GitHub

@tips_ai #tools
Post #40 8

Forwarded from Tips AI | IT & AI

Последние месяцы пользовался только cmux для работы в терминале

Но честно говоря стало скучно.

Захотел новые ощущения и нашел терминальный IDE, если это можно так назвать, под названием Orca.

Работает в основном привычно: у каждой задачи есть свой worktree, свой терминал, свой браузер и свой контекст.

Агент может спокойно ломать, чинить, запускать тесты, потому что не трогает основную папку и не мешает параллельным агентам.

Очень круто сделана система ревью AI-диффов: открываешь дифф, оставляешь комментарии, они попадают обратно агенту и он их чинит.

Есть браузер с Design Mode, где так же можно выделять элементы и оставлять коменты.

Что еще понравилось:
1/ Очень приятный интерфейс, понятные иконки, удобное дерево проекта, история чатов, поиск и много чего еще
2/ Можно создавать автоматизации, чтобы новая сессия создавалась уже с настроенным терминалом
3/ Есть мобильное приложение для удаленного подключения

Eще много разных конекторов и интеграций, например Voice Dictation, Computer Use, Оркестратор, Linear и Jira.

Поддерживает Windows, macOS, Linux

Скачать
| GitHub

Пока я остановился на нем 💻

@tips_ai #tools
Older posts →

About this channel

How can I read @skill9md without a Telegram account?
TGViewer shows the public web preview Telegram publishes for /skills.md: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does /skills.md have?
/skills.md (@skill9md) has 1 subscribers on Telegram, refreshed roughly every 30 minutes.
Does /skills.md know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →