TGViewer
Channel Public Channel
very vibe coding

very vibe coding

@veryvibecoding

Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Subscribers
121
Photos
463
Videos
126
Links
995

Showing posts older than #861 · Back to latest

Older Posts 8 shown
Post #860 38
very vibe coding Начал было писать себе прогу для работы с нейронками голосом, чтобы меньше печатать, но тут увидел пост с рекламой готовой программы Handy, и решил не тратить время на свою - установил, работает хорошо. Очень симпатичный интерфейс, не хватает только удобного…
В продолжение поста - whisper все-таки русский распознает с ошибками, а лучшая модель в этом плане - отечественная GigaAM. Думал переписать программу сам для использования отечественной нейронки, но на GitHub это уже следали за нас. Ниже нужная ссылка

https://github.com/Servideus/Handy-GigaAM/releases/tag/app-v0.7.3

Попросите Claude code или Codeх (ну или Gemini CLI) установить все за вас - нейронки, работающие в терминале, прекрасно с этим справляются. А если они еще у вас не установлены - ставьте скорее и ваша жизнь скоро изменится
GitHub Release Handy v0.7.3 · Servideus/Handy-GigaAM Handy with GigaAM. Contribute to Servideus/Handy-GigaAM development by creating an account on GitHub.
Post #858 39
Начал было писать себе прогу для работы с нейронками голосом, чтобы меньше печатать, но тут увидел пост с рекламой готовой программы Handy, и решил не тратить время на свою - установил, работает хорошо. Очень симпатичный интерфейс, не хватает только удобного выбора моделей.

Модель для распознавания голоса выбирайте whisper large (немного качественнее) или whisper turbo (побыстрее). Для работы с нейронками качества достаточно (они понимают текст с ошибками). Для других применений есть возможность настроить использование дополнительной нейронки для облагораживания надиектованного текста в экспериментальных возможностях.

В общем, готов рекомендовать, хорошая штука. Попробую ее еще переписать на сберовский Salut, который специализируется на русской речи, посмотрим, что получится
Telegram Tips AI | IT & AI В прошлом году писал про набор текста голосом. Тогда это только набирало популярность, инструментов было мало, платно и в основном на Mac. Недавно поймал себя на мысли, что уже год сижу на удалёнке и всё это время общаюсь только текстом. С нейронками текстом…
Post #857 42

Forwarded from Anton Vdovitchenko — One Man Enterprise

Привет, друзья! Вчера в ночи вышли две новые модели: у Anthropic вышел Opus 4.6 с 1М токенов, а у OpenAi — Codex 5.3.

Из статьи Anthropic следует, что на сегодняшний день Opus 4.6 — самая интеллектуальная модель, доступная широкой общественности.

Судя по их тестам, всё классно, но нужно, разумеется, потестировать в деле. Context Rot никто не отменял, к сожалению.

Помните концепцию «Standing on the shoulders of giants»? Мы строим продукты, которые базируются на постоянно растущем уровне интеллекта и становятся «умнее» без нашего участия. Ух…

Всё начало этой недели я был в командировке, поэтому ничего не писал, но есть пара моментов, которые я посмотрел и попробовал, хочу поделиться. Вдруг, есть время на выходных, либо вы уже настолько поглощены новинками Agent Coding, что вместо основной работы занимаетесь экспериментами и этого ещё никто не заметил :)

1. AutoForge (https://github.com/AutoForgeAI/autoforge) — проект нашего товарища Leon Van Zyl, раньше назывался Autocoder. Это практически автономная среда для кодирования, которая умеет разбивать проект на фичи и параллельно их создавать, попутно тестируя и проверяя функциональность. Мы с ребятами уже пару-тройку недель её терзаем, обычно флоу работы такой: ты создаешь 80% проекта через AutoForge, а потом остальные 20% добиваешь в Windsurf / Claude Code CLI. Вещица убойная, особенно для несложных задач. Идеально для PoC.

2. Sandboxed.sh (https://github.com/Th0rgal/sandboxed.sh) — окестратор для AI-coding-агентов, позволяет запускать, контролировать и мониторить AI-агентов (Claude Code, OpenCode, Amp, Codex) в изолированных окружениях (Docker). Если страшно запускать агентов на своей машине или хочется развернуть где-нибудь в облаке, это прекрасный продукт. Пока в активной стадии разработки, постоянно за ними слежу, ребята очень интересные. На базе Sandboxed можно создать автономную фабрику агентного кодирования, которая будет разворачиваться и работать в нужных окружениях практически с нулевыми затратами на настройку и запуск.

3. Claude-mem (https://github.com/thedotmack/claude-mem) — система постоянной памяти для агентного кодирования. Пользовался ею последний месяц. Фактически, она пытается решить задачу бесконечного контекста для моделей, у которых этот контекст ограничен + очень эффективно инициализирует сессии новых агентов, передавая им контекст проекта. Если вы знакомы с феноменом Context Rot, то это палочка-выручалочка. По моим ощущениям, повышает качество и точность работы процентов на 10-15 в большинстве сценариев.

Happy Coding!
Post #856 38
О, битва гигантов - вышел Claude Opus 4.6 и тут же Codex 5.3 от OpenAI. Обычные пользователи могут этого не оценить - обе модели, прежде всего, для программирования. Честно говоря, из них мне нравятся... обе.

Я пользуюсь Claude code в основном, хотя Codex почти также хорош. Решающий фактор - то, что Антропик сделал тарифы на 20, 100 и 200 баксов, а OpenAI - за 20 и 200.

Модели за 20 баксов мне уже мало, а за 200 - жаба душит. Поэтому взял за 100, а произошло это когда Антропик выкатил Опус 4.5 и снизил цену в 3 раза (хотя ChatGPT дешевле Опуса).

Кстати, о деньгах я не пожалел - теперь высадить подписочные токены очень тяжело я тупо могу работать с лучшей моделью нон-стоп.

Чистая победа маркетологов. Но был бы тариф у OpenAI за 100, взял бы и его - 2 модели прикольно использовать.

Так что прекрасные новости, модели и были лучшими (Джемини нервно курит в сторонке), а теперь будут еще круче. Супер
Post #852 45

Forwarded from Machinelearning

🌟 ACE-Step v1.5: обновление локального генератора музыки.

Ace Studio в коллабе со StepFun обновили генератор музыки ACE-Step до версии 1.5.

Порог входа уронили до минимума: младшая модель требует меньше 6 ГБ видеопамяти, а, в зависимости от настроек think mode, генерация может занять от 2 до 10 секунд - это уже уровень коммерческих решений.

Разработчики собрали гибрид из языковой модели, которая превращает промпт в чертеж композиции: расписывает структуру, придумывает лирику и метаданные и DiT, который отвечает за звук. Логическое ядро всей этой системы базируется на Qwen3.

ACE-Step v1.5 может генерировать треки длиной от 10 секунд до 10 минут, причем до 8 штук одновременно. В базе больше 1000 инструментов, а тексты песен система понимает на 50 языках.

Авторы подготовили целый набор моделей под разный объем VRAM:

🟢Меньше 6 ГБ: без LM-модуля, работает только звуковой движок.

🟢6–12 ГБ: облегченная версия LM (0.6B).

🟢16 ГБ и выше: полноценная модель на 4 млрд. параметров, которая лучше всего понимает контекст и выдает максимум качества.

При запуске, ACE-Step v1.5 автоматически выбирает подходящую под железо модель и параметры. Подробную информацию по конфигурациям можно найти тут.

ACE-Step умеет гораздо больше, чем просто превращать текст в мелодию. Можно дать ей пример аудио, чтобы скопировать стиль, делать каверы, исправлять куски уже готовых треков или генерировать аккомпанемент к вокалу.


Самая интересная функция - возможность создавать LoRA. Чтобы скормить модели свой стиль, достаточно всего 8 треков. На 30-й серии RTX с 12 ГБ памяти этот процесс займет около часа.

С деплоем все в порядке, разработчики подготовили портабельную сборку, а для ComfyUI уже написали все необходимые ноды и воркфлоу.


📌Лицензирование:  MIT License.


🟡Страница проекта
🟡Модель
🟡Arxiv
🟡Demo
🟡Сообщество в Discord
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #Text2Music #AceStudio #StepFun
Post #851 38
В этих новостях для меня самые интересные и полезные - новости по моделям распознавания голоса от Мистраль. Полезно для нас в части распознавания записей совещаний и автоматического формирования протоколов

https://t.me/ai_machinelearning_big_data/9469
Telegram Machinelearning ✔️ Anthropic принципиально отказалась от рекламы в Claude. В компании говорят, что рекламная модель просто не вяжется с инструментом, который должен быть нейтральным пространством для размышлений, работы и решения сложных задач. Anthropic видят огромную…
Post #847 44

Forwarded from Denis Sexy IT 🤖

Anthropic смешно троллит OpenAI: Если помните, ChatGPT планирует встроить рекламу для бесплатных пользователей и Anthropic за это зацепился, во-первых, написали статью, что у нас рекламы в Claude никогда не будет – во вторых, «запустили ни на что не намекающие рекламы»:

– В одной парень просит составить план тренировок для пресса, указывает рост 170 см - и АИ тут же предлагает ему стельки, добавляющие рост, с промокодом «hide maxing»

– В другой девушка делится бизнес-идеей, АИ начинает составлять план и вдруг переключается на рекламу быстрых займов под 400% годовых, «потому что girl boss'ам нужны быстрые деньги»

– В третьей рекламе студентка спрашивает про своё эссе, АИ хвалит работу, замечает, что дедлайн сегодня и предлагает отметить это событие ювелирными украшениями со скидкой 10%

– В четвёртой человек спрашивает, как наладить общение с мамой, АИ даёт советы — а потом добавляет: «Если отношения не исправить, найдите эмоциональную связь на сайте знакомств Golden Encounters для любителей женщин постарше»

🤣
Post #840 34

Forwarded from Креативный совет

🔥Kling 3.0 уже тут...

Модель уже можно использовать на официальном сайте (если у вас тариф Ultra) и через провайдеров (например https://higgsfield.ai/)

Подробнее про релиз раскажу в видео, а пока ловите примеры того, что может делать эта модель

@creadvice | Наш курс по ИИ Видео
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →