TGViewer
Channel Public Channel
Гари ИИ Аватар

Гари ИИ Аватар

@gari_azat

Для вопросов и предложений: @gari_azat_team
Subscribers
3.33K
Photos
515
Videos
538
Links
577
Recent Posts 11 shown
Post #1298 480
Скоро будем смотреть “ЧБД”, созданное нейросетями?

Кажется, нейросетевой контент официально добрался до «высшей лиги» российского развлекательного продакшена.

Medium Quality / LABELCOM запустили комедийный баттл для нейросетчиков: принимают юмористические ролики длиной 2–5 минут, созданные с помощью нейросетей. Тема, герои и стиль могут быть любые. Главное, чтобы было смешно.

А Medium Quality это один из самых заметных производителей развлекательного контента в стране: у них «Что было дальше?», «Большое шоу», «Женский форум», «Внутри Лапенко», проекты LABELCOM и много чего ещё.

Короче большие продакшены уже воспринимают нейросетевой контент не как игрушку «для технарей», а как нормальный инструмент производства контента.

Пока речь идёт о площадках самого продакшена. Но дальше вполне логично ожидать, что такого контента будет становиться больше и в крупных интернет-шоу, и, возможно, со временем в телевизионных форматах типа на ТНТ.

Умение быстро сделать актуальный, качественный и смешной ролик с помощью нейросетей становится ещё ценнее. Особенно когда нужно реагировать на событие буквально сегодня, а не через две недели после съёмок и постпродакшена.

Короче, ставки повышаются.

И для всех, кто сейчас учится работать с нейросетями не просто ради красивых картинок, а именно как с полноценным инструментом видеопроизводства, — это, на мой взгляд, очень хороший знак.
  • 👍 4
  • ❤ 3
Post #1297 513
📺🔈 Главные ИИ-новости: HeyGen Professional Voice звучит как живой голос


Hello! Вышел новый выпуск еженедельного дайджеста «ИИШНИЦА». Ниже 5 интересных новостей про нейросети, контент и то, как на этом зарабатывать.

В этом выпуске:

00:25 HeyGen Professional Voice Clone ссылка
03:35 Higgsfield подключил ChatGPT к After Effects ссылка
05:24 Syntx: повторяем тренд STORM через Seedance 2.5
07:26 Adobe Premiere генерирует видео на таймлайне ссылка
08:36 Higgsfield API: 50+ моделей без обязательной подписки ссылка


📺Смотреть на YouTube
💙Смотреть во ВКонтакте
  • 🔥 6
  • 👍 4
Post #1296 483
Промт и реф для тренда STORM

Одна из новостей сегодняшней ИИшницы будет про тот самый нашумевший тренд из клипа Storm, режиссёром которого был Роман Говраз.

С творчеством Романа я познакомился ещё лет 15 назад. Тогда на Vimeo выходили его очень дерзкие работы, и уже в то время они производили на меня сильное впечатление.

Поэтому когда сейчас этот отрывок из клипа начал звучать буквально «из каждого утюга», я, естественно, тоже не смог пройти мимо.

В сегодняшнем выпуске покажем, как сделать такой тренд самостоятельно. Я делал всё, как обычно, через Syntx AI, но на самом деле ничего особенно сложного в этой механике нет.

А сюда, в комментарии к посту, я прикреплю всё необходимое:

- видео-референс, который нужно загружать в нейросеть;
- готовый универсальный промпт.

Промпт можно подробно адаптировать под себя. А если вообще не хочется заморачиваться, то просто копируете его, вставляете и обязательно прикладываете свой референс того, как вы хотите выглядеть в ролике сами.

В своём варианте я ещё добавил бабулек для общего абсурда 😄 и актуалочку на спину футболки.

Изначально, кстати, идея была другая: я хотел поставить вокруг себя известных людей из мира IT и технологий: Илона Маска, Марка Цукерберга, Павла Дурова, Дженсена Хуанга и других.

Но генерация такие варианты не пропускала. Судя по всему, на некоторые публичные лица фильтры работают значительно жёстче. При этом я видел похожие ролики с известными российскими блогерами, так что здесь всё сильно зависит от конкретного персонажа и модели. Но даже без этого простор для экспериментов огромный. Так что забирайте в комментариях референс и промпт, подставляйте себя и экспериментируйте. 😊

Сам клип, который я в итоге использовал, обошёлся мне примерно в 230 токенов (примерно 500 руб). Это генерация в разрешении 480p. Я пробовал делать и в HD, там одна генерация уже стоила мне примерно 1300–1400 рублей, но почему-то постоянно возникали какие-то баги и глюки в видео😭. В итоге даже для выпуска я взял одну из самых первых и самых дешёвых генераций. И, кстати, по качеству она оказалась вполне нормальной. Для Reels, как я понял, 480p вообще более чем достаточно.

А в сегодняшнем выпуске подробно покажу, как всё это собирается.
  • 🔥 9
  • ❤ 5
  • 👍 2
Post #1294 605
Одна механика, которая одновременно прокачивает школу и YouTube

Сегодня добавил в свою школу цифровых аватаров новый модуль «Расширенные практикумы».
И понял, что сама эта механика может быть полезна всем, кто занимается онлайн-образованием.

Как она работает:

Я регулярно нахожу темы, которые актуальны прямо сейчас и при этом достаточно долгоиграющие. Например, как создавать обложки с помощью нейросетей, как делать приветственные видео со своим цифровым аватаром, как использовать новые AI-инструменты в реальной работе и т. д.

На такую тему я записываю большой полноценный практикум. Сначала полная версия появляется в AI Avatar School. Раньше, чем где-либо, и без сокращений. Ученики получают дополнительный контент в рамках уже купленного курса, без каких-либо доплат. А через некоторое время этот же практикум выходит на YouTube, но уже в сокращённой примерно на 50% версии.

Получается такая связка:

Полный практикум → ранний доступ ученикам → сокращённая версия на YouTube → охваты → новая аудитория → школа.

И мне эта механика сейчас нравится, потому что она решает сразу несколько задач. Нейросети меняются настолько быстро, что образовательный продукт невозможно один раз записать и забыть. Если ты что-то продал человеку, хоть за 500 рублей, хоть за 50 000, хочется, чтобы продукт продолжал жить, а человек регулярно получал новую пользу.

При этом тебе всё равно нужно постоянно создавать контент для YouTube и других площадок.
А здесь одна работа начинает выполнять сразу две функции. Для действующих учеников это дополнительная ценность и причина оставаться внутри продукта. Для новой аудитории это полезный контент, который работает как трипвайр и приводит людей в школу.

Такую механику я раньше нигде не встречал. Просто постепенно пришёл к ней через собственные пробы и ошибки. Пока минусов для себя вообще не вижу.

На сайте школы теперь тоже появился отдельный раздел «Расширенные практикумы». Каждый раз, когда будет выходить новый практикум, будем сразу добавлять его туда.

Сейчас там уже появился урок, о котором меня очень часто просили в комментариях: как я создаю приветственные видео со своим лицом для начала выпусков «ИИшницы».

Поэтому, если у вас есть онлайн-школа или вы занимаетесь образовательными продуктами, попробуйте такую связку. Мне кажется, для быстро меняющихся ниш, особенно для AI, она работает очень органично.
  • 👍 5
  • ❤ 3
Post #1293 714
📼 ИИ-новости недели: 7 нейросетей для аватаров и короткометражка в один промпт

Hello! Вышел новый выпуск еженедельного дайджеста «ИИШНИЦА». Ниже 5 интересных новостей про нейросети, контент и то, как на этом зарабатывать.

В этом выпуске:

01:04 7 нейросетей для говорящих аватаров: сравнение ссылка
04:22 GPT Image 2.5: тест двух версий в SYNTX и Higgsfield ссылка
06:31 GPT-6 Astra создаёт игры с Higgsfield ссылка
08:03 Короткометражка в один промпт через Seedance 2.5 ссылка
11:42 Suno V6: музыка под ваше видео ссылка
13:12 Рекомендация ссылка

📺Смотреть на YouTube
💙Смотреть во ВКонтакте
  • 🔥 7
  • ❤ 3
Post #1292 725
heygen_professional_voice_story.wav15.4 MB
В HeyGen появился профессиональный голос.

Не обычный быстрый клон, а полноценный Professional Voice Clone который по смыслу уже гораздо ближе к тому, что давно есть в ElevenLabs.

Всю суть я рассказал в аудиофайле выше, поэтому здесь повторяться не буду. Причём важный момент: сам этот файл тоже уже сгенерирован не мной, а моим новым профессиональным голосом HeyGen.

В комментариях тут ещё прикреплю скриншоты всей моей вакханалии с Terminal, API, загрузкой огромных WAV-файлов и ChatGPT 😄 Я сам до сих пор не до конца понимаю, что именно там делал, но главное — всё заработало!

Пока функция доступна ограниченно и в обычном интерфейсе HeyGen её ещё нет. Если у вас уже есть HeyGen и вы тоже хотите попробовать получить ранний доступ к Professional Voice Clone, заявку можно оставить здесь:
https://form.typeform.com/to/kAyRxanI

Тут ссылка на новость в их X:
https://x.com/HeyGen/status/2097728121189630396?s=20

Инструкция подключения:
https://developers.heygen.com/docs/voices/professional-voice-clone

По самому голосу: я вообще никак не управлял ударениями, паузами или интонациями. Просто отправил готовый текст через API. Поэтому это практически «сырой» результат. Но даже так мне голос понравился.

А когда HeyGen добавит Professional Voice в обычный интерфейс и к нему можно будет применять привычные инструменты управления интонациями и произношением, думаю, станет уже совсем интересно.

Для аватаров голос критически важная часть. Особенно с учётом того, что YouTube, как показывает практика, многие не столько смотрят, сколько слушают.

Как вам сам голос в аудиофайле? Насколько похож и насколько естественно звучит?
  • 🔥 10
  • ❤ 6
  • 👍 2
  • 🤯 1
  • 👌 1
Post #1284 642
Какая нейросеть сейчас лучше всего делает AI-аватаров?

Прогнали один и тот же аватар сразу через 7 популярных видеомоделей и сравнил их в одинаковых условиях: один исходный кадр, один текст, вертикальный формат 9:16, HD.

Тестировали:

Minimax H3
Kling 3.0
Omni Flash 1.1
Grok Imagine 1.5 Preview
Wan 2.7
FLUX 3
Seedance 2.5

Отбирал те, на которых в принципе можно попробовать сделать говорящего персонажа / цифрового аватара.

Все генерации делал внутри SYNTX AI, чтобы можно было сравнить модели в одном интерфейсе и сразу увидеть разницу в качестве и стоимости.

Оценивал по нескольким параметрам: визуал, речь и липсинг, актёрская игра, следование промпту, возможность загрузить свой аудиореференс и цена.

Коротко по результатам:

Minimax H3 — хорошо понял промпт, нормально отработал актёрку и принял мой аудиофайл с голосом. Но картинка получилась слишком рисованной. 120 токенов за 10 секунд.

Kling 3.0 — недорогой, 60 токенов, но лицо постепенно меняется, персонаж долго остаётся в расфокусе, а русская речь в этом тесте практически провалилась.

Omni Flash 1.1 — главное открытие по соотношению цена/результат. Всего 34 токена: нормальная русская речь, хороший липсинг, эмоции и выполнение действий. Минусы — нельзя загрузить свой голос, а лицо и физика местами выглядят искусственно.

Grok Imagine 1.5 Preview — 55 токенов. Речь и липсинг рабочие, но часть действий игнорирует, лицо меняется по ходу ролика, плюс пришлось сокращать промпт из-за ограничения по длине.

Wan 2.7 — можно загрузить свой аудиореференс, но в моём тесте липсинг практически отсутствует, лицо быстро меняется, промпт выполняется слабо. 60 токенов.

FLUX 3 — за 100 токенов результат меня скорее разочаровал: слабый липсинг, неестественная физика, свой аудиореференс добавить нельзя.

Seedance 2.5 — самый дорогой вариант, 167 токенов, но именно здесь лучше всего сохранилось лицо, хорошо отработал мой голос, получился точный липсинг и модель почти полностью выполнила действия из промпта.


По среднему баллу в таблице Omni Flash 1.1 даже выходит выше Seedance, потому что в оценку входит цена.

Но если говорить именно про максимальное качество, сохранение персонажа и контроль, мой выбор сейчас — Seedance 2.5.

Если же задача получить максимально адекватный результат за минимальные деньги, очень интересно выглядит Omni Flash 1.1.

К посту прикрепляю все исходные рендеры целиком их можно спокойно скачать, посмотреть без нарезки и сравнить между собой.

Плюс прикладываю итоговую таблицу с баллами и стоимостью.

Сразу отмечу: тест я специально усложнил и здесь много динамики, взрывов, людей и движения. Для любой модели это тяжёлая сцена. На простом фоне с одним говорящим персонажем результат, конечно, был бы заметно лучше. Но мне хотелось проверить модели сразу в сложных условиях.


Завтра часть этого теста покажу в новом выпуске «ИИШНИЦЫ», но все семь роликов туда целиком вставлять не стал — иначе одна эта новость растянулась бы надолго. Поэтому из выпуска буду отдельно ссылаться сюда.

А вы какой результат поставили бы на первое место цена/качество?
  • 👍 9
  • ❤ 5
  • 🔥 5
Post #1282 575
🔥 Вышла новая GPT-Image 2.5

В пятничном выпуске «ИИШНИЦЫ» обязательно разберём её подробнее

Из главного, что обещает OpenAI:

- лучше сохраняет лицо, персонажей и другие детали с референсов;
- точнее вносит локальные правки, не перерисовывая всё изображение;
- натуральнее работает со светом, текстурами и мелкими деталями;
- и генерирует до 50% быстрее.

Я сейчас тестирую её в Syntx AI там уже появилась GPT-Image 2.5 Sunburst.

Прикрепляю несколько сравнений: GPT-Image 2 vs GPT-Image 2.5 на одинаковых задачах. Пока смотрю, насколько разница заметна именно в реальной работе, а не только в красивых демках.

Кто уже начал тестировать GPT-Image 2.5? Как вам? Есть ощущение заметного апгрейда относительно второй версии?
  • 🔥 10
Post #1281 632
Короткометражка в один промпт.

Сейчас нейросети вроде Wan 3.0 или Seedance 2.5 уже позволяют генерировать до 30 секунд видео.

А 30 секунд, как оказалось, вполне достаточно, чтобы в один промпт собрать маленькую историю с драматургией, эмоцией и финалом.

Вот хороший пример такой короткой, но довольно поучительной истории.

Если интересно, ставьте огонёк 🔥, чтобы в следующем выпуске «ИИШНИЦЫ» одну из новостей посвятить тому, как создавать такие короткометражки в один промпт.
  • 🔥 42
  • ❤ 6
Post #1280 653
Каждый понедельник после нового выпуска я собираю статистику из YouTube Studio и закидываю скриншоты в одну ветку ChatGPT.

Он сравнивает выпуск с предыдущими, показывает, что выросло, что просело и где сейчас главное «узкое горлышко».

Так, например, долгое время проблемой было удержание первых 30 секунд. Мы докрутили интро и показатели выросли. Теперь ищем следующее слабое место.

Получается простой цикл:

аналитика → нашли проблему → докрутили → снова аналитика.

В видео показал, как именно я это делаю. Можно спокойно адаптировать под свои соцсети.
  • 👏 8
  • 🔥 7
  • ❤ 5
Post #1279 700
Лайфхак с генерацией голоса на других языках.

Связка простая: HeyGen + ChatGPT Voice.

Если вы вообще не знаете язык и не понимаете, правильно ли нейронка произносит слова, просто включаете ChatGPT и даёте ему послушать результат.

Я в тесте умышленно сделал ошибку и Chat GPT легко её подсветил мне.

Он может подсказать, где всё окей, а где есть проблемы с произношением.

Единственный вопрос здесь это доверие. Но в конечном итоге всё всегда упирается в него. Если вы нанимаете вы переводчика, то так же вы либо доверяете ему, либо нет. Здесь примерно то же самое.

Для тех, кто делает мультиязычные ролики и работает с клиентами, очень простой, но реально полезный лайфхак.
  • ❤ 10
  • 🔥 9
  • 👍 3
Older posts →

About this channel

How can I read @gari_azat without a Telegram account?
TGViewer shows the public web preview Telegram publishes for Гари ИИ Аватар: recent posts, photos, videos and the subscriber count, with no app, login or account.
How many subscribers does Гари ИИ Аватар have?
Гари ИИ Аватар (@gari_azat) has 3.33K subscribers on Telegram, refreshed roughly every 30 minutes.
Does Гари ИИ Аватар know I viewed it here?
No. Public channel previews carry no viewer identity, and TGViewer has no accounts or tracking of what you look up.
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →