TGViewer
Channel Public Channel
Derp Learning

Derp Learning

@derplearning

Используем ИИ строго не по назначению.
Заметки про ИИ, IT, компьютерные игры, и всякие инженерные интересности.
Subscribers
13.9K
Photos
3.6K
Videos
1K
Links
1.5K

Showing posts older than #4781 · Back to latest

Older Posts 18 shown
Post #4780 4.29K
И анимированная версия (со звуком)

Animate it as heroes of might and magic castle interface, add heroes 3 music and christmas sounds

veo3 i2v fast

@derplearning
  • ❤ 17
Post #4779 3.98K
  • ❤ 24
  • 🔥 6
  • 🤩 4
Post #4777 4.06K

Forwarded from CGIT_Vines (Marvin Heemeyer)

В Davinchi Resolve оказывается есть клонирование голоса.
Сама программа бесплатная и что интересно, голос считается нейронкой на вашей машине локально.

Кроме того, он сохраняет исходный ритм и стиль речи, просто применяя звучание обученного голоса.

Конечно совпадение не идеальное, но как бесплатное решение вполне может сгодиться.

Тут можно глянуть тутор.
@CGIT_Vines
  • ❤ 5
  • 🔥 3
Post #4776 3.29K

Forwarded from эйай ньюз

Qwen-Image-Edit-2511: теперь и у Qwen есть своя Nano Banana

Умеет всё то же, что и аналоги от Google, OpenAI и Flux. Клёво, что Qwen тоже не отстаёт от гонки, причём их релиз вышел под лицензией Apache 2.0. Это обновление старой Qwen Image Edit, версии Qwen Image вдохновлённой Flux Kontext.

Главная фишка релиза — возможности популярных LoRA (например, для улучшения освещения или смены ракурса), интегрированы здесь прямо в базовую модель. Отдельно так же дообучили на полезные для реального дизайна фичи, такие как генерация изометрических проекций и замена материала. С этим в целом и банан явно справляется, но квен все-таки локальная и главное открытая моделька.

Модель с первого дня поддерживается LightX2V, с ускорением в 1.4 раза. А в комбинации с дистилляцией и FP8 обещают ускорение до 42-х раз.

Результаты нужно смотреть на практике, но сам факт появления сильного опенсорс-конкурента — это отлично.

Демо Hugging Face
Демо Qwen Chat
Пейпер
Обнимающее лицо
Гитхаб

@ai_newz
  • 🎉 14
  • ❤ 1
Post #4775 9.18K
  • ❤ 24
  • 😢 16
  • 😁 7
  • 💯 6
  • 😱 1
Post #4774 4.76K
Finally, humans taking jobs from ai
  • 🤣 72
  • 😢 4
  • ❤ 3
  • 💯 2
  • 🫡 1
Post #4773 10.2K
  • 🤣 64
  • 😢 15
  • 😁 10
  • 😱 3
  • 💯 3
  • ❤ 1
Post #4771 3.96K

Forwarded from Метаверсище и ИИще (Sergey Tsyptsyn ️️)

Flash portrait

Кому ещё один оживлятор портретов? С кодом.

Главная фишка - он типабыстрый. Ускорен в 6 раз, но не реалтайм.
Генерит говорящие головы неограниченной длительности.

Теперь плохая новость.

40 гиг vram.

И это нашлепка над wan 2.1 14b.

https://github.com/Francis-Rings/FlashPortrait

@cgevent
  • 👍 11
  • ❤ 2
Post #4769 4.34K

Forwarded from Метаверсище и ИИще (Sergey Tsyptsyn ️️)

Ого, в Комфи завозят Automatic1111 Simple Mode!

Не прошло и много лет, как в Комфи заподозрили, что вся эта ацкая лапша плохо заходит в потребителей нормальных интерфейсов.
Уже были проекты-нашлепки над Комфи, которые вытаскивали основные параметры в окно со слайдерами. Теперь Комфи сами взялись за это.

Встречайте - Simple Mode.
В которой на экране остается одна финальная картинка (видео?), а справа появляется панель с основными параметрами типа Seed, Steps, Prompt, разрешение, CFG, Sampler, Scheduler, Имя модели с выбором(о, боги, да!), негативный промпт, количество генераций.

Более того, теперь вот такие "упрощенные" форкфлоу можно шарить (на деле просто шарится воркфлоу), чтобы другие юзеры открывали и пользовались (ха, представляете сколько конфликтов будет вылезать).

Мысль очень хорошая. Я года два назад писал, что интерфейс для генерации должен строиться вокруг огромной картинки (как в Фотошопе) - все кнопочки и педалечки не должны отжирать UI-пространство у самой картинки.
Ну примерно как в Invoke AI. Inpaint, маски, выборы - все на самой полноразмерной картинке. Просто потому что Адобченко уже всех приучил за 40 лет. Щас вот до Комфи дошло.

Осталось побороть CUDA–PyTorch mismatches или tensor size mismatches, которые будут валить с ног новых пользователей.

@cgevent
  • ❤ 19
  • 🤣 6
  • 👍 3
Post #4768 11.9K
TurboDiffusion

Обещают ускорение Wan 2.1 T2V / 2.2 I2V аж до 100x-200x

Сравнивали, видимо, с ванильными Wan без causevid/turbo лор, которые и так генерят нормально за 5-10 шагов.

Sparse-Linear Attention, q8, rCM

hf
git

техрепорт
  • 🔥 6
  • ❤ 1
  • 👀 1
Post #4767 3.8K

Forwarded from Ai molodca (Dobrokotov (в отпуске))

У нас новый GPT-image!

Альтман и co. в погоне за бананами наконец-то починили отвратительную желтизну и непостоянство объектов, а ещё — в четыре раза ускорили генерацию и улучшили понимание промта.

Идём тестировать.
Post #4765 5.01K
Выкатили новую версию three.js

Все эти штуки можно крутить прямо в браузере.
Берете ллм по вкусу, даете гитхаб, просите юзать
r182

ченжлог
  • 🔥 31
  • ❤ 3
  • 🤡 1
Post #4764 4.76K
Разыскиваются террористы: претрейн датасетов,
разъеб лидербордов,
ваншот литкодов,
вайбкод дашбордов,
анУс логотипов,
наеб инвестфондов,
подьем раУндов,
админ каналов,
адвайз стартапов
Аджайл канбанов
Файнтюн претрейнов
Редтим бэкдоров
эйчар лейоффов

папищеки:
Игнор Консёрнов
Постпон Релизов
Реквест Дейоффов

Докидывайте в комментах
  • 😁 41
  • ❤ 3
  • 🤡 2
Post #4763 4.17K

Forwarded from Vladimir🏴‍☠️ [🥴] 💅

спиздил
  • 😁 38
  • 🔥 4
Post #4762 20.5K
We’ve officially rolled into open beta: a video stylization / transformation & VFX service — the spiritual successor to WarpFusion (discord with sassy mods included)

You upload a video, tweak the keyframes right there in Banana on the spot, hit render — and let it cook 🍌🔥

Everything lives in a video-editor-style interface:
projects, tracks, frame-by-frame scrubbing, and side-by-side comparisons of up to four videos at once. Yes, four. Because we can.

👉 Break it here: app.mago.studio

And for the OG goats, a promo code may mysteriously appear in the comments 🐐😏
  • 🔥 13
  • 🤡 8
  • ❤ 2
  • 👀 2
  • 👍 1
Post #4761 4.4K
Agi achieved
  • 😱 81
  • 👍 14
  • 🎉 6
  • ❤ 3
  • 😁 3
  • 🤡 2
  • 🏆 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →