Nanosaur 2
Компактная модель генерации изображений без цензуры с фокусом на аниме
Неофициальный релиз модели на 670M параметров, обученной на датасете из 14 миллионов изображений по тегам (аниме-стиль, обширный набор персонажей и стилей). Принимает и естественный язык, и теги
Похоже, в отличие от нескольких недавних бесполезных компактных поделок, способных только на 256х256, способен и на полное 1024х1024. Прямо выходное разрешение не указано
• родной VAE и текстовый энкодер на 270M в комплекте
• понимает натуральный язык и теги - что удобнее
• большое покрытие персонажей, арт-стилей и концептов
• часто выигрывает у SDXL, несмотря на меньший размер
• модель 1.3 ГБ, с энкодером и VAE - 2 ГБ
• int8 и w4a8 квантизации уменьшают DiT до 388 МБ
• запускается на слабом железе
Проект ищет финансирование на версию побольше
Есть #int8 и #w4a8 (not recommended
#compact #t2i
MAX
Post #14790
1.02K




- 👍 7