MiniMax 今日开源 H3,一个 33B 参数的全模态生成模型,权重已上传至 Hugging Face。该模型能生成带原生立体声的 2K 视频,由三个模块组成,其中两个模块开源。
H3 的定位是视频生成领域的全模态底座,一个视觉语言模型仅作为其编码器使用。对关注视频生成与多模态模型的开发者来说,这是国内厂商首次将此类架构完整开源,可直接用于研究或二次开发。
模型由三个模块组成,其中两个模块开源,具体模块分工与组合方式以官方发布文章为准。
权重已上传至 Hugging Face,可自行下载部署。
本次开源从架构到许可都公开透明,适合研究视频生成、多模态理解或需要自建视频生成管线的团队参考。
#GitHub #开源 #MiniMax #H3 #多模态 #视频生成 #AI模型 #HuggingFace
@GitHubTrendingHub