Tavus 的 Griffin 模型,拟真程度已经接近真人,一半测试者都没能分辨出来。
它用全双工视频到视频架构,不用转文字中转,H100 显卡上延迟只有 0.43 秒,可以一边感知画面一边实时对话,支持随时打断插话。英伟达测评里它 3.83 分,几乎追上人类 3.92 的基准。既能用来口语教学、老人陪伴,但身份诈骗风险也很高。目前只对少量可信用户开放轻量版本,团队也把身份核验和安全防护当成首要任务。
Post #5153
21

黑科 黑科技资源分享 @deeptech123 · 3.52K subscribers 