

全球最优秀的实时虚拟形象模型现已开源,并开放权重。您可免费获取模型、进行调优并投入使用。其独特之处在于:模型在您说话时同步聆听——全双工模式;虚拟形象以极低延迟实时响应。• 每一帧均为实时生成,避免预渲染播放中恼人的动画循环。• 附带完整流式传输基础设施,助您即刻上手。
Loading comments…
成就
项目信息
产品关键词
AVTR-1 是首个完全开源、实时的 AI 虚拟形象模型,它能够实时生成面部的每一帧,而不是将说话的口型拼接到预先录制的视频循环中。该模型以全双工模式运行,意味着虚拟形象在您说话时会倾听,并以极低的延迟即时做出反应。该模型及其完整的流式传输基础设施均可从 GitHub 免费下载,且无使用成本。
虚拟形象不会仅仅等待您说完。它会持续倾听,并以与对话情感基调(而非仅文字内容)相匹配的面部表情和微表情做出回应。
虚拟形象面部的每一帧都是即时生成的。这消除了其他虚拟形象系统中那些重复、呆板的动画,这些动画会破坏临场感的幻觉。
模型权重以开放许可发布。您可以下载、修改并部署 AVTR-1,无需支付任何按次使用费或版税。
此次发布包含了实时流式传输的完整管道,使您从下载到拥有一个可工作的虚拟形象只需几分钟,而非数月。
“直到今天,每一个‘实时’AI 虚拟形象都是同样的把戏——将生成的口型拼接到预先录制的脸上。今天,这改变了。”
这句话概括了根本性的创新:AVTR-1 并非静态视频上的唇形同步叠加。它实时生成整个面部,包括表情、反应和微动作。虚拟形象可以在您说话时表现出惊讶、共情或困惑,使互动感觉真正人性化,而非机械。
您正在构建任何需要逼真、响应式数字存在的产品——无论是销售教练、语言导师、客户支持代理,还是虚拟主持人。如果您曾因预录制虚拟形象循环的恐怖谷效应或专有实时模型的高昂成本而感到沮丧,AVTR-1 提供了一个免费、开放且真正会倾听的替代方案。
制作者
neon_dev
Loading comments…
其他您可能感兴趣的工具