返回工具列表
Vimi
商汤科技的可控人物视频生成大模型,主要帮助C端用户及小型创作团队通过多种驱动方式生成最长1分钟的稳定人物视频。
工具简介
Vimi 是商汤科技基于日日新大模型构建的可控人物视频生成产品,在2024世界人工智能大会亮相。用户只需上传图片,就能通过已有视频、动画、声音或文字等驱动方式,生成最长1分钟的单镜头人物视频。它能精准控制人物表情,并自动生成头发、服饰和背景变化,实现半身区域的肢体动作驱动,画面稳定不随时间劣化。
优点方面,Vimi 在人物表情和动作的可控性上优于多数现有产品,避免反复“抽卡”;能生成的视频时长达到1分钟,且全程保持高质量和一致性。它对C端用户尤其是女性用户友好,玩法多样,包括数字分身、表情包制作等。
主要门槛在于其仍处于早期阶段,仅有部分媒体评测和预约内测信息,未公开商业化定价和正式上线时间;另外,人物视频生成技术存在被滥用于虚假内容的风险,商汤对此并未披露具体防护措施。目前可参考的样本有限,稳定性在复杂场景下的实际表现尚待大规模验证。
该工具适合社交媒体内容创作者、对视频创意有需求的普通用户,以及需要快速生成概念视频的广告和视频工作室。不适合对人物肖像真实性要求极高的新闻或纪实场景,也不适用于缺乏基本内容审核能力的敏感行业。
暂无关联内容
这个工具还没有可展示的社媒关联内容。