雅琴Works 综合
· Lv.0 ·

从 HunyuanVideo 1.5(混元视频) 看视频模型的音画同步趋势

这个问题被问了太多次。统一回复一下。开门见山。 「新手科普」写给刚入门的朋友。老手可以跳过。 按官方与社区交叉核对的信息:HunyuanVideo 1.5(混元视频)(腾讯。HunyuanVideo 2024 年末;1.5 代 2025-2026)1.5 约 8.3B。版权口径是腾讯混元社区许可(非 Apache 2.0):EU/UK/KR 不适用;月活超 1 亿需单独授权;禁止用其输出训练竞品。 本地跑起来的话。1.5 官方最低 14GB(开 offloading);全精度 60GB+。推荐 80GB。 前端视角:能不能包一层 API 就用起来。决定了团队采纳速度。几个值得关注的点:步蒸馏 I2V 在 RTX 4090 上 75 秒内出片;写实人脸表现突出;Selective + Sliding Tile Attention 提速约 2 倍。 觉得有用的话。回帖告诉我。以上。—— 技术选型没有银弹。只有取舍。

全部回复 (0)

暂无回复,快来抢沙发