概述
Sora、Stable Video Dissfusion等视频生成模型都存在一个问题,那就是生成的视频是无法精准控制的。这在人物的动作方面尤其明显。
可控视频模型是什么?
通过提示词精准控制人物动作等行为的视频生成模型就是可控的视频生成模型。
Viggle AI是什么?
Viggle AI 号称第一个具有实际物理理解的视频-3D基础模型。它可以随心所欲地控制任何人物角色的动作。
Viggle AI 的官网:https://www.viggle.ai/
如何使用Viggle AI?
Viggle AI 目前寄生在discord中。
你可以加入:https://discord.com/channels/1181076253172842537/@home
Viggle AI生成的视频示例
总结
可控视频会让现在的数字人实现技术产生很大的变化,大大降低一个数字人产品的成本。也会产生很多以前很难做到的数字人视频。
相关文章
观察
· 1 分钟阅读
Gemini:王者归来?
掉队近一年的Gemini突然动作频频:Gemini 4曝光、Antigravity集成Claude 5.5、Google收紧Gemini模型权限。免费版Gemini,基本就是个强化版的搜索引擎了。
观察
· 1 分钟阅读
Token Plan:一个黑盒好生意
Token正在成为继水、电、煤、云计算之后的又一个日常用品。云厂商纷纷推出看起来很便宜的Token Plan,但真实体验下来,ChatGPT和Claude的订阅反而更划算。而且很多Token Plan是个黑盒——用积分计价,积分与token的转换系数只有厂商自己知道,还可以随意控制。
观察
· 1 分钟阅读
DeepSeek Harness不止是一个Agent
亲测DeepSeek Harness:与Claude Code对比之后,发现DeepSeek自家Agent配上自家大模型更好用。它不止是一个Agent工具,更是开源、可以完全定制化成各种专用Agent产品的平台。