告别“默片”:智谱发布新清影,可生成 10 秒 4K60 帧 / 自带音效视频
2024-11-09 07:10:38人工智能 IT之家 清源
相比于原有模型,CogVideoX v1.5 将包含 5/10秒、768P、16 帧的视频生成能力,I2V模型支持任意尺寸比例,大幅提升图生视频质量及复杂语义理解。
感谢最新网友 HH_KK 的线索投递!
最新 11 月 8 日消息,智谱技术团队今天发布并开源最新版本的视频模型 CogVideoX v1.5,相比于原有模型,CogVideoX v1.5 将包含 5/10 秒、768P、16 帧的视频生成能力,I2V 模型支持任意尺寸比例,大幅提升图生视频质量及复杂语义理解。
官方介绍,CogVideoX v1.5 也将同步上线到“清影”平台,并与新推出的 CogSound 音效模型结合,“新清影”将具备如下特性:
质量提升:在图生视频的质量、美学表现、运动合理性以及复杂提示词语义理解方面能力显著增强。
超高清分辨率:支持生成 10s、4K、60 帧超高清视频。
可变比例:支持任意比例,从而适应不同的播放场景。
多通道输出:同一指令 / 图片可以一次性生成 4 个视频。
带声效的 AI 视频:新清影可以生成与画面匹配的音效。
最新附开源地址如下:
代码:
https://github.com/thudm/cogvideo
模型:
https://huggingface.co/THUDM/CogVideoX1.5-5B-SAT
赞一个! ()
相关文章
- AMD 发布首个 10 亿开源 AI 模型 OLMo,用 Instinct MI2
- 谷歌 DeepMind 研究再登 Nature 封面,隐形水印让 AI 无
- 全球首次:AI 机器人画作首登苏富比拍卖,成交价 108 万美
- 谷歌 Gemini 2.0 AI 模型现踪迹,响应速度更快
- 黄仁勋:AI 算力集群会扩展到 100 万芯片,没有任何物理定
- 告别“默片”:智谱发布新清影,可生成 10 秒 4K60 帧 /
- Meta 开源小语言 AI 模型 MobileLLM 家族:适用智能手机
- 60 秒生成 5 秒 AI 视频,字节自研视频生成模型 Seaweed
- 字节跳动 X- Portrait2 技术尝鲜:我感觉动捕要升级到 n
- 英国明年将立法防范 AI 风险,主要面向 ChatGPT 等“前