PChome 8月3日消息,MiniMax宣布正式开源新一代通用视频模型MiniMax H3。这是一套通用型全模态生成系统,能同时理解文本、图像、视频和音频,并直接生成最高2K分辨率、最长15秒、带原生立体声音频的视频。
PChome 8月3日消息,MiniMax宣布正式开源新一代通用视频模型MiniMax H3。这是一套通用型全模态生成系统,能同时理解文本、图像、视频和音频,并直接生成最高2K分辨率、最长15秒、带原生立体声音频的视频。在权威视频模型榜单Artificial Analysis中,H3的视频编辑能力排名全球第一,文生视频、图生视频能力分别位居第二、第三名。价格方面,H3的2K视频生成仅需0.8元/秒,约为同类旗舰模型的三分之一。

H3最特别的地方在于它更像一位“视频后期设计师”而非单纯的“导演”。它能根据几张静态海报自动生成动态海报,也能把一组照片做成带节奏和字幕的Vlog。用户上传商品图、参考视频和创意需求后,模型能自动完成从画面组织到节奏把控的全流程。某美妆品牌测试显示,使用H3制作新品预告视频的效率提升60%,修改次数从平均4.2次降至1.5次。

目前,PixPix已首发接入MiniMax H3,用户无需等待复杂部署即可体验。开源意味着开发者可以免费获取模型权重并自行部署,H3的多模态能力正在推动视频创作从单一文字驱动扩展到图片、视频、音频的混合驱动。当AI视频开始认真处理“改稿”这件事,视频生产的门槛正在从“会不会用软件”变成“有没有好创意”。