据LibTV消息,LibTV与MiniMax联合推出新一代开放通用多模态视频模型H3,该模型在统一理解文字、图片、视频与声音的基础上,实现了从多素材参考、视听生成到精准编辑的一体化创作,并将生成成本大幅拉低至0.1元/秒。
文字、图片、视频和声音,统一理解
H3可将人物、商品、场景图,以及动作视频和音频参考等多种素材置于同一多模态上下文中进行统一理解,涵盖外观、动作、运镜、构图、风格、节奏、台词、音色与环境声等要素。创作者上传素材后可直接生成完整视听内容,并支持后续对人物、商品、背景、光影、动作、台词与声音进行修改,实现从参考、生成到编辑的单模型统一。
面向真实商业内容生产
H3直接面向真实项目,可应用于多个商业场景。在AI短剧与剧情内容方面,支持人物形象、动作表演、对白、情绪与镜头节奏的共同生成,适用于古装、现代真人、海外竖屏短剧及漫剧。在品牌广告与电商营销方面,可结合商品、人物、场景与品牌风格,生成时尚广告、产品展示、TVC与投流素材。在影视创意与数字体验方面,可生成电影预告片、MV、动态包装、游戏(881275)角色、UI交互和产品功能演示。
更低成本,更高出片效率
在LibTV平台上,H3可结合爆款复刻等专业Skill,一站式完成从创意分析到最终成片。约10元可制作一支广告视频,约20元可完成一集短剧。同时,H3支持一抽四、一抽八能力,一次生成多个候选版本,便于比较不同表演、广告创意或运镜节奏,提升出片效率。
上线限时优惠
MiniMax H3上线期间,LibTV推出限时优惠,768p分辨率低至0.1元/秒,2K分辨率低至0.2元/秒。该模型现已上线LibTV,支持5至15秒视频生成、24 FPS输出与原生双声道声音,覆盖多种主流画幅,单次最多可输入9张图片、3段视频与3段音频,提示词长度最高7000字符,并可由768p升级至1440p分辨率。
原文:LibTV x MiniMax 联合首发H3:超高水准视频模型,价格低至0.1元/s(来源:LibTV)
