重磅!视频开源模型MiniMax H3正式上线,限时3折,快来Pixmax抢先体验!

发布时间:新闻资讯

图片展示的是Pixmax首发接入MiniMax H3的宣传图。画面背景为深蓝色夜空,右侧有多个画面拼接的图像,呈现不同场景。画面中央是一个发光的蓝色“P”形结构,其内部有旋转的蓝色光圈。左侧白色大字写着“Pixmax 首发接入 MiniMax H3”,下方小字为“MiniMax正式上线视频模型MiniMax H3并同步开源,开发者可基于此进行二次开发与自由部署”。该图片与文档中MiniMax H3上线及Pixmax首发接入的内容相呼应,强调Pixmax在MiniMax H3上的首发接入。

今日,MiniMax正式上线视频模型MiniMax H3并同步开源,开发者可基于此进行二次开发与自由部署。

但开源模型的部署依赖GPU集群,环境配置复杂,推理优化需要工程能力。对于绝大多数创作者和中小团队而言,代码层面的自由度并不是他们的首要诉求,能否稳定调用、快速产出,才是决定模型能否进入生产管线的核心标准。

Pixmax已完成MiniMax H3的接入,用户无需本地部署或代码调试,在Pixmax无限画布中即可直接调用MiniMax H3模型。

这张图片展示了Pixmax平台的界面,是MiniMax H3视频开源模型上线的体验入口。界面中,上方呈现一个800秒时长的校园场景视频预览窗口,下方的模型选择栏里,MiniMax H3选项被红色框标注,其右侧带有醒目的“限时3折”标识,对应文档中该模型限时优惠的活动信息,下方还列出了其他相关视频模型选项,界面底部标注有该模型的相关配置信息与33的价格标识。

MiniMax H3:让AI视频真的“经得起看”

在短剧、广告TVC、音乐MV、跨境电商视频等实际创作场景中,一段视频是否“可用”,不只取决于画面好不好看,还要看它是否足够真实、稳定、可控,能不能经得起反复迭代和最终交付。

这次,MiniMax H3在底层能力上做足了准备。支持5 到 15 秒的视频生成,24 FPS输出及原生双声道声音,画幅方面覆盖了从 21:9 电影宽屏到 9:16 竖屏短视频在内的主流比例,横竖题材都能直接适配。

参考素材单次最多可上传 9 张图片、3 段视频和 3 段音频,混合参考素材合计可达12 个文件,提示词长度也放宽到了7000字符,长叙事、多细节的创作意图可以完整传递给模型。分辨率则支持多档可调,可由768p 进一步升级到 1440p,根据项目需求在生成效率和画质精细度之间灵活取舍。

从理解、生成到编辑、交付,MiniMax H3全链路能力提升,在复杂动作逻辑、画面真实感、叙事镜头语言等核心能力上全面提升,更接近一个能融入专业视频制作流程的生产工具。

原生多模态理解生成:把多类型素材“揉”进作品

传统视频模型的输入通常以文字为主,图片和音频作为辅助参考时,各模态之间的信息是割裂的,你给它一张角色参考图,再给它一段动作描述,它可能只认其中一个,另一个就“选择性忽略”了。

而现在,MiniMax H3支持文字、图片、音频、视频等多种输入形式,并能将所有素材视作统一的上下文进行理解,信息、声音、情绪、画面与表达意图之间的关系,模型能一并处理。

提示词:保持视频1中的建筑、行人和整体环境为真实世界风格不变。仅将视频1画面中的树木、轿车转化为3D像素或体素积木风格(Minecraft style),风格参考图1。像素化物体的运动轨迹需正常,且保留真实环境的阴影和透射光。整体效果参考视频2

图片展示了MiniMax H3视频生成效果的参考视频及图片。左侧是视频片段,画面中男子背对镜头走在街道上;中间是视频片段,展示城市街道场景;右侧是图片,呈现蓝色汽车在绿植环绕的场景。这些素材与上下文提到的创作者可同时丢入参考视频、角色照片、背景音乐和提示词等内容相呼应,直观呈现了MiniMax H3的多模态理解生成能力。

▲MiniMax官方生成参考视频及图片

图片展示了一位背对镜头的男子走在城市街道上,街道两旁有绿色像素风格的树木、棕色像素风格的建筑和垃圾桶。男子身穿白色衬衫、黑色马甲和深色裤子。街道上有行人和车辆,远处可见麦当劳标志。该图片是MiniMax官方生成效果的参考视频及图片之一,体现了MiniMax H3原生多模态理解生成的能力,可将多类型素材“揉”进作品,输出从内容到风格都保持统一的作品。

▲MiniMax官方生成效果

创作者可以同时丢进去一段参考视频、一张角色照片、一段背景音乐和一句提示词,MiniMax H3会自动拆解其中的角色形象、动作逻辑、镜头运动、画面构图、声音氛围和剪辑节奏,将信息自然融合,输出一部从内容到风格都保持统一的作品。

多模态精准编辑控制:精准局部调整不跑偏

生成只是第一步,真正做内容的人都知道,视频创作的核心是“改”。但在过去,想要在原AI视频基础上改个角色衣服,背景跟着变;删个物体,光影全乱。

现在,MiniMax H3支持对人物、物体、场景、声音与节奏进行多维度编辑,角色替换、动作参考、背景替换、背景特效、台词修改、氛围调整,都能精准执行,同时保持未编辑内容的稳定。想改哪里就只改哪里,不会牵一发动全身,高精度的指令遵循能力,让内容调整更稳定、更可控,迭代效率大幅提升。

提示词:将参考视频中的报纸替换为一本绿色封皮的书;人物所坐的椅子改为红色沙发;去掉人物佩戴的墨镜,保留清晰面部;移除汽车燃烧效果,使车辆保持正常状态;人物从怀里拿出的照片改为一个黑色小本子;同时在画面左侧增加一棵树

图片展示的是原视频画面,一位男士坐在沙漠中,身着西装,戴着墨镜,手里拿着报纸,背景是一辆正在燃烧的汽车。该图片位于介绍视频开源模型MiniMax H3功能的文档中,用于展示需要精准局部调整的原视频画面,以突出其多模态精准编辑控制能力,即能精准局部调整而不跑偏,如将参考视频中的报纸替换为绿色封皮的书等。

▲原视频

图片展示的是原视频画面,一位身着黑色西装的男子坐在红色沙发上阅读绿色封面的书,沙发旁有一棵枯树,背景是一辆停在沙地上的汽车。该图片位于介绍视频开源模型MiniMax H3功能的上下文之后,用于展示原视频画面,与上下文提到的“精准局部调整不跑偏”等功能相呼应,直观呈现视频内容。

▲精准调整后

对于需要反复提案、修改、迭代的商业项目,能够经得起反复迭代优化,真正将模型能力放入工作流。

商用级多场景内容生成:覆盖多行业真实需求

一个视频模型能不能真正投入生产,除了画质,还要看它对商业信息的呈现准不准确。MiniMax H3兼顾文字、字幕、品牌信息、UI/UX、游戏及电商内容呈现,覆盖影视、广告、游戏、品牌、电商等高频内容场景。

这张图片是MiniMax官方生成的短片截图,属于该品牌视频开源模型MiniMax H3的生成效果展示。图中呈现了一位妆容造型个性的女性形象,她有着深色调的长发,妆容重点突出在偏橘色的亮眼唇妆,佩戴着带有金属饰件的颈饰,整体风格潮流前卫;背景配有醒目的黑色大写英文字样,与文字介绍中该模型可生成创意性视觉内容的作用相呼应,直观体现了MiniMax H3能够打造多元视觉方案的能力。

▲MiniMax官方生成短片截图

创作者可以使用MiniMax H3快速尝试制作短视频创意,帮助品牌探索不同视觉方案,让产品展示更有创意,也让 IP 角色拥有更多动作和场景。视觉团队还能用它完成概念验证、分镜预览和内容提案,过去需要外包或花几天时间手绘的内容,现在几分钟就能生成可用的参考版本。

Pixmax:让模型能力真正融入创作生产

模型能力再强,如果不能真正融入生产流程,对创作者而言也是空谈,Pixmax的意义就在于它把MiniMax H3装进了一个真正能高效生产的制作环境。模型解决了“能做什么”的问题,Pixmax则让这个模型用得顺、用得高效。

Pixmax底层聚合了MiniMax H3、Seedance 2.0、Kling3.0等行业主流音视频模型,一个账号即可调用多款大模型能力,配合全流程创作Agent,输入剧本即可自动拆解分镜、生成连续镜头,一个人就能在Pixmax上跑完整条制作链路。

创作者可以直接在Pixmax的无限画布上进行创作,在上面规划分镜、生成视频素材、比较不同模型的输出效果,把创意逐步转化为可交付的内容。

光说功能可能有点抽象,我们用Pixmax+MiniMax H3,实操全流程制作一部武侠短剧看看效果。

武侠短剧实操

第一步:剧本与分镜

在Pixmax的无限画布上拖出一个文本节点,输入核心想法“一个关于江湖恩怨的武侠短剧”。让AI自动生成符合短剧节奏的分镜脚本——开场、冲突、打斗高潮、收尾,每个镜头的景别、时长、动作要点全部梳理清楚。

图片展示了Pixmax生成的武侠短剧剧本及画面。画面中人物众多,有持剑者、持伞者等,背景有古建筑、灯笼等。画面右上角有分镜脚本,标注了场景、人物、动作等信息。画面左上角有分镜图,标注了镜头、景别、时长等。画面右下角有视频生成节点,显示视频时长。该图片与上下文紧密相关,直观呈现了Pixmax让AI自动生成符合短剧节奏的分镜脚本,以及后续分镜、角色、素材等信息串联的创作流程。

▲Pixmax画布部分内容

剧本不再是孤立的文档,而是整个制作流程的起点,后续所有分镜、角色、素材,都可以基于这个剧本节点进行生成,信息天然串联。全程不用离开Pixmax的画布,在一张画布上即可完成短剧创作。

第二步:角色设定与人物一致性

剧本和分镜有了,接下来要先确定人物。在Pixmax选择合适的图像模型生成角色设定图,Pixmax平台聚合了PixNano、Image 2等多个顶尖AI模型,同一个项目内可以根据任务类型灵活切换,积分通用,一套工作流跑通从图像到视频的全链路。

图片展示的是Pixmax平台生成的武侠短剧角色赵无极的设定图。画面中赵无极手持长刀,身着黑色战衣,背景为阴暗的天空。右侧有面部特写,呈现其凶狠眼神。下方有武器设定,展示九尺大砍刀。还有人物三视图、战斗风格(动作捕捉拳拳)等,如劈砍木桩、万气爆发等动作场景。该图与上下文介绍的Pixmax平台角色设定图生成功能相契合,直观呈现了平台生成角色设定图的效果。

▲部分角色三视图

主角、配角、反派的所有定妆照都在同一张画布上完成,生成后一键保存至团队资产库,统一命名、分类管理。后续所有镜头节点直接调用同一份角色资产,不用反复上传,角色形象从头到尾保持一致。

第三步:视频生成

拖出视频生成节点,把人设图、场景图、分镜脚本全部作为参考素材导入,使用MiniMax H3进行生成。

图片展示的是Pixmax武侠短剧实操中生成的视频片段。画面中,一名身穿黑色武士服、头戴斗笠的男子手持长剑,身姿矫健,正以一种准备战斗的姿态站立。背景为夜晚的古建筑庭院,两侧有悬挂的灯笼,营造出古色古香的氛围。该图片与上下文紧密相关,是视频生成步骤中使用MiniMax H3模型生成的片段示例,直观呈现了生成效果。

▲MiniMax H3 生成片段

如果创作者手里已经有参考素材,比如类似风格的参考视频、氛围参考图、甚至一段背景音乐都可以一并拖入画布。MiniMax H3会自动融合这些信息,输出的剧本在风格和调性上直接贴向参考方向,而不是凭空生成一段不搭边的内容。

所有素材还能在Pixmax的无限画布里完成剪辑,无需导出到其他软件。

图片展示的是Pixmax剪辑功能界面。画面中呈现了一位戴着斗笠、手持长剑的武侠人物,背景为昏暗的室内和阴沉的室外。左侧有剧本编辑区域,显示“侠客行”剧本内容。下方是视频播放进度条,当前播放至15秒。画面右下角有播放、暂停、快进、快退等操作按钮。该图片与上下文紧密相关,直观呈现了Pixmax在从剧本到视频成片过程中,剪辑功能的操作界面和效果。

▲Pixmax剪辑功能

从剧本到分镜,到视频素材,到角色统一,到配音成片。整条制作链路都能在Pixmax的一张画布上完成。

不用导出导入、不用切换软件、不用反复向AI解释“这个角色长什么样”。剧本、图像、视频、音频,全部都可以在一个界面里无缝衔接,一个人就能在Pixmax上跑完整条视频制作链路。

随着AI视频模型的快速迭代,竞争焦点从对单帧画质的极致追求,转向多场景下更加稳定、可控、可生产的视频生成能力。模型的能力在快速进化,但真正决定创作效率的,是这些能力能否被顺畅地组织和调用。

PixMax一直致力于将技术突破转化为即开即用的生产力,让创意回归创作本身,当技术真正融入生产流程,创意的生产力才能真正释放。

Pixmax现已上线MiniMax H3,7月31日至8月2日,首发上新限时3折,快来Pixmax抢先体验!

用 Pixmax 一站式生成 AI 短剧
用 Pixmax 一站式生成 AI 短剧

从剧本到分镜、角色、视频生成和配音,快速完成完整创作流程。