跳到主要内容

MINIMAX H3

一个模型,理解每一项创作意图。

真正的能力,要在镜头里成立

从角色一致性、镜头执行到物理真实感,H3 把每一条创作指令,转化为连续、可信、可以直接使用的视频结果。

选择案例: 角色一致性

从输入到成片,只需三步

添加参考,描述镜头,然后生成。H3 会理解人物、动作、声音与风格,把分散的创作信息组织成一段完整视频。

  1. 第一步:输入图像/ 视频参考图

    上传图像、视频或声音,让 H3 理解人物、场景与整体风格。

  2. 第二步:输入提示词

    用自然语言说明动作、摄影机、节奏以及需要保持不变的内容。

  3. 第三步:生成结果

    选择画幅与时长,生成视频;再通过新的指令继续修改和完善。

越复杂的镜头,越能看见 H3 的理解

从指令执行到主体稳定,从摄影机调度到真实物理反馈,H3 让复杂的创作要求在连续画面中同时成立。

PROMPT INTELLIGENCE

每一条指令,都被认真执行

H3 能同时处理人物、场景、动作、镜头与时间顺序,理解不同要求之间的约束和优先级,让复杂 Prompt 依然能够逐项落实。

SUBJECT CONSISTENCY

主体稳定,故事才能连续

无论景别、角度、光线还是动作如何变化,人物五官、服装、道具与空间关系都能在连续镜头中保持一致。

DIRECTOR CONTROL

镜头按你的叙事节奏移动

跟拍、推拉、摇移、升降与环绕不再随机发生。H3 会协调摄影机与主体动作,让每一次镜头移动都有明确的叙事目的。

PHYSICAL REALISM

运动有惯性,世界有重量

人物、布料、水流、烟雾与物体碰撞遵循连续的重力、惯性和材质反馈,让高速动作与复杂交互依然自然可信。

现在,让你的想法成真

选择一个模型,开始第一段创作。

选择你的套餐

获得更多生成次数,并优先体验 PixPix 的全新创作功能。

关于 H3,你可能还想知道

输入方式、生成规格与镜头控制的常见问题。

支持文本、图像、视频与声音输入,可单独使用,也可组合为统一的创作上下文。

从零创作选文生视频;规定起止构图选首尾帧;锁定人物、道具与风格选全能参考。

支持 4–15 秒视频,最高 2K 分辨率与 24fps 输出;具体规格以生成模式为准。

使用清晰参考素材,并在提示词中固定人物身份、服装、道具位置及不可变化项。

支持跟拍、推拉、摇移、升降与环绕;用时间分段描述,镜头执行会更清晰。

减少同一镜头中的核心动作,明确空间关系、动作顺序和结束状态,通常更容易稳定生成。