独立 Turbo 端点
文生使用 minimax/h3-max-turbo/text-to-video,首尾帧使用 minimax/h3-max-turbo/image-to-video。它们是公开 fal 模型别名,不是发送给 Max 或 H3 的 turbo 布尔值。明确 ID 后,队列轮询、错误和任务历史才能审计。
选择文字或首尾帧模式,从聚焦测试开始,并在本生成器内查看实时所需积分后提交。
MiniMax H3 Max Turbo
fal 官方 MiniMax H3 Max Turbo 输出示例
此素材来自 fal 官方模型页,用作供应商证据,不代表 NanoPic 已完成付费实测。

MiniMax H3 Max Turbo 是 fal 提供的独立 Max 系列文生与图生视频路由。它接收文字镜头,或一张首帧与可选尾帧,生成 5–15 秒、480P/768P 的原生音视频。需要在正式成片前比较多种运镜、动作或节奏时,Turbo 适合持续迭代。它仍是生成系统,速度不会省掉人工检查:人物身份、人体结构、物体接触、事实细节和声音同步都必须在完整视频里确认。
NanoPic 的选项对应 active 状态的 fal 公开别名;超出官方结构的值会在创建供应商请求前被拒绝。
文生使用 minimax/h3-max-turbo/text-to-video,首尾帧使用 minimax/h3-max-turbo/image-to-video。它们是公开 fal 模型别名,不是发送给 Max 或 H3 的 turbo 布尔值。明确 ID 后,队列轮询、错误和任务历史才能审计。
可选 21:9、16:9、4:3、1:1、3:4 与 9:16,并按目标画幅写镜头。竖屏需要适合窄画布的主体间距和运动,超宽画面要主动利用两侧空间。
图生视频必须提供首帧,也可以用第二张图指定终点。NanoPic 专用适配器保留上传顺序,映射成 image_url 和 end_image_url。端点从源图获取几何关系,因此页面不会显示无效的文生画幅控件。
支持 5–15 秒内每个整数。五秒适合测试动作,八至十秒适合揭示或短台词,十五秒可安排更从容的事件序列。更长不等于更好,每增加一秒都应有明确用途。
两个 Turbo 端点都支持 480P 与 768P。先用 480P 判断场景是否读得懂、动作是否及时开始、镜头是否按预期移动;决定稳定后再上 768P。公开结构没有 1080P 或 2K。
返回视频含原生音频,提示词可以把环境、台词、音乐和音效绑定到画面事件。Balanced 是默认扩写,Quality 允许更长供应商处理时间;两者都不能替代实际试听,也不能让过长台词自动适配短视频。
让每个草稿只回答一个创意问题。用可重复的检查循环,不要看完结果就一次改变所有参数。
先决定任务:检查运镜是否成立、人物动作是否读得懂、产品首帧能否走到干净英雄画面,或声音能否落在正确时刻。广泛探索用文生视频,必须保留开场构图时用图生视频。只有能描述两端之间合理路径时才添加尾帧;互相矛盾的主体、光线和透视变化会让生成目标失焦。
设置草稿先写主体和连续性,再写一个主动作、景别与运镜、光线与环境行为,最后写台词或声音,并以不要字幕、不要多余人物等硬限制收尾。这个顺序让失败更容易定位。Balanced 能整理文字,但两个创意方向冲突时,扩写无法替你决定哪个优先。
阅读提示词指南先生成一段短 480P 草稿,固定时长、分辨率、画幅和源图,只比较两个提示版本;再固定较好的提示,测试机位或节奏。受控实验能看出哪条指令真正改善结果,也避免用长视频才发现开场构图错误。
开始聚焦草稿草稿成功后,只增加完整节拍需要的秒数;细节确有用途时再选 768P。打开完成视频,声音重要时戴耳机听,在快速运动和物体接触处逐帧检查。记录成功种子和设置,但输入或提示结构变化后,结果仍可能明显不同。
查看控制项清晰比长度更重要。每句话都应说明可见、可听或连续性必需的内容。
指出观众跟随的人或物,只列出本镜头需要保持的特征。人物可写服装、头发、位置和视线;产品可写轮廓、材质、颜色和朝向。有首帧时,重点说明希望发生的运动,不必重新描述每个像素。
可执行动作有开头和可观察结尾:骑行者停在雨棚下、盒盖合上、窗帘揭开房间,或镜头到达车头。多个节拍应按顺序写,并给最后状态留短暂停顿,方便后期剪辑。
写清景别和一个主镜头行为,例如肩高横向跟拍、低机位固定近景或缓慢俯拍升高。变焦和焦点变化应服务动作;“镜头固定并高速环绕”这样的矛盾指令会让结果无法评估。
用光线方向、色温、天气、纹理、倒影、粒子与背景运动代替泛泛情绪词。写雨如何作用于玻璃、布料如何被风吹动、霓虹如何滑过金属。次要运动要克制,让短片的焦点动作仍然清楚。
台词前写明说话者,长度符合真实语速;音效要连到可见来源,持续环境声另写,音乐说明主导或克制。原生音频属于生成文件,但同步、发音、噪声与平衡仍需人工试听。
只保护会让视频失效的关键内容:不要字幕、不要重复肢体、不要额外产品、不要切镜、服装稳定或结尾干净。过长排除清单会稀释主方向;精确文字与受监管产品信息应在后期添加。
这个模型适合探索、方案对比和早期运动决策。
围绕机位、运动、时段或表演能量制作受控变量,其余提示保持不变,让团队只比较一个决定。每个任务都记录设置,不要只靠缩略图和记忆。
上传分镜、概念图、产品照片或人物肖像,测试它如何开始运动。保护主体,描述本片需要的动作。结果是生成解释,不保证身份与产品几何完全一致。
为竖屏、方形或横屏制作五秒开场,把视觉钩子放在第一个节拍,文字留给剪辑,并分别判断有声与静音时是否读得懂。只有首尾状态能合理对齐时才要求无缝循环。
测试关门、列车到站、水花、人物反应或音乐提示是否支持故事节拍。生成音轨适合作为规划参考;版权、精确时序、声音身份或播出质量重要时,应在后期替换。
先探索光线如何掠过玻璃、金属、布料、美妆、食物或包装,再决定是否做长片。逐帧检查标签、Logo、边缘、反射和物理接触,不能让生成视频虚构产品并不存在的功能。
用多个聚焦草稿确定调度和镜头语言,只把最强方向延长或升级分辨率。Turbo 草稿是制作讨论的证据,但仍是一份生成提案,不是正式拍摄一定复现的蓝图。
名字相似不代表 ID 可互换。使用前确认选择器显示的型号,并遵循该路由的参数。
需要 fal 的独立 Turbo 文生与首尾帧路由时选择本页。它支持 480P/768P 与 5–15 秒。本页默认 Turbo,绝不会把请求改写成基础 H3。
明确需要非 Turbo fal 别名时选择 H3 Max。NanoPic 开放的两种模式和参数维度相同。它的参考端点尚未开放,因为当前公开表单无法安全约束混合参考输入规则。
现有 NanoPic H3 使用 KIE ID,从 4 秒开始,提供 768P/2K,并有不同的文字、首尾帧与参考控制。它保持独立型号,没有被改名为 Max 或 Turbo。
了解端点、输入规则、声音行为、控制项和当前验证边界。
是。fal 发布 active 状态的 minimax/h3-max-turbo/text-to-video 与 minimax/h3-max-turbo/image-to-video。NanoPic 使用这些精确 ID 并轮询公开队列别名,不通过重命名 H3 Max 或 H3 来模拟 Turbo。
文生需要提示词;图生必须有首帧,可选尾帧。专用适配器保留顺序,移除不适用的文生画幅,把时长转成 fal 要求的整数,并保留分辨率和扩写模式。
分辨率为 480P/768P,时长为 5–15 秒任意整数。文生支持 21:9、16:9、4:3、1:1、3:4、9:16;图生跟随源画面,不显示无效画幅覆盖。
fal 将它作为原生视听生成并返回视频文件。可提示台词、环境、音乐与动作音效;完成后必须播放视频,海报或浏览器静音状态无法验证音轨。
在生成器内选择场景、时长与分辨率。已登录用户会在生成操作区看到提交当前任务所需的实时 NanoPic 积分。
会。时长和分辨率会影响当前需求,提交前应以生成器内部实时显示的数值为准。
不做这种通用质量承诺。Turbo 与 H3 Max 是不同的 fal 路由;应使用同一制作说明进行受控测试,完整检查视频与声音,再判断差异是否对具体镜头有意义。
尚未。本地测试覆盖 payload 映射、必需首帧、队列轮询、输出解析、参数归一化与严格拒绝行为。生产就绪前仍需单独批准付费真实生成。