为每项输入分配一个职责
逐项命名图片、视频或音频参考,并说明要保留什么。把主体身份、外观、动作、环境和声音分开,避免参考素材互相冲突。
把视频创意以及文字、图片、音频或视频参考整理成一份结构化 Gemini Omni 简报。先明确每项输入负责什么,再安排时间线,最后复制提示词到官方 Gemini 工作流。
本页只构建提示词,NanoPic 当前不会在这里运行 Gemini Omni,也不会上传你的参考文件。单独的 Veo 3.1 链接会打开 NanoPic 自有生成器,不代表 Gemini Omni 请求。
创作目标: 制作一条克制的 8 秒商品短片,让无品牌钴蓝色陶瓷花瓶从安静的工作室静物场景过渡到完成布置的画廊展示。 输入职责: 第一张图只负责花瓶形状与釉色;短视频参考只负责缓慢转台节奏;音频只负责空间底噪,不复制任何说话者身份。 时间线与编辑计划: 0-2 秒:固定中远景工作室画面。2-6 秒:花瓶缓慢转动,光线掠过釉面。6-8 秒:扩展成干净画廊环境,最终停在正面偏三分之四角度。 运镜: 一次平滑、小幅度推进;不切镜、不环绕、不脉冲变焦、不突然重构画面。 音频: 轻柔工作室环境音,一次陶瓷接触声,无对白、无音乐。 连续性与排除项: 保持花瓶几何、釉面纹理、比例和朝向稳定;不要可读文字、Logo、水印、额外物体、重复花瓶或黑边。 请求输出: 16:9, 1080p
复制免费且不会创建供应商任务。提交前请在官方界面核对模型代码、支持的输入、安全规则与输出设置。
Google 将 Gemini Omni 描述为支持生成、扩展与对话式编辑的多模态视频模型。有效简报应该明确每项输入的职责,避免让模型猜测哪份参考负责身份、动作、声音或风格。
逐项命名图片、视频或音频参考,并说明要保留什么。把主体身份、外观、动作、环境和声音分开,避免参考素材互相冲突。
描述开场画面、定时动作、编辑节点和落版画面。扩展或编辑源视频时,先列出必须保留的内容,再写新增部分。
锁定主体数量、几何、服装、商品形状、运镜方向、对白归属和禁用伪影。多轮编辑时每次只改一个主要变量。
先确认是生成、扩展、首尾帧规划还是编辑。第一轮不要混入多个无关目标。
说明每个文件负责什么以及禁止复制什么,并确认你拥有使用人物、声音、品牌和源视频的权利。
把结构化简报粘贴到官方 Gemini 工作流,选择可用 Gemini Omni 模型及受支持设置,再检查可见的供应商条款。
检查连续性、时间、音频、文字、手部、几何和边缘,只提出一个定向修改,并明确保留已经正确的部分。
不会。本页是免费提示词规划工具,不会发送生成请求。Gemini Omni 任务请使用 Google 官方 Gemini 界面。NanoPic 的 Veo 3.1 链接是另一个模型的独立生成器。
Google 当前模型文档列出的 Gemini Omni Flash 代码是 gemini-omni-1.1-flash。模型名称、可用性、输入支持和弃用时间可能变化,提交时请核对官方模型页。
Google 描述了文字、图片、音频与视频输入,以及视频生成和编辑工作流。具体组合和限制以当前 API 与界面为准。
职责说明可以减少歧义。例如一张图负责主体外观,一段视频负责动作,一段音频负责环境声,而不是默认完整复制所有参考内容。
不会。在本页编辑和复制简报只是浏览器本地操作。打开其他生成器不会自动提交任务;可用任务的成本应在提交前由对应生成器显示。