做视频生成的内容创作者终于不用靠堆砌形容词碰运气了——这套导演式 Prompt 方法让你像控制分镜一样控制输出,建议直接套用文中的镜头词库和骨架试试。
本文介绍了如何将 Gemini Omni 用作视频导演工具,核心思路是从描述画面升级为控制系统。Google AI 提供了 5 种 Prompt 方法:调用真实世界知识、控制文字渲染、像摄影师一样写镜头、局部迭代修改、动态修改动作。文章给出了具体的 Prompt 骨架和镜头词库,帮助用户像导演一样控制世界知识、主体动作、镜头语言、文字系统、时间节奏和迭代约束。这种方法让视频生成更精准、可迭代,适合内容创作者和视频制作者直接使用。
这篇文章主要讲:怎么把 Gemini Omni 当成“视频导演工具”来用。重点不是写很长的画面描述,…
这篇文章主要讲:怎么把 Gemini Omni 当成“视频导演工具”来用。重点不是写很长的画面描述,而是用更像导演分镜的方式控制视频:世界知识、文字、镜头、迭代、动作。
主要讲了啥
Google AI 给了 5 个视频 Prompt 方法:
1. 调用真实世界知识 直接写文化、历史、科学、物理概念。比如“宇航员火星 POV”“大理石球链式反应轨道”。模型会自动补全很多真实世界细节。
2. 控制文字渲染 可以明确要求文字怎么出现,包括具体词语、字体、位置、动画、节奏、是否跟踪物体。
3. 像摄影师一样写镜头 用影视语言控制画面,比如 one continuous shot、locked off、push in、pan left、dolly zoom、vintage film camera。
4. 局部迭代修改 不用每次重写完整 Prompt。可以只说“保留原视频结构,把背景换掉”“只改镜头角度”。
5. 动态修改动作 可以直接要求角色改变动作、速度、情绪,比如踮脚走、加快节奏、跳起来。
最核心有价值的内容
最有价值的是这个思路: 视频生成 Prompt 要从“描述画面”升级成“导演控制系统”。
你要控制的不是单张画面,而是这些变量:
- 世界知识:这个场景遵循什么现实逻辑 - 主体动作:谁在做什么,怎么动 - 镜头语言:机位、角度、运动、镜头风格 - 文字系统:字幕、标题、位置、动画、节奏 - 时间节奏:时长、FPS、每个动作持续多久 - 迭代约束:保留什么,只改什么
可以直接操作的做法
1. **先用这个 Prompt 骨架**
```text [知识锚点] + [主体动作] + [场景与物理规则] + [镜头类型 / 镜头运动 / 相机风格] + [文字系统 / 节奏] + [保留项] + [修改项] ```
2. **镜头词直接套**
```text one continuous shot locked off fixed angle push in pan left dolly zoom natural smartphone zoom vintage film camera grainy webcam style ```
3. **文字控制这样写**
```text exact words: ... white lowercase sans-serif one word at a time motion-tracked text floating in 3D space synced to the beat bottom left ```
4. **局部修改这样写**
```text Preserve the character, composition, lighting, timing and scene geometry. Change only the camera angle to over the shoulder. ```
5. **动作变体这样写**
```text Make the character walk on tiptoes. Speed up the pacing. Have them leap into the air. Change the emotion to nervous excitement. ```
一句话总结
这篇文章最实用的点是:写视频 Prompt 时,把自己当导演,少写堆砌形容词,多写“知识锚点、镜头指令、文字系统、动作变量、保留边界”。