H3 提示词完整指南:五种模式 + 时间码分镜,出片稳一半
H3 出片好坏,大半在提示词。它和"写一句话出图"的模型完全不同:你会同时指挥画面、镜头、对白、音效、配乐。先把模式选对,再按结构写。
五种模式,按手里的素材选
T2VA(纯文字生视频)、I2VA(给首帧、让画面动起来)、FL2VA(给定首尾帧、补全中间)、L2VA(给定尾帧、倒推开头)、Ref2VA(混合图+视频+音频多参考,最强最复杂)。别因为缩写酷就乱选,看你手上有什么素材。
提示词的三层结构
不管哪种模式,正经写法都分三层:时间线(按镜头写画面/动作/对白)、物理音效(环境声、脚步、布料摩擦)、配乐(只给观众听的配乐)。对白用引号写出角色台词,并放进对应镜头描述里,口型对齐会稳很多。
两个真能提效的写法
一是时间码分镜:按 [0s-2s]、[2s-5s] 切分,每段跟多模块结构,社区流行开后已被写进多份第三方指南;二是风格前置:开头一句声明画面风格(皮克斯/电影感/水墨/8-bit),效果立竿见影。长 prompt 给的是全片语境,适合概念预告,严格分镜请拆成多段分别生成。
电商广告案例:图生视频,H3 自动补齐运动与光影
H3 提示词技巧
H3 对中文提示词理解很自然,直接写大白话就行,不用硬翻英文。结构化依然有效:角色 + 任务 + 约束 + 输出格式 + 示例,五段给齐,产出立刻可用。它上下文窗口长,可以一次性喂进大段资料再问,比切小段更连贯。
做多模态任务时,把"你要它基于哪张图/哪个文件"说清楚,别让它猜。比如"基于我上传的第三张图,写一段产品描述",比"写段描述"准得多。长文写作先给大纲再让扩写,也比直接要一整篇质量高。
避坑
别堆无效修饰("请务必尽最大努力高质量地"这种),H3 不吃这套,反而稀释重点。复杂任务拆步骤给,一次塞太多要求它容易顾此失彼。涉及事实、数据、人名的部分,生成后务必你核对——再强的模型也会一本正经地编。
还有个习惯问题:第一版别当定稿。把它的回复发回去说"这里太啰嗦,缩短到一半""换个更口语的语气",迭代两三轮,效果才到位。好结果都是改出来的,不是一次生成的。
