Omni-Reference:三视图锁脸

Omni-Reference: Face Lock via Three Views

用正视图/侧视图/背视图三张参考图 + 一张表情参考,把角色面孔锁死;参考图标记必须统一写成 <Picture 1> 形式。

自产验证作者 template难度 进阶427 字符3 次浏览

提示词全文

【subject_definitions】 角色定义以 <Picture 1>(正面)、<Picture 2>(侧面)、<Picture 3>(背面) 三张参考图为准,四者描述同一人物。 <Picture 4> 仅提供表情与嘴型参考,不参与服装判定。 【summary】 角色在近景固定机位前完成一段独白,头部有自然的微转动,口型与台词语速匹配。 【retention_analysis】 必须保留:脸型轮廓、眼型与瞳色、眉形、发型分区与发际线、耳饰。 允许变化:头部偏转角度、表情强度、眨眼频率。 【detailed_description】 机位:85mm 等效焦距,齐胸近景,机位与视线齐平,浅景深,背景为虚化的室外环境光斑。 表演:说话时下颌开合幅度适中,重音处眉峰轻抬,句尾有一次自然的眨眼。 光线:柔和主光来自画面左前方,右侧补光弱两档,面部无硬阴影。 【Negative】 脸部形态漂移,五官错位,牙齿外翻,颈部过长,背景出现清晰建筑结构。

官方描述(另一语言)

Lock the character's face with three-view references plus an expression reference; keep all reference markers in <Picture N> form.

逐段拆解

哪一段在控制画面里的什么 —— 这是照抄提示词学不到的部分

subject_definitions

三视图 + 表情图,明确各图职责

→分工写清楚,模型才不会拿表情图去改服装

summary

近景独白

→限定景别与表演类型

retention_analysis

逐项锁五官与发型

→脸部漂移几乎都出在这一段写得太笼统

detailed_description

机位/表演/光线三段

→焦距与景深决定「像不像影视」,必须显式写

Negative

列出漂移形态

→同样避免使用否定句式,只描述要排除的形态

失败对照

症状 → 原因 → 改法

症状说话时脸会缓慢变成另一个人

原因三视图参考权重被表情图稀释

改法把表情图单独声明为「仅提供表情参考,不参与身份判定」

症状口型与台词对不上

原因没写语速与重音位置

改法在 detailed_description 里给出重音落点,或改用音频驱动模式

相关案例

谢尔顿与佩妮的纯提示词生成
文生视频 演示12 秒16:9

谢尔顿与佩妮的纯提示词生成

以谢尔顿和佩妮作为文字指令中的角色,用 MiniMax H3 直接完成角色场景。

角色对白作者原发15194 字符
创作者@SqueakAlGaib
追逐午夜龙的碎月少年
首尾帧 演示15 秒16:9

追逐午夜龙的碎月少年

少年 Kael 目睹银月裂开、午夜龙衔走碎片,随即穿过湖畔与森林追向禁忌山谷。 原生视频规格为 15 秒 · 2560×1440。原帖完整公开了 Prompt,本页按原文保留。

角色对白作者原发24378 字符
创作者@ManuAGI01
温室里的害羞雨云
首尾帧 演示15 秒16:9

温室里的害羞雨云

小园丁 Luma 在旧水壶中发现害羞雨云 Nimbus,一滴雨让枯萎向日葵重新抬头。 原生视频规格为 15 秒 · 2560×1440。原帖完整公开了 Prompt,本页按原文保留。

角色对白作者原发23806 字符
创作者@ManuAGI01
黄昏加油站旁的家庭录像
文生视频 演示15 秒629:360

黄昏加油站旁的家庭录像

女子站在旧车与加油机旁对拍摄者说话,手持镜头留下倾斜和晃动。

角色对白作者原发5037 字符
创作者@bmx_ai13
公寓门前的韩剧式对峙
文生视频 演示15 秒16:9

公寓门前的韩剧式对峙

两人在公寓内对峙,双人构图切换为各自近景。

角色对白作者原发6030 字符
创作者@IamEmily2050
晨起女子与海景露台的一日开场
文生视频 演示15 秒16:9

晨起女子与海景露台的一日开场

长发女子先坐在明亮卧室的床上整理头发,随后画面切到摆有木桌椅的海景露台,最后以落日海面和“Good vibes, Good life”文字收尾。 成片规格为 15 秒 · 1088×720。原帖完整公开了 Prompt,本页按原文保留。

角色对白作者原发3349 字符
创作者@ayzalnooor24521