Omni-Reference:三视图锁脸
Omni-Reference: Face Lock via Three Views
用正视图/侧视图/背视图三张参考图 + 一张表情参考,把角色面孔锁死;参考图标记必须统一写成 <Picture 1> 形式。
プロンプト全文
【subject_definitions】 角色定义以 <Picture 1>(正面)、<Picture 2>(侧面)、<Picture 3>(背面) 三张参考图为准,四者描述同一人物。 <Picture 4> 仅提供表情与嘴型参考,不参与服装判定。 【summary】 角色在近景固定机位前完成一段独白,头部有自然的微转动,口型与台词语速匹配。 【retention_analysis】 必须保留:脸型轮廓、眼型与瞳色、眉形、发型分区与发际线、耳饰。 允许变化:头部偏转角度、表情强度、眨眼频率。 【detailed_description】 机位:85mm 等效焦距,齐胸近景,机位与视线齐平,浅景深,背景为虚化的室外环境光斑。 表演:说话时下颌开合幅度适中,重音处眉峰轻抬,句尾有一次自然的眨眼。 光线:柔和主光来自画面左前方,右侧补光弱两档,面部无硬阴影。 【Negative】 脸部形态漂移,五官错位,牙齿外翻,颈部过长,背景出现清晰建筑结构。
公式説明(別言語)
Lock the character's face with three-view references plus an expression reference; keep all reference markers in <Picture N> form.
セグメント解説
各セグメントが映像の何を制御しているか —— 丸写しでは分からない部分です
subject_definitions三视图 + 表情图,明确各图职责
→分工写清楚,模型才不会拿表情图去改服装
summary近景独白
→限定景别与表演类型
retention_analysis逐项锁五官与发型
→脸部漂移几乎都出在这一段写得太笼统
detailed_description机位/表演/光线三段
→焦距与景深决定「像不像影视」,必须显式写
Negative列出漂移形态
→同样避免使用否定句式,只描述要排除的形态
失敗の対照表
症状 → 原因 → 対処
症状说话时脸会缓慢变成另一个人
原因三视图参考权重被表情图稀释
対処把表情图单独声明为「仅提供表情参考,不参与身份判定」
症状口型与台词对不上
原因没写语速与重音位置
対処在 detailed_description 里给出重音落点,或改用音频驱动模式
関連する事例
テキストから動画 デモ12 秒16:9谢尔顿与佩妮的纯提示词生成
以谢尔顿和佩妮作为文字指令中的角色,用 MiniMax H3 直接完成角色场景。
始点と終点のフレーム デモ15 秒16:9追逐午夜龙的碎月少年
少年 Kael 目睹银月裂开、午夜龙衔走碎片,随即穿过湖畔与森林追向禁忌山谷。 原生视频规格为 15 秒 · 2560×1440。原帖完整公开了 Prompt,本页按原文保留。
始点と終点のフレーム デモ15 秒16:9温室里的害羞雨云
小园丁 Luma 在旧水壶中发现害羞雨云 Nimbus,一滴雨让枯萎向日葵重新抬头。 原生视频规格为 15 秒 · 2560×1440。原帖完整公开了 Prompt,本页按原文保留。
テキストから動画 デモ15 秒629:360黄昏加油站旁的家庭录像
女子站在旧车与加油机旁对拍摄者说话,手持镜头留下倾斜和晃动。
テキストから動画 デモ15 秒16:9公寓门前的韩剧式对峙
两人在公寓内对峙,双人构图切换为各自近景。
テキストから動画 デモ15 秒16:9晨起女子与海景露台的一日开场
长发女子先坐在明亮卧室的床上整理头发,随后画面切到摆有木桌椅的海景露台,最后以落日海面和“Good vibes, Good life”文字收尾。 成片规格为 15 秒 · 1088×720。原帖完整公开了 Prompt,本页按原文保留。