推文
@Soranlan · 2026-10-04 19:43
感觉这个脸,没之前的好看了,而且手还多了 prompt: 生成一段20秒、16:9横屏、中文对白、超真实AI动态桌面互动视频。 【人物参考】 仅使用图片1锁定成年女主的五官、脸型、发型、肤色、人物身份和身体比例。 图片1中的服装不作为服装参考。 全程必须是同一个成年女主,不换脸,不改变五官,不改变发型,不改变肤色,不改变身材比例。 人物身份一致性的优先级最高。即使服装变化,脸、发型、肤色和身体比例仍保持高度一致。 【整体场景】 模拟电脑全屏桌面录屏。 画面底部始终保留简洁任务栏,左上角保留少量桌面图标。 桌面中央是一张可以实时互动的动态壁纸。 深色现代房间,黑色皮质沙发,冷色柔光,背景安静简洁。 固定机位。 全程 SINGLE CONTINUOUS SHOT。 20秒内完全一镜到底。 禁止切镜。 禁止推拉镜头。 禁止镜头突然重新构图。 女主主要活动于画面右半部分。 画面左侧中部始终留给语音字幕UI。 【字幕UI】 字幕只出现在画面左侧中部,不能放到底部。 字体为纤细现代无衬线中文字体,中等字号,无底框,轻微柔光和阴影。 女主 S1 说话时: 淡紫色字幕。 字幕左侧显示小型扬声器图标。 男主 S2 说话时: 白色字幕。 字幕左侧显示小型麦克风图标。 字幕下方始终存在一条细小白色实时音频波形。 当前有人说话时,波形随声音自然跳动。 每句话必须随着真实发音逐字输入。 约每字0.08至0.12秒。 不能整句同时出现。 不能提前出现后面的字。 当前句结束后完整字幕停留约0.4秒,再整体淡出。 下一句话开始之前,上一句已经完成淡出。 【对白规则】 成年女主固定为 S1。 镜头外成年中文男声固定为 S2。 S2 永远不露脸。 S1说话时,只有S1张嘴。 S2说话时,S1嘴唇必须完全闭合,只允许通过眼神、微笑、点头、转身等非口型反应进行互动。 严禁两个人同时说话。 所有中文对白口型必须准确。 对白自然,像真实情侣在电脑前随口互动,避免夸张配音腔。 【服装状态】 初始服装: 黑白横条纹修身短款七分袖上衣,低圆领或浅V领,轻微露出事业线,其余位置完整遮盖。 黑色低腰抽绳休闲长裤。 银色细项链。 第一套学院风: 深蓝黑格纹短款针织上衣,浅V领,剪裁完整自然。 蓝黑格纹百褶短裙。 白色过膝袜。 黑色乐福鞋。 整体年轻、清爽、自然。 第二套学院风: 黑色修身短西装外套。 象牙白衬衫,浅V领。 酒红色细领带。 酒红黑色格纹百褶短裙。 浅肤色薄丝袜。 黑色乐福鞋。 整体更成熟、更精致、更有反差。 所有衣服必须具有真实布料厚度、缝线、褶皱、重量和自然下垂。 禁止衣服在人物走动过程中融化、闪烁、变形或自行变化。 任何换装只能发生在女主完全离开画面以后。 【20秒完整时间线】 00:00至00:02.50 S1穿初始造型坐在黑色皮沙发右侧。 腿上抱着黑色靠枕。 她先自然整理一下耳边头发,然后抬眼看向镜头。 眼神亲近,带一点轻微玩笑感。 S1自然开口: 「今天想看哪套?」 左侧淡紫色字幕按照发音逐字输入: 「今天想看哪套?」 字幕下方白色波形随声音跳动。 00:02.50至00:03.40 S2从镜头外回答: 「想看学院风。」 S1立即闭嘴。 她听着男声,只轻轻抬眉,然后笑着点一下头。 左侧白色字幕逐字输入: 「想看学院风。」 00:03.40至00:04.60 S1笑着回答: 「行,等我一下。」 字幕同步逐字输入: 「行,等我一下。」 说完后,她立刻把黑色靠枕放到身边。 右手撑住沙发,自然起身。 00:04.60至00:07.20 S1迅速站起。 因为固定镜头距离较近,她的身体从镜头右侧前景向上掠过。 脸自然离开画面上沿。 腰部、长裤和腿部短暂经过前景。 她随后直接向右侧走出画面。 完全离画后才能开始换装。 出现一次轻快、短促的「嗖」声。 画面留下黑色皮沙发约0.8秒空镜。 桌面UI、任务栏、图标、沙发、光线、背景、镜头全部保持完全不动。 00:07.20至00:10.20 伴随一个很轻的亮相提示音。 S1已经在画外完成第一套换装。 她穿蓝黑学院风造型从右侧重新走进画面。 整个进入过程衣服保持稳定完整。 不能边走边生成服装。 不能出现局部闪烁或服装突变。 她站到靠近镜头的右侧位置。 由于距离较近,镜头主要看到腰部、蓝黑格纹裙摆、过膝袜和腿部。 头部允许自然超出画面上沿。 她轻轻转动一下身体,让百褶裙产生很小幅度、真实的惯性摆动。 然后略微低头朝镜头方向看。 S1笑着问: 「这套可以吗?」 淡紫色字幕逐字输入: 「这套可以吗?」 00:10.20至00:11.20 S2立即回答: 「好看,挺乖的。」 S1保持闭嘴。 她听见「挺乖的」以后,笑意停顿一下。 眼神变成一点不服气又觉得好笑的状态。 白色字幕逐字输入: 「好看,挺乖的。」 00:11.20至00:12.50 S1轻轻挑眉。 像临时改变主意一样说道: 「那再换一套。」 淡紫色字幕逐字输入: 「那再换一套。」 说完立刻转身。 裙摆跟随身体产生自然惯性。 她快速向右侧完全离开画面。 00:12.50至00:15.10 S1完全离画。 再次出现一次短促、流畅的换装「嗖」声。 沙发和桌面留下约0.7秒稳定空镜。 换装只能在画外完成。 随后S1已经穿好第二套酒红学院风,从右侧重新进入。 黑色西装、白色衬衫、酒红领带、酒红黑格纹裙、丝袜和乐福鞋从进入画面的第一刻起就已经完整存在。 服装在整个行走过程中保持完全一致。 她走到刚才相近的位置停下。 一只手很自然地整理一下西装下摆和领带。 然后轻轻侧身展示完整轮廓。 00:15.10至00:16.30 S1看着镜头问: 「这套呢?」 淡紫色字幕逐字输入: 「这套呢?」 00:16.30至00:17.30 S2几乎没有犹豫地回答: 「这套更适合你。」 S1完全闭嘴。 她听完以后先轻轻笑一下。 随后开始自然坐回沙发。 白色字幕逐字输入: 「这套更适合你。」 00:17.30至00:20.00 S1快速但自然地坐回黑色皮沙发右侧。 拿起原来的黑色靠枕重新抱在腿上。 她顺手整理一下头发和酒红领带。 身体微微靠向沙发。 镜头重新完整看到她的脸。 她始终看着镜头。 表情从刚才展示服装时的自信,变成亲近、略带捉弄感。 她抱着靠枕,嘴角微微扬起,对镜头说道: 「那你只能留一套。」 淡紫色字幕随着发音逐字输入: 「那你只能留一套。」 说完以后不要增加新的对白。 她轻轻偏头。 保持眼神交流。 像在等镜头外的人做决定。 字幕完整停留约0.4秒。 实时波形逐渐恢复平静。 画面自然结束。 【声音设计】 S1为真实年轻成年女性中文现场人声。 音色自然、亲近,避免广播腔。 S2为成年中文男性画外音。 声音距离感像坐在电脑前和她直接交流。 对白必须始终最清晰。 房间内保留非常轻微的真实环境底噪。 头发整理、身体起身、衣料摩擦、裙摆摆动、坐回沙发均带轻微真实物理声音。 两次离画换装分别出现一次非常短的流畅「嗖」声。 重新进入画面时允许一个极轻的亮相提示音。 背景音乐使用低音量、克制的电子氛围音乐。 对白开始时音乐自动降低。 对白结束后轻微恢复。 音乐不能覆盖对白。 【表演】 全程自然克制。 不要夸张卖萌。 不要舞台式展示。 不要刻意扭腰。 不要持续摆Pose。 所有动作像真实人在房间里和镜头外熟悉的人随口聊天。 初始状态亲近轻松。 第一次学院风带一点俏皮。 听到「挺乖的」之后出现很短的反差反应。 第二套更自信成熟。 最后重新坐下以后带一点得逞式的小捉弄感。 【稳定性约束】 固定机位。 一镜到底。 无切镜。 无推拉。 无突然变焦。 无镜头漂移。 无瞬移。 无镜内变装。 无服装融化。 无服装闪烁。 无人物复制。 无多余人物。 无错误手指。 无异常手臂。 无异常腿部。 无身体比例突变。 无脸型变化。 无发型变化。 无年龄变化。 S2永远不进入画面。 S2说话时S1严格闭嘴。 同一时刻只能有一个说话人。 字幕只能对应当前正在说话的人。 字幕不能提前出现下一句话。 保持桌面任务栏、图标、沙发、房间布局、灯光和镜头轴线从第一帧到最后一帧完全连续。
曝光 7003 · 评论 0 · 点赞 0 · 书签 0