TwKit

推文

@noahvisualsx · 2026-10-11 10:07

为什么大家用 Opus 5.5 做的动效,最后都长一个样? 居中大字、渐变背景、全员淡入、结尾甩个 logo。 看完 @N01ennn 那篇长文才想明白:prompt 只占很小一部分,成片好坏取决于模型外面那一圈,规则、检查、循环。最近很火的动效设计、harness engineering、loop engineering,其实是同一套东西。 拆开讲。 1. 动效是怎么来的 Opus 写出来的是代码:一个 draw(t) 函数,给任意时间点都能画出确定的那一帧。无头浏览器逐帧截图,ffmpeg 拼成视频。 每帧只取决于时间,同一帧渲染两次结果完全一样,所以可以自动检查。 这也意味着需要一个能执行命令的环境,比如 Claude Code。只在对话框里写出代码,渲染和回看帧都做不了。 2. Harness:套在模型外面的规矩和检查 出自 Birgitta Böckeler 在 http://martinfowler.com 的框架,分两半: - guide:动手前的约束。规则文件、风格指南、分镜表、品牌素材 - sensor:做完后的检查。脚本跑的确定性检查(帧哈希、循环接缝、测试),加上模型判断的推理型检查(让 Opus 看自己渲染的帧缩略图打分) 每踩一次坑,规则文件里就多一条禁用项,越用越稳。 3. Loop:让它自己跑到合格为止 这个词今年 6 月才出现。有篇论文的比喻很准:harness 是引擎,loop 是驾驶员。 按交出去多少,循环分四档:每轮人来审 → 交出停止条件 → 交出触发时机 → 连 prompt 都交出去。 Claude Code 的 /goal 就是第二档:每轮结束,一个小模型检查完成条件达没达成,没达成就接着干,还能限制轮数。 4. 可以直接抄的四步 ① 写一份 CLAUDE.md 或 AGENTS.md:约定、禁用的默认做法、完成标准 ② 加两个检查:一个每次改动都跑的脚本,一个带独立评审说明的模型检查 ③ 包成 goal:机器能判断的停止条件 + 轮数上限 + 没进展就中止 ④ 同一个问题出现两次,去改规则和检查,别只修这一版 一个常见的坑: 只让模型凭自己的感觉反复改,几乎没提升。接上测试、schema 这类硬检查,效果才明显。能写成脚本的指标,尽量写成脚本。 5. 为什么是 Opus 5.5 官方数据:多数任务达到 Fable 5.1 水平,综合成本比 Opus 5 低 40%。便宜,才敢让它反复跑;能看图,才能检查自己的帧。 6. 能拿来做什么 UI 演示、文字动效、数据可视化、产品功能讲解都很合适。做电商的,详情页卖点动图、功能演示视频可以直接上。 写实人物视频,还是交给视频模型。 你的 CLAUDE.md 第一条禁用项,会写什么?

曝光 109 · 评论 1 · 点赞 1 · 书签 1 · 曝光/时 81.7140836470303

TwKit
正在载入