推文
@Michaelzsguo · 2026-10-12 05:05
今天早上,我和 Claude Code 一起,给 Mac 上的 Foresight 加中文转写支持。最后做成了,但回头看,几次关键突破都来自我继续追问了一句“为什么”。 最初,Claude 沿着替换模型的方向探索。模型能识别中文,应用里却还是只显示英文。我反复反馈实际看到的结果,它才继续追踪输出链路,发现应用内部还有一道只保留 ASCII 字符的过滤器。 解决了显示问题,也还没结束。为了让模型接入原应用,方案多出了一份 3.4GB 的 Gemma 模型包。我继续问:为什么需要重新构建?为什么要保留两份?为什么一定要用 Gemma,能不能换成更小的中英文语音模型? 这次追问把探索带到了另一条路:通过一个适配层,把语音交给专门的 SenseVoice-Small 处理,再把文字送回 Foresight。最终,模型、停顿检测和运行库合计 273MB,中文也能在原应用里显示了。 这让我想起现实中带团队的一项重要能力:问开放式问题。 如果我直接指定怎么改,Claude 很可能就沿着我选定的路径继续做。问“这个限制到底来自哪里”“还有什么办法能达到同样的目标”,才给了它重新调查、挑战假设的空间。 当然,开放式提问也需要明确的方向。我始终守住一个目标:让原来的应用方便地支持中文。实现方法可以调整,实际体验要不断验证。 和 agent 合作,沟通方式会影响它探索的方向。你在带着它解决问题。很多时候,一句问到关键处的“为什么”,比再补一条操作指令更有用。 这个早晨的完整复盘:https://why-as-a-springboard.mguo5.chatgpt.site/zh
曝光 161 · 评论 0 · 点赞 1 · 书签 1