TwKit

推文

@wlzh · 2026-10-11 09:22

纳德拉昨晚发了篇长文,核心就一句话:别再把 AI 模型当自己人了。 传统软件再复杂,你好歹能追踪代码跑哪去了;AI 模型是个黑盒子,能力强得多,但你根本不知道它在想什么。都这样了,还把它当"可信组件"用,心也太大了。 所以他给开发者立了个规矩:默认假设模型已经被攻破了,再围绕这个假设设计系统。七条原则: 1. 模型多样性:别把鸡蛋放一个篮子里,更别让模型自己验证自己的活儿 2. 观察一切:模型干的每件大事,都得留下防篡改、人类能看懂的证据 3. 可验证性:天天测,不光测成功的,故障、攻击、边缘情况全测 4. 独立控制:模型能碰什么、能干什么,人说了算 5. 独立审计:裁判不能是运动员,不能让模型自己证明自己没干坏事 6. 遏制:紧急刹车必须有,授权的人随时能暂停、能关停,模型越强刹车得越好 7. 事件披露:出事了别捂着,及时告诉受影响的人,全行业通报警示 还有两句狠的:闭源开放在他眼里都是"内部风险",别分亲疏;模型提供商不能把责任外包出去——"超级智能"不是套个黑匣子、点个接受就能免责的。 说白了,纳德拉在给全行业打预防针:AI 智能体已经摸到你最敏感的数据、替你干最关键的活了,信任架构得重建。先假设它会失控,再谈怎么用它。

曝光 689 · 评论 5 · 点赞 3 · 书签 1 · 曝光/时 189.27897005028396

TwKit
正在载入