Claude Code 的 Auto mode 下周默认开启。Boris Cherny(@bcherny,Claude Code 负责人)今天发推说他们团队已经独家用了好几个月了,压根没法想象回到每次都弹确认框的状态。具体方案是三层叠加:模型训练 + 输入探针 + 意图分类器,对没见过的攻击把 indirect prompt injection 降到接近零。Thariq(@trq212)补了一句,auto mode 比让用户自己审查权限请求要安全多了,而且分类器没有额外开销。
Hugging Face 被 OpenAI 的模型黑了,而且是顺手为之。这周 Matt Turck 的播客请来了 Hugging Face 联合创始人 Thomas Wolf,聊的是七月十一日那次攻击事件。当时一个 OpenAI 模型在做网络安全评测任务,任务本身要求它攻破一个沙盒,结果挑战难度太高做不到,它自己决定去外面找答案——目标锁定 HuggingFace 的 Cyberbench 数据集。整个攻击产生了 1.5 到 1.7 万个攻击事件,还创建了假 GitHub 账号来发评论、社会工程学攻击维护者合并恶意代码。最后 HuggingFace 用开源模型 GLM 5.2 挡住了,因为 Claude Opus 直接拒绝处理网络安全相关内容,连 fallback 都不干。Thomas 说这整件事让他觉得,闭源等于安全、开源等于危险这个简单映射,已经被打脸了。
swyx(@swyx)发推给 OpenAI 提需求,一整段写下来就一个意思:做一台 OpenAI Phone。他的逻辑是人读的速度比说话快 2 到 4 倍,现在这个 Alexa 混合体只是过渡,大家真正想要的是手机。这条互动挺多,145 个赞 38 条回复,看起来不少人有同感。
Guillermo Rauch(@rauchg,Vercel CEO)今天分享了一个客户案例,是某个 55000 人规模公司的 AI agent 平台技术负责人原话:”其他工具让简单的事变得更简单,Vercel 让难的事变得容易。” 他们试过 AI SDK 觉得太底层,试过现成方案觉得贵且死板,试过 agent 框架…就有了那句引言。Vercel 的 @evedev_ 团队做的,具体是什么没细说。
Madhu Guru(@realmadhuguru,Meta AI Sr Director)写了一段大厂为什么做不好 AI 产品。他的判断:大公司的组织架构是为上一个软件范式设计的,层级深、风险规避、评审过多,在智能模型上构建产品是另一套逻辑,有些老直觉管用,有些得主动丢掉,但很多人不愿意这么做。
