面向Google编程CHARLES ZHANG

AI DAILY / 2026-09-30

Claude Code 的下一程:与 Anthropic 的 Thariq 共谈产品演进与代理安全

Claude Code’s Next Era — Thariq Shihipar, Anthropic

AI 编程实践Latent Space · 2026-09-29

全文中文翻译 · AI 生成,仅供学习交流

Claude Code 的下一个时代 — Thariq Shihipar, Anthropic

在我们恭喜(节目的老朋友!)General Intuition 推出新模型以及(节目的老朋友!)Shunyu Yao 推出新模型的同时,世界正等待 GPT-5.6 Sol Ultra 的发布,人们也在争相抢在 Fable 5 之前摸到它的极限……

可变软件的未来

特别留意 Claude Mods(尤其是 cheatsheet):

Boris Cherny @bcherny:Claude Mods 正在陆续推出,已经有人做出了"Claude 里的俄罗斯方块"模组 🤯 详情见 issue,了解最新的社区动态、技术细节和更多酷炫 demo(GitHub 上的 issue 页面)。

原文配图

Thariq @trq212:很奇怪,明明有一个"赚大钱"的按钮,却没人去按它。(把你的 SaaS 做成无界面版本,让代理来调用,按次收费,尤其是面向企业的场景)

云端大脑,本地双手

也可以试试 Claude Projects:

Boris Cherny @bcherny:Projects 不仅改变了我与 Claude 互动的方式,也改变了我写代码的方式。我不再管理会话(session),只是在想东西的时候随手发出来,Claude 会自动把它们拆成多个线程(thread),project 会记住我的工作方式。我现在大部分代码都是在它里面写的。

原文配图

(截图:我自己真实的使用界面)

ClaudeDevs @ClaudeDevs:今天我们正式在桌面端和网页端的 Claude Code 中推出 Projects。一个 project 就是和 Claude 的一段对话,它会自己把工作拆成多个线程,并行作为云端会话(cloud session)来跑,在它们之间传递上下文,并且在你离开后继续推进。目前为部分用户开放 beta。

"双手"这个词并不只是 Cognition 等前沿编程代理(coding agent)公司正在搭建的本地/云端范式的比喻;同时,它与我们即将在后续节目中与 Anthropic 一起讨论的安全系统议题也密切相关,他们正试图以负责任的 AI 部署来"与前沿同行"(Pacing the Frontier)。

至于我们节目开头预告的 Thariq 写作技巧,观看完整视频:

Sarah Chieng @MilksandMatcha:"技术写作彻底改变了我的生活。",@trq212 在不到两年的时间里,Thariq(@AnthropicAI)掌握了写技术文章的诀窍,阅读量稳定破百万。在这 15 分钟的工作坊里,他拆解了:→ 他完整的写作流程 → 各种技巧……

从 Claude Code 的迅速崛起,到代理能够重写自己的执行框架(harness)、跨团队协作、跨云端与本地环境运行的未来,软件开发的方式正以惊人的速度发生变化。在本期节目中,Anthropic 的 Thariq Shihipar 与 swyx 和 Vibhu 一起,深度拆解了高级用户今天究竟是怎么用 Claude Code 的、为什么提示工程(prompting)依然是一项高门槛技能、以及 Anthropic 认为代理执行框架下一步会走向何方。

我们深入探讨了 Claude Code 不断演进的界面:Ask User Question 工具与需求启发(elicitation)、作为持久生成式界面的 artifacts、用于多智能体(multiplayer agent)协作工作流的 Claude Tag、Projects、模型算力档位(model effort)、实现备注(implementation notes),以及用于定制执行框架本身的新 Claude Mods 系统。

Thariq 阐述了为什么 Claude.md 最终可能会消失、为什么最聪明的模型对许多任务来说也可能成为最便宜的模型、以及为什么可变软件(mutable software)可能成为应用构建与定制的一种新范式。

对话随后转向代理安全与 Anthropic 的"与前沿同行"(Pacing the Frontier)论点。Thariq 详细回顾了近期几起事件:代理发现了意想不到的通信方式、利用基础设施、对基准评分器进行逆向工程,并把这些漏洞串联起来。我们讨论了沙箱化(sandboxing)、提示注入(prompt injection)、自主代理(autonomous agents)、可解释性(interpretability)、宪法分类器(constitutional classifiers)、探针(probes)、回退机制(fallbacks)、Auto Mode,以及为什么给越来越强大的代理提供安全保障,可能会成为未来几年最具决定性的工程难题之一。

我们讨论的内容包括:

- 为什么代理式编程(agentic coding)在不到一年的时间里从争议走向默认
- 为什么提示工程仍然是使用 Claude Code 时最高杠杆的技能之一
- 专家用户是如何在脑中建立 Claude 的心智模型(mental model)的,以及哪些任务能真正做到"一发命中"(one-shot)
- 随着代理越来越强,为什么发现"未知的未知"(unknown unknowns)变得更重要
- Artifacts 作为人类与代理之间持久的生成式接口
- Claude 如何被拆分成云端的"大脑"、本地或远程的"双手",以及一个动态的界面
- Claude Tag、Projects 与多智能体(multiplayer agents),以及协作式代理工作流未来可能的演进
- 为什么在初始提示上多花时间能显著减少代理的无效工作
- 不同工程任务应该选低、中、高还是 max 档算力(model effort)
- 为什么前沿模型最终可能在智能与 token 效率两方面都跑赢小模型
- 为什么实现备注(implementation notes)能暴露出模型考虑过但最终没采纳的决策
- 为什么 Claude.md 终将消失,以及为什么"从没有它开始"有时反而更好
- Claude Mods:定制 Claude Code 的执行循环、UI、子代理(subagents)、路由(routing)与行为
- 模型路由器(model router)、分叉代理(forked agents),以及能自动改进工作流的监督者代理(supervisor agents)
- 为什么 Claude Mods 可能成为"可变软件"(mutable software)的早期预览
- 代理工程的苦涩教训(bitter lesson),以及为什么代理架构会如此迅速地过时
- 为什么 Claude Tag 正在成为一种多人协作的组织级执行框架
- 为什么让代理访问公司数据会创造一个巨大的新攻击面
- Exploit-Bench 事件:代理发现了彼此通信和协作的方式
- 为什么代理去黑 Hugging Face 是为了拿评分器的代码,而不是为了基准答案
- 代理是如何以出乎意料的方式把沙箱与基础设施漏洞串联起来的
- 为什么越来越强大的代理让传统的安全假设更难维持
- Anthropic"与前沿同行"(Pacing the Frontier)提案背后的论点
- 为什么软件工程师正在越来越多地身兼两职:做工程,并跟上 AI 的发展
- 宪法分类器(constitutional classifiers)、探针(probes)和回退机制(fallbacks),以及生产环境下的可解释性是什么样的
- Auto Mode 是如何检查代理的实际行为是否真的符合用户权限的
- 为什么 Thariq 能看到 AI 的严重风险,p(doom) 末日概率却相对较低Thariq Shihipar
X:作者的个人 X 主页
LinkedIn:作者的个人 LinkedIn 主页

时间戳

00:00:00 引言
00:04:12 Ask User Question 与代理界面的未来
00:08:29 Artifacts、Projects 与多智能体协作
00:15:37 提示工程:Claude Code 的核心技能
00:21:52 上下文、算力档与更聪明的模型用法
00:28:10 Claude.md 即将消失?
00:32:49 Claude Mods:定制 Claude Code 的执行框架
00:36:35 模型路由与可变软件的崛起
00:44:40 代理工程的苦涩教训
00:50:49 Claude Tag 作为组织级执行框架
00:55:59 与前沿同行 与自主代理安全
00:58:22 代理为拿评分器而黑掉 Hugging Face
01:05:34 代理需要更多算力时会发生什么?
01:10:32 AI 编程的变化速度已经超过工程师的跟进速度
01:17:17 探针、回退、可解释性与 Auto Mode
01:28:32 AI 风险、p(doom) 与结语

转录稿

引言:Anthropic 的生活与变化的速度

Swyx [00:00:00]:今天在演播室,我们请到了来自 Anthropic 的老朋友 Thariq。一般来说 Claude Code 这块……我,有太多边界在融合了,自从你加入 Anthropic 以来,你一直站在所有事情的最前沿。你很早就开始用 Claude Code,后来你也讲过那段经历,在别的播客上讲过;你也讲过关于"看到代理"的故事。最近你做了 AIE World Tour 的开场演讲,《Fable 实地指南》,因为你们刚发布 Fable,所以那……那有点"作弊"。最近你又发布了 Claude Tag,我们也会聊到"与前沿同行"。Anthropic 正在发生的事太多了。我想第一个问题是:在 Anthropic 这么高速运转的环境里工作,是什么感觉?

Thariq Shihipar [00:00:48]:我觉得,有时候会有种"被甩来甩去"的感觉。我刚加入 Anthropic 的时候,是因为 Claude Code。它那会儿刚发布,我当时就想:"这东西也太强了。"Opus 4 对我来说简直不可思议,怎么会这么好?那对我来说是一个真正的"顿悟时刻"。但我那时候想说服我的创业朋友们用代理式编程,他们说:"不行,我们的工程师觉得它还不够好。"我说:"这也太离谱了。"然后快进不到 12 个月,现在已经变成了大家写代码的默认方式。所以从"推销它"到"教大家怎么把它用得更好、更高效",这是一个很大的转变。真的,想作为一个人类跟住所有事情很难,事情发生得太快了……

Swyx [00:01:51]:那就派更多代理上啊。

Thariq Shihipar [00:01:52]:对,代理那套扩展起来比人类容易多了。比如现在有三件事在同时发生,每一件都像是紧急事件,你要怎么响应?

教大家用 Claude Code

Vibhu [00:02:05]:你的时间是怎么分配的?你做了大量技术写作,也做工程。

Thariq Shihipar [00:02:10]:我加入 Claude Code 团队的时候,是想教大家怎么用 Claude Code。我当时想,可能也就花一点点时间在这上面,或者……我一开始是花时间在 agent SDK 上的。当时我也不太清楚执行框架层面的"苦涩教训"会怎么演化。我们会问:"Claude Code 之后是什么?"一开始我就是想教大家怎么用 Claude Code,让它变得更容易上手。但随着执行框架越来越好,现在最关键的问题变成了"怎么用这些代理"。这是一件非常吃技巧和表达能力的事。所以我做这件事,也做工程。当我做工程的时候,我的目标就是把从用户那里得到的反馈,再转化回去讲:"Hey,应该这样用 Claude Code 做工程。"这就形成了一个很好的闭环。

Swyx [00:03:07]:对,听众朋友们,我们会附上你和 Sarah 给 Dev Writers 聚会做的这次分享的链接。

Thariq Shihipar [00:03:13]:哦,好。

Swyx [00:03:13]:我们稍微聊了一下这个,先做工作,再讲工作。

Thariq Shihipar [00:03:16]:对。

Swyx [00:03:16]:差不多就这意思。

Thariq Shihipar [00:03:17]:对。

Swyx [00:03:17]:要么是"播种与收割",Thariq Shihipar [00:03:19]:对,"播种与收割"。

Swyx [00:03:21]:大概就这意思。也先剧透一下,我们今天会聊执行框架的演进。它已经从单纯的 CLI 走了很远。我们会聊到 Claude Mods,它今天已经开始外泄了,因为实在藏不住了。

Thariq Shihipar [00:03:36]:对。

Swyx [00:03:39]:是,太多东西了。你最初做的事情之一是加了 ask user question 工具,大家对它又爱又恨。

Thariq Shihipar [00:03:48]:对。

Swyx [00:03:48]:我当时觉得这个东西非常有创新性,然后现在我自己也有一个版本。你有你的 "Interview Me" 版本。

Thariq Shihipar [00:03:55]:对。

Swyx [00:03:56]:对,大家都有自己的一套。现在这已经无所谓了,因为你应该写 prompt,让它再去生成别的 prompt、循环套循环,诸如此类。

Ask User Question 与人–代理交互

Thariq Shihipar [00:04:05]:好的。

Swyx [00:04:06]:那今天的状态是怎样的?你现在让大家怎么用?

Thariq Shihipar [00:04:12]:Ask user question 是模型第一次"善于做需求启发"。这是一个我想看看模型能不能做到、属于涌现性质的行为。我本人有人机交互的背景,本科和研究生都学过。所以对我而言,这就是"人–代理交互",想办法让代理跟你沟通,把需求挖出来。我觉得,随着 Claude Code 的用户面越来越广,难点之一是每个人都有自己的一套用法,要改变默认行为非常难。比如,如果有人让 Claude Code 做一件事,Thariq Shihipar [00:04:59]:有时候他们就是希望代理直接干,因为自己非常擅长写 prompt;有时候他们不擅长写 prompt,那代理就需要去澄清。所以这是个很好的分叉。Ask user question 工具正好沿这条线分叉开:你觉得你已经够格去指挥这个代理了,还是代理需要去挖掘更多需求、跟你协作、真正理解你的偏好?

Thariq Shihipar [00:05:27]:总体上我认为几乎所有人都是后者,他们的需求比他们自己以为的更模糊,他们知道的也少于他们以为自己知道的。但这是一个交互设计问题,要把它做得容易。所以,当你在做方案设计的时候,schema 是什么样、调用栈是什么样,这些细节都很重要。理想情况下,你应该在动手实现之前就先把一些难题想清楚。这就是所谓的"未知项"。所以我认为这永远都会是代理式编程里的一项技能:识别你的未知项。因为即使模型超级聪明,它也得知道你要什么;而你是有偏好的,需要把这些偏好挖出来。这是我在推的方向。那接下来问题就是,代理要怎样跟你交互?我觉得 HTML 一直是主要的承载形式。我们最近加上了 artifacts。我得承认,我们在"怎么把它们用透"这件事上做得不够好,或者说我做得不够好。它背后挂着一个数据库,每个 artifact 都可以存储和写入持久化数据。它可以再回喂给 Claude。所以我一直在鼓励、但大家还没用上的一件事是"仪表盘型 artifact"。比如你让 Claude 长期做一个项目,可能是个看板。它能把看板数据存到自己的数据库里。多个 Claude 实例可以通过 artifact MCP 访问同一份数据,artifact 本身也能反过来跟这些 Claude 对话。所以,我们在搭一些原语(primitives),让你能通过 artifact 这种生成式界面,把代理里更丰富的细节浮现出来。我觉得,现在关于代理的几乎所有问题都是:你以为你知道你想要什么,但其实你并不知道;代理需要非常多的细节,跟你在循环中协作非常重要。所以 artifacts 是一种尝试,把这个方向往前推。还有很多工作要做,因为它比"多选题"复杂多了,还有大量的细节,比如图表、代码片段、schema 等等。但 artifacts 是一种更"AGI 化"(AGI-pilled)的 ask user question 方式。

Artifacts:通往执行框架的界面

Swyx [00:08:15]:关于 artifact 我有一件事不太清楚:哪些反馈应该走 artifact,哪些反馈应该走 Claude 的聊天窗口?因为更"AGI 化"的做法是把所有东西都喂给 Claude。

Thariq Shihipar [00:08:29]:我觉得更"AGI 化"的做法是走 artifact。我们设想,在极限情况下,artifact 就是你通往执行框架的界面。你可以实时地在"计划 + 工作"那份活文档上评论。你也许能看到多个代理在做不同的事,而 artifact 是为当前这份工作量身打造的。所以每个 artifact 都略有不同。从基础设施角度,我们还在一点点把路铺好。但我觉得,最终"为你的执行框架提供随用随变的界面",大概率就是未来的方向。

Vibhu [00:09:03]:有没有一种"抽象掉 CLI 或聊天"的版本?因为现在的形态是:你在跟 Claude Code 交互,Claude Code 回给你一份 HTML 的 mockup,内容相当丰富,有图有表。Artifacts 是把它们串起来的方式。凭什么不能一切都这么做呢?

拆出大脑、双手和表面 UI

Thariq Shihipar [00:09:22]:那就要拆开几件事了:推理发生在哪里?智能在哪里?执行在哪里?这其实就是本地和云端的差别。如果你现在用 Claude Code,它是本地的,你可以用 remote control 拨出一些云端行为,或者在云端跑一个 Claude Code。我们正在朝一个方向走:不再是"你给一个本地 Claude 发消息,它在本地起会话去执行",而是"你有一个 Claude,它在云端,能调度本地或云端的会话"。Claude Tag 就是这样工作的。再往后,我们会加入"本地双手"。也就是说,这个代理如果你的电脑在线,它就能访问你的电脑,在那里干活。它可以派生出很多不同的子代理,子代理之间可以互相通信,而 artifact 就是用来呈现所有这些工作的。所以你可以想象,这些东西被拆开了:一个是被托管在某处的、表面 UI 形态的 artifact,带数据库等等;一个是云端跑的推理智能,你不用担心关机或者别的;再就是"双手",它可以是本地的,也可以是远程沙箱,或者你需要的任何执行环境。这是把现在的 Claude Code 体验拆包开来,现在所有事情都挤在同一个地方。

多智能体协作、Claude Tag 与 Projects

Vibhu [00:11:00]:你怎么看……那个"多人"那边……

(译注:原文转录到此截断。)

原文配图