AI 热点综述 · 2026-09-15
今天没有单一的”大新闻”,而是三条平行推进的线:Claude 生态开始长出社区插件、Codex 进入密集发布期、Vercel 把”验证器”当成新一代框架。Aaron Levie 的两条长帖则负责把视角拉到三年后:Agent 的使用量将是人类的 100 倍,而安全治理会成为这个世纪最难的工程题之一。
一、Claude 的”插件化”时刻
Boris Cherny(Anthropic)宣布 Claude Mods 正在陆续上线,并且已经有人做出了”Claude 里的俄罗斯方块”——他的原帖拿到 2169 赞,是今天互动量最高的技术内容之一。
这件事的意义不在游戏本身。当一个模型平台开始允许用户改造它本身,衡量生态活力的指标就从”模型能力”转向”社区能多快把想法变成可分享的东西”。俄罗斯方块只是一个足够简单的证明:扩展点是真的通的。
与之呼应的是 Thariq 的一条预告:他刚录完一档关于 latent space 的节目,”这次非常技术,聊了很多我们此前没怎么谈过的东西”(393 赞)。另一条是他和 Sid、Robert 对谈 Claude Code 是怎么被造出来的——包括”变化有多快、跟上模型能力有多难,以及我们有多怀念 AI 之前的软件工程”(381 赞)。
一边是向外开放扩展点,一边是向内复盘自己的构建历史,这两件事同时发生通常意味着:这个产品从”探索期”进入了”平台期”。
二、Codex 的”发布潮”,和一个 8000 赞的提问
Thibault Sottiaux(OpenAI)贡献了两条:
- “这周的发布密度,你会以为现在是 DevDay 2025。”(1488 赞)—— 典型的”预告式自信”,但也说明 Codex 一侧确实在密集迭代。
- 一个更有意思的互动:“有什么 Codex 的功能你觉得没用了,应该删掉?”(8017 赞、148 转发)。
第二条是整个时间线上互动最高的内容,而且它不是一个功能公告,而是一个减法征集。放在 Codex 这种”什么都能加”的工具上,这个提问本身是一种成熟信号:功能通胀开始被当成成本,而不是卖点。
同时,Peter Steinberger 转了一条”非常有用”的内容并说”正在推动把它也加到 codex 里”(655 赞)——这类”上游抄下游”的动作,已经成为 AI 编程工具迭代的常态节奏。
三、Vercel:verifiers + skills 是新的”框架”
Guillermo Rauch 今天的输出质量很高,值得逐条拆:
“Agent 的上限,取决于你给它的 proof-checker、编译器、类型系统和 linter 有多好。” 他顺带安利了
shadcn/lint,”帮 Agent 守住你设计系统的规则”。他的结论是一句话口号:“Meta: verifiers + skills 才是新的框架!”(1182 赞)这条之所以值得记下来,是因为它把过去一年的隐性经验说破了:给 Agent 加约束,比给它加提示词更有效。 编译器、类型系统、lint 规则这些”老旧”的工具链,正在成为 Agent 时代的基础设施。
fx自动升级,ctrl+g重启并恢复对话,”0.0.10 在长会话里快得多”(200 赞)——长会话的稳定性正在被当作一等指标。挖来 Steren(Google Cloud Run 的创造者),负责 Fluid 计算产品族(Functions、Containers、Sandbox、Builds)。他的原话很有信息量:“Serverless 是云的上一章……Agent 是下一个前沿,它们需要为它们设计的新计算原语。”(1935 赞)
这三条合起来其实是一个判断:Agent 需要新的运行时(Sandbox)、新的验证层(verifiers)、新的长会话可靠性。三者缺一不可。
四、Aaron Levie:100 倍的用量,和 21 世纪最复杂的安全题
Levie 今天发了两条长帖,是当日最重的判断。
第一条讲”量级跳跃”。 他认为把 agent swarm、更好的 computer use、下一代 API 与 MCP、以及 Muse / Instinct 这类新形态、垂直企业 Agent、后台工作流 Agent 放在一起看,现有的预期全都偏小:
“我们会把 Agent 扔向远超最初想象的任务数量。Agent 在后台替我们找到并处理的信息量,会是我们以前在单次会话里提示的 100 倍。”
他举的例子很具体:7×24 地精准招募人才、扫描客户业务里的每一个成交信号、处理每一条对话与转录做产品洞察、审查每一行代码的安全问题、对系统做暴力测试——“以及另外几百种任务”。
至于我们离终点有多远,他的估算是:“大概只走了 1%。” ——从哪里部署、怎么管理、怎么给它们做预算,这些形态都还没定型。
第二条讲安全,而且他明确反对”一刀切”。 核心张力说得很清楚:
“给 Agent 太多无约束的信息访问,你就很难真正控制和保护数据;反过来,如果全部锁死,你就拿不到 AI 带来的任何实质性生产力收益。”
他透露 Box 的做法示例:Box Shield 新增了按文档密级控制”Agent 能与不能处理哪些内容”的粒度权限,并正在做自动检测、告警乃至阻断异常访问的功能。他也点名了参与重构这一层的玩家——从 OpenAI、Anthropic 这样的实验室,到 Palo Alto、Cisco、CrowdStrike、Okta 这类安全平台,再到 Enclave、Method、Alterion、Runlayer 这些创业公司。
把两条帖连起来读,Levie 的潜台词是:安全不是生产力的对立面,而是生产力的前置条件。 这条路线和昨天 Sam Altman 的 “pacing ≠ stopping” 是同一个方向的不同切面。
五、其余观察
- Gemini 的”用户组”打法:Josh Woodward 复盘了 Gemini power user group——两个月、20+ 个功能测试,”你们的反馈非常棒”。新一批用户正在拿到 Daily Brief 与 Personal Intelligence 的早期访问(1001 赞)。此外他还挂出了”来和我们一起做设计”的招募(181 赞)。把种子用户组当成产品流程的一部分,而不是市场活动,这是 Google 这一轮少见的灵活。
- Matt Turck 的冷水:”这个周末很好玩,但我们都明白 AI 的进展不会慢下来吧?玩家太多、经济激励太多、国内和国际都存在太多囚徒困境。”(34 赞)——简短,但和 Altman 的 pacing 讨论放一起看,恰好构成上下两句。
- Peter Yang:语音让他在自然里散步时也比盯着屏幕更高产(51 赞);以及一句情绪直给的”Screw it I can’t wait to 2030”(88 赞)。
- Aditya Agarwal 转发了一个演示:”AI 可以是有人性的。这是终极目标。”(118 赞)
- Nikunj Kothari 领投了 Piston(本轮不完全是 AI 叙事,但值得记一笔):该公司直接绕开卡组织、自建支付轨道做车队燃油支付,交易与具体司机、时间、地点、油品绑定——支付量增长 8 倍,商户网络增长 40 倍,留存 98%+,已覆盖 2000 座加油站、48 个州。他的一句话值得抄下来:“卡本身就是问题,所以 Piston 决定把卡拿掉。”
小结
今天的三条线索各自成立,合起来指向同一个方向:
- 平台期开始了——Claude 长出社区 Mods、Codex 开始征集”该删的功能”、Vercel 把验证器提到框架的高度。热闹的加功能阶段之后,是”约束与精简”的阶段。
- Agent 真正需要的是基础设施——Sandbox 计算、类型系统与 linter、长会话稳定性。能力已经不是瓶颈,”能不能被验证”才是。
- 量级变化带来治理问题——Levie 的 100 倍与 1% 给了两个刻度:未来的用量会大到今天的框架撑不住,而我们现在连部署和预算的形态都还没想清楚。
一句话概括:Agent 的上限,取决于我们愿意给它加多少约束;而它的下限,取决于我们还没建好的那些基础设施。
数据来源:Follow Builders · 2026-09-15