AI Builders 每日摘要 · 2026-09-23

Agent 正在重新组织广告、交易和企业软件基础设施,浏览器 agent 的自主操作也进入通用可用阶段,安全分类器与 prompt injection 防护成为关键能力。

一句话结论

今天的信号集中在 agent 对商业和软件基础设施的重新组织:agent 可能绕过传统广告触达并直接完成交易,企业软件的权限、数据和业务逻辑反而会变得更重要;与此同时,浏览器 agent 的自主操作开始进入通用可用阶段,安全分类器和 prompt injection 防护成为产品能力的一部分。

X / Twitter

AI 教程与访谈作者 Peter Yang

Peter Yang 认为,agent 直接替用户浏览网站并完成任务,可能让大量展示广告失去原本的曝光对象,广告市场因此会迎来一次重新定价。这个判断的关键不是广告消失,而是网站需要重新思考:当访问者变成替用户执行任务的 agent 时,商业价值应该如何被呈现和计量。

来源:https://x.com/petergyang/status/2102215701255844074

Vercel CEO Guillermo Rauch

Guillermo Rauch 宣布,Vercel 的 AI Gateway 现在可以通过 HTTP 使用 Jev,并把它放在 type-safe AI SDK API 的更新语境中。另一个更偏能力验证的信号是,他让 Grok 4.7 处理运行中 binary 的逆向工程问题,并称其完成得很漂亮且速度很快,说明模型评测正在从标准题目走向真实工程任务。

来源:https://x.com/rauchg/status/2102205684544852121

来源:https://x.com/rauchg/status/2102089968860721335

Box CEO Aaron Levie

Aaron Levie 认为,personal agent 一旦能够端到端处理复杂事务,越来越多的消费和服务交易会经由 agent 完成。机会不只属于 agent 提供商,也属于为 agent 设计的 commerce、local 和 B2B 服务层。与此同时,他强调 agent 对软件的使用量可能远超人类,因此 CRM、ERP、数据平台、权限控制、guardrails 和业务编排等基础能力不会消失,反而会因为 agent 能执行破坏性操作而变得更关键。

来源:https://x.com/levie/status/2102253246807261579

来源:https://x.com/levie/status/2102235949430354273

Y Combinator 总裁兼 CEO Garry Tan

Garry Tan 分享了 GBrain 执行大规模 bug 修复的示例:任务被清晰拆分,工作可以自动并行化,并最终形成整洁的 GitHub PR 与 CI 流程。这个案例值得关注的地方不只是 agent 能改多少代码,而是它已经开始承担任务分派、并行执行和交付验证之间的组织工作。

来源:https://x.com/garrytan/status/2102096495847551011

FPV Ventures 合伙人 Nikunj Kothari

Nikunj Kothari 对不同 agent 产品的观察是,Instinct 和 Muse 在手机浏览器场景中几乎不需要设置,而 Codex on Mac 在 computer use 和一次性完成手动工作流方面更强。他还批评“tokenmaxxing”式产品把太多能力直接丢给 agent,认为好的产品更依赖筛选、整理和持续维护,而不是把所有工具都堆进去让 agent 自己猜。

来源:https://x.com/nikunj/status/2102186665863463199

来源:https://x.com/nikunj/status/2102049065504739366

OpenClaw 与 OpenAI 的 Peter Steinberger

Peter Steinberger 澄清,围绕“Meta 使用 OpenClaw”的说法并不准确:Meta 团队实际构建了自己的 agent,只是受到了相关工作的启发。他对对方团队表示认可,这条信息的价值在于把“使用同一产品”和“受到产品启发后自建”区分开来。

来源:https://x.com/steipete/status/2102116206371315854

OFFICIAL BLOGS

Claude Blog:Claude in Chrome is generally available

Claude in Chrome 已面向所有付费 Claude 计划正式开放。它可以读取当前网页、输入文字、点击链接、跨页面导航和填写表单,并开始在安全边界内自主执行浏览器操作,不再要求用户逐步批准每个动作。对于内部 dashboard、旧系统和供应商门户等没有现成集成的工具,这意味着 agent 可以直接通过现有登录状态完成工作。

这次发布的重点是安全机制。feed 内容显示,Claude 会用 probes 扫描网页、邮件和表单中的潜在 prompt injection,再由 action classifier 检查即将执行的导航或输入是否符合用户原始请求,不匹配的动作会被拦截。博客给出的评测中,未加额外防护时,攻击对 Opus 4.5 和 Opus 5 的成功率分别为 17.6% 和 3.8%;加入 probes 与安全分类器后,Claude Sonnet 5 和 Opus 5 的攻击成功率为 0%,Fable 5 为 0.3%。这不是“浏览器 agent 已经解决安全问题”,而是把持续红队、攻击样本库和动作级校验正式纳入产品闭环。

博客也明确提醒:“Prompt injection remains a moving target.” 浏览器 agent 的安全能力需要随着新攻击样本、红队测试和模型版本持续更新。

来源:https://claude.com/blog/claude-in-chrome-generally-available

PODCASTS

今天没有新的播客条目。


Generated through the Follow Builders skill: https://github.com/zarazhangrui/follow-builders