专栏 AI 管理编年史 第 259/303 讲 查看课程目录

Anthropic 开源商务智能体蓝图:购物+商家两套代理,覆盖零售旅游电信票务

02/09/2026 298
5:10
Anthropic 开源商务智能体蓝图:购物+商家两套代理,覆盖零售旅游电信票务
图/Photo by sarah b on Unsplash

2026 年 9 月 2 日,Anthropic 在 GitHub 以 Apache-2.0 协议开源 Claude Commerce Agent Blueprint,包含购物代理与商家代理两套参考实现、各五项技能,并提供零售、旅游、电信、娱乐票务四个可运行的垂直场景。护栏原则是「模型只提议、代码才执行」,资金流转、数据写入、身份验证一律由 harness 闸控。蓝图刻意不含支付协议、结账流程与广告层。

Anthropic 于美西时间 2026 年 9 月 2 日(周三)在 GitHub 发布「Claude Commerce Agent Blueprint」,仓库为 anthropics/commerce-agents,采用 Apache-2.0 开源协议。它不是一项可订阅的产品,而是一套可以直接跑起来的参考实现:包含购物代理(shopping agent)与商家代理(merchant agent)两条线,并提供零售、旅游、电信、娱乐票务四个可运行的垂直场景,另附一个 Claude Code 插件「commerce-builder」。

两套代理,各有五项技能

购物代理面向消费者,负责目录搜索、商品比较、创建购物车,以及订单与退货客服,内置五项 skills:

  • search-discovery:商品搜索与发现
  • purchase-research:购买前的比较研究
  • planning-goals:按需求与预算做规划
  • customer-care:订单、退货与售后
  • memory-personalization:记忆与个性化

商家代理则面向店铺员工,同样是五项:

  • performance-insights:销售业绩分析
  • catalog-listings:商品上架文案起草
  • inventory-operations:库存作业
  • pricing-promotions:定价与促销
  • marketing-campaigns:营销活动

关键设计是:商家代理的所有产出都只是草稿,必须经人工核准后才生效。

护栏:模型只提议,代码才执行

蓝图的安全原则写得很直白——「the model proposes, the harness applies」(模型只提议、harness 才执行)。以下三类动作一律交由代码闸控,不让模型自行决定:

  • 资金流转相关动作
  • 数据写入
  • 身份验证

部署路径支持 Messages API、Claude Agent SDK 与 Claude Managed Agents(beta),并兼容 Claude API、Amazon Bedrock、Microsoft Foundry 与 Google Cloud Vertex AI;技术要求只有 Python 3.11 以上或 Node 22,再加一组 ANTHROPIC_API_KEY。

官方数据怎么看,以及它没有给的那一块

Anthropic 公布的工程数据包括三项:prompt caching 命中率达 90–99%;采用异步记忆抽取(async memory extraction)的事实回想率,比传统 in-turn save 工具高 13%;单一代理(single-agent)设计在质量、成本、延迟三项上都优于子代理与单一提示词方案。其中命中率落在 90–99% 这一项尤其值得留意——它意味着系统提示、商品目录与对话上下文在多数回合无需重新计费,长对话的推理成本因而被压在可控范围,这正是代理式客服能长时间在线而不失控烧钱的前提。至于「商家购物车金额最高可提升 35%、购买完成率提升 60%」这两个数字,是 Anthropic 官方自报、并非第三方独立评测,引用时务必标明这一点。目前 Shopify 与 Priceline 已有基于该技术的在线代理在运行。

更值得注意的是蓝图「没有」的部分:不含支付协议、不含结账流程,也不含广告层。这些要由零售商自行集成,或交给 Visa、Mastercard 等合作伙伴处理。换句话说,真正碰钱的那一段,Anthropic 这次刻意没碰。

对管理者的意义

对在泰国经营零售、电商、旅游与门店的管理者而言,这则新闻的重点不是「AI 会取代客服」,而是引入代理的门槛从「自己从零搭系统」降成「改一份开源模板」。真正该先想清楚的,是那条护栏线:公司里哪些动作可以让 AI 提议、哪些必须由人签核?先把这张清单列出来,再谈技术选型。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 OpenAI 发布 GPT-6 Astra:主打电脑操作智能体、首列网络安全 Critical 级,同日投入 10 亿美元补贴一线防御者

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策