Anthropic 开源 commerce-agents:一套能抄的商务 Agent 工程结构,Apache 2.0

2026-09-19 Agent开源Anthropic工程实践

Anthropic 在 GitHub 上放出了 commerce-agents:一个用 Claude 搭商务 Agent 的参考蓝图。它包含两个角色——面向顾客的 shopping agent(搜索、比价、做方案、加购物车、答政策),和给商家自己用的 merchant agent(解释经营数据、维护商品、处理库存与订单告警、定价促销、起草活动)。每个角色的定义只有一份(提示词、skills、工具契约、闸门),但能跑在三套运行时上:Messages API、Claude Agent SDK、托管的 Managed Agents。仓库里还有四个可直接运行的行业垂直示例:零售、旅行、电信、娱乐。

真正值得抄的是它的工程约束,我挑三条:

  • 每一处写操作都是「暂存」而不是「执行」。 仓库明确写了:整套 demo 不产生真实订单、不扣信用卡、不改真实商品。结算只渲染购物车交由宿主网站完成,商家的每一次写入都先进暂存区,由人批准后才生效。这不是道德声明,是把「Human-in-the-loop」做进了数据流。
  • 安全约束跑在工具调用内部,而不是写在提示词里。 fencing、来源闸门(provenance gates)、金额上限、记忆校验、商家侧审批闸门——全部在工具调用模块里强制执行,三条运行时路径都绕不过去。提示词里写「请不要…」是建议,写在工具层才是约束。
  • 用开关而不是分支来支持「你没有的系统」。 商家完全不存在的能力(比如没有购物车、没有订单追踪)对应一个 enable_* 开关,关掉就同时移除它的工具、提示词行和 grounding 规则。这对一个人维护多套客户部署来说是救命的设计——同一套代码,不同客户不同配置。

另外几个细节也很实用:docs/backends.md 讲怎么把你自己的系统映射进去(身份与凭证、有顺序要求的流程、结算、带规格的商品);docs/deployment.md 覆盖了 GCP Vertex AI、AWS Bedrock、Microsoft Foundry 和各类网关;仓库还带一个 Claude Code 插件,/scaffold-commerce-agent 可以直接按这套结构脚手架一个新 agent,/review-commerce-agent 能审查已有的。

对一人公司的用处,分两层:

  • 如果你在给客户做 AI 商务功能,这是现成的甲方说服材料。客户最担心的从来不是「聪不聪明」,是「会不会乱下单、乱改价」。把「写操作必须人工批准」做成架构图上的一块,比任何口头承诺都管用。
  • 如果你在做任何带副作用的 agent(发邮件、改数据库、调别人的接口),这套结构直接搬。三个抽象就够:能力写成 SKILL.md 目录、副作用走 backend 方法由宿主持凭证执行、写操作一律 staging + 审批。

要泼的冷水:

  • 仓库 README 自己写明:这是参考实现,不维护、不接受贡献。别当依赖直接用,要抄结构。
  • 示例 host 没有鉴权,MCP server 只绑 loopback,直接搬上公网会出事。
  • 它是围绕 Claude 生态写的(messages / agent sdk / claude code 插件),换模型的改造成本得自己估。

我的建议:不用跑 demo。直接读三个文件就够了——shopping-agent/skills/ 里任意一个 SKILL.md、merchant-agent/core/ 的工具契约、docs/safety.md。看完你会对自己手上那堆「提示词 + 一堆脚本」的组织方式有新的想法。

原文出处 · 事实以此为准
Anthropic(GitHub)
阅读原文 ↗