这是 Transgenia 在墨西哥 B2B 经销商内部落地 Claude.ai 所使用的操作手册。它不是营销文案,也不是"数字化转型"的承诺,而是我们实际执行的决策序列,分 5 个阶段、30 天 完成,以确保客户在第 30 天拥有足够的证据,能够在 " 扩展、调整或放弃" 之间做出不靠猜测的决定。
本手册源自我们成为 Claude 注册合作伙伴 (Anthropic) 的认证路径。在该路径中,我们的团队完成了 Partner Badge · Claude Code 的 Delivery Methodology 课程,并将 Anthropic 的方法论 (最初为软件工程试点设计) 推广到经销商的真实业务场景:国际采购、汇率、库存、报关文件,以及那些在销售完成前就被侵蚀的利润。
两条规则贯穿本手册及所有由此衍生的内容。第一:不虚构任何客户数据;当我们用数字举例时,要么引用公开来源,要么将其保留为针对客户实际场景的诊断问题。第二:精确定位。Transgenia 是 正在朝完整认证方向建设、并具备真实落地证据的 Claude 注册合作伙伴。不是已认证合作伙伴 (认证路径的最终评估仍在进行中),也不是候选合作伙伴 (该说法已于 2026 年 8 月停止使用)。这两条规则的存在,是为了保护读者不受市场普遍存在的过度承诺影响。
本手册的目标读者
本手册面向 B2B 经销商内部的三种角色:
- 运营总监或 CEO:批准试点、签署成功标准的决策者。
- 候选流程的负责人 (采购、仓储主管、成本分析师):每天真实经历该流程、也是试点组的核心成员。
- IT 或内部项目发起人:协调访问权限、基线数据以及与 Transgenia 对接的负责人。
如果您的经销商已经在考虑"用 AI 做点什么",但还没想清楚先衡量哪个流程、以什么为基线、由谁负责让采纳撑过第三周,那么本手册回答的正是这个问题。
1. 既然 Claude 的 AI 什么都能做,为什么还需要合作伙伴?
这是第一次会面中最诚实的问题,而 Anthropic 并不回避它:在 Partner Basecamp 的介绍中被明确提出。他们的原话是:"如果模型本身是任何人都能调用的商品,为什么还要引入合作伙伴,而不是直接调用相同的 API?" 答案同样来自同一份材料,也是我们在此应用的答案。
瓶颈已经转移。当模型能力还不达标的时候,难题是 "AI 能做到吗?" 这个问题在大多数场景下已经解决。今天的难题是 围绕模型的一切:如何在其之上设计产品,如何连接真实数据,如何衡量质量,如何真正改变人们的工作方式。Anthropic 直白地说:"模型是商品,应用层才是产品。"
查看 Mermaid 源码
flowchart LR
M["模型
约 10%
Claude API 商品化"]
P["提示词
约 25%
指令设计"]
C["上下文
约 30%
RAG、工具、记忆"]
E["评估
约 30%
质量、回归、置信度"]
G["安全护栏
约 15%
安全、监控、升级"]
M --> P
M --> C
M --> E
M --> G
style M fill:#1e3a5f,color:#fff
style P fill:#166534,color:#fff
style C fill:#166534,color:#fff
style E fill:#166534,color:#fff
style G fill:#78350f,color:#fff
一个已经真正操作过这 90% 的合作伙伴,能提供 API 本身无法带来的四件事:业务上下文 (知道哪些流程适合做试点、哪些不适合),应用层设计 (提示词、RAG、评估与安全护栏,而不仅仅是调用模型),基于基线的诚实衡量 (让"事后"能与"事前"进行有效对比),以及 变革管理 (让采纳撑过第三周)。缺少这四项,AI 试点只是昂贵的玩具。具备这四项,它才是一个在第 30 天可以做出有据决策的项目。
本手册所记录的,正是这四层能力。
2. 为什么大多数 AI 试点熬不到第 30 天
这种失败模式在各行业几乎如出一辙:场景没有经过筛选就上马,启动时没有记录基线,内部无人对新流程负责,几周后试点在沉默中被搁置。真正的问题几乎从来不是模型本身,而是缺少一套方法论,在 第 1 天之前 就明确:衡量什么、以什么为基线、由谁对采纳负责。
查看 Mermaid 源码
mindmap root((6 个可预防
失败)) 无基线 前值缺失 部门 Excel 需在第 1 天前捕获 无推动者 同伴参照 不是最技术那位 内部信誉 边缘场景 收益模糊 不影响总监级指标 跳过了阶段 0 监督期停滞 团队安于审核 始终不放手 缺少同伴演示 文档过时 手册不反映流程 提示词不共享 知识只在一人脑中 交接未正式化 供应商离场 无人接手 无带日期的记录
这 6 个失败模式,每一个都在后续阶段中有明确的应对措施。不是哲学,是清单。
3. 5 个阶段 · 总览
查看 Mermaid 源码
flowchart LR
F0["阶段 0
筛选
第 1-3 天"]
F1["阶段 1
试点设计
第 1-3 天"]
F2["阶段 2
衡量与 ROI
第 4-30 天"]
F3["阶段 3
分级采纳
第 4-27 天"]
F4["阶段 4
收尾与交接
第 28-30 天"]
F0 --> F1 --> F2 --> F3 --> F4
style F0 fill:#166534,color:#fff
style F1 fill:#166534,color:#fff
style F2 fill:#1e3a5f,color:#fff
style F3 fill:#1e3a5f,color:#fff
style F4 fill:#78350f,color:#fff
每个阶段都有 可验证的退出条件。没有该条件,不进入下一阶段。这种关卡纪律,正是"在第 30 天产生决策的试点"与"被遗忘的演示"之间的分界。
4. 阶段 0 · 场景筛选
不是每一个"可以用 AI"的流程都值得做试点。第一个决策是区分 边际收益 (节省时间但不改变业务结果) 与 结构性收益 (推动总监级已在关注的指标:每 SKU 毛利、回款周期、缺货率、发货时间)。
查看 Mermaid 源码
flowchart TD
Start(["候选流程"]) --> Q1{"量是否
足够?"}
Q1 -- "否" --> Rej1["放弃
不足以支撑试点"]
Q1 -- "是" --> Q2{"规则
是否清晰?"}
Q2 -- "否" --> Risk["高风险
先梳理流程"]
Q2 -- "是" --> Q3{"是否存在
基线?"}
Q3 -- "否" --> Q3b{"能否在
3 天内建成?"}
Q3b -- "否" --> Rej2["放弃
没有事前就没有事后"]
Q3b -- "是" --> Q4
Q3 -- "是" --> Q4{"团队是否
愿意配合?"}
Q4 -- "否" --> Rej3["暂缓
没有试点组就没有试点"]
Q4 -- "是" --> OK(["合格试点
进入阶段 1"])
style OK fill:#166534,color:#fff
style Rej1 fill:#7f1d1d,color:#fff
style Rej2 fill:#7f1d1d,color:#fff
style Rej3 fill:#7f1d1d,color:#fff
style Risk fill:#78350f,color:#fff
4 个过滤器,依序如下:
- 量。频率是否高到值得自动化?每季度才发生一次的流程不值得做 30 天的试点。
- 复杂度。是否有清晰、可重复的规则?还是依赖未成文的个案判断?规则不清的高复杂度是风险信号,不是试点信号。
- 可衡量。今天是否存在某个基线数据 (即便是 Excel),还是要重新构造?如果无法衡量"事前",就无法证明"事后"。
- 团队意愿。真正经历流程的人是否愿意在 30 天内改变自己的工作方式?一个流程之外的热心志愿者,验证的是工具有趣,而不是流程改进。
放弃规则:高复杂度加上缺少衡量,等于风险,不是试点。要么先梳理流程,要么缩小范围。
我们已在 B2B 经销商中确认为结构性的场景:
- 每 SKU 的真实到岸成本核算 (运费、关税、汇率、港口作业、报关代理费),替代掩盖负毛利的平均成本法。
- 国际供应商跟进代理与采购订单 ETA,能读取邮件与附件。
- 预测性库存,降低缺货率、释放低周转商品占用的资金。
- 报关文件自动识别与分类 (商业发票、pedimento、装箱单、原产地证书)。
在这些场景中,被推动的指标 (每 SKU 毛利、发货时间、占用资金、录入错误) 都是运营总监原本就会关注的指标。不是为了给试点找理由而杜撰的指标。
5. 阶段 1 · 试点设计
在场景通过筛选后,试点设计有三个不可让步的决策:试点组、操作范围、成功标准。
试点组。 是每天真正在做这件事的人 (采购、仓储主管、成本分析师)。永远不是流程之外的"热心志愿者"。志愿者验证的是工具有趣,而我们要验证的是真实流程有所改进。
查看 Mermaid 源码
flowchart LR
C1["采购
试点组"]
C2["仓储主管
试点组"]
C3["成本分析师
试点组"]
Champ["内部推动者
同伴影响力"]
Lead["部门负责人
疏解阻力"]
TGN["Transgenia 促进者
开放答疑时间"]
C1 --> Champ
C2 --> Champ
C3 --> Champ
Champ --> Lead
Champ --> TGN
style C1 fill:#1e3a5f,color:#fff
style C2 fill:#1e3a5f,color:#fff
style C3 fill:#1e3a5f,color:#fff
style Champ fill:#166534,color:#fff
style Lead fill:#1e3a5f,color:#fff
style TGN fill:#78350f,color:#fff
操作范围。 用精确的操作术语来定义,而不是愿景语言。不是 "采购数字化",而是 "从供应商确认到入库,自动跟进国际采购订单的文档状态"。判断标准是:局外读者能毫不含糊地说出 "这件事在试点内,那件事不在"。
标准时长 是被测试任务的 两个完整周期。对于经销商而言,通常是 25 到 30 天,足以捕捉真实的波动:一次典型采购单、一次月末结账、一周高峰负荷。
成功标准 必须在 第 1 天之前 定下来,不是事后再补,并包含四个明确要素:
- 基线:今天的数值,来源与日期写清楚。
- 阈值:达到什么变化才算成功。
- 方法:如何衡量 (哪份报表、哪个字段、由谁录入)。
- 日期:何时评估结果。
在看到初步结果之后再来设定,整套衡量都会失效。这是本手册中最不受欢迎的一条规则,也是拯救试点最多的一条。
6. 阶段 2 · 衡量与证据 (ROI)
基线要在 启动前 就捕获。试点开始两周后再"重建"的基线,已经被我们试图衡量的那个变化污染了。
我们在四个类别上衡量,把 Anthropic 原课程中面向软件工程的类别,推广到真实的经营运作:
查看 Mermaid 源码
pie showData
title 试点的 4 个 ROI 衡量类别
"运营生产力" : 30
"质量与返工" : 25
"使用与采纳" : 25
"团队感受" : 20
- 运营生产力:每份采购订单、每次 ETA 对账、每份毛利报表所需的人时。
- 质量与返工:录入错误、退货、成本差异、需要重开的订单。
- 使用与采纳:走 AI 流程与走人工流程的订单或文档比例。
- 团队感受:每天在做的人,如果没人要求,是否还愿意继续使用?这个问题在收尾时会一字不差地问出来。
试点结果以 一个数字加一句面向管理层的翻译 呈现,而不是一堆技术观察。像 "我们把 ETA 对账每周所需人时从 X 降到 Y" 这样一句话,总监会一听就懂。像 "代理正确处理了 Z% 的供应商邮件" 这样一句,单独说出来是不够的。(X、Y、Z 是格式占位符:每位客户在收官时用自己有据的数字填写。)
7. 阶段 3 · 分级采纳
真正的采纳呈曲线,不是一开一关。它从"全程审核"到"自主运行",分四段推进;主要风险不是初期的下降,而是中段的停滞。
查看 Mermaid 源码
flowchart LR
S1["第 1 周
监督
自主度约 20%
校准"]
S2["第 2-3 周
自主度上升
约 55% → 约 80%
只审例外"]
S3["第 4 周
代理模式
约 95%
流程自主运行"]
S4["第 30 天+
制度化
约 100%
就是现在这么做"]
S1 --> S2 --> S3 --> S4
Plateau["主要风险:
监督期停滞"]
Plateau -.-> S2
style S1 fill:#7f1d1d,color:#fff
style S2 fill:#78350f,color:#fff
style S3 fill:#1e3a5f,color:#fff
style S4 fill:#166534,color:#fff
style Plateau fill:#101820,color:#FBA225,stroke:#FBA225
第 1 周,监督:团队在每次使用代理输出前都会审核。速度在这一周下降是正常的,这是校准,不是失败。
第 2-3 周,自主度上升:代理在已验证的场景下无需审核运行,团队只处理例外。
第 3-4 周,代理模式:流程在约定范围内自主运行,只对例外情况报告。
第 30 天后,制度化模式:AI 化的流程就是"现在的做法",有文档、可以交接给岗位上的新人。
最常见的风险不是第 1 周的下降 (是预期的),而是 停滞效应:团队安于监督模式、始终不进阶。打破它的是同伴的现场演示,而不是供应商的动员讲话。
8. 阶段 4 · 收尾、推动者与交接
任何试点若缺少 内部推动者,都无法长久:那是客户团队内部,让新流程有归属感的那个人。他以 同伴影响力 被挑选,而不是团队里最技术的那位。推动者需要的是同伴相信,而不是精通配置。
一次干净的收尾至少交付:
- 流程的活文档 (客户内部的
CLAUDE.md):代理做什么、不做什么、超出范围时向谁升级。 - 3 到 5 份可复用的提示词或流程目录,已验证,团队可自行执行,不必每次都依赖 Transgenia。
- 6 个可预防失败清单 (图 2) 在宣布试点收尾前逐一勾选。
- 正式交接记录,包含日期、接收责任人、交接时刻流程的准确状态。
没有带日期与责任人的记录,试点就没有真正收尾。它只是暂停,等某个人来接手,这正是图 2 中"交接未正式化"的模式。
9. 30 天运作节奏
5 个阶段,每个都有可验证的退出条件,以及从第 1 天就排定的两个接触点:
查看 Mermaid 源码
timeline
title 30 天试点运作节奏
第 1-3 天 : 基线与成功标准签署
: 试点组与推动者确定
: 操作范围锁定
第 4-10 天 : 首个周期全程人工审核
: 提示词与流程校准
: 第 8 天与部门负责人接触
第 11-20 天 : 第二周期只审例外
: 自主度上升
: 第 15 天与部门负责人接触
第 21-27 天 : 约定范围内代理模式
: 每周开放答疑时段
: 活文档建设中
第 28-30 天 : 文档交付
: 推动者正式确认
: 收官展示与交接记录
| 天数 | 阶段 | 退出条件 |
|---|---|---|
| 1-3 | 筛选与基线 | 基线记录完成、成功标准签署 |
| 4-10 | 监督期 | 首个完整周期已跑完,全程人工审核 |
| 11-20 | 自主度上升 | 第二周期跑完,只对例外审核 |
| 21-27 | 代理模式 | 流程在约定范围内运行,无常态介入 |
| 28-30 | 收尾与展示 | 文档交付、推动者确认、记录签署 |
从第 1 天就排定的接触点 (非被动响应):
- 第 8 或 15 天,与部门负责人 30 分钟,在阻力累积前疏解。
- 每周 60 分钟开放答疑,试点尾声由内部推动者主持,而非 Transgenia。
第 30 天收官展示,三段各 10 分钟:流程实时演示、事前事后数字、以及关于后续延续性的正式对话。
10. 第 30 天的决策
本手册的目标是产出 一个基于证据的决策,不是一份报告。收官展示后,经销商会带着三种决策之一离场:
查看 Mermaid 源码
flowchart TD
Start(["第 30 天
展示"]) --> Q1{"阈值指标
是否
推动?"}
Q1 -- "否" --> Discard["放弃
场景
未通过验证"]
Q1 -- "部分" --> Adjust["调整
再 2 周
范围修订"]
Q1 -- "是" --> Q2{"团队在
无要求时
是否继续用?"}
Q2 -- "否" --> Adjust
Q2 -- "是" --> Q3{"推动者
就位且
活文档就绪?"}
Q3 -- "否" --> Adjust
Q3 -- "是" --> Scale["扩展
下一个流程
或扩大范围"]
style Scale fill:#166534,color:#fff
style Adjust fill:#78350f,color:#fff
style Discard fill:#7f1d1d,color:#fff
- 扩展:场景推动了指标,团队接受了,推动者就位。进入下一个流程或扩大范围。
- 调整:有进展但不完整。再给 2 周,范围与标准重新校准。
- 放弃:场景未通过验证。记录教训,把团队释放出来。第 30 天诚实放弃,是有效结果,不是失败。
11. 为什么这也是 Transgenia 的资产
每一次按本方法论执行的项目,不仅为客户创造价值,也直接推进 Transgenia 在 Claude (Anthropic) 合作伙伴计划中的等级。
查看 Mermaid 源码
flowchart LR
T1["Registered
最低承诺:
10 位
认证成员"]
T2["Select
10 位活跃成员
2 家客户上线
1 个公开案例"]
T3["Elite
更高标准
Anthropic 官方引荐"]
T1 --> T2 --> T3
Now["Transgenia 当前:
Registered
正在积累证据"]
Now -.-> T1
style T1 fill:#166534,color:#fff
style T2 fill:#1e3a5f,color:#fff
style T3 fill:#78350f,color:#fff
style Now fill:#101820,color:#FBA225,stroke:#FBA225
Anthropic 的 Partner Program Guide · Services Edition 从三个维度衡量,且不做平均 (单一维度出色并不达标):团队内的认证成员数、已在生产环境上线的联合客户数、可公开发布的客户案例数。按本手册执行的每一次项目,都同时构成对这三个维度的证据。
我们对外的一致且诚实的说法是:Transgenia 是 正在朝完整认证方向建设、并具备真实落地证据的 Claude 注册合作伙伴。不是已认证合作伙伴,也不是候选合作伙伴。这一区分之所以重要,是因为市场上有太多供应商只挂上 Anthropic 的名字,却拿不出实际路径。
Claude Partner Badge · Claude Code
由 Anthropic 颁发给 Efraín Carreón Ortiz。认证具备 端到端完成 Claude Code 部署的规模评估、落地、配置和运营能力。课程共 8 门,并以基于真实场景的最终评估收尾。
12. 下一步
在预约任何通话前,先对您希望自动化的流程问自己四个问题:发生频率是否足够?规则是否清晰,还是依赖未成文的判断?今天是否已有基线数据,即便是一份电子表格?每天真正在做的人,是否愿意在 30 天内改变自己的工作方式?如果四题中有至少三题为"是",您可能已经有了一个适合做 30 天试点的合格场景。
如果贵公司同时经营多品牌、多供应商或高 SKU 目录,您可能已经在我们面向 B2B 经销商 的专属指南中识别出多个摩擦点,那里我们详细说明了这套 AI 应用层如何落在 Odoo、多品牌库存与项目毛利之上。
第一步不是签一个 AI 项目,而是一次 15 分钟的诊断,用上述过滤器判断您的经销商是否已经具备一个可以做 30 天试点的合格场景。
本手册是 Centrum Transgenia SAS 的自有操作手册,内容参考 Anthropic Partner Badge · Claude Code 认证路径中的 " Delivery Methodology " 课程与 " Partner Basecamp "。Transgenia 是 Claude (Anthropic) 注册合作伙伴,不是已认证合作伙伴,也不是候选合作伙伴。本手册中的所有数字均不代表任何具体客户结果。
引用来源: Anthropic, 《Introducing the Services Track and Partner Hub of the Claude Partner Network》; Anthropic, 《Anthropic invests $100 million into the Claude Partner Network》; Credly, 《Claude Partner Badge · Claude Code》。