Transgenia 的 Claude.ai 实施手册
这是 Transgenia 在墨西哥 B2B 经销商内部落地 Claude.ai 所使用的操作手册。它不是营销文案,也不是"数字化转型"的承诺,而是我们实际执行的决策序列,分 5 个阶段、30 天 完成,以确保客户在第 30 天拥有足够的证据,能够在 " 扩展、调整或放弃" 之间做出不靠猜测的决定。
本手册源自我们成为 Claude 注册合作伙伴 (Anthropic) 的认证路径。在该路径中,我们的团队完成了 Partner Badge · Claude Code 的 Delivery Methodology 课程,并将 Anthropic 的方法论 (最初为软件工程试点设计) 推广到经销商的真实业务场景:国际采购、汇率、库存、报关文件,以及那些在销售完成前就被侵蚀的利润。
两条规则贯穿本手册及所有由此衍生的内容。第一:不虚构任何客户数据;当我们用数字举例时,要么引用公开来源,要么将其保留为针对客户实际场景的诊断问题。第二:精确定位。Transgenia 是 正在朝完整认证方向建设、并具备真实落地证据的 Claude 注册合作伙伴。不是已认证合作伙伴 (认证路径的最终评估仍在进行中),也不是候选合作伙伴 (该说法已于 2026 年 8 月停止使用)。这两条规则的存在,是为了保护读者不受市场普遍存在的过度承诺影响。
本手册的目标读者
本手册面向 B2B 经销商内部的三种角色:
- 运营总监或 CEO:批准试点、签署成功标准的决策者。
- 候选流程的负责人 (采购、仓储主管、成本分析师):每天真实经历该流程、也是试点组的核心成员。
- IT 或内部项目发起人:协调访问权限、基线数据以及与 Transgenia 对接的负责人。
如果您的经销商已经在考虑"用 AI 做点什么",但还没想清楚先衡量哪个流程、以什么为基线、由谁负责让采纳撑过第三周,那么本手册回答的正是这个问题。
1. 既然 Claude 的 AI 什么都能做,为什么还需要合作伙伴?
这是第一次会面中最诚实的问题,而 Anthropic 并不回避它:在 Partner Basecamp 的介绍中被明确提出。他们的原话是:"如果模型本身是任何人都能调用的商品,为什么还要引入合作伙伴,而不是直接调用相同的 API?" 答案同样来自同一份材料,也是我们在此应用的答案。
瓶颈已经转移。当模型能力还不达标的时候,难题是 "AI 能做到吗?" 这个问题在大多数场景下已经解决。今天的难题是 围绕模型的一切:如何在其之上设计产品,如何连接真实数据,如何衡量质量,如何真正改变人们的工作方式。Anthropic 直白地说:"模型是商品,应用层才是产品。"
查看 Mermaid 源码
flowchart LR
M["模型
约 10%
Claude API 商品化"]
P["提示词
约 25%
指令设计"]
C["上下文
约 30%
RAG、工具、记忆"]
E["评估
约 30%
质量、回归、置信度"]
G["安全护栏
约 15%
安全、监控、升级"]
M --> P
M --> C
M --> E
M --> G
style M fill:#1e3a5f,color:#fff
style P fill:#166534,color:#fff
style C fill:#166534,color:#fff
style E fill:#166534,color:#fff
style G fill:#78350f,color:#fff
一个已经真正操作过这 90% 的合作伙伴,能提供 API 本身无法带来的四件事:业务上下文 (知道哪些流程适合做试点、哪些不适合),应用层设计 (提示词、RAG、评估与安全护栏,而不仅仅是调用模型),基于基线的诚实衡量 (让"事后"能与"事前"进行有效对比),以及 变革管理 (让采纳撑过第三周)。缺少这四项,AI 试点只是昂贵的玩具。具备这四项,它才是一个在第 30 天可以做出有据决策的项目。
本手册所记录的,正是这四层能力。
2. 为什么大多数 AI 试点熬不到第 30 天
这种失败模式在各行业几乎如出一辙:场景没有经过筛选就上马,启动时没有记录基线,内部无人对新流程负责,几周后试点在沉默中被搁置。真正的问题几乎从来不是模型本身,而是缺少一套方法论,在 第 1 天之前 就明确:衡量什么、以什么为基线、由谁对采纳负责。
查看 Mermaid 源码
mindmap root((6 个可预防
失败)) 无基线 前值缺失 部门 Excel 需在第 1 天前捕获 无推动者 同伴参照 不是最技术那位 内部信誉 边缘场景 收益模糊 不影响总监级指标 跳过了阶段 0 监督期停滞 团队安于审核 始终不放手 缺少同伴演示 文档过时 手册不反映流程 提示词不共享 知识只在一人脑中 交接未正式化 供应商离场 无人接手 无带日期的记录
这 6 个失败模式,每一个都在后续阶段中有明确的应对措施。不是哲学,是清单。
3. 5 个阶段 · 总览
查看 Mermaid 源码
flowchart LR
F0["阶段 0
筛选
第 1-3 天"]
F1["阶段 1
试点设计
第 1-3 天"]
F2["阶段 2
衡量与 ROI
第 4-30 天"]
F3["阶段 3
分级采纳
第 4-27 天"]
F4["阶段 4
收尾与交接
第 28-30 天"]
F0 --> F1 --> F2 --> F3 --> F4
style F0 fill:#166534,color:#fff
style F1 fill:#166534,color:#fff
style F2 fill:#1e3a5f,color:#fff
style F3 fill:#1e3a5f,color:#fff
style F4 fill:#78350f,color:#fff
每个阶段都有 可验证的退出条件。没有该条件,不进入下一阶段。这种关卡纪律,正是"在第 30 天产生决策的试点"与"被遗忘的演示"之间的分界。
4. 阶段 0 · 场景筛选
不是每一个"可以用 AI"的流程都值得做试点。第一个决策是区分 边际收益 (节省时间但不改变业务结果) 与 结构性收益 (推动总监级已在关注的指标:每 SKU 毛利、回款周期、缺货率、发货时间)。
查看 Mermaid 源码
flowchart TD
Start(["候选流程"]) --> Q1{"量是否
足够?"}
Q1 -- "否" --> Rej1["放弃
不足以支撑试点"]
Q1 -- "是" --> Q2{"规则
是否清晰?"}
Q2 -- "否" --> Risk["高风险
先梳理流程"]
Q2 -- "是" --> Q3{"是否存在
基线?"}
Q3 -- "否" --> Q3b{"能否在
3 天内建成?"}
Q3b -- "否" --> Rej2["放弃
没有事前就没有事后"]
Q3b -- "是" --> Q4
Q3 -- "是" --> Q4{"团队是否
愿意配合?"}
Q4 -- "否" --> Rej3["暂缓
没有试点组就没有试点"]
Q4 -- "是" --> OK(["合格试点
进入阶段 1"])
style OK fill:#166534,color:#fff
style Rej1 fill:#7f1d1d,color:#fff
style Rej2 fill:#7f1d1d,color:#fff
style Rej3 fill:#7f1d1d,color:#fff
style Risk fill:#78350f,color:#fff
4 个过滤器,依序如下:
- 量。频率是否高到值得自动化?每季度才发生一次的流程不值得做 30 天的试点。
- 复杂度。是否有清晰、可重复的规则?还是依赖未成文的个案判断?规则不清的高复杂度是风险信号,不是试点信号。
- 可衡量。今天是否存在某个基线数据 (即便是 Excel),还是要重新构造?如果无法衡量"事前",就无法证明"事后"。
- 团队意愿。真正经历流程的人是否愿意在 30 天内改变自己的工作方式?一个流程之外的热心志愿者,验证的是工具有趣,而不是流程改进。
放弃规则:高复杂度加上缺少衡量,等于风险,不是试点。要么先梳理流程,要么缩小范围。
我们已在 B2B 经销商中确认为结构性的场景:
- 每 SKU 的真实到岸成本核算 (运费、关税、汇率、港口作业、报关代理费),替代掩盖负毛利的平均成本法。
- 国际供应商跟进代理与采购订单 ETA,能读取邮件与附件。
- 预测性库存,降低缺货率、释放低周转商品占用的资金。
- 报关文件自动识别与分类 (商业发票、pedimento、装箱单、原产地证书)。
在这些场景中,被推动的指标 (每 SKU 毛利、发货时间、占用资金、录入错误) 都是运营总监原本就会关注的指标。不是为了给试点找理由而杜撰的指标。
5. 阶段 1 · 试点设计
在场景通过筛选后,试点设计有三个不可让步的决策:试点组、操作范围、成功标准。
试点组。 是每天真正在做这件事的人 (采购、仓储主管、成本分析师)。永远不是流程之外的"热心志愿者"。志愿者验证的是工具有趣,而我们要验证的是真实流程有所改进。
查看 Mermaid 源码
flowchart LR
C1["采购
试点组"]
C2["仓储主管
试点组"]
C3["成本分析师
试点组"]
Champ["内部推动者
同伴影响力"]
Lead["部门负责人
疏解阻力"]
TGN["Transgenia 促进者
开放答疑时间"]
C1 --> Champ
C2 --> Champ
C3 --> Champ
Champ --> Lead
Champ --> TGN
style C1 fill:#1e3a5f,color:#fff
style C2 fill:#1e3a5f,color:#fff
style C3 fill:#1e3a5f,color:#fff
style Champ fill:#166534,color:#fff
style Lead fill:#1e3a5f,color:#fff
style TGN fill:#78350f,color:#fff
操作范围。 用精确的操作术语来定义,而不是愿景语言。不是 "采购数字化",而是 "从供应商确认到入库,自动跟进国际采购订单的文档状态"。判断标准是:局外读者能毫不含糊地说出 "这件事在试点内,那件事不在"。
标准时长 是被测试任务的 两个完整周期。对于经销商而言,通常是 25 到 30 天,足以捕捉真实的波动:一次典型采购单、一次月末结账、一周高峰负荷。
成功标准 必须在 第 1 天之前 定下来,不是事后再补,并包含四个明确要素:
- 基线:今天的数值,来源与日期写清楚。
- 阈值:达到什么变化才算成功。
- 方法:如何衡量 (哪份报表、哪个字段、由谁录入)。
- 日期:何时评估结果。
在看到初步结果之后再来设定,整套衡量都会失效。这是本手册中最不受欢迎的一条规则,也是拯救试点最多的一条。
6. 阶段 2 · 衡量与证据 (ROI)
基线要在 启动前 就捕获。试点开始两周后再"重建"的基线,已经被我们试图衡量的那个变化污染了。
我们在四个类别上衡量,把 Anthropic 原课程中面向软件工程的类别,推广到真实的经营运作:
查看 Mermaid 源码
pie showData
title 试点的 4 个 ROI 衡量类别
"运营生产力" : 30
"质量与返工" : 25
"使用与采纳" : 25
"团队感受" : 20
- 运营生产力:每份采购订单、每次 ETA 对账、每份毛利报表所需的人时。
- 质量与返工:录入错误、退货、成本差异、需要重开的订单。
- 使用与采纳:走 AI 流程与走人工流程的订单或文档比例。
- 团队感受:每天在做的人,如果没人要求,是否还愿意继续使用?这个问题在收尾时会一字不差地问出来。
试点结果以 一个数字加一句面向管理层的翻译 呈现,而不是一堆技术观察。像 "我们把 ETA 对账每周所需人时从 X 降到 Y" 这样一句话,总监会一听就懂。像 "代理正确处理了 Z% 的供应商邮件" 这样一句,单独说出来是不够的。(X、Y、Z 是格式占位符:每位客户在收官时用自己有据的数字填写。)
7. 阶段 3 · 分级采纳
真正的采纳呈曲线,不是一开一关。它从"全程审核"到"自主运行",分四段推进;主要风险不是初期的下降,而是中段的停滞。
查看 Mermaid 源码
flowchart LR
S1["第 1 周
监督
自主度约 20%
校准"]
S2["第 2-3 周
自主度上升
约 55% → 约 80%
只审例外"]
S3["第 4 周
代理模式
约 95%
流程自主运行"]
S4["第 30 天+
制度化
约 100%
就是现在这么做"]
S1 --> S2 --> S3 --> S4
Plateau["主要风险:
监督期停滞"]
Plateau -.-> S2
style S1 fill:#7f1d1d,color:#fff
style S2 fill:#78350f,color:#fff
style S3 fill:#1e3a5f,color:#fff
style S4 fill:#166534,color:#fff
style Plateau fill:#101820,color:#FBA225,stroke:#FBA225
第 1 周,监督:团队在每次使用代理输出前都会审核。速度在这一周下降是正常的,这是校准,不是失败。
第 2-3 周,自主度上升:代理在已验证的场景下无需审核运行,团队只处理例外。
第 3-4 周,代理模式:流程在约定范围内自主运行,只对例外情况报告。
第 30 天后,制度化模式:AI 化的流程就是"现在的做法",有文档、可以交接给岗位上的新人。
最常见的风险不是第 1 周的下降 (是预期的),而是 停滞效应:团队安于监督模式、始终不进阶。打破它的是同伴的现场演示,而不是供应商的动员讲话。
8. 阶段 4 · 收尾、推动者与交接
任何试点若缺少 内部推动者,都无法长久:那是客户团队内部,让新流程有归属感的那个人。他以 同伴影响力 被挑选,而不是团队里最技术的那位。推动者需要的是同伴相信,而不是精通配置。
一次干净的收尾至少交付:
- 流程的活文档 (客户内部的
CLAUDE.md):代理做什么、不做什么、超出范围时向谁升级。 - 3 到 5 份可复用的提示词或流程目录,已验证,团队可自行执行,不必每次都依赖 Transgenia。
- 6 个可预防失败清单 (图 2) 在宣布试点收尾前逐一勾选。
- 正式交接记录,包含日期、接收责任人、交接时刻流程的准确状态。
没有带日期与责任人的记录,试点就没有真正收尾。它只是暂停,等某个人来接手,这正是图 2 中"交接未正式化"的模式。
9. 30 天运作节奏
5 个阶段,每个都有可验证的退出条件,以及从第 1 天就排定的两个接触点:
查看 Mermaid 源码
timeline
title 30 天试点运作节奏
第 1-3 天 : 基线与成功标准签署
: 试点组与推动者确定
: 操作范围锁定
第 4-10 天 : 首个周期全程人工审核
: 提示词与流程校准
: 第 8 天与部门负责人接触
第 11-20 天 : 第二周期只审例外
: 自主度上升
: 第 15 天与部门负责人接触
第 21-27 天 : 约定范围内代理模式
: 每周开放答疑时段
: 活文档建设中
第 28-30 天 : 文档交付
: 推动者正式确认
: 收官展示与交接记录
| 天数 | 阶段 | 退出条件 |
|---|---|---|
| 1-3 | 筛选与基线 | 基线记录完成、成功标准签署 |
| 4-10 | 监督期 | 首个完整周期已跑完,全程人工审核 |
| 11-20 | 自主度上升 | 第二周期跑完,只对例外审核 |
| 21-27 | 代理模式 | 流程在约定范围内运行,无常态介入 |
| 28-30 | 收尾与展示 | 文档交付、推动者确认、记录签署 |
从第 1 天就排定的接触点 (非被动响应):
- 第 8 或 15 天,与部门负责人 30 分钟,在阻力累积前疏解。
- 每周 60 分钟开放答疑,试点尾声由内部推动者主持,而非 Transgenia。
第 30 天收官展示,三段各 10 分钟:流程实时演示、事前事后数字、以及关于后续延续性的正式对话。
10. 第 30 天的决策
本手册的目标是产出 一个基于证据的决策,不是一份报告。收官展示后,经销商会带着三种决策之一离场:
查看 Mermaid 源码
flowchart TD
Start(["第 30 天
展示"]) --> Q1{"阈值指标
是否
推动?"}
Q1 -- "否" --> Discard["放弃
场景
未通过验证"]
Q1 -- "部分" --> Adjust["调整
再 2 周
范围修订"]
Q1 -- "是" --> Q2{"团队在
无要求时
是否继续用?"}
Q2 -- "否" --> Adjust
Q2 -- "是" --> Q3{"推动者
就位且
活文档就绪?"}
Q3 -- "否" --> Adjust
Q3 -- "是" --> Scale["扩展
下一个流程
或扩大范围"]
style Scale fill:#166534,color:#fff
style Adjust fill:#78350f,color:#fff
style Discard fill:#7f1d1d,color:#fff
- 扩展:场景推动了指标,团队接受了,推动者就位。进入下一个流程或扩大范围。
- 调整:有进展但不完整。再给 2 周,范围与标准重新校准。
- 放弃:场景未通过验证。记录教训,把团队释放出来。第 30 天诚实放弃,是有效结果,不是失败。
11. 为什么这也是 Transgenia 的资产
每一次按本方法论执行的项目,不仅为客户创造价值,也直接推进 Transgenia 在 Claude (Anthropic) 合作伙伴计划中的等级。
查看 Mermaid 源码
flowchart LR
T1["Registered
最低承诺:
10 位
认证成员"]
T2["Select
10 位活跃成员
2 家客户上线
1 个公开案例"]
T3["Elite
更高标准
Anthropic 官方引荐"]
T1 --> T2 --> T3
Now["Transgenia 当前:
Registered
正在积累证据"]
Now -.-> T1
style T1 fill:#166534,color:#fff
style T2 fill:#1e3a5f,color:#fff
style T3 fill:#78350f,color:#fff
style Now fill:#101820,color:#FBA225,stroke:#FBA225
Anthropic 的 Partner Program Guide · Services Edition 从三个维度衡量,且不做平均 (单一维度出色并不达标):团队内的认证成员数、已在生产环境上线的联合客户数、可公开发布的客户案例数。按本手册执行的每一次项目,都同时构成对这三个维度的证据。
我们对外的一致且诚实的说法是:Transgenia 是 正在朝完整认证方向建设、并具备真实落地证据的 Claude 注册合作伙伴。不是已认证合作伙伴,也不是候选合作伙伴。这一区分之所以重要,是因为市场上有太多供应商只挂上 Anthropic 的名字,却拿不出实际路径。
Claude Partner Badge · Claude Code
由 Anthropic 颁发给 Efraín Carreón Ortiz。认证具备 端到端完成 Claude Code 部署的规模评估、落地、配置和运营能力。课程共 8 门,并以基于真实场景的最终评估收尾。
12. 下一步
在预约任何通话前,先对您希望自动化的流程问自己四个问题:发生频率是否足够?规则是否清晰,还是依赖未成文的判断?今天是否已有基线数据,即便是一份电子表格?每天真正在做的人,是否愿意在 30 天内改变自己的工作方式?如果四题中有至少三题为"是",您可能已经有了一个适合做 30 天试点的合格场景。
如果贵公司同时经营多品牌、多供应商或高 SKU 目录,您可能已经在我们面向 B2B 经销商 的专属指南中识别出多个摩擦点,那里我们详细说明了这套 AI 应用层如何落在 Odoo、多品牌库存与项目毛利之上。
第一步不是签一个 AI 项目,而是一次 15 分钟的诊断,用上述过滤器判断您的经销商是否已经具备一个可以做 30 天试点的合格场景。
本手册是 Centrum Transgenia S.A.S. de C.V. 的自有操作手册,内容参考 Anthropic Partner Badge · Claude Code 认证路径中的 " Delivery Methodology " 课程与 " Partner Basecamp "。Transgenia 是 Claude (Anthropic) 注册合作伙伴,不是已认证合作伙伴,也不是候选合作伙伴。本手册中的所有数字均不代表任何具体客户结果。
引用来源: Anthropic, 《Introducing the Services Track and Partner Hub of the Claude Partner Network》; Anthropic, 《Anthropic invests $100 million into the Claude Partner Network》; Credly, 《Claude Partner Badge · Claude Code》。