人工智能 · Claude · 方法论 · B2B 经销商

Transgenia 的 Claude.ai 实施手册

Transgenia 的 Claude.ai 实施手册

这是 Transgenia 在墨西哥 B2B 经销商内部落地 Claude.ai 所使用的操作手册。它不是营销文案,也不是"数字化转型"的承诺,而是我们实际执行的决策序列,分 5 个阶段、30 天 完成,以确保客户在第 30 天拥有足够的证据,能够在 " 扩展、调整或放弃" 之间做出不靠猜测的决定。

本手册源自我们成为 Claude 注册合作伙伴 (Anthropic) 的认证路径。在该路径中,我们的团队完成了 Partner Badge · Claude CodeDelivery Methodology 课程,并将 Anthropic 的方法论 (最初为软件工程试点设计) 推广到经销商的真实业务场景:国际采购、汇率、库存、报关文件,以及那些在销售完成前就被侵蚀的利润。

两条规则贯穿本手册及所有由此衍生的内容。第一:不虚构任何客户数据;当我们用数字举例时,要么引用公开来源,要么将其保留为针对客户实际场景的诊断问题。第二:精确定位。Transgenia 是 正在朝完整认证方向建设、并具备真实落地证据的 Claude 注册合作伙伴。不是已认证合作伙伴 (认证路径的最终评估仍在进行中),也不是候选合作伙伴 (该说法已于 2026 年 8 月停止使用)。这两条规则的存在,是为了保护读者不受市场普遍存在的过度承诺影响。

本手册的目标读者

本手册面向 B2B 经销商内部的三种角色:

如果您的经销商已经在考虑"用 AI 做点什么",但还没想清楚先衡量哪个流程、以什么为基线、由谁负责让采纳撑过第三周,那么本手册回答的正是这个问题。


1. 既然 Claude 的 AI 什么都能做,为什么还需要合作伙伴?

这是第一次会面中最诚实的问题,而 Anthropic 并不回避它:在 Partner Basecamp 的介绍中被明确提出。他们的原话是:"如果模型本身是任何人都能调用的商品,为什么还要引入合作伙伴,而不是直接调用相同的 API?" 答案同样来自同一份材料,也是我们在此应用的答案。

瓶颈已经转移。当模型能力还不达标的时候,难题是 "AI 能做到吗?" 这个问题在大多数场景下已经解决。今天的难题是 围绕模型的一切:如何在其之上设计产品,如何连接真实数据,如何衡量质量,如何真正改变人们的工作方式。Anthropic 直白地说:"模型是商品,应用层才是产品。"

图 1。Claude 落地工作的分布:模型约 10%,应用层约 90%,由提示词、上下文、评估、安全护栏组成。
查看 Mermaid 源码
flowchart LR
    M["模型
约 10%
Claude API 商品化"] P["提示词
约 25%
指令设计"] C["上下文
约 30%
RAG、工具、记忆"] E["评估
约 30%
质量、回归、置信度"] G["安全护栏
约 15%
安全、监控、升级"] M --> P M --> C M --> E M --> G style M fill:#1e3a5f,color:#fff style P fill:#166534,color:#fff style C fill:#166534,color:#fff style E fill:#166534,color:#fff style G fill:#78350f,color:#fff
图 1。分布来自 Anthropic Partner Basecamp 第一模块。差异化不在模型本身,而在如何围绕它构建。应用层加起来约占工作量的 90%。

一个已经真正操作过这 90% 的合作伙伴,能提供 API 本身无法带来的四件事:业务上下文 (知道哪些流程适合做试点、哪些不适合),应用层设计 (提示词、RAG、评估与安全护栏,而不仅仅是调用模型),基于基线的诚实衡量 (让"事后"能与"事前"进行有效对比),以及 变革管理 (让采纳撑过第三周)。缺少这四项,AI 试点只是昂贵的玩具。具备这四项,它才是一个在第 30 天可以做出有据决策的项目。

本手册所记录的,正是这四层能力。


2. 为什么大多数 AI 试点熬不到第 30 天

这种失败模式在各行业几乎如出一辙:场景没有经过筛选就上马,启动时没有记录基线,内部无人对新流程负责,几周后试点在沉默中被搁置。真正的问题几乎从来不是模型本身,而是缺少一套方法论,在 第 1 天之前 就明确:衡量什么、以什么为基线、由谁对采纳负责。

图 2。导致 AI 试点被放弃的 6 个可预防失败:无基线、无推动者、边缘场景、监督期停滞、文档过时、交接未正式化。
查看 Mermaid 源码
mindmap
  root((6 个可预防
失败)) 无基线 前值缺失 部门 Excel 需在第 1 天前捕获 无推动者 同伴参照 不是最技术那位 内部信誉 边缘场景 收益模糊 不影响总监级指标 跳过了阶段 0 监督期停滞 团队安于审核 始终不放手 缺少同伴演示 文档过时 手册不反映流程 提示词不共享 知识只在一人脑中 交接未正式化 供应商离场 无人接手 无带日期的记录
图 2。6 个可预防失败。每一个在本手册第 0 至 4 阶段都有对应的解药。

这 6 个失败模式,每一个都在后续阶段中有明确的应对措施。不是哲学,是清单。


3. 5 个阶段 · 总览

图 3。Transgenia 30 天手册 5 个阶段概览:阶段 0 筛选、阶段 1 设计、阶段 2 衡量、阶段 3 采纳、阶段 4 交接。
查看 Mermaid 源码
flowchart LR
    F0["阶段 0
筛选
第 1-3 天"] F1["阶段 1
试点设计
第 1-3 天"] F2["阶段 2
衡量与 ROI
第 4-30 天"] F3["阶段 3
分级采纳
第 4-27 天"] F4["阶段 4
收尾与交接
第 28-30 天"] F0 --> F1 --> F2 --> F3 --> F4 style F0 fill:#166534,color:#fff style F1 fill:#166534,color:#fff style F2 fill:#1e3a5f,color:#fff style F3 fill:#1e3a5f,color:#fff style F4 fill:#78350f,color:#fff
图 3。5 个阶段并行且串行:阶段 0 和 1 在前 3 天并行启动;阶段 2 和 3 贯穿整个试点;阶段 4 在最后 3 天完成收尾。

每个阶段都有 可验证的退出条件。没有该条件,不进入下一阶段。这种关卡纪律,正是"在第 30 天产生决策的试点"与"被遗忘的演示"之间的分界。


4. 阶段 0 · 场景筛选

不是每一个"可以用 AI"的流程都值得做试点。第一个决策是区分 边际收益 (节省时间但不改变业务结果) 与 结构性收益 (推动总监级已在关注的指标:每 SKU 毛利、回款周期、缺货率、发货时间)。

图 4。阶段 0 的 4 个筛选过滤器:量、复杂度、可衡量、意愿。放弃规则:高复杂度加上缺少衡量,等于风险,而不是试点。
查看 Mermaid 源码
flowchart TD
    Start(["候选流程"]) --> Q1{"量是否
足够?"} Q1 -- "否" --> Rej1["放弃
不足以支撑试点"] Q1 -- "是" --> Q2{"规则
是否清晰?"} Q2 -- "否" --> Risk["高风险
先梳理流程"] Q2 -- "是" --> Q3{"是否存在
基线?"} Q3 -- "否" --> Q3b{"能否在
3 天内建成?"} Q3b -- "否" --> Rej2["放弃
没有事前就没有事后"] Q3b -- "是" --> Q4 Q3 -- "是" --> Q4{"团队是否
愿意配合?"} Q4 -- "否" --> Rej3["暂缓
没有试点组就没有试点"] Q4 -- "是" --> OK(["合格试点
进入阶段 1"]) style OK fill:#166534,color:#fff style Rej1 fill:#7f1d1d,color:#fff style Rej2 fill:#7f1d1d,color:#fff style Rej3 fill:#7f1d1d,color:#fff style Risk fill:#78350f,color:#fff
图 4。4 个过滤器作为决策关卡。任一环节 " 否 " 都会在花费 30 天之前重新引导项目方向。

4 个过滤器,依序如下:

  1. 。频率是否高到值得自动化?每季度才发生一次的流程不值得做 30 天的试点。
  2. 复杂度。是否有清晰、可重复的规则?还是依赖未成文的个案判断?规则不清的高复杂度是风险信号,不是试点信号。
  3. 可衡量。今天是否存在某个基线数据 (即便是 Excel),还是要重新构造?如果无法衡量"事前",就无法证明"事后"。
  4. 团队意愿。真正经历流程的人是否愿意在 30 天内改变自己的工作方式?一个流程之外的热心志愿者,验证的是工具有趣,而不是流程改进。

放弃规则:高复杂度加上缺少衡量,等于风险,不是试点。要么先梳理流程,要么缩小范围。

我们已在 B2B 经销商中确认为结构性的场景:

在这些场景中,被推动的指标 (每 SKU 毛利、发货时间、占用资金、录入错误) 都是运营总监原本就会关注的指标。不是为了给试点找理由而杜撰的指标。


5. 阶段 1 · 试点设计

在场景通过筛选后,试点设计有三个不可让步的决策:试点组、操作范围、成功标准

试点组。 是每天真正在做这件事的人 (采购、仓储主管、成本分析师)。永远不是流程之外的"热心志愿者"。志愿者验证的是工具有趣,而我们要验证的是真实流程有所改进。

图 5。试点的人际系统:试点组 (采购、仓储主管、成本分析师)、内部推动者、部门负责人、Transgenia 促进者,以固定接触点相互连接。
查看 Mermaid 源码
flowchart LR
    C1["采购
试点组"] C2["仓储主管
试点组"] C3["成本分析师
试点组"] Champ["内部推动者
同伴影响力"] Lead["部门负责人
疏解阻力"] TGN["Transgenia 促进者
开放答疑时间"] C1 --> Champ C2 --> Champ C3 --> Champ Champ --> Lead Champ --> TGN style C1 fill:#1e3a5f,color:#fff style C2 fill:#1e3a5f,color:#fff style C3 fill:#1e3a5f,color:#fff style Champ fill:#166534,color:#fff style Lead fill:#1e3a5f,color:#fff style TGN fill:#78350f,color:#fff
图 5。内部推动者以同伴影响力挑选,而不是最技术的那位。他必须是同伴们相信的人。缺少这一环,采纳会在第三周停滞。

操作范围。 用精确的操作术语来定义,而不是愿景语言。不是 "采购数字化",而是 "从供应商确认到入库,自动跟进国际采购订单的文档状态"。判断标准是:局外读者能毫不含糊地说出 "这件事在试点内,那件事不在"

标准时长 是被测试任务的 两个完整周期。对于经销商而言,通常是 25 到 30 天,足以捕捉真实的波动:一次典型采购单、一次月末结账、一周高峰负荷。

成功标准 必须在 第 1 天之前 定下来,不是事后再补,并包含四个明确要素:

在看到初步结果之后再来设定,整套衡量都会失效。这是本手册中最不受欢迎的一条规则,也是拯救试点最多的一条。


6. 阶段 2 · 衡量与证据 (ROI)

基线要在 启动前 就捕获。试点开始两周后再"重建"的基线,已经被我们试图衡量的那个变化污染了。

我们在四个类别上衡量,把 Anthropic 原课程中面向软件工程的类别,推广到真实的经营运作:

图 6。试点 4 个 ROI 类别的示意分布:运营生产力、质量与返工、使用与采纳、团队感受。
查看 Mermaid 源码
pie showData
    title 试点的 4 个 ROI 衡量类别
    "运营生产力" : 30
    "质量与返工" : 25
    "使用与采纳" : 25
    "团队感受" : 20
图 6。相对权重的示意分布。Delivery Methodology 课程的教训推广到运营:任何单一类别都撑不起一份收官报告。只推动生产力却没有采纳的试点,已经输了。

试点结果以 一个数字加一句面向管理层的翻译 呈现,而不是一堆技术观察。像 "我们把 ETA 对账每周所需人时从 X 降到 Y" 这样一句话,总监会一听就懂。像 "代理正确处理了 Z% 的供应商邮件" 这样一句,单独说出来是不够的。(X、Y、Z 是格式占位符:每位客户在收官时用自己有据的数字填写。)


7. 阶段 3 · 分级采纳

真正的采纳呈曲线,不是一开一关。它从"全程审核"到"自主运行",分四段推进;主要风险不是初期的下降,而是中段的停滞。

图 7。试点每周的采纳曲线与自主度:第一周 20%、第二周 55%、第三周 80%、第四周 95%。
查看 Mermaid 源码
flowchart LR
    S1["第 1 周
监督
自主度约 20%
校准"] S2["第 2-3 周
自主度上升
约 55% → 约 80%
只审例外"] S3["第 4 周
代理模式
约 95%
流程自主运行"] S4["第 30 天+
制度化
约 100%
就是现在这么做"] S1 --> S2 --> S3 --> S4 Plateau["主要风险:
监督期停滞"] Plateau -.-> S2 style S1 fill:#7f1d1d,color:#fff style S2 fill:#78350f,color:#fff style S3 fill:#1e3a5f,color:#fff style S4 fill:#166534,color:#fff style Plateau fill:#101820,color:#FBA225,stroke:#FBA225
图 7。第一周的下降是预期中的校准。真正的风险是团队安于"监督"状态、不再前进。打破它的是同伴的现场演示,不是供应商的动员讲话。

第 1 周,监督:团队在每次使用代理输出前都会审核。速度在这一周下降是正常的,这是校准,不是失败。

第 2-3 周,自主度上升:代理在已验证的场景下无需审核运行,团队只处理例外。

第 3-4 周,代理模式:流程在约定范围内自主运行,只对例外情况报告。

第 30 天后,制度化模式:AI 化的流程就是"现在的做法",有文档、可以交接给岗位上的新人。

最常见的风险不是第 1 周的下降 (是预期的),而是 停滞效应:团队安于监督模式、始终不进阶。打破它的是同伴的现场演示,而不是供应商的动员讲话。


8. 阶段 4 · 收尾、推动者与交接

任何试点若缺少 内部推动者,都无法长久:那是客户团队内部,让新流程有归属感的那个人。他以 同伴影响力 被挑选,而不是团队里最技术的那位。推动者需要的是同伴相信,而不是精通配置。

一次干净的收尾至少交付:

没有带日期与责任人的记录,试点就没有真正收尾。它只是暂停,等某个人来接手,这正是图 2 中"交接未正式化"的模式。


9. 30 天运作节奏

5 个阶段,每个都有可验证的退出条件,以及从第 1 天就排定的两个接触点:

图 8。试点日程:第 1-3 天基线,4-10 首个周期,11-20 第二周期,21-27 代理模式,28-30 收尾与展示。两个接触点从第 1 天就排定。
查看 Mermaid 源码
timeline
    title 30 天试点运作节奏
    第 1-3 天 : 基线与成功标准签署
              : 试点组与推动者确定
              : 操作范围锁定
    第 4-10 天 : 首个周期全程人工审核
               : 提示词与流程校准
               : 第 8 天与部门负责人接触
    第 11-20 天 : 第二周期只审例外
                : 自主度上升
                : 第 15 天与部门负责人接触
    第 21-27 天 : 约定范围内代理模式
                : 每周开放答疑时段
                : 活文档建设中
    第 28-30 天 : 文档交付
                : 推动者正式确认
                : 收官展示与交接记录
图 8。第 1 天就排定的接触点不是被动响应,而是在阻力累积之前主动疏解。前期由 Transgenia 主持,后期由内部推动者主持。
天数 阶段 退出条件
1-3 筛选与基线 基线记录完成、成功标准签署
4-10 监督期 首个完整周期已跑完,全程人工审核
11-20 自主度上升 第二周期跑完,只对例外审核
21-27 代理模式 流程在约定范围内运行,无常态介入
28-30 收尾与展示 文档交付、推动者确认、记录签署

从第 1 天就排定的接触点 (非被动响应):

第 30 天收官展示,三段各 10 分钟:流程实时演示、事前事后数字、以及关于后续延续性的正式对话。


10. 第 30 天的决策

本手册的目标是产出 一个基于证据的决策,不是一份报告。收官展示后,经销商会带着三种决策之一离场:

图 9。第 30 天决策树:1) 阈值指标是否推动?2) 团队在没被要求时是否也会继续用?3) 推动者是否就位?最终得到
查看 Mermaid 源码
flowchart TD
    Start(["第 30 天
展示"]) --> Q1{"阈值指标
是否
推动?"} Q1 -- "否" --> Discard["放弃
场景
未通过验证"] Q1 -- "部分" --> Adjust["调整
再 2 周
范围修订"] Q1 -- "是" --> Q2{"团队在
无要求时
是否继续用?"} Q2 -- "否" --> Adjust Q2 -- "是" --> Q3{"推动者
就位且
活文档就绪?"} Q3 -- "否" --> Adjust Q3 -- "是" --> Scale["扩展
下一个流程
或扩大范围"] style Scale fill:#166534,color:#fff style Adjust fill:#78350f,color:#fff style Discard fill:#7f1d1d,color:#fff
图 9。第 30 天的决策不在展示现场协商:标准在第 1 天就已定下。诚实放弃是一个合法结果。第 30 天诚实放弃一个未通过筛选的场景,等于省下了钱。

11. 为什么这也是 Transgenia 的资产

每一次按本方法论执行的项目,不仅为客户创造价值,也直接推进 Transgenia 在 Claude (Anthropic) 合作伙伴计划中的等级。

图 10。Anthropic Services Track 三个等级:Registered (至少 10 人取得认证)、Select (10 人活跃、2 家客户上线、1 个公开案例)、Elite (更高标准)。Transgenia 当前:Registered。
查看 Mermaid 源码
flowchart LR
    T1["Registered
最低承诺:
10 位
认证成员"] T2["Select
10 位活跃成员
2 家客户上线
1 个公开案例"] T3["Elite
更高标准
Anthropic 官方引荐"] T1 --> T2 --> T3 Now["Transgenia 当前:
Registered
正在积累证据"] Now -.-> T1 style T1 fill:#166534,color:#fff style T2 fill:#1e3a5f,color:#fff style T3 fill:#78350f,color:#fff style Now fill:#101820,color:#FBA225,stroke:#FBA225
图 10。来源:Anthropic 《Services Track and Partner Hub of the Claude Partner Network》。三个等级不求平均:单维出色不算达标。按本手册执行的每一次项目都同时推动三个维度。

Anthropic 的 Partner Program Guide · Services Edition 从三个维度衡量,且不做平均 (单一维度出色并不达标):团队内的认证成员数、已在生产环境上线的联合客户数、可公开发布的客户案例数。按本手册执行的每一次项目,都同时构成对这三个维度的证据。

我们对外的一致且诚实的说法是:Transgenia 是 正在朝完整认证方向建设、并具备真实落地证据的 Claude 注册合作伙伴。不是已认证合作伙伴,也不是候选合作伙伴。这一区分之所以重要,是因为市场上有太多供应商只挂上 Anthropic 的名字,却拿不出实际路径。

可验证凭证

Claude Partner Badge · Claude Code

Anthropic 颁发给 Efraín Carreón Ortiz。认证具备 端到端完成 Claude Code 部署的规模评估、落地、配置和运营能力。课程共 8 门,并以基于真实场景的最终评估收尾。

在 Credly 验证


12. 下一步

在预约任何通话前,先对您希望自动化的流程问自己四个问题:发生频率是否足够?规则是否清晰,还是依赖未成文的判断?今天是否已有基线数据,即便是一份电子表格?每天真正在做的人,是否愿意在 30 天内改变自己的工作方式?如果四题中有至少三题为"是",您可能已经有了一个适合做 30 天试点的合格场景。

如果贵公司同时经营多品牌、多供应商或高 SKU 目录,您可能已经在我们面向 B2B 经销商 的专属指南中识别出多个摩擦点,那里我们详细说明了这套 AI 应用层如何落在 Odoo、多品牌库存与项目毛利之上。

第一步不是签一个 AI 项目,而是一次 15 分钟的诊断,用上述过滤器判断您的经销商是否已经具备一个可以做 30 天试点的合格场景。

Efraín Carreón Ortiz
Transgenia 首席执行官 · Claude (Anthropic) 注册合作伙伴
"我们不是我们讲述的故事,而是能产生效果的事实。"

本手册是 Centrum Transgenia S.A.S. de C.V. 的自有操作手册,内容参考 Anthropic Partner Badge · Claude Code 认证路径中的 " Delivery Methodology " 课程与 " Partner Basecamp "。Transgenia 是 Claude (Anthropic) 注册合作伙伴,不是已认证合作伙伴,也不是候选合作伙伴。本手册中的所有数字均不代表任何具体客户结果。

引用来源: Anthropic, 《Introducing the Services Track and Partner Hub of the Claude Partner Network》; Anthropic, 《Anthropic invests $100 million into the Claude Partner Network》; Credly, 《Claude Partner Badge · Claude Code》

← 返回博客