老板常踩的,AI 采购深坑
我这边已经遇到五个客户了,公司团队十几个人,跟我说全部都是用的官方的 Claude Code。我一检查才发现:三个是中转站,两个是国内的大模型。
还有一个老板跟我说,Claude Code 用了半年,觉得没有 Codex 好用。我当时就特别纳闷——因为我认识的所有人,凡是用了官方订阅、并且把那一整套 harness 配置好的,没有任何一个人觉得 Codex 更好用。
先说那几个数字
老板们交的 AI 智商税,最常见的就是 Claude Code。
我这边已经遇到五个客户了,公司团队十几个人,跟我说全部都是用的官方的 Claude Code。我一检查才发现:三个是中转站,两个是国内的大模型。
还有一个老板跟我说,Claude Code 用了半年,觉得没有 Codex 好用。我当时就特别的纳闷。因为我认识的所有人,包括我的所有的客户,凡是用了官方订阅的 Claude Code、并且配置好了一整套那个 harness 之后,没有任何一个人觉得 Codex 更好用。
当然,其中大概有三分之一的比例是 Codex 和 Claude Code 都用的——毕竟 Codex 可以用订阅的额度去免费地出图。
说到这里,就有些人会在评论区说了:Claude Code 加 Kimi 的 K3 也不错。对,确实不错,前端的页面还有一些办公文书之类的工作,是做得非常好的。但是复杂的任务,尤其是当知识库比较庞大的时候,确实是力不从心的。
为什么换个接口就不行了
今天我让我的 Claude Code 去梳理了一下:到底 API 的方式接入,哪怕是官方的模型、就是俗称的号池,它跟官方订阅有什么区别。
关键在这个类比:
Claude Code 就像一个机器人一样。我们会给它配置它的大脑,就是它的大模型;还会给它配置一系列的 MCP 也好,或者是技能、Skill 也好。它之所以能够顺畅地帮我们去完成一系列的任务和工作,最主要的一个原因就是——大模型利用了机器人的这个「壳」,它可以去方便地调用一系列的工具。
而每家大模型调用工具的方式,其实是非常不一样的。
所以如果你不是接入的官方的所谓「纯血」的订阅,或者是 API 的话,有四个层面都会出现严重的问题。
三种表现:报错、变笨、幻觉
- 有的时候你可以看到明确的报错,压根就没办法去执行;
- 有的时候它执行了,但你感觉它变笨了;
- 甚至会导致严重的幻觉,产生不可逆的后果。
这三种里,最贵的是中间那种。报错反而最省心——你立刻就知道出问题了。
逐条过一遍:哪些工具会坏
片里对着那份分级网页逐条过了一遍。红色的标记是直接报错或者完全不可用;橙色的代表它会降级,会默默地在你不注意的时候变差;灰色的这种,是会让整个工作变得更慢。
- 精确字符替换——最简单的这样一个操作,都是不能用的
- 写入、严格的枚举
- 网络搜索——包括调研里面最常用到的,都不能用
- 智能体在运作的时候会抓取一些小模型去调用,那些参数一有问题,在做一些简单的摘要的工作的时候就会出错
- 最让体验不好的:图片和 PDF 的输入都会被直接影响,没有办法用到官方的工具,只能用第三方的去替代
- 工具的扩展字段降级、并行工具调用降级、高强度的思考链全面阻断、流式事件降级、MCP 降级、子代理降速
- Skill 降级、思考预算不能用、实验性的功能标记没有办法正确识别
- 上下文的自动压缩和阻断都会有问题、成本和用量的统计不能用、计划模式有问题、错误恢复与重试有问题
也要说句公道话:第三方的模型在接入的时候,也会通过一些配置其他工具的手段去完成这些任务。但可以想象一下:一个设计得非常精妙的机器人,它身体的某个零部件被换成了不是原厂的版本,可以预想的是,它的运行效率是降低的。
最该算给老板听的,是那笔钱账
本地执行的这些最基础的命令,每一轮都会去传全量的上下文,根本没有缓存。
所以——
这就是为什么你用了中转站,人家给你打了那么低的折扣,你一个月的 tokens 的费用还是那么高,有的时候会比官方的订阅还要高。
折扣是账面上的,token 账单才是实际发生的。这两个数不是一回事。
一个让步论证
而且还会因为中转站的耗时机制,导致上下文的混乱、注入,甚至是会给你替换成更便宜的、降质的模型。
但退一步说——
哪怕姑且我们相信,中转站是一个非常诚实的一个机构,它不会去看你的数据,不会去改你的价格,以上的这些功能,也全部都是有问题的。
这句是全片的骨头:这不是人品问题,是架构问题。 客户端的整套优化本来就是按官方那条线定制的,换一条线,优化自然失效。
所以我之前说,有的 AI 博主真的是为了赚广告费一点良知都没有,教用户在 Claude Code 里面接入第三方的模型。
真的上不了官方,怎么退一步
那如果真的没有办法用上 Claude Code 呢?也有路,而且是更体面的一条路:
其实在国内的这些智能体的工具里面(具体的厂商我就不说了),国内的智能体再接入国内的模型,尤其是与它匹配的大厂的模型,或者是它明确列表里面可以去调用的这些模型,通常都是优化得比较好的。
在国产的智能体里面去调用国产的模型,都比 Claude Code 去调用一个国产的模型,效果要好得多。
道理是同一个:让工具去用它自己适配过的模型,而不是把一个模型硬塞进一个不是为它设计的壳里。
那怎么知道自己有没有被骗
这一点片里我说了「文章下面列出了一些方法,就不一一赘述」——那份清单的原件放在本文附件里(上面的下载区),一页可以对着自查。
最先该做的一件事很简单:别只问「我们用的是不是 Claude」,要问「我们走的是官方订阅、官方 API,还是中转」。 团队里「大家都说是官方的」不算数,值得自己看一遍配置。我这五个客户,全都是在这一步才发现的。
再往下,清单里那套「五分钟自查」是按真实执行顺序排的,每一步的结论决定下一步:
- 确认协议端点 —— Claude Code 只发
POST /v1/messages。中转只有/v1/chat/completions的话两者根本不兼容 - 核对 model ID —— 别照抄官方文档的模型名,以中转的实际列表为准,大小写敏感
- 探专有字段是否透传 ——
thinking和cache_control各发一次,看是被接受、被忽略还是 400。响应 usage 里有没有cache_creation_input_tokens,是缓存能力的直接证据 - 用一次真实工具调用做验收 —— 读一个文件 → 精确 Edit 一行 → 再 Grep 验证。这一条链路同时压到并行调用、
tool_use_id配对、逐字精度三个高危点 - 按结果显式关掉不支持的能力 —— 与其让客户端一直发会被拒或被忽略的字段,不如主动关掉,能少掉一大批莫名其妙的 400 和空转
顺一句:能不能用 WebSearch 是最快的分辨器。它是 Anthropic 的服务端工具,搜索在官方服务器上完成;中转只做协议转换、没有搜索服务,Bedrock / Vertex 同样不支持。所以反代通道只能 Fetch、不能 Search。
最后一句
今天讲的这些判断,跟你用哪个客户端没关系,在官方的命令行里一样成立。
最后那句是留给某些同行的:人在做,天在看,赚点干净钱吧。
来源:EP0077_audio.mp3 · ASR 模型 gemini-2.5-pro(切段并发) · 原片完整文字版
[00:00] 老板们交的 AI 智商税啊 最常见的就是 Claude Code 那我已经遇到我这边五个客户了 公司团队十几个人 跟我说全部都是用的官方的 Claude Code 那我一检查才发现三个是中转站 两个是国内的大模型 还有一个老板跟我说 Claude Code 用了半年 觉得没有 Codex 好用 我当时就特别的纳闷 因为我认识的所有人 包括我的所有的客户 凡是用了官方订阅的 Claude Code 并且配置好为一整套的 那个 harness 之后呢 没有任何一个人
[00:26] 觉得 Codex 更好用 当然了其中大概有三分 之一的比例 是 Codex 和 Claude Code 都用的 毕竟 Codex 可以用订阅的额度 去免费的出图 说到这里啊就有些人 就会在评论区说了啊 说 Claude Code 加 Kimi 的 K3 也不错 对确实不错 前端的页面还有一些办公文书 之类的一些工作 是做得非常的好的 但是复杂的任务 尤其是当知识库比较庞大的时候 确实是力不从心的 那我今天也让我的 Claude Code 去梳理了一下 到底 API 的方式接入
[00:52] 哪怕是官方的模型 就是俗称的号池 它到底跟官方订阅有什么区别? 那我们可以看到这个 CC 做的网页啊 Claude Code 就像一个机器人一样 我们会给它配置它的大脑 就是它的大模型 还会给它配置一系列的 MCP 也好或者是技能也好 Skill 也好 那它之所以能够顺畅地 帮我们去完成一系列的 任务和工作呢 最主要的一个原因就是 大模型利用了机器人的这个壳 它可以去方便地调用一
[01:17] 系列的工具 每家大模型调用工具的方式 其实是非常不一样的 所以如果你不是接入的 官方的所谓纯血的订阅 或者是 API 的话 有四个层面都会出现严重的问题 有的时候你可以看到明确的 报错啊 压根就没办法去执行 有的时候它执行了 但你感觉它变笨了 甚至会导致严重的幻觉 产生不可逆的后果 那我们具体来看有哪些的 tool use 会出问题 我会把这个网页 扔到群里面 这里面红色的标记就是
[01:42] 直接报错或者是 完全不可用的 那橙色的呢代表它会降级 会默默的在你不注意的时候变差 那灰色的这种是 会让整个工作变得更慢 那这里面呢第三方的模型 在接入的 时候也会通过一些配置 其他工具的手段 去能够完成这些任务 但我们可以想象一下 一个设计得非常精妙的机器人 它身体的 某个零部件被换成了 不是原厂的版本 可以预想的是它的 运行效率是降低的
[02:07] 那最简单的这样的 一个精确字符替换都是不能用的 那再往下看写入严格的枚举 包括最常用到的 调研里面最常用到的 网络搜索都不能用 当智能体在运作的时候 它会抓取一些小模型去调用 那如果这些参数有问题 在做一些简单的摘要的 工作的时候就会出错 那最让体验不好的是什么呢 是图片和 PDF 的输入都会被直接影响 没有办法用到官方的工具 只能用第三方的去替代
[02:32] 工具的扩展字段降级 并行工具调用降级 高强度的思考链全面的阻断 流式事件降级 MCP 降级 子代理会降速 而且因为没有缓存 整个的成本会额外的高 这就是为什么你用了中转站 人家给你打了那么低的折扣 你一个月的 tokens 的费用还是那么高 有的时候会比官方的 订阅还要高 Skill 降级 本地执行的这些最基础的命令 每一轮都会去传全量的上下文
[02:58] 根本没有缓存 思考预算不能用实验性的 功能标记没有办法正确识别 上下文的 自动压缩和阻断都会有问题 成本和用量的统计不能用 计划模式有问题 错误恢复与重试有问题 而且会因为中转站的耗时机制 导致上下文的混乱注入 甚至是会给你替换成更 便宜的降质的模型哪怕 姑且我们相信中转站是一个非常 诚实的一个机构 它不会去看你的数据 不会去改你的价格
[03:23] 以上的这些功能也全部都是 有问题的 所以我之前说有的 AI 博主真的是 为了赚广告费一点良知都没有 教用户在 Claude Code 里面 接入第三方的模型 那如果真的没有办法用上 Claude Code 其实在国内的这些智能体的 工具里面 那具体的厂商我就不说了 国内的智能体再接入国内的模型 尤其是与它匹配的大厂的模型 或者是它明确列表里面
[03:48] 可以去调用的这些模型 通常都是优化的比较好的 在国产的 智能体里面去调用国产的模型 都比 Claude Code 去调用一个国产的 模型效果要好得多所以怎么 知道你到底有没有被骗呢 这文章下面我列出了一些方法 我这里就不一一赘述了 那最后呢我想奉劝某些同行 人在做天在看 赚点干净钱吧 今天内容就是这样 我们下期再见拜拜