← 回首页

老板常踩的,AI 采购深坑

真人长视频 · EP0077 2026年8月2日 04:08
这一期讲什么

我这边已经遇到五个客户了,公司团队十几个人,跟我说全部都是用的官方的 Claude Code。我一检查才发现:三个是中转站,两个是国内的大模型。

还有一个老板跟我说,Claude Code 用了半年,觉得没有 Codex 好用。我当时就特别纳闷——因为我认识的所有人,凡是用了官方订阅、并且把那一整套 harness 配置好的,没有任何一个人觉得 Codex 更好用。

配套下载 · 给你的 Claude Code 学

先说那几个数字

老板们交的 AI 智商税,最常见的就是 Claude Code。

我这边已经遇到五个客户了,公司团队十几个人,跟我说全部都是用的官方的 Claude Code。我一检查才发现:三个是中转站,两个是国内的大模型。

还有一个老板跟我说,Claude Code 用了半年,觉得没有 Codex 好用。我当时就特别的纳闷。因为我认识的所有人,包括我的所有的客户,凡是用了官方订阅的 Claude Code、并且配置好了一整套那个 harness 之后,没有任何一个人觉得 Codex 更好用

当然,其中大概有三分之一的比例是 Codex 和 Claude Code 都用的——毕竟 Codex 可以用订阅的额度去免费地出图。

说到这里,就有些人会在评论区说了:Claude Code 加 Kimi 的 K3 也不错。对,确实不错,前端的页面还有一些办公文书之类的工作,是做得非常好的。但是复杂的任务,尤其是当知识库比较庞大的时候,确实是力不从心的

为什么换个接口就不行了

今天我让我的 Claude Code 去梳理了一下:到底 API 的方式接入,哪怕是官方的模型、就是俗称的号池,它跟官方订阅有什么区别。

关键在这个类比:

Claude Code 就像一个机器人一样。我们会给它配置它的大脑,就是它的大模型;还会给它配置一系列的 MCP 也好,或者是技能、Skill 也好。它之所以能够顺畅地帮我们去完成一系列的任务和工作,最主要的一个原因就是——大模型利用了机器人的这个「壳」,它可以去方便地调用一系列的工具。

每家大模型调用工具的方式,其实是非常不一样的

所以如果你不是接入的官方的所谓「纯血」的订阅,或者是 API 的话,有四个层面都会出现严重的问题。

三种表现:报错、变笨、幻觉

  • 有的时候你可以看到明确的报错,压根就没办法去执行;
  • 有的时候它执行了,但你感觉它变笨了
  • 甚至会导致严重的幻觉,产生不可逆的后果。

这三种里,最贵的是中间那种。报错反而最省心——你立刻就知道出问题了。

逐条过一遍:哪些工具会坏

片里对着那份分级网页逐条过了一遍。红色的标记是直接报错或者完全不可用;橙色的代表它会降级,会默默地在你不注意的时候变差;灰色的这种,是会让整个工作变得更慢。

  • 精确字符替换——最简单的这样一个操作,都是不能用的
  • 写入、严格的枚举
  • 网络搜索——包括调研里面最常用到的,都不能用
  • 智能体在运作的时候会抓取一些小模型去调用,那些参数一有问题,在做一些简单的摘要的工作的时候就会出错
  • 最让体验不好的:图片和 PDF 的输入都会被直接影响,没有办法用到官方的工具,只能用第三方的去替代
  • 工具的扩展字段降级、并行工具调用降级、高强度的思考链全面阻断、流式事件降级、MCP 降级、子代理降速
  • Skill 降级、思考预算不能用、实验性的功能标记没有办法正确识别
  • 上下文的自动压缩和阻断都会有问题、成本和用量的统计不能用、计划模式有问题、错误恢复与重试有问题

也要说句公道话:第三方的模型在接入的时候,也会通过一些配置其他工具的手段去完成这些任务。但可以想象一下:一个设计得非常精妙的机器人,它身体的某个零部件被换成了不是原厂的版本,可以预想的是,它的运行效率是降低的。

最该算给老板听的,是那笔钱账

本地执行的这些最基础的命令,每一轮都会去传全量的上下文,根本没有缓存

所以——

这就是为什么你用了中转站,人家给你打了那么低的折扣,你一个月的 tokens 的费用还是那么高,有的时候会比官方的订阅还要高。

折扣是账面上的,token 账单才是实际发生的。这两个数不是一回事。

一个让步论证

而且还会因为中转站的耗时机制,导致上下文的混乱、注入,甚至是会给你替换成更便宜的、降质的模型。

但退一步说——

哪怕姑且我们相信,中转站是一个非常诚实的一个机构,它不会去看你的数据,不会去改你的价格,以上的这些功能,也全部都是有问题的。

这句是全片的骨头:这不是人品问题,是架构问题。 客户端的整套优化本来就是按官方那条线定制的,换一条线,优化自然失效。

所以我之前说,有的 AI 博主真的是为了赚广告费一点良知都没有,教用户在 Claude Code 里面接入第三方的模型。

真的上不了官方,怎么退一步

那如果真的没有办法用上 Claude Code 呢?也有路,而且是更体面的一条路:

其实在国内的这些智能体的工具里面(具体的厂商我就不说了),国内的智能体再接入国内的模型,尤其是与它匹配的大厂的模型,或者是它明确列表里面可以去调用的这些模型,通常都是优化得比较好的。

在国产的智能体里面去调用国产的模型,都比 Claude Code 去调用一个国产的模型,效果要好得多。

道理是同一个:让工具去用它自己适配过的模型,而不是把一个模型硬塞进一个不是为它设计的壳里。

那怎么知道自己有没有被骗

这一点片里我说了「文章下面列出了一些方法,就不一一赘述」——那份清单的原件放在本文附件里(上面的下载区),一页可以对着自查。

最先该做的一件事很简单:别只问「我们用的是不是 Claude」,要问「我们走的是官方订阅、官方 API,还是中转」。 团队里「大家都说是官方的」不算数,值得自己看一遍配置。我这五个客户,全都是在这一步才发现的。

再往下,清单里那套「五分钟自查」是按真实执行顺序排的,每一步的结论决定下一步:

  1. 确认协议端点 —— Claude Code 只发 POST /v1/messages。中转只有 /v1/chat/completions 的话两者根本不兼容
  2. 核对 model ID —— 别照抄官方文档的模型名,以中转的实际列表为准,大小写敏感
  3. 探专有字段是否透传 —— thinkingcache_control 各发一次,看是被接受、被忽略还是 400。响应 usage 里有没有 cache_creation_input_tokens,是缓存能力的直接证据
  4. 用一次真实工具调用做验收 —— 读一个文件 → 精确 Edit 一行 → 再 Grep 验证。这一条链路同时压到并行调用、tool_use_id 配对、逐字精度三个高危点
  5. 按结果显式关掉不支持的能力 —— 与其让客户端一直发会被拒或被忽略的字段,不如主动关掉,能少掉一大批莫名其妙的 400 和空转

顺一句:能不能用 WebSearch 是最快的分辨器。它是 Anthropic 的服务端工具,搜索在官方服务器上完成;中转只做协议转换、没有搜索服务,Bedrock / Vertex 同样不支持。所以反代通道只能 Fetch、不能 Search。

最后一句

今天讲的这些判断,跟你用哪个客户端没关系,在官方的命令行里一样成立。

最后那句是留给某些同行的:人在做,天在看,赚点干净钱吧。

老板们交的 AI 智商税,最常见的就是 Claude Code。