# Spotify 公开 Claude Code 内部架构，用 Hook 拦截加廉价模型分流把大文件读取 Token 消耗降低约 90%

- 来源：AYi (@AYi_AInotes)
- 发布时间：2026-09-08 12:20
- AIHOT 分数：68
- AIHOT 链接：https://aihot.virxact.com/items/cmts6kgnc0537ro46vsuuyauf
- 原文链接：https://x.com/AYi_AInotes/status/2097178140413972948

## AI 摘要

Spotify 公开其工程师使用 Claude Code 的内部架构，通过拦截超过 350 行的读取请求并分流给廉价模型，把大文件读取的 Token 消耗平均降低约 90%。

## 正文

Spotify 刚把自家的 Claude Code 内部架构全盘公开了, 直接把大文件读取的 Token 消耗硬生生砍掉了 90%:
绝大多数人都没意识到,你的编程助手 90% 的动作根本不是在思考, 它翻遍 5 个大文件只为找一个配置,照着旁边抄 20 个重复测试, 全是毫无技术含量的体力活,却全在按顶尖旗舰模型的最高费率狂烧。
Spotify 能把成本按在原地的 3 套刚性杀手锏:
1️⃣ 软规则全废直接上 Hook 铁门: 以前写在配置里的规矩模型全当耳旁风,现在任何读取请求只要超过 350 行,在执行前直接强行拦截熔断;
2️⃣ 派廉价工蜂提取子弹点摘要: 被拦截的大文件全分流给廉价小模型,只带回干干净净的结构化要点,几千行源代码永远不准跨进昂贵的上下文;
3️⃣ 模板代码直接落地不准回传: 让小模型按样本批量生成重复代码,剥离格式标记后直接静默写入磁盘,昂贵模型连看都不用看一眼。
但必须保留底牌:编辑文件和复杂推理绝不分流, 测试里小模型漏掉了一个严重的线程安全漏洞,旗舰模型几秒钟就抓了出来。
体力活交给工蜂,复杂逻辑留给旗舰, 所以大家别在提示词里求模型节约了,代码级拦截才是唯一的算力避孕套。

### 引用推文

> Yarchi：Spotify just published the internal setup their engineers use with Claude Code, the one that cut token usage by 90 percent. Here is how it works. The observatio...
