本文以 Anthropic 2026 年 9 月发布的威胁情报报告中的蒸馏指控相关章节为基础,通过 AI 工具进行内容分析与文字润色。文中观点为作者个人解读,不构成官方立场,仅供交流参考。
2026 年 9 月 10 日,Anthropic 发布月度威胁情报报告《Detecting and countering misuse of AI: September 2026》。其中”非法蒸馏”(illicit distillation)一节中点名了七家中国 AI 实验室:阿里、月之暗面、DeepSeek、智谱、小米、商汤、MiniMax。
关于这份报告的讨论已经不少,但大部分都在转述同一份材料。这篇换个做法:只看 Anthropic 自己的材料——官方博客、报告全文、以及它自己的法律文档——然后看看这份报告本身说了什么。
这个限制不是为了替任何一方辩护,也不是为了预设立场,理由很实际:想知道一份报告经不经得起检验,二手转述帮不上忙,因为转述会同时放大它的结论和它的漏洞。而 Anthropic 公开的材料足够多,多到可以用它自己的话检验它自己。
154 页的原文里,有几个中文讨论里几乎被漏掉的点,其中一条相当关键。
这篇会聊到:先把材料摆出来 → 9 月报告说了什么 → 蒸馏章节为什么一条可核验指标都没有 → 归因方法上 2 月反而比 9 月说得更清楚 → 报告里那句它自己承认”不知道”的话 → 动机里哪些能确认、哪些不能 → 以及一份可以用来检验任何威胁情报报告的 6 问清单。
一、先把材料摆出来
下面这些来源全部出自 Anthropic 自己:
- 《Detecting and preventing distillation attacks》,2026 年 2 月 23 日——第一次公开指控的原文
- 《Detecting and countering misuse of AI: September 2026》,2026 年 9 月 10 日(154 页 PDF)
- 《Our position on open-weights models》,2026 年 7 月 27 日,署名 Dario Amodei
- 《More details on Fable 5’s cyber safeguards and our jailbreak framework》,2026 年 7 月 2 日
- 《Improving our alignment and security efforts》,2026 年 8 月 31 日
- 消费者服务条款、隐私政策、支持国家名单等法律与管理文档
本文刻意不引用媒体的报道。 不是媒体不可靠,而是当判断的是”这份报告自己说了什么”时,中间每多一层,噪声就多一分。
