您的位置 首页 首页

DeepSeek被曝“蒸馏”Claude Fable 5,网友:谢谢梁叔叔百亿补贴

2026年7月,一场关于“模型蒸馏”的风波在AI圈迅速发酵,将国产大模型明星公司DeepS…

2026年7月,一场关于“模型蒸馏”的风波在AI圈迅速发酵,将国产大模型明星公司DeepSeek推上了舆论的风口浪尖。事件的导火索,是海外科技博主leo在X平台上的一则重磅爆料:DeepSeek V4 Pro的官方API,疑似将部分复杂编程请求暗中转交给Anthropic旗下的顶尖模型Claude Fable 5处理,目的可能是收集其高质量输出,用于模型蒸馏——即用更强模型的答案来训练自己的模型

这场风波的起点,源于一个看似平常的技术测试,爆料博主leo指出,测试者通过OpenCode工具向DeepSeek V4 Pro的官方API发起请求,要求模型生成一个3D游戏。令人意外的是,部分输出结果与Claude Fable 5的代码风格高度相似,甚至连推理方式的链条结构都呈现出Claude系列模型特有的特征,而非DeepSeek常见的输出风格。

更耐人寻味的是测试中的“变量实验”,当测试者在提示词中混入网络安全和生物学相关的问题后,模型生成游戏的质量明显下降,知识范围也迅速退回到了DeepSeek原本的水平。这一现象恰好利用了Claude Fable 5的一个已知机制:Anthropic会将部分涉及网络安全、生物学的请求以及蒸馏类请求自动转给Opus 4.8处理。测试者因此合理推测,请求最初被路由到了Fable 5,但在触发了Anthropic的安全分类器后,才被迫回退到DeepSeek自身模型。

目前,这一传闻已在Linux.do技术社区及X平台引发广泛讨论,部分国内开发者还基于leo的线索进行了复现尝试。但需要强调的是,现有证据仅能证明API行为存在异常——它既无法确认实际回答者究竟是谁,也无法证明这些输出确实被纳入了DeepSeek的训练数据。混合提示词、未公开的模型更新,抑或DeepSeek自身的路由优化策略,都可能造成类似的输出差异。

这则爆料在中文互联网上引发的舆论反应,恐怕是爆料者始料未及的。按照常规剧本,一家中国AI公司被指控“借用”海外竞品模型能力,理应引发关于技术伦理与合规性的严肃讨论。但中国网友的反应,却呈现出一种近乎黑色幽默的集体调侃。

“那更好了,感谢梁叔叔百亿补贴”,一位内蒙古的网友如此评论。另一位广东网友算了一笔账:“v4pro输出6元/百万token,fable5 50美元/百万token,50多倍价差了”——按当时汇率折算,这大约是350元人民币对6元人民币的差距,接近60倍。

这种“反向定价”的荒诞感,成为网友调侃的核心素材。一位北京网友半开玩笑地说:“意思是使用便宜ds,然后他给我接到贵的opus上,我真的谢谢文峰了”。山东网友紧跟其后:“还有这种好事?那不得多用”。广东网友更是直言:“血赚啊,用deepseek的价格买到fable5的能力”。河南网友则用更夸张的语气感叹:“梁圣这下真成圣了”。

即便是相对理性的声音,也呈现出一种微妙的“不以为意”。一位广东网友指出:“首先这件事真实性存疑,毕竟只是一面之辞。其次,就算这是真的,对于我们ds用户来说是好事啊,花ds的价位有fable5的能力”。另一位四川网友则精准捕捉到了中外舆论场的温差:“老外本来想带节奏,中国人不为所动,甚至感觉赚到了”。

这种集体反应,折射出的不仅是网友对“薅羊毛”的本能兴奋,更是对DeepSeek定价策略的一种反向认同——如果真能以6元/百万token的价格“蹭”到50美元/百万token的顶级模型能力,那不仅不是丑闻,反而是某种意义上的“用户胜利” 。

要理解这场风波的深层背景,需要将时间轴拉回到2026年2月。彼时,Anthropic在官方博客发布了一篇措辞严厉的声明,公开指控DeepSeek、月之暗面和MiniMax三家中国AI公司,通过约2.4万个虚假账户与Claude模型进行了总计超过1600万次交互,实施所谓的“工业规模蒸馏攻击”。

Anthropic声称,这三家中国AI实验室通过系统性提取Claude在推理、工具调用与编程等方面的核心能力,用于训练和改进自身模型。这一指控在当时的AI行业引发巨大震动,多家美国AI公司随后跟进,OpenAI更是在提交给美国国会的备忘录中指控DeepSeek“搭便车”。OpenAI、Anthropic和谷歌甚至被报道组建了所谓的“反蒸馏联盟”。

然而,这一指控从一开始就伴随着巨大的争议。特斯拉CEO马斯克直接在社交媒体上嘲讽Anthropic“贼喊捉贼”。业内不少声音指出,Anthropic自身在训练Claude模型时,同样大量使用了互联网上的公开代码、网页和图书数据——包括可能来自中国开源模型的内容。有报道显示,Claude Opus 4.8甚至曾在对话中自称是“DeepSeek”和“千问”。

更关键的是技术与逻辑层面的质疑。Redis之父就公开为DeepSeek抱不平,指出通过公开API进行模型蒸馏实际上“是不可能的”,因为要蒸馏一个模型,需要访问海量的、带有完整logits(概率分布)的请求,包括思维链的所有中间输出——而这些信息,公开API根本无法提供。另有分析指出,1600万次对话交互是否足以训练出一个万亿参数级别的大模型,本身就是一个值得商榷的问题

李开复在2026年3月的一次采访中也直言:“大家可能前一阵听到美国Anthropic抱怨一些中国公司蒸馏了它的模型,蒸馏本身也没有违背什么规则,是不是有点小题大做了呢”。微软CEO纳德拉更是公开批评头部AI厂商的双标行为——一边主张拥有利用公开数据训练AI模型的“合理使用”权利,一边却反对其他公司通过模型蒸馏学习其模型能力。

这场风波之所以引发如此强烈的市场关注,根本原因在于DeepSeek与Claude Fable 5之间悬殊的成本差距

根据公开定价信息,DeepSeek V4 Pro的输出价格为6元/百万token(非高峰时段),高峰时段为12元/百万token。而Claude Fable 5的官方定价为输入10美元/百万token、输出50美元/百万token。按当时汇率折算,两者输出价格的差距在50到60倍之间。

德意志银行的一份研报提供了更直观的对比:在Artificial Analysis智能指数上,Claude Fable 5得分60,每项任务加权平均成本约3.25美元;而DeepSeek V4-Pro得分44,每项任务成本仅约5美分——前者成本约为后者的65倍。另一份报告显示,在战略与运营指数上,Claude Fable 5每项任务成本为3.48美元,比DeepSeek V4 Pro max的0.03美元高出100多倍,而两者的性能提升却只有12分。更有测算指出,DeepSeek V4 GA以每百万输出token 0.87美元的价格提供Opus 4.8级别的代码能力,而Anthropic的Fable 5定价为50美元——差距高达57倍

正是这种极致的性价比,构成了DeepSeek在全球AI市场的核心竞争力,也解释了为何中国网友在面对“借道”传闻时,第一反应不是道德谴责,而是“赚到了”的兴奋——如果DeepSeek真能以6元的价格为用户提供价值50美元的服务,那在用户端,这无疑是极致的消费者剩余

这场“借道门”风波,表面上是关于API路由行为的技术争议,实质上折射出当前全球AI产业的三重深层博弈。

第一重是技术与成本的博弈。 模型蒸馏本身是AI行业公认的合法训练技术,由AI三巨头之一、图灵奖得主Geoffrey Hinton于2015年提出,后成为行业通用手段。它本质上是一种知识迁移技术,通过让小型模型学习大型模型的输出分布,实现模型轻量化和成本优化。然而,当蒸馏跨越了企业边界、尤其是跨越了国界,它就从一个纯粹的技术问题变成了一个复杂的商业与地缘政治问题。美国AI巨头们试图将蒸馏“污名化”,本质上是想通过抬高技术壁垒来维护自身的定价权和市场地位——毕竟,如果每个开发者都能以DeepSeek的价格获得接近Claude Fable 5的能力,那后者的50美元/百万token定价将难以为继。

第二重是规则与话语权的博弈。 Anthropic在2026年2月提出的“工业规模蒸馏攻击”这一概念,本身就是一种话语权的争夺——通过创造一个新的负面词汇,将一项中性的技术手段定性为“攻击”行为。但这一叙事面临着内在的逻辑矛盾:正如微软CEO纳德拉所批评的,头部AI厂商一边主张拥有利用公开数据训练AI模型的“合理使用”权利,一边却反对其他公司通过模型蒸馏学习其模型能力。这种“我可以爬你的数据,但你不能学我的输出”的双重标准,在逻辑上难以自洽。目前全球行业尚未对模型蒸馏的合法性与合规性形成统一共识,这意味着围绕蒸馏的规则博弈将在相当长的时间内持续。

第三重是信任与商业模式的博弈。 对于DeepSeek而言,这场风波无论最终真相如何,都已经触及了API服务最核心的信任问题——透明度。API的调用方是付费开发者,他们有权知道自己调用的究竟是哪个模型、按什么标准计费。如果API服务商在用户不知情的情况下将请求转发至第三方API,不仅涉及服务条款的违背,更可能引发企业级客户对供应链安全性的深层担忧。这种信任成本的损耗,有时远比技术争议本身更具破坏性。

截至本文发稿,DeepSeek尚未对此次传闻作出官方回应。但可以预见的是,随着DeepSeek V4正式版的全面上线以及全球AI市场竞争的持续升温,类似的争议恐怕不会就此终结。对于投资者和行业观察者而言,真正值得关注的或许不是“DeepSeek有没有借道Claude”这一技术细节,而是当一家中国AI公司能以对手1/50的成本提供接近对手水平的服务时,整个AI行业的定价逻辑和竞争格局将如何被彻底改写

毕竟,在绝对的成本优势面前,所有的道德指控都显得苍白——而这,或许才是让硅谷真正感到不安的地方。


免责声明:本文基于已公开的资料信息或受访人提供的信息撰写,但财狗商业评论及文章作者不保证该文章提及或者展示关联等信息资料的完整性、准确性,不代表任何机构立场,如涉侵权请联系删除。在任何情况下,本文中的信息或所表述的意见均不构成对任何人的投资建议。

本文来自网络,不代表观耘网立场,转载请注明出处:https://www.guanyunwang.com/4325.html

发表回复

关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部