Anthropic反对的究竟是“蒸馏”还是技术扩散? - FT中文网
登录×
电子邮件/用户名
密码
记住我
请输入邮箱和密码进行绑定操作:
请输入手机号码,通过短信验证(目前仅支持中国大陆地区的手机号):
请您阅读我们的用户注册协议隐私权保护政策,点击下方按钮即视为您接受。
AI

Anthropic反对的究竟是“蒸馏”还是技术扩散?

刘远举:某种程度上,通过汲取技术扩散,保持“迫近追赶”,才是中国AI当下的最佳策略。
00:00

{"text":[[{"start":8.97,"text":"近日,美国领先的人工智能公司Anthropic发布了一份报告,引发了强烈关注。"}],[{"start":15.24,"text":"这不是Anthropic第一次发布类似报告。今年2月,Anthropic发布声明,指责中国三家头部大模型企业对其Claude模型实施工业规模的蒸馏,进行了总计逾1600万次交互,截取Claude的技术能力、迭代优化自身模型。"}],[{"start":32.81,"text":"Anthropic声称这是“蒸馏”攻击,并将事情定性上升至国家安全层面,借此强调美国对华人工智能芯片出口管制政策的战略必要性与合理性。OpenAI也附和类似论调,指责美国创新成果有被所谓“盗用和包装”的风险。"}],[{"start":51.410000000000004,"text":"Anthropic的确撬动了美国的相关部门。"}],[{"start":55.300000000000004,"text":"4月白宫科技政策办公室把蒸馏列为联邦机构重点问题,7月美国财长贝森特直接威胁要对相关企业实施制裁。9月,美国NSA(国家安全局)、FBI(联邦调查局)、CISA(网络安全与基础设施安全局)三机构联合发布通告,点名指控6家中国AI企业:DeepSeek(深度求索)、Moonshot AI(月之暗面)、阿里巴巴、MiniMax(稀宇科技)、StepFun(阶跃星辰)、智谱AI,指控它们自至少2024年底以来,通过数百万次请求从Claude、GPT、Gemini和Grok等美国模型中提取了“数十亿token”的数据,用于训练和改进自身模型。"}],[{"start":96.03,"text":"知识蒸馏(Knowledge Distillation)蒸馏最早由深度学习之父Geoffrey Hinton提出,目前已经是AI领域的一种广泛应用的技术。它是用性能更优的模型输出结果,对能力较弱的模型开展训练,让小模型以更低成本获得接近大模型的能力。这有点类似作文范文,同一个题目,老师让学生学习范文,以获得范文学生的能力。"}],[{"start":119.8,"text":"知识蒸馏是一种非常有效的工程手段,在降低成本、提升轻量化模型能力、快速把前沿能力产品化方面都有价值。竞争对手可通过该方式,以极低的成本和极短的时间,获取其他实验室研发的核心模型功能,而这些功能若依靠独立研发,往往需要投入大量的时间与精力。"}],[{"start":141.46,"text":"OpenAI、Google、Anthropic自己、公司之间,也都在用蒸馏优化模型,也蒸馏中国公司的模式。5月份,Anthropic发布Claude Opus 4.8后,多个平台的用户反馈称其通过API测试发现,Opus 4.8在回答关于自身身份的问题时,会自称是阿里通义千问(Qwen)或DeepSeek。"}],[{"start":163.25,"text":"3月份,美国Anysphere旗下的编程工具Cursor推出新模型Composer 2后,开发者在API响应中发现其内部模型ID为“kimi-k2p5-rl”。后来,该公司承认Composer 2是基于月之暗面(Moonshot AI)开源模型Kimi K2.5的微调版本。当时马斯克也在社交平台上跟帖“是的,那就是Kimi 2.5”。"}],[{"start":187.42000000000002,"text":"今年5月,马斯克在加州联邦法院的庭审证词中承认,他创立的xAI曾利用OpenAI的模型通过蒸馏技术训练Grok。"}],[{"start":197.18,"text":"相比马斯克的态度,Anthropic对“模型蒸馏”持强烈的反对态度,认为这削弱了闭源模型的商业护城河,并曾公开指责部分开源模型通过蒸馏“窃取”闭源模型能力。"}],[{"start":209.85,"text":"Anthropic同样也反对开源。AnthropicCEO Dario表示模型在性能上无法完全替代闭源模型,且开源模型无法解决数据隐私、合规审计和商业化回报等问题。他认为,开源并不能解决AI的安全问题,一旦强能力模型权重完全公开,可能带来不可控的“攻防不对称”风险。因此,他提出,强能力、高算力、高成本的“前沿模型”应保持闭源或受控。"}],[{"start":238.75,"text":"这种立场被外界解读为“明修栈道,暗度陈仓”,即通过“安全”和“风险管控”的话语,为闭源商业模式的合理性提供支撑,并影响监管政策抑制开源模型。投资人Chamath Palihapitiya在X上说:Dario的观点就是停止开源,把大的技术与经济力量集中在Anthropic手中。"}],[{"start":260.53,"text":"Anthropic对蒸馏的态度,本质都是源于Anthropic所处的状态:“一个技术扩散极快的领域的技术领先者”。"}],[{"start":269.52,"text":"Anthropic的Claude本身是闭源模型,其商业模式核心在于投入巨资训练顶尖闭源模型,并通过API提供付费服务。所以,反对蒸馏,是保护其商业利益和维持高壁垒的必要手段。"}],[{"start":285.39,"text":"更重要的是,如今全球AI发展的一个鲜明特征是:技术快速扩散。"}],[{"start":291.97999999999996,"text":"OpenAI成立于2015年12月,2022年11月,推出ChatGPT。Anthropic成立于2021年,由前OpenAI研究副总裁达里奥・阿莫迪带队创立,2023年3月推出Claude模型,目前是全球第二大AI大模型独角兽。包括Claude、Grok、中国大模型的快速崛起,都说明了一件事,AI的技术扩散非常快。可以拿来做对比的是,芯片哪怕再炙手可热,全球也不会一下子出现很多芯片企业。"}],[{"start":325.08,"text":"正是AI技术的快速扩散特征,导致了商业上的超额利润的不稳定。Anthropic年收入为140亿美元,估值为3800亿美元,在编程方面处于领先地位,但中国开源模型以性价比领先。在OpenRouter上每周调用量排名前四全部为中国产品,在Hugging Face上中国模型下载量占比达到41%。"}],[{"start":350.88,"text":"所以,Anthropic要尽力阻断技术扩散,将技术上升到国家安全层面。"}],[{"start":357.03,"text":"有人说,蒸馏最终训练出来的可能是一种很强的模仿能力,却未必是一种真正的前沿创新能力。领先的公司一定会越来越重视反蒸馏、模型输出保护和能力隐藏。"}],[{"start":371.07,"text":"首先,中国公司并非没有创新。中国模型的平均API定价是海外对标模型的10%到20%,而且仍然能保持20%到40%的毛利。这意味着成本优势是结构性的,源于有针对性的研发、架构创新、工程优化以及开源协作。"}],[{"start":392.01,"text":"但更关键的是,当下承接技术扩散,对中国AI的发展是重要的。承接技术扩散,必然有信息交流。当一家外资汽车公司在中国进行生产的时候,中国的工业能力的信息就不再是秘密;当一家汉堡店在中国遍地开花,中国的消费数据就不再是秘密;如果再结合各行各业的情况,整个中国经济运行的信息,无需官方数据,也能被外界详细了解,挖掘出深层次信息。信息安全非常重要,但关键在于门槛前置,设置在使用者环节。如果因为Anthropic的报告就阻断信息交流、放弃汲取技术扩散,就上了达里奥的当。"}],[{"start":434.57,"text":"实际上,某种程度上,通过汲取技术扩散,保持“迫近追赶”,才是中国AI当下的最佳策略。"}],[{"start":442.58,"text":"在AI领域,美国领先,中国次之,处于追赶状态。但这个状态,其实有一种后发优势。后发优势是指后进入者由于较晚进入行业,较先行者获得的竞争优势,包括:先行者承担高昂的开拓成本,后发者可免费搭车;后发者可直接采用成熟技术,无需从头研发,节约研发成本与时间;借鉴成功经验与失败教训,预测发展前景,减少自身面临的不确定性。"}],[{"start":471.21,"text":"其实,如果从零和博弈的角度,后发优势还有一个优势,那就是先发者,需要持续投入研发,才能拉大技术差距,获得超额利益。但后发者,可以以更低成本存在时,就能压缩先行者的收益,拖住先行者。比如,两家互联网平台,一家不收费,或者低价,另一家的利润就上不去。"}],[{"start":493.45,"text":"这才是达里奥最头痛的事。"}],[{"start":496.19,"text":"当然,只有后发者具备足够的技术吸收能力、制度环境和市场规模,这种“侵蚀”才可能实现;否则后发优势只是潜在优势,甚至可能落入“后发陷阱”,长期依赖模仿而无法赶超。所以,对中国的AI发展而言,整体经济的发展,宽松的制度,比蒸馏更重要。"}],[{"start":516.35,"text":"(本文仅代表作者本人观点,责编:闫曼 man.yan@ftchinese.com)"}]],"url":"https://audio.ftcn.net.cn/album/a_1789598143_7567.mp3"}

版权声明:本文版权归FT中文网所有,未经允许任何单位或个人不得转载,复制或以任何其他方式使用本文全部或部分,侵权必究。

新的工作岗位从哪里来?

凯恩斯:延续了数百年的专业分工趋势,或许正面临逆转。

AI时代的苹果信任溢价

阿姆斯特朗:在一个充斥AI风险的市场中,苹果获得溢价的原因并不只是没有AI风险;苹果出售的是这个世界越来越缺乏的信任。

马克•卡尼与欧洲的“蜜月”为何难以更进一步

柏林方面反对为加拿大获得欧盟“准成员国”身份开辟快车道,官员警告称,优待渥太华可能惹恼其他伙伴。

核聚变的关键时刻

核聚变初创企业正在吸引创纪录数额的投资,但一些科学家认为它们宣布的商业化时间表过于乐观。

德国东部与俄罗斯的旧有联系助推德国选择党崛起

在周日一场事关重大的投票前,乌克兰问题已成为梅克伦堡-前波美拉尼亚州的分歧性议题。

AI时代,我们的孩子还能茁壮成长吗?

卡文迪什:只要孩子们拥抱AI带来的“非凡”机遇,增强批判性思维能力,并避免社交媒体的干扰,就能茁壮成长。
设置字号×
最小
较小
默认
较大
最大
分享×