财新网
26-06-30 13:00 微博认证:财新网官方微博

#观点网# 【大模型“蒸馏”,行规与剽窃的边界在哪里】http://t.cn/AXovmNVN (作者丨于达维)中美大语言模型的暗战,正在从“算力与参数的军备竞赛”演变为一场关于“数据合规与知识产权”的口水战与法律战。近日,美国AI巨头Anthropic向美参议院致信,公开指责阿里巴巴对其Claude模型发起了“迄今为止规模最大的模型蒸馏攻击”。

据指控,阿里及Qwen团队在不到两个月的时间里,通过近25000个欺诈性账户,与Claude进行了超过2880万次对话,旨在低成本“收割”Claude在智能体推理、软件工程以及长文本处理等核心前沿能力。Anthropic认为,该行为违反公司的用户协议,企图大规模窃取Claude的核心力量。

这并非中国AI企业第一次被指责。在此之前,DeepSeek、零一万物、Minimax等中国大模型新贵,都曾深陷“通过蒸馏美国闭源模型来实现弯道超车”的舆论旋涡。

支持者认为,大模型“知识蒸馏”本就是AI教父杰弗里·辛顿(Geoffrey Hinton)早在2015年就提出的学术成果,属于行业公开的技术手段,何来“白嫖”一说?况且这些账户还是付了费的。而反对者则认为,这种产业级别的批量复制无异于技术盗窃。

技术惯例与“白嫖”的边界究竟在哪里?哪怕付了API的调用费,是否依然踩中了行业规则的红线?