谁怕中国模型?
Who’s Afraid of Chinese Models?
摘要
本·汤普森提出美国应通过法律,将收集数据用于训练模型视为合理使用(fair use),并禁止服务条款限制蒸馏(distillation),以回应实验室使用未授权数据却禁止蒸馏的虚伪做法,同时帮助美国开源模型与中国模型竞争。汤普森推测,阿里巴巴开放权重发布Qwen 3.8 Max的决定,可能受习近平近期鼓励开源、开放、协作与共享讲话的影响。
谁在害怕中国模型?本·汤普森提出了一个有趣的方案,既回应了实验室一边用未授权数据训练模型、一边禁止他人对其模型进行蒸馏(distillation)的虚伪做法,也有助于美国开源模型更有效地与中国同行竞争:美国应通过一项法律,(1)明确将收集数据用于训练模型视为合理使用(fair use),(2)至少对美国公司而言,禁止服务条款中限制蒸馏的行为。阻止蒸馏——本质上只是查询API——几乎不可能;美国应反其道而行之,推行一项新的版权政策,既为实验室提供赔偿保障,又确保它们所学到的内容能推动其他人的进一步创新。本还推测,阿里巴巴决定以开放权重形式发布Qwen 3.8 Max——这逆转了他们在5月不发布Qwen 3.7 Max的决定——可能受到了习近平近期讲话的影响。习近平表示:我们要抓住这一难得的历史机遇,鼓励开源、开放、协作与共享。via John Gruber 标签:ai , generative-ai , llms , training-data , qwen , ai-ethics , ai-in-china
译自 Simon Willison · 博客 · 录于 二〇二六年七月二十日