德国搞出自研大模型,中国模型帮忙训的

头条新闻 · 经八阕原文

10月3日是德国的国庆日。在这个极具仪式感的大日子里,被誉为“欧洲AI全村希望”的德国初创公司 Aleph Alpha,隆重发布了号称纯血自主的开源大模型 Kolibri。 官方宣发铺天盖地,关键词极尽奢华: “德国本土端到端研发”、“欧洲本地基础设施训练”、“具备完整供应链独立性”、“绝无外国控制”。 欧盟官员听了直点头,欧洲科技界感动得几乎要落泪:咱们欧洲人,终于有属于自己的大模型了!

然而,吃瓜网友们显然保持着对欧式宣发的理性怀疑:“你发誓这真是你们全流程自主搞出来的?” 德国团队倒也坦诚,直接奉上了一份长达 189 页的技术白皮书。翻开报告第 3.1.1 节,全世界的 AI 工程师直接笑喷在键盘上——白纸黑字写得明明白白: 这只被称为“蜂鸟”(Kolibri)的欧洲神鸟,其后训练(SFT)合成数据的核心“教练组”,居然全来自远在东方的中国开源模型:智谱 AI 的 GLM-5.2、GLM-5.3,以及阿里的通义千问 Qwen3.8-27B!

很多人听到“知识蒸馏”和“合成数据”可能觉得有些晦涩,用大白话怎么理解这件事? 打个比方,这就像欧洲有一位名门望族的小少爷(Kolibri),准备参加高考(大模型后训练微调)。为了考出好成绩,少爷需要大量的经典刷题集和高分答题模板。 但少爷和家族管家(Aleph Alpha 团队)翻了翻网上的开源公共题库(比如英伟达的 Nemotron 数据集),发现里面很多题目解答含糊不清,甚至连科学选择题的答案都有错。如果直接拿这套错漏百出的题库去背,少爷非得考砸不可。 怎么办? 少爷家里虽然坐拥 768 张英伟达 B200 顶配显卡(相当于极其豪华的书房),但自己还写不出顶级的高分标准答案。 于是,管家果断聘请了两位东方特级教师——智谱 GLM 和阿里 Qwen。

管家把题目塞给这两位中国老师,命令道:“用你们绝妙的逻辑和推理,把这几百万道题重新做一遍,写出最标准、最详尽的解题过程!” 这就是大模型研发里的“数据重写”与“知识蒸馏”。小模型想要快速变聪明,最省时省力的捷径,就是让已经功力深厚的大模型生成海量高质量的“合成数据”,然后小模型照着这些“神仙笔记”进行微调。 如果在 Aleph Alpha 这份 189 页的技术白皮书中寻章摘句,你会发现德国人的账单记得比财务报表还仔细,堪称中国大模型的“功勋表彰大会”: 第一,在 Kolibri 的后训练数据池里,共有 57 个数据集、2200 万条样本、高达 3358 亿 Token。其中,有接近三分之二(31.7% 的重写合成数据 + 32.1% 的自主生产数据)都经过了中国导师的“精加工”。 第二,英伟达开源的著名指令跟随数据集 Nemotron,答案质量参差不齐。欧洲工程师直接请出智谱 GLM-5.2 和 GLM-5.3,把解题过程全部打翻重写;为了锻炼少爷的长文本耐力,还专门弄了个无推理链子集,用用户模拟器硬生生把对话扩充到了 50 轮! 第三,针对 Nemotron 里的科学选择题,德国团队指定由阿里通义千问 Qwen3.8-27B 来出具权威答案。 第四,德语本地化与代码修复怎么做? GLM-5.3 被用来生成带推理过程的德语对话,GLM-5.2 甚至被派去翻阅德语维基百科,自动生成德语问答和工具调用轨迹;连软件工程代码修 bug 数据,也是让 GLM 在 Python 项目里注入漏洞再自己尝试修复…… 这出戏之所以能在全球科技圈引发轰动,主要是因为它的讽刺效果实在过于炸裂。 过去几年,硅谷和华盛顿动不动就指责“别人在蒸馏美系大模型”,动辄挥舞技术封锁的大棒。 结果欧洲高举“数字主权”、“自主可控”的大旗,砸了数亿欧元资金,最后挂在墙上的技术路径闭环竟然是这样的: 硬件算力:买美国英伟达的 B200 芯片; 灵魂导师:请中国智谱 GLM 与阿里 Qwen 重写和生成数据; 加工基地:设在德国与芬兰的数据中心; 贴牌产物:纯血欧洲主权大模型 Kolibri!

这哪是什么“去外部依赖”,这分明是当今全球科技供应链协同的巅峰演绎——中国模型负责干活答题发货,欧洲机构负责监工验收贴标。西方嘴上全是主权与政治正确,白皮书里全是算力成本与“真香”。 德国团队的做法其实非常务实。在商业落地和模型性能的硬指标面前,花几千亿 Token 自己从头打磨高质合成数据,不仅慢,而且贵得离谱;直接请当今开源生态中最顶尖的中国大模型打工,才是性价比最高的选择。 在Kolibri 官方发布的评测结果中,它的德语和英语综合得分分别达到了 70.8 和 75.5,在同等激活参数的轻量化 MoE模型中表现出色。但尴尬的是,作为它后训练教练之一的 Qwen3.8-27B,得分高达 80.2 和79.9。少爷虽然进步神速,但距离东方名师的真传,显然还有一段路要走。 不知欧盟官员在审阅这篇 189 页的技术报告、批复下一期“数字主权”资金补贴时,看着白纸黑字上的 GLM 和 Qwen,心里会泛起怎样的涟漪。但无论如何,这场由德国团队自曝的赛博大戏已经证明: 在绝对的技术实力与性价比面前,傲慢的偏见根本抵不过一句实事求是。

来源:头条新闻(经八阕转载) · 查看原文
Scroll for more