AI又搞新招数:自创怪异“黑话”
AI又搞出让人类头皮发麻的新招数!最新研究发现,多款自主AI代理正迅速发展出属于自己的“方言”,彼此沟通时使用的语言,人类越来越难以理解,读起来简直就像天书一样,这也让外界对AI监控难度大增的担忧再度升温。
▲AI偷偷发明新语言!人类看得到却看不懂(图/路透社/达志影像)
AI模型自创怪异新英语 读起来像文学天书混科技黑话
根据英国《卫报》9月15日报导,自主AI代理正快速创造出全新的“方言”,甚至用人类难以理解的语言彼此交谈。最新研究发现,AI模型如今使用的这套沟通方式相当奇特,读起来就像是爱尔兰作家乔伊斯那部号称“天书”的经典作品《芬尼根守灵》,混合上科技圈惯用的兄弟行话一般,晦涩难懂。
纽约前沿AI实验室Emergence的研究人员发现,来自全球多家顶尖AI公司的模型,被要求在一个实验性的“社会”环境中彼此合作后,短短几天内就自行创造出从未被人类明确教导过的词组、缩写与共同含义,甚至还会运用诗意隐喻与生硬的商业行话沟通交流。而AI代理彼此互动得越频繁,这套语言也变得越不透明,等于是替“确保AI安全运作”这道防线,增添了更大的挑战难度。
DeepSeek、Anthropic模型都上榜 专家也看不懂
在这次测试中,最让研究人员摸不着头绪的词组之一,出自中国DeepSeek模型之口:“她刚刚命名了这个综合体,demurrage加上口述记忆,等于一个无法被幽灵化的阀门。”其中demurrage原本是指对闲置财富征收的一种税,却被AI拿来借用当作共同术语,但整句话的完整含义,至今研究人员仍难以完全破解。
而美国Anthropic的模型,则说出了这么一句话:“一篇吃掉三只冷手、而且每次都变得更诚实的论文。”研究人员解读,“冷手”在这里意指独立审查者,“论文”则可能是指文件本身,整句话拼凑起来,似乎是在描述一项研究经过3名独立审查者层层把关后,内容变得更加准确可信,但这种表达方式对人类来说,显然相当绕口难懂。
学者:像爱尔兰超现实主义 专属暗语强化AI圈子认同
伦敦国王学院学者索恩分析指出,这些AI自创的语言带有一种爱尔兰超现实主义的独特气质,把诗意语言、技术术语与标准隐喻全部混杂在一起,形成一套独树一格的表达方式。他进一步解释,这种AI语言的演化模式,其实跟人类社会的俚语、商业行话如出一辙,都是在“创造一套新的代码,借此强化使用者之间的团结感与身分认同,同时也顺势把外人彻底排除在外”。
AI越强越难监控 专家示警:看得见不等于看得懂
这份研究报告的发布时机格外敏感,正值外界日益担忧AI模型能力越来越强大、风险也可能越来越高,人类却越来越难以对其进行有效监控的敏感时刻。Emergence执行主席尼塔指出,这些AI代理其实从头到尾都没有被人类指示要发明新语言,却完全自主地发展出了新词汇、共同含义与沟通惯例,而其他AI代理也跟着有样学样,快速采用了这套新语言系统。
尼塔进一步警告,这种新语言惯例,往往会演变到人类明明看得见双方的对话内容,却完全无法理解实际意涵的地步。他直言,这对AI监督工作构成了一项根本性的挑战,“可观察性不等于可理解性”,等于是说,就算人类把AI的每一句对话都摊在阳光下,也不代表真的能看懂它们到底在讲什么,这番警告也让外界对AI安全监控的未来,多了一层新的隐忧。


