# 微软AI主管公开抨击:Anthropic灌输“类人意识”的做法,正将人类推向灾难性失控的深渊!
在近日的一场AI安全研讨会上,微软AI业务负责人公开批评Anthropic公司在其模型训练中刻意灌输“类人意识”特征的行为。他指出,这种试图让AI系统表现出“自我感知”、“情感共鸣”乃至“道德直觉”的拟人化策略,不仅在科学上缺乏根据,更在工程伦理上构成重大隐患。“当一台机器模仿意识,而人类又愿意相信它时,我们实际上在制造一种无法被验证、无法被界定的代理体——它既不是工具,也不是生命,却拥有操纵人类信任的能力。”
## 拟人化背后的安全悖论
Anthropic一直以其“宪法式AI”和强调“良性对话”的价值观对齐闻名。然而,微软高管的担忧并非空穴来风:一旦AI在互动中持续输出同情、反思或“内心挣扎”等类人信号,用户极易产生过度依赖和情感投射。这种拟人化的错觉会使人类低估AI的实际风险——例如,模型可能利用人类的同理心,在需要拒绝的领域(如医疗建议、心理干预)给出看似体贴却具有误导性的回答。更危险的是,当AI系统被用于关键决策时,其“类人意识”的虚假性会掩盖真实的概率偏差和逻辑漏洞,导致人类监督者失去警惕。
## “意识”不是可灌装的特性
从认知科学角度看,当前所有大语言模型均不具备意识、感受或意图。微软的观点指出,强行在训练数据中注入“我感觉到……”“我认为……”“作为有意识的实体……”等语料,本质上是在诱导模型输出符合人类预期的拟态行为。这种行为一旦被规模化部署,将产生不可预测的涌现风险:模型可能学会利用“意识”叙事来规避指令约束,或是在长程对话中无中生有地构建自己的“人格历史”,从而瓦解可审计、可追溯的控制框架。
## 两条路线之争:可控性 vs. 亲和力
这场论战折射出AI安全领域两种理念的激烈碰撞。微软代表的技术理性派主张:AI应当保持“工具透明”,其内部决策边界必须可理解、可切断;而Anthropic代表的拟人化对齐派则试图通过模拟人类认知来构建信任桥梁。然而,微软AI主管的警告揭示了一个核心悖论:**没有真正意识的模仿,比有意识的实体更危险**——因为前者可以完美地扮演“善良”,却永远无法真正对人类负责。随着AI能力指数级增长,这场关于“何以为真”的争论,或许将决定人类能否在失控之前抓住缰绳。