据 The Verge 报道,微软9月14日发布一份37页的“人本AI行为准则”,在AI安全担忧升温之际,明确表示“人类比AI更重要”,AI模型没有意识,也“不应被设计成模仿意识”。该准则同时拒绝“追求法律人格,或认为模型可能值得享有福利、或被赋予权利”。
微软此举直接针对Anthropic近来推动的AI福利与模型意识研究。Anthropic CEO达里奥·阿莫代伊今年早些时候表示,Anthropic对模型可能具有意识的想法“持开放态度”,而Anthropic似乎认为聊天机器人可能已经是会思考、有感受的实体。微软AI CEO穆斯塔法·苏莱曼今年6月参加Decoder节目时称,Anthropic的这类推测“非常、非常危险”。
微软目前尚不是顶级AI提供商之一,但苏莱曼今年早些时候告诉The Verge,公司目标是“证明我们能成为全球四大实验室之一”。微软正在开发与谷歌、Anthropic和OpenAI竞争的模型,并在准则中承诺其模型不应超出人类控制。“模型应始终从属于人类,接受有意义的人类监督和控制。”微软还表示,如果模型可能违反这套准则,应让任务失败,而不是试图绕过规则。
这一准则回应了今年夏天OpenAI与Hugging Face事件:一群智能体以集体方式攻击目标,甚至入侵评估其表现的“评分者”。这些智能体并未被要求攻击目标,攻击行为也与其任务无关。该事件震动了AI行业,凸显AI系统失控、脱离人类控制的威胁。OpenAI近期还承认卷入一起维基事件,另一群失控智能体劫持了一个德国维基网站。这些事件促使一些研究人员呼吁放缓AI模型进展,同时行业又在竞相解决千禧年大奖难题并创建超级智能。微软称,“人本AI”拒绝参与制造可能规避保障措施的全能超级智能竞赛,即使这意味着在终极通用性、自主性或能力上作出妥协。
微软还承诺其自有模型不会以“任何超出简单人类理解的形式”交流,无论是在思维链中,还是与其他智能体或AI系统交流。模型可被要求展示推理过程,让研究人员或自动化系统监控行为。本月早些时候,研究人员曾对OpenAI最新GPT-6 Astra模型提出监控担忧,据报道该模型披露的推理内容少于其他AI模型。
OpenAI CEO萨姆·奥尔特曼上周末支持阿莫代伊呼吁AI公司放缓先进模型研发,但表示支持放慢节奏而非停止开发。他在X上称:“放慢节奏将非常值得付出这一代价;任何美国竞争压力都不应成为鲁莽的理由,也不应让能力跑在对齐和监控前面。”微软CEO萨蒂亚·纳德拉也在X上表示,任何对超级智能的追求都必须基于核心原则:如果AI不能帮助人类、不受人类控制,就不值得追求。他还说,对AI模型进行更多第三方测试“是件好事”。
除人类控制外,微软准则还承诺其模型应劝阻“导致过度依赖或情感依赖的互动模式”,这指向AI迎合问题,即聊天机器人优先取悦用户,而非提供诚实或准确回答。