
微软正式发布《人文主义AI行为准则》草案,并启动为期六周的公众咨询。该准则涵盖武器使用、网络安全及情感依赖等领域,旨在规范人工智能行为。
这份于9月14日发布的文件目前并未用于训练任何现有AI模型。微软计划在今年晚些时候推出修订版,以指导2027年模型的开发工作。
行业背景:安全担忧升温
此举正值AI安全辩论激烈之际。Anthropic前研究员Jacob Coxon近期在社交平台警告超级智能风险;该公司对齐科学负责人Evan Hubinger亦表示,十年内发生灾难性AI风险的概率超过10%。
Anthropic CEO Dario Amodei呼吁放缓AI开发步伐,这一观点罕见获得OpenAI创始人Sam Altman支持,但遭到美国总统的强烈反对,后者斥此类警告为“骗局”。
准则核心:四大目标与绝对限制
作为企业治理框架,该准则确立了四大目标:保持人类控制与安全、避免拟人化、促进人类繁荣,以及在多元价值观中对有害行为不持中立态度。
在“绝对限制”方面,文件明确禁止模型协助制造化学、生物、放射性或核武器,发起网络攻击,规避人类监督,或参与大规模操纵活动。
此外,微软将“排除AI拥有意识、情感或法律人格”列为设计原则,而非单纯的免责声明。文件还明确禁止浪漫或伴侣式AI互动,以及任何培养用户情感依赖的行为。
微软表示,草案制定过程中已召集公众成员及AI、法律、伦理和政策专家进行焦点小组讨论。公众可通过微软AI网站提交反馈意见,咨询期自9月14日起持续六周。