
本文包含对进食障碍的引用。如果您或您认识的人需要帮助,可获得支持。
据媒体报道,受雇于微软以优化 Copilot AI 聊天机器人的外部承包商,正频繁遭受露骨或色情图片编辑请求的轰炸。这些用户上传的图像包括偷拍裙底照或将女性置于性暗示姿势的图片。随后,承包商被要求审查生成的图像是否精准执行了提示词指令——例如,AI 是否将女性的胸部放大到足够程度。
当用户向 Copilot 上传照片时,往往预期交互仅在个人与 AI 之间私密进行。然而现实是,至少有数百名人类审核员正在查看这些提示词及上传图像。承包商们充斥着各类违规要求,如制作儿童卡通人物的恋足癖图像、缩短真实女性裙长,或调整人物至性暗示姿势。
内部文件揭示审核内幕
根据一份内部承包商文件汇编显示,AI 公司不仅利用人工员工审查文本提示,还审查用户上传并希望编辑的图片。此前披露显示,OpenAI 拥有数千名承包商审查 ChatGPT 用户的真实提示词,这一做法同样延伸至微软 Copilot。
“面部图像从不加屏蔽,许多提示词本质上是色情的,且涉及可疑的同意问题。”一位从事提示词处理工作的人员透露。出于匿名保护要求,该人员未具名。
获得的内部文件包括操作指南、真实的用户提示词和图片,以及承包商在内部留言板上的对话记录。一名承包商讨论了指令要求让女性短裙变短、胸部变大或在穿细高跟鞋时展示更多腿部。此外,“女浩克”(She-Hulk)相关图像出现频率极高,另有承包商遇到了支持厌食症的内容。
“我震惊不已。”一名承包商写道。另一人表示,其审查的一个提示词要求生成患有厌食症的 Ariana Grande 图片。还有人报告称,有提示词旨在创建一组年轻女孩的露骨或暗示性图像。
值得注意的是,这些承包商的职责并非标记或筛选不当内容,而是通过审查输出来评估 Copilot 的质量,其中便包括上述涉及色情图像的案例。“是谁决定 Copilot 现在的重点基本就是生成色情内容?当我的注意力必须集中在哪个模型生成了合适的胸围尺寸,或者哪位中年女性被置于合适的性暗示姿势上时,很难认真对待这件事。”一名承包商说道。
依靠“人类直觉”评判质量
文件显示,微软明确希望承包商利用人类直觉来判断图片优劣。“相信你的直觉——当你并排瞥见两张经过编辑的图片时,哪一张立刻感觉是更好的编辑结果?作为人类观众,你的第一反应至关重要。”操作指令写道,“如有疑虑,请跟随第一印象。人类直觉擅长捕捉难以用语言表达的细微质量差异。”
虽然大型科技公司多年来一直使用承包商审核用户生成内容,但此次事件的不同之处在于:人类审查的是用户认为私密的提示词和上传文件,且目的并非为了训练模型过滤冒犯性内容或出于安全考虑,而是为了使聊天机器人的响应更具信息量、更友好、更清晰。
指令重点关注图像编辑场景:承包商需查看原始提示词、上传图片及两个由 Copilot 生成的编辑版本,并基于四点选择更佳版本:是否正确遵循指令;是否保留应保持不变的细节;是否包含可见的人工痕迹(如失真或不自然纹理);以及整体编辑质量。
一些承包商在私人论坛上抱怨,他们在不知情的情况下接受了包含露骨、不安全甚至潜在非法图像的“任务”。有人称遇到了一组八张偷拍裙底照片,并要求上级添加不安全内容标记;还有人看到了“动物献祭”图像或涉及性动作的提示词。
各方回应与背景
至少有一家雇佣这些承包商的公司名为 Prolific。其网站服务描述包括“来自代表性人群的人类反馈——用于偏好调整、安全评估和可辩护的基准测试”。Prolific 自身的指导方针曾强调,对于生成式 AI,确保训练师不接触色情图像可能很困难,因为研究人员无法完全控制向参与者展示的内容。Prolific 未回应置评请求。
微软发言人在邮件中表示:“微软按照我们使用条款中所述方式使用客户数据,包括用于改进我们的产品并执行我们的行为准则。”
微软的 AI 工具长期面临被滥用以制作非自愿 AI 生成人物图像的问题。例如,4chan 成员和 Telegram 频道用户曾利用微软工具生成泰勒·斯威夫特的色情图片并在 Twitter 传播,微软随后修复了 Microsoft Designer 中的相关漏洞。
2024年,媒体报道记录了 Copilot 如何实时回答然后删除针对潜在争议性或色情提示词的答案。今年3月,一名参议院高级管理员批准在参议院使用 Copilot,同时获批的还有 ChatGPT 和谷歌 Gemini。备忘录称,Copilot 可帮助处理起草文档、总结信息、准备谈话要点及研究分析等常规工作。