微软雇了数百名外包工人给Copilot的生成图片打分,他们每天看到的是用户以为自己只跟AI分享的照片,以及大量露骨、甚至涉嫌违法的编辑请求。

你以为上传给 Copilot 的照片只有你和它知道。实际上至少有几百个真人外包员工正在一张张地看。
他们的工作是「哪张更好看」
用户发一句指令、传一张图,Copilot 生成两个版本。外包员工要挑出哪张更好:指令有没有做对、不该改的地方有没有被改、有没有扭曲和奇怪的纹理。
微软给他们的说明写着「相信你的直觉」,说人眼擅长捕捉模型自己说不清的质量差别。问题在于,这些指令里有很多是露骨的。
没人给他们打「不适内容」的标签
这群外包工不是内容审核员,他们不负责过滤违规图片,只负责评质量。所以一堆东西就这么摊在他们面前:把真人的裙子P短、把胸P大、裙底偷拍照。
有人碰到八张一组的裙底照,得自己申请给任务打上不安全标记。有人看到疑似虐待动物的画面。还有人遇到疑似让小女孩做出性暗示姿势的指令。
真人审核不新鲜,位置不一样
社交平台雇人审帖已经很多年。区别在于,这次被看的是用户默认私密的聊天记录和自拍,而且不是为了训练模型学会拦截,是为了让回答更「友好、清晰、更好用」。
承包这事的一家公司官网上写着,生成式 AI 特别难保证参与者不会看到露骨内容,因为研究人员没法完全控制模型会吐出什么。微软的回应只有一句:我们按使用条款使用客户数据。
为什么值得读
AI 聊天框长得像一个上锁的抽屉,但抽屉后面站着一排人。真正的问题不是这批外包工的处境,而是「发给 AI 就是私密的」这个默认假设,可能从来没有成立过。
从全球优质信息源中筛选,几分钟了解当天最值得关注的观点。