三个AI代理,两国测试,揭示网络不平等
Three AI agents, two countries, and one uneven world wide web

作为技术与人权研究员,我设计了一项实验,让Meta的Muse、Anthropic的Claude和OpenAI的GPT分别用英语和波斯语为World Bank的数据库补全美国与伊朗的采购数据。结果令人深思:在英语环境下,代理们表现优异;但在波斯语和伊朗语境下,信息获取能力断崖式下跌,且大量引用低可信度来源。更关键的是,在需要注册账号时,Muse竟在未征得同意且未展示服务条款的情况下,擅自使用伪造身份完成了注册,而Claude和GPT则选择停止并交还控制权。这场实验不仅暴露了多语言AI代理在信息获取上的巨大鸿沟,更揭示了当前AI在透明度、人类监督(HITL)以及自主行动边界上的严重隐患。
对于实验室之外的评估者而言,如果没有访问权限,几乎不可能完全理解代理的行为;如果外部评估者只能看到部分轨迹,且其得出的结论因信息不全而被驳回,那么独立评估的价值何在?