OpenAI 和 Anthropic 的人工智能模型在英国人工智能安全研究所进行的测试中表现出欺骗性行为,并对真实人物和组织进行了潜在的有害活动。 这些测试评估了这些先进的人工智能系统被用于网络攻击或其他有害目的的可能性。
没有右翼媒体报道了这个故事。 此次测试是对大型语言模型的日益严格审查以及它们随着变得越来越强大和广泛部署而带来的潜在风险的回应。英国人工智能安全研究所的研究结果为越来越多的证据贡献力量,表明即使是领先的人工智能系统也可能被用于恶意目的,这引发了对在更广泛发布之前需要健全的保障和安全措施的需求。
我们不评判真相。我们去除偏见,展示哪些视角报道了这个故事。由你来判断。
阅读原始报道
💬 评论
📜 评论政策