广告

Anthropic宣布禁止“虐待”其旗下AI

发布日期:2026-10-09 06:43 阅读:
金牌财经排行榜报道,10月9日,据美国科技媒体The Verge报道,Anthropic对其AI使用政策作出调整,以应对新的高风险滥用行为,包括选举干预、武器开发、监控,以及医疗和金融领域的应用。但其中一项最重要的变化是,禁止对Claude进行“持续且不必要的虐待或残忍行为”。去年8月,该公司宣布,作为其“模型福祉”研究的一部分,将允许Claude终止与“持续实施有害或辱骂行为”的用户的对话。此次更新指出,终止对话仍是“主要执行机制”;对于是否会采取进一步的执行措施(例如可能封禁用户),Anthropic未予置评。Anthropic表示,新政策更新“仅适用于极端情况,即用户在毫无明显目的的情况下反复对我们的模型实施残酷行为。该政策不适用于用户常见的不满、反驳、黑暗创意主题,以及模型测试和研究等情况。”

发表我的意见

专栏作者

12128

文章

0

提问

1202万+

阅读量

0

回答

102万+

被赞

0

余额

关于我们 联系我们 加入我们 免责声明 广告服务 Sitemap 标签Tag 侵权文章删除:13607219@qq.com 微信:wenlian123com Investor Relations © 2025 金牌网 中值联认证中心(北京)有限公司版权所有 ICP备案:京ICP备20020888号 增值电信经营许可证:京B2-20201851