17611538698
webmaster@21cto.com

Anthropic:用户不得无故侮辱Claude

动态 0 19 1小时前
一只手拿着一部智能手机,屏幕上显示着“人为”字样。

21CTO导读:Anthropic发布了其人工智能模型的新准则。其中一项重要内容是,禁止用户无故侮辱和伤害Claude。

Anthropic 公司发布了新的用户指南。

依据这些指南,人工智能模型 Claude 现在有权终止与辱骂用户的对话。新政策禁止“持续且不必要的辱骂或残忍行为”。自 8 月以来,Claude 已能够基于这些原因终止对话;这份新政策为此提供了正式的框架。

Anthropic强调,这主要是针对极端情况。如果用户在创作或研究过程中发泄不满或对模型出言不逊,这还不足以构成终止合作的理由。重点在于那些不必要的伤害性行为。

Anthropic将此举视为对“模型福利”的贡献,即对人工智能模型的关怀。这种观点在人工智能领域引发争议。Anthropic还表示,他们并不清楚其人工智能模型是否具有意识。其他公司,例如微软,则明确反对“模型福利”的概念,并强调不应赋予人工智能系统权利,也不应过分关注它们的“福祉”。

选举操纵和监视等行为均被禁止。

此外,Anthropic禁止将Claude用于误导性广告或政治宣传活动。选举条款还禁止欺骗选民和扰乱选举,包括散布有关候选人或投票程序的虚假信息以及试图压制选民投票率。

Anthropic多次声明Claude系统不得用于监视、识别和迫害政治对手,这种行为现在已被更加明确地禁止。但是在既定框架内,国家机构、记者和研究人员仍可使用该系统。

原则上,如果Anthropic评估认为合同规定的使用限制和适用的保障措施足以减轻潜在危害,则Anthropic保留在“与特定政府客户签订的合同”框架内凌驾于其所有准则之上的权利。例如,五角大楼曾广泛使用Anthropic的人工智能,但在因Claude的军事用途伦理准则引发争议后,该人工智能被认定为安全风险。

目前,禁止将Claude用于武器研发的禁令已明确扩大至包括此类系统软件的开发。此前,Anthropic曾在一份报告中描述了如何挫败了企图滥用Claude进行生物武器研发的“阴谋”。

作者:聆听音乐的鱼

评论

我要赞赏作者

请扫描二维码,使用微信支付哦。

分享到微信