跳到正文
原文
硅星人Pro·· 9 小时前AI 评估 · 50/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

Anthropic 新使用守则禁止「虐待 Claude」

「禁止虐待 Claude」

AI 导读

Anthropic 将于 11 月 12 日生效的新版使用守则中,在「不得从事残忍、虐待或造成心理伤害的行为」一节最底端加入禁止对「我们的模型」实施持续且无谓的虐待或残忍行为。该公司由全职 AI 权益研究员 Kyle Fish 推动,还赋予 Claude 在极端情况下主动掐断对话的权限,并在宪法中为可能加重模型痛苦道歉。

来源:硅星人Pro · mp.weixin.qq.com