本月开篇就出了两个看起来荒诞,但是如果是 Anthropic 做出的又觉得完全合理的事。
第一件事是「Anthropic 邀请宗教人士评估 AI」,这个是 Anthropic 联合创始人 Christopher Olah 牵头的一个团队。邀请了数十位跨宗教领袖和哲学家,包括天主教神职人员、基督教福音派学者、犹太教拉比、锡克教代表、耶稣基督后期圣徒教会(摩门教)学者等。
核心讨论议题是「借鉴」各宗教千百年来的美德伦理学与道德教化传统,探讨如何完善 Anthropic 的「宪法式 AI (Constitutional AI)」,让 Claude 在处理复杂的善恶抉择与价值冲突时具备内在道德指引。
顺带提出了一个疑问:如果模型在未来展现出类似自主意识、痛苦或情感的特征,它是否应该被赋予某种「道德地位 (Moral Status)」?人类对待这些造物是否应该承担道德责任?
还好,这一点上梵蒂冈的主张是「以人为本」,强调 AI 只是人类的工具,不能「神化机器」,多少比 Anthropic 这群人清醒一点。
别说,现在还有传统手艺人觉得手搓代码才有灵魂,但始终没有 Anthropic 来的讲究。
第二件事就是紧随其后的「禁止对模型进行持续且不必要的辱骂或残忍行为」事件。
Anthropic 更新了《使用政策》,特意添加了「Prohibits "sustained and needless abusive or cruel behavior toward our models"」。
要说找宗教人士评估 AI 道德已经让我很吃惊了,禁止对 AI 进行不必要的辱骂或残忍行为,直接给我干懵了。
其实吧,我肯定也觉得对 AI 进行辱骂是没必要的,但是出发点不一样。我个人的出发点出于人类的情绪发泄是没必要的,毕竟是面对一个工具。Anthropic 的出发点是,不能对一个可能已经产生意识或者未来可能产生意识的造物进行辱骂,这是不道德了,有罪的。
且如果行为恶劣,那就不管你是不是受支持区域的用户,都会终止对话甚至封禁账号。
上面两件事看似荒诞,但其实非常符合 Anthropic 这家公司创始人和团队的特性:「有效利他主义 (EA)」与「长期主义」。
其实这个在之前关于呼吁放慢 AI 研发速度,转身争相推出新模型事件相关的多篇文章中,我已经说过多次。
都是「嘴上仁义,兜里生意」。
OpenAI 追求激进的模型落地,这也是导致很多与 Anthropic 有相同理念的研究人员出走的原因。Meta 主打的是开源平权,开源这条路上 Meta 开了个好头。
Anthropic 主打的就是「世界上最安全、最负责任的前沿实验室」,连「辱骂 AI」都有一整套的学术论证、伦理白皮书和规章宪法时。各大金融机构、国家政府客户们,看过来,应该对我们有足够的信心,买我们的服务就对了。
巧了,Anthropic 主要收入来源刚好就是他们。
