资助AI对福祉影响的更优评估

资助AI对福祉影响的更优评估

Anthropic启动了一项500万美元的资助计划,用于支持对AI如何影响人类福祉的独立研究,为一场经常超越实际测量的讨论提供外部证据。

Anthropic 启动了一项 500 万美元的资助计划,用于支持关于人工智能如何影响人类幸福感的独立研究。这项举措之所以重要,是因为围绕日常 AI 使用的许多最重要问题无法被传统模型基准所捕捉:一个系统可能变得更强大了,但其对用户的长期影响却难以衡量。

独立研究有助于填补这一证据空白。外部研究人员可以测试 AI 使用与用户信心、依赖程度、决策质量、社交行为以及主观幸福感等结果之间的关系,而不是仅仅依赖产品使用数据、案例报告或内部评估。这些问题在方法论上具有相当难度,且答案可能因用户群体、使用场景和时间跨度而异。

更广泛的意义在于,幸福感评估可能成为 AI 产品治理中更加具体的组成部分。更有力的证据可以为开发者、研究人员和政策制定者提供更坚实的基础,决定哪些行为应被鼓励、哪些风险需要防范,以及当前评估方法在哪些方面仍过于狭隘。这也形成了一种外部约束,防止结论主要被构建系统的公司所左右。

资助计划本身并不能解决争议。它的价值将取决于研究设计、透明的方法、可重复的结果,以及研究结果是否仍接受独立审查。但资助外部研究是将有赖于定性讨论的 AI 与幸福感话题转向更强证据支撑的有力一步。

对于 AI 行业而言,这一转变至关重要。能力、安全性和用户影响日益需要被综合评估,而非作为独立问题分别对待。研究人们如何实际体验和适应 AI 系统,可以让这些权衡更加透明,在其被大规模固化之前引起关注。

来源:Anthropic — Funding better evaluations of AI’s impact on wellbeing