💬 观点Anthropic
Funding better evaluations of AI’s impact on wellbeing — Anthropic 推出 500 万美元资助计划,支持独立研究 AI 对用户福祉
Anthropic 推出 500 万美元资助计划,支持独立研究 AI 对用户福祉的影响,并建立开源评估标准。
2026-08-26原文
本文为要点摘要,完整细节以原文为准。
- 该计划提供资金、模型访问和技术支持,资助方独立工作并开源成果,供任何开发者使用。
- 福祉评估需多轮对话上下文,单一回答难以判断,需考虑长期互动中的风险升级和情境变化。
- 评估应明确通过/失败标准,涉及临床专家,测试过度顺从和过度拒绝,并验证评分者与专家一致性。
- 对开发者而言,这意味着未来 AI 工具需更关注用户长期互动中的情感和心理健康,而非仅单次回答的准确性。
原文:Funding better evaluations of AI’s impact on wellbeing · 作者 Anthropic