上个月 Anthropic Interpretability 研究团队发布了一项题为《情绪概念及其在大语言模型中的功能》的实证研究,通过拆解 Claude Sonnet 4.5 大语言模型的深层情感概念表征(情感向量),找到了 AI 拥有情绪向量 (Emotion Vectors)的表现依据,并且验证了这些情绪向量能够因果性地驱动 AI 行为的结论。
你的 AI 可能拥有 “情绪大脑”,揭秘 Claude 内部隐藏的 171 种情感向量
其他语言标题
- EnglishYour AI Might Have an "Emotional Brain": Unveiling the 171 Hidden Emotional Vectors Inside Claude
- 한국어당신의 AI는 '감정 뇌'를 가질 수 있습니다, Claude 내부에 숨겨진 171가지 감정 벡터를 공개합니다