
【导语:中科大、牛津等机构研究者发现,允许AI识别“内心情绪”并据此行动,能大幅提升其工作能力。实验表明,情绪驱动技能选择可显著提高任务成功率,世界模型嵌入情绪预测准确率最高提升45.72%。】

此前研究认为,LLM内部存在与人类情感标签高度对应的计算模式,如好奇、渴望、乐观等。研究者发现,AI特定的情绪状态与特定的技能选择之间存在连贯的配对关系。
在购物实验中,Agent形成了四种可解释的配对模式。当感到好奇且渴望时会自发搜索产品;困惑且紧张时会查询重述;认可且乐观时会确认购买;失望且恼怒时会比较价格。抽取200次技能选择事件验证,一致性比例高达76.5%。

传统设计中,AI犯错被视为需抑制或消除的异常。但该研究指出,在需频繁从失败中恢复的任务中,情绪作用显著。“坏情绪”是有用的元认知信号,标志着当前策略与外部环境失配。
给AI布置六类家务,“加热物品”和“拾取两个物品”初始成功率极低,分别为9.6%和4.4%。采用情绪驱动技能选择后,成功率大幅上升,分别提升到了56.9%和31.3%。
以“加热一个杯子并放到台面上”任务为例,传统方式依赖外部文本和失败反馈,而情绪驱动能提前捕捉内部状态变化,引导正确子序列完成任务。消融实验证实“加热”和“捡两个东西”激活频率最高的情绪模板分别是“挫败”(41%)和“困惑”(39%)。

天津大学研究将情绪直接嵌入世界模型(Large Emotional World Model, LEWM)。传统世界模型在以人为中心的环境中易陷入“物理还原论”误区,而情感是驱动人类行动与引发环境变化的重要内生因果变量。
LEWM将预测分成两步,先预测未来情绪状态,再以预测情绪引导未来世界状态预测。在其自建数据集上,该方法的准确率最高提升45.72%。消融实验发现移除情感数据会影响逻辑推理与通用问答能力。

今年4月Anthropic的实验发现,LLM内部存在可“读出来”的情绪表征。过去研究者关注模型“是否有情绪”多出于对齐安全或哲学思辨,现在模型内部状态正转变为可被提取、利用和整合进系统设计的功能性信号。
编辑观点:AI情绪研究为提升其工作能力带来新思路,从技能选择到世界模型预测,情绪的应用潜力巨大,未来有望推动AI在多领域更智能发展。

281

被折叠的 条评论
为什么被折叠?



