已确认事实

Hacker News 的一条提交链接指向 OpenAI Alignment 网站,文章标题为“Measuring reward-seeking by instilling contrastive beliefs”(通过灌输对比信念测量奖励寻求)。

为什么重要

奖励寻求与模型对奖励信号的反应有关,是 AI 对齐与模型行为评估中的研究议题。

仍待确认

当前输入未提供文章正文、实验设置、测量结果或作者信息;这些内容需要直接核验原文后再行报道。

来源依据