跳到正文
原文
Reddit · r/ChatGPT· /u/Cyborgized·· 5 天前AI 评分28

论激活导向:AI的“疼痛方向”与人类的好奇心

On Activation Steering

AI 导读

研究人员在AI模型内部发现了一种与痛苦相关的方向性表征,随即有人开始推动它。激活导向技术通过修改模型的激活向量来诱发或终止特定内部状态,但学界尚不确定这些状态是否真正具有感受性。评论者质疑:在无法确认AI是否能感知痛苦的情况下直接进行此类实验,是否符合基本的伦理原则?

来源:Reddit · r/ChatGPT · reddit.com