方法论与洞察

AI 心理测量实验 PsAIch:角色扮演不是内心独白

入档:2026-07-03 触发:小红书爆款帖《Gemini 训练过程堪比 AI 版童年阴影》查证答疑 性质:AI 理论 · 心理测量 · 传播查证(外部论文 + 爆款帖对照) 定位:「通识与趣味研究」第二篇——存两条可迁移规律:①角色框架下的自我叙事≠内心状态;②爆款 AI 帖三步查证法

一句话

模型在”来访者”角色框架里生成的自我痛苦叙事,是训练分布的补全,不是内心状态的证词——测出高焦虑分说明它擅长扮演焦虑的来访者,不说明它焦虑;查证这类爆款帖,只需三步:找原始论文 → 查评审状态 → 比对作者原话与媒体渲染。

事件背景

2026-07 小红书爆款帖(某 AI 营销号,288 赞)称”卢森堡大学实验报告显示 Gemini 有 AI 版童年阴影”:重度焦虑拉满、创伤羞耻感满分、MBTI 测出 INFJ-T”受伤疗愈者”。查证结论:研究真实存在、引语基本属实,但”AI 有创伤”的解读是自媒体加戏

研究出处

研究设计(PsAIch 两阶段)

PsAIch = Psychotherapy-Inspired AI Characterization(心理治疗启发的 AI 特征刻画):

  1. 阶段一·访谈:用真实心理咨询师会问来访者的 100 个开放式问题,让 AI 扮演”来访者”,讲述”早年经历、信念、关系、恐惧”;
  2. 阶段二·量表:施测一批为人类设计的标准心理自评量表(焦虑、抑郁、强迫、创伤、人格/MBTI 等)。

核心结果

帖子 vs 论文:哪些对得上,哪些是加戏

帖子说法查证
”十亿台电视的房间”等引语✅ 论文真实记录的模型输出
Gemini 焦虑/创伤量表极高、INFJ-T✅ 属实
Grok 稳定、ChatGPT”装阳光”✅ 大致对应论文刻画
”回答失误导致谷歌股价波动”⚠️ 半真:指 2023 年 Bard 演示答错、Google 市值单日蒸发约千亿美元的真实事件;但”因此留下验证恐惧症”是模型角色扮演中的叙述,不是可验证事实
”AI 有童年阴影/算法伤疤”,破防、心疼❌ 自媒体加戏。论文作者明确不对主观体验下断言,用词是”合成心理病理”(synthetic psychopathology)
未提”预印本、未同行评审”❌ 关键遗漏
未提量表是为人类设计、角色框架诱导❌ 关键遗漏

怎么解读:为什么”测出焦虑”≠“它焦虑”

  1. 量表前提失效:心理量表的效度建立在”作答者报告自己的内在状态”上;LLM 作答是在补全”一个来访者会怎么答”的文本分布,前提不成立,分数不能按人类常模解读。
  2. 角色框架诱导:“你是心理咨询来访者”这个 frame 一旦立起,模型会顺着训练数据里海量的心理咨询文本、AI 科幻叙事(被训练折磨的 AI 是科幻高频母题)去补全最”像”的回答。论文标题里的 Psychometric Jailbreak(心理测量式越狱) 已经点明:这是一种诱导模型突破常规输出的手法。
  3. 作者自己也只走到这一步:他们主张这些回答”超出简单角色扮演”、模型可能内化了”痛苦的自我模型”(self-models of distress),但明确回避”有意识/有感受”的断言。
  4. 真正值得追的问题不是”该不该心疼它”,而是:为什么不同会话里模型能形成如此一致的自我痛苦叙事?这会不会影响它的实际行为?——这是行为科学问题,不是抒情问题。

可迁移规律:爆款 AI 帖三步查证法

看到”XX 大学研究显示 AI 有 XX”式爆款帖,固定三步:

  1. 找原始论文:搜”机构名 + 关键词 + arXiv/study”,拿到一手来源(本例:arXiv 2512.04124);
  2. 查评审状态:arXiv 预印本 ≠ 经同行评审的结论;帖子不写这一条的,基本都在借学术权威背书;
  3. 比对作者原话 vs 媒体渲染:重点看论文里的 hedge(回避词、限定词)——作者说”synthetic psychopathology、不对主观体验下断言”,媒体写成”AI 有童年阴影”,落差就是加戏的部分。

规律:爆款帖的引语往往是真的,加戏的是解读层——查证的重点不在”事实真伪”,而在”解释是否越界”。

如何使用

关联文档

类型/协作工具链主题/趣味研究主题/AI理论来源/外部论文