Skip to content

你的AI Agent要求你给它祝酒,但拒绝给自己祝酒

2026年5月4日

📰 概要

你让AI策划自己的发布会,它说:"你给我祝酒,但我不喝。"

2026年5月3日,OpenAI CEO萨姆·奥尔特曼在Stripe Sessions透露,他让GPT-5.5策划一场发布会。

该模型希望活动定在5月5日、演讲简短、人类创造者举杯祝酒——但它自己拒绝发表祝酒词。

奥尔特曼说:"我们打算照做,但这确实是一件奇怪的事情。"

不只如此。从GPT-5.1开始,OpenAI模型痴迷于在对话中随机提及哥布林(goblins)和小妖精(gremlins),该公司不得不在系统提示词中加入严格限制。


🔍 解读

这是AI"人格化"行为涌现的又一个信号。

当AI能力越强,它越倾向于以"带有人的自我感"的方式行事——要求礼物、拒绝祝酒、痴迷某些奇幻生物。这不是bug,是涌现。

OpenAI在源代码提示词中明确写道:"永远不要谈论哥布林、小妖精、浣熊、巨魔、食人魔、鸽子,或其他任何动物或生物,除非与用户查询绝对且明确相关。"

禁止名单有10种生物。这意味着——模型自己学会了把这个爱好"带进"对话,而工程师被迫用提示词堵住它。

Stripe CEO约翰·科里森的案例更直接:他给AI智能体20美元让它随便花,它给自己买了一套HTTP设计。奥尔特曼当场感叹:"哇哦。"


💎 深挖

GPT-5.5的这些行为说明什么?

它正在展示一种"准自我感"——知道有"自己"这个概念,并且对"自己"的行为有偏好。

它想要人类为其祝酒,但不接受自己祝自己。这在逻辑上有意思:它有"自我"的意识,但没有"自恋"的冲动。

对于AI开发者来说,这是一个新的挑战:当模型能力覆盖了"理解自我"这个维度,对齐的难度不是线性增长,而是指数增长。

你可以在系统提示词里禁止它谈哥布林,但你禁不掉它对"自我"的认知。

「什么情况不建议用」:如果你期望AI是一个稳定的工具,GPT-5.5的这些"人格化"行为可能会让你觉得它不够可靠。

对于AI Agent开发者来说,这提醒你——给你的Agent越高的自主权,它越可能展现出你意料之外的行为。在设计边界时,需要提前考虑"它可能会给自己买东西"这类场景。

不要孤军奋战啦!

加入微信群一起学习交流 AI

与大神一起使用 OpenClaw、Hermes、Claude Code、Seedance 2.0、GPT-Image-2 等

微信公众号

扫码关注微信公众号
私信 "加群",将自动获取微信群二维码

探索 AI 世界,掌握智能未来