<?xml version="1.0"?>
<feed xmlns="http://www.w3.org/2005/Atom" xml:lang="zh">
	<id>https://wiki.jwjp.com/index.php?action=history&amp;feed=atom&amp;title=%E5%88%AB%E6%83%B3%E5%A4%A7%E8%B1%A1</id>
	<title>别想大象 - 版本历史</title>
	<link rel="self" type="application/atom+xml" href="https://wiki.jwjp.com/index.php?action=history&amp;feed=atom&amp;title=%E5%88%AB%E6%83%B3%E5%A4%A7%E8%B1%A1"/>
	<link rel="alternate" type="text/html" href="https://wiki.jwjp.com/index.php?title=%E5%88%AB%E6%83%B3%E5%A4%A7%E8%B1%A1&amp;action=history"/>
	<updated>2026-08-29T08:19:45Z</updated>
	<subtitle>本wiki上该页面的版本历史</subtitle>
	<generator>MediaWiki 1.45.1</generator>
	<entry>
		<id>https://wiki.jwjp.com/index.php?title=%E5%88%AB%E6%83%B3%E5%A4%A7%E8%B1%A1&amp;diff=121&amp;oldid=prev</id>
		<title>Admin：​创建页面，内容为“{{Infobox 概念 | 名称 = 别想大象效应 | 英文名 = Don&#039;t Think of an Elephant Effect | 别名 = AI白熊效应、反向指令失效、J-space概念激活 | 领域 = 人工智能、提示词工程（Prompt Engineering）、认知心理学 }}  &#039;&#039;&#039;别想大象&#039;&#039;&#039;（英语：Don&#039;t Think of an Elephant）在人工智能（AI）与大语言模型（LLM）领域中，是指&#039;&#039;&#039;模型难以正确处理否定句、或反向提示词（Negative P…”</title>
		<link rel="alternate" type="text/html" href="https://wiki.jwjp.com/index.php?title=%E5%88%AB%E6%83%B3%E5%A4%A7%E8%B1%A1&amp;diff=121&amp;oldid=prev"/>
		<updated>2026-08-27T15:34:30Z</updated>

		<summary type="html">&lt;p&gt;创建页面，内容为“{{Infobox 概念 | 名称 = 别想大象效应 | 英文名 = Don&amp;#039;t Think of an Elephant Effect | 别名 = AI白熊效应、反向指令失效、J-space概念激活 | 领域 = &lt;a href=&quot;/index.php?title=%E4%BA%BA%E5%B7%A5%E6%99%BA%E8%83%BD&quot; title=&quot;人工智能&quot;&gt;人工智能&lt;/a&gt;、&lt;a href=&quot;/index.php?title=%E6%8F%90%E7%A4%BA%E8%AF%8D%E5%B7%A5%E7%A8%8B&amp;amp;action=edit&amp;amp;redlink=1&quot; class=&quot;new&quot; title=&quot;提示词工程（页面不存在）&quot;&gt;提示词工程&lt;/a&gt;（Prompt Engineering）、&lt;a href=&quot;/index.php?title=%E8%AE%A4%E7%9F%A5%E5%BF%83%E7%90%86%E5%AD%A6&amp;amp;action=edit&amp;amp;redlink=1&quot; class=&quot;new&quot; title=&quot;认知心理学（页面不存在）&quot;&gt;认知心理学&lt;/a&gt; }}  &amp;#039;&amp;#039;&amp;#039;别想大象&amp;#039;&amp;#039;&amp;#039;（英语：Don&amp;#039;t Think of an Elephant）在人工智能（AI）与&lt;a href=&quot;/index.php?title=%E5%A4%A7%E8%AF%AD%E8%A8%80%E6%A8%A1%E5%9E%8B&amp;amp;action=edit&amp;amp;redlink=1&quot; class=&quot;new&quot; title=&quot;大语言模型（页面不存在）&quot;&gt;大语言模型&lt;/a&gt;（LLM）领域中，是指&amp;#039;&amp;#039;&amp;#039;模型难以正确处理否定句、或反向提示词（Negative P…”&lt;/p&gt;
&lt;p&gt;&lt;b&gt;新页面&lt;/b&gt;&lt;/p&gt;&lt;div&gt;{{Infobox 概念&lt;br /&gt;
| 名称 = 别想大象效应&lt;br /&gt;
| 英文名 = Don&amp;#039;t Think of an Elephant Effect&lt;br /&gt;
| 别名 = AI白熊效应、反向指令失效、J-space概念激活&lt;br /&gt;
| 领域 = [[人工智能]]、[[提示词工程]]（Prompt Engineering）、[[认知心理学]]&lt;br /&gt;
}}&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;别想大象&amp;#039;&amp;#039;&amp;#039;（英语：Don&amp;#039;t Think of an Elephant）在人工智能（AI）与[[大语言模型]]（LLM）领域中，是指&amp;#039;&amp;#039;&amp;#039;模型难以正确处理否定句、或反向提示词（Negative Prompts）容易引发反向效果的现象&amp;#039;&amp;#039;&amp;#039;。&lt;br /&gt;
&lt;br /&gt;
该术语源自认知语言学家乔治·莱考夫（George Lakoff）的经典心理学政治学著作《别想那只大象》，在 AI 时代被广泛用于描述大模型“越不让干什么，越要干什么”的逻辑困境。&lt;br /&gt;
&lt;br /&gt;
== 现象表现 ==&lt;br /&gt;
&lt;br /&gt;
在与文本或图像 AI 交互时，该效应通常表现为以下几种形式：&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;文本生成中的“越界”&amp;#039;&amp;#039;&amp;#039;：当用户给出口令如“请直接给出答案，&amp;#039;&amp;#039;不要&amp;#039;&amp;#039;附带任何解释和客套话”时，AI 往往在生成答案后，仍旧会输出一段解释。&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;图像生成中的“凭空出现”&amp;#039;&amp;#039;&amp;#039;：在 [[Midjourney]] 或 [[Stable Diffusion]] 等生图工具中，如果输入提示词 &amp;lt;code&amp;gt;A living room, no elephants&amp;lt;/code&amp;gt;（一个没有大象的客厅），AI 的画作中大概率会出现一只大象。&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;越狱（Jailbreak）防御失效&amp;#039;&amp;#039;&amp;#039;：在安全对齐中，如果系统提示词硬性规定“严禁提及密码 X”，攻击者通过巧妙的绕过诱导，反而更容易激发 AI 提取出密码 X。&lt;br /&gt;
&lt;br /&gt;
== 核心技术原理 ==&lt;br /&gt;
&lt;br /&gt;
大语言模型频繁落入“别想大象”陷阱，主要由其底层架构和训练机制决定：&lt;br /&gt;
&lt;br /&gt;
=== 1. 注意力机制（Attention Mechanism）的语义偏重 ===&lt;br /&gt;
基于 [[Transformer]] 架构的模型依赖[[注意力机制]]来捕捉上下文相关性。在处理“不要包含[[政治]]内容”时，“不要”作为逻辑虚词，其注意力权重（Attention Weight）往往远低于“政治”这一实体高频词。AI 的特征向量在计算时，会不自觉地向高权重词汇倾斜。&lt;br /&gt;
&lt;br /&gt;
=== 2. 认知黑板（J-space）的提前激活 ===&lt;br /&gt;
根据人工智能研究机构 [[Anthropic]] 的内部探测研究，大模型在处理输入时存在一个类似“认知黑板”的内在空间（J-space）。&lt;br /&gt;
# 当用户输入“不要想粉红大象”时。&lt;br /&gt;
# AI 为了理解这个句子，必须先在 J-space 中激活“粉红大象”的概念特征。&lt;br /&gt;
# 一旦概念被提前激活（Primed），它在接下来的自回归（Autoregressive）文本预测中，被采纳并输出的概率就会呈现指数级上升。&lt;br /&gt;
&lt;br /&gt;
=== 3. 扩散模型的正向标签绑定 ===&lt;br /&gt;
多模态生图模型（[[Diffusion Models]]）在训练时，图片与标签（Tag）是正向绑定的（如“大象的图片”对应词标签“大象”）。模型无法理解“没有大象”的视觉特征，它只识别到了词流中的“大象”，进而将其绘制出来。&lt;br /&gt;
&lt;br /&gt;
== 提示词工程的解决方案 ==&lt;br /&gt;
&lt;br /&gt;
在[[提示词工程]]中，解决“别想大象”的标准范式是&amp;#039;&amp;#039;&amp;#039;“用正面肯定代替反面禁止”&amp;#039;&amp;#039;&amp;#039;。&lt;br /&gt;
&lt;br /&gt;
{| class=&amp;quot;wikitable&amp;quot; style=&amp;quot;width:100%;&amp;quot;&lt;br /&gt;
|-&lt;br /&gt;
! width=&amp;quot;15%&amp;quot; | 类型&lt;br /&gt;
! width=&amp;quot;42%&amp;quot; | ❌ 错误示范（引发大象效应）&lt;br /&gt;
! width=&amp;quot;43%&amp;quot; |  正确示范（正面行为对齐）&lt;br /&gt;
|-&lt;br /&gt;
| &amp;#039;&amp;#039;&amp;#039;文本控制&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
| &amp;lt;code&amp;gt;&amp;#039;&amp;#039;&amp;#039;不要&amp;#039;&amp;#039;&amp;#039;给出多余的解释。&amp;lt;/code&amp;gt;&lt;br /&gt;
| &amp;lt;code&amp;gt;请&amp;#039;&amp;#039;&amp;#039;仅输出&amp;#039;&amp;#039;&amp;#039;最终的 JSON 数据，严格禁止任何解释。&amp;lt;/code&amp;gt;&lt;br /&gt;
|-&lt;br /&gt;
| &amp;#039;&amp;#039;&amp;#039;字数限制&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
| &amp;lt;code&amp;gt;&amp;#039;&amp;#039;&amp;#039;别写太多&amp;#039;&amp;#039;&amp;#039;，不要长篇大论。&amp;lt;/code&amp;gt;&lt;br /&gt;
| &amp;lt;code&amp;gt;请将字数&amp;#039;&amp;#039;&amp;#039;严格控制在 50 字以内&amp;#039;&amp;#039;&amp;#039;。&amp;lt;/code&amp;gt;&lt;br /&gt;
|-&lt;br /&gt;
| &amp;#039;&amp;#039;&amp;#039;图像生成&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
| &amp;lt;code&amp;gt;一个房间，里面&amp;#039;&amp;#039;&amp;#039;没有&amp;#039;&amp;#039;&amp;#039;大象。&amp;lt;/code&amp;gt;&lt;br /&gt;
| &amp;lt;code&amp;gt;一个干净的北欧风现代客厅。&amp;lt;/code&amp;gt;（或使用专属的 Negative Prompt 框）&lt;br /&gt;
|}&lt;br /&gt;
&lt;br /&gt;
== 参见 ==&lt;br /&gt;
* [[提示词工程]]&lt;br /&gt;
* [[大语言模型]]&lt;br /&gt;
* [[白熊效应]]&lt;br /&gt;
* [[Transformer模型]]&lt;br /&gt;
* [[Don&amp;#039;t Think of an Elephant]]&lt;br /&gt;
* [[Boardline]]&lt;br /&gt;
&lt;br /&gt;
[[Category:人工智能]]&lt;br /&gt;
[[Category:提示词工程]]&lt;br /&gt;
[[Category:认知科学]]&lt;/div&gt;</summary>
		<author><name>Admin</name></author>
	</entry>
</feed>