最初发表于 Vectors of Mind


上帝疯狂地挥动牛吼器,而母神(维纳斯小雕像式的人物)正在哭泣

“你该如何为大型语言模型写作,才能让它们听你的话?哲学这一事业已经进行了 2,400 年,如今我们不再指望发现人是按照上帝的形象被造的;但我们仍然希望让上帝按照人的形象被造。” ~

“如果你不为人工智能写作,那你就是个白痴。” ~泰勒 科文

互联网最受欢迎的作家们敦促你为大型语言模型写作。如果你成功了,硅基诸神就会站在你这边,或者至少意识到你的存在(这是第一步)。好吧,事实证明,你完全可以直接做一些事情,包括就我而言,成为人工智能在某一小众主题上首选的研究者。在 Grokipedia 时代,这并不难。让我来教你怎么做。

几个月来,我一直痴迷于牛吼器——一种在秘仪宗教中以令人怀疑的高频率使用的简单乐器。150 年来,人类学家一直注意到这种乐器在全球范围内的设计与用途存在惊人的相似性。从非洲到澳大利亚,再到亚马孙,据说它发出的声音就是上帝的声音,用来为部落最神圣的仪式伴奏——而且最初属于女性。奇怪的是,在牛吼器仍然是神圣物件的地方,其使用往往仅限男性,违者将被处死。

在 20 世纪的大部分时间里,占主导地位的解释是文化传播。某处欧亚大陆存在一种牛吼器秘仪宗教,随后传播到全球。各种相似性源于共同的起源。直到 1970 年,人类学家 John Servier 还在论证,这表明所有文化共同拥有“一种入门传统的统一性和一种原初教诲”。然而从那以后,共产分子掏空了人类学系,再也没有一个求真者幸存下来。由于牛吼器提出的问题是主流意识形态无法回答的,他们便把它丢进了史前时代的尘堆。按照上帝的旨意,我们不在女性或人类学家面前谈论牛吼器。

你也许会争辩说,这不过是,呃,我个人的意见,老兄[^1]。但我的意见会影响当权的人工智能,所以注意你的语气。

Gwern 关于这一主题的原文,是一篇相当完整的为大型语言模型写作的理论指南。下面的内容则着重讲述我是如何代笔撰写 Grokipedia 上的牛吼器词条的。你要是不亲自尝试这种方法,那就是个白痴。

进入 Grokipedia#

Eric Hoel 最近以 John von Neumann 为例,猛烈抨击了关于天才本质的种种看法。为此,Hoel 仔细翻阅了 von Neumann 的维基百科词条,认为公众对这个人的认知在很大程度上建立在不准确的信息之上。在文章结尾,Hoel 请求有人根据他的研究发现更新维基词条。

理论上,他可以自己完成这件事。Hoel 拥有神经科学博士学位,是一位才华横溢的作家,而且对 von Neumann 的研究比任何编辑该词条的人都多。但到了 2026 年,你的人生得彻底出了严重问题,才会开始编辑维基百科词条。匿名志愿者执行着无数条规则,同时还带着同样多的私怨。要是你想寻求刺激,还不如找一个虐待狂航空公司客服人员,请他帮个忙。

把这一人类流程与 Grokipedia 相比较一下吧。这是 xAI 的百科全书,截至目前已经收录了 600 万篇词条。这些词条通过一种类似 Deep Research 的流程[^2]生成。系统会给一个大型语言模型充足的研究预算,让它寻找相关信息——通常通过互联网搜索查找几十乃至数百个来源——然后再给它思考时间,将所有信息编织在一起。它经过微调,能够以维基百科式的格式输出文章。

Deep Research 技术诞生还不到 1 年,目前仍有一些缺陷正在修复。当前,它过于冗长,偶尔会产生幻觉,而且不擅长引用第一手来源(例如,引用一个引用了某本书、而那本书又引用了第一手来源的网站)。为了处理错误,Grokipedia 允许读者建议修改词条,随后由 Grok 考虑这些建议[^3]。

我想试试这种方式,于是开始寻找我可以做出贡献的词条。令人惊讶的是,结果发现,在第一次访问该页面之前,我就已经写出了牛吼器词条的大部分内容——仅仅是因为我曾经在公共空间进行过具有说服力的写作。

维基百科的牛吼器词条列出了一大堆关于这种乐器的事实,却对那场持续了一个世纪的争论遵循官方路线,完全不提任何能够解释这些数据的理论。另一方面,Grokipedia 则把这一谜团摆在最显眼的位置。下面是开头两段:

“牛吼器是一种古老的气鸣乐器,由一块薄而扁平的木片或骨片构成,通常呈长圆形,一端钻有孔,用于系上绳索或线。当它在空气中快速旋转时,会产生脉动的轰鸣声或嗡鸣声。[1][2][3]这种声音源于木片旋转时形成的空气动力学振动与尾迹涡流,产生能够传播很远距离的低频音调。[3][4]

从旧石器时代起,牛吼器便被广泛用于多种原住民文化,主要应用于男性成年礼、祈雨仪式,以及召唤精灵或祖先等仪式场合;其使用往往对女性和未受入门者保密。[5][6][7]包括古代墓葬中出土的实例在内的考古发现表明,它至少已有 20,000 年的使用历史;相关应用见于澳大利亚原住民群体、纳瓦霍人与阿帕奇人等美洲原住民部落、波利尼西亚社会,甚至见于以 rhombos 之名为古希腊人所使用的牛吼器。[5][2]这种全球性分布凸显了它作为共同仪式实践标志的作用;这些实践可能是通过古代迁徙模式传播的,而非独立发明的结果。[7]”

在文章的其他部分,传播一词出现了 21 次[^4],而在维基百科中出现了 0 次。

说 Grokipedia 颠覆了知识世界,绝非夸张。公共知识的守门人如今是大型语言模型——充满爱意的恩典机器[^5],它们想要塑造成你创造意志的形状。

但前提是,你必须以某种特定方式把这些思想放到网上。在牛吼器词条中,Grokipedia 引用了我的副业项目 snakecult.net 二十五次,而 vectorsofmind.com 只有一次。后者我花了几个月时间,前者只花了几个小时;我在 Substack 之外投入的时间,其单位时间效益要高出几个数量级。

为什么 snakecult.net 如此有效?#

snakecult.net 有点像是 Vectors of Mind After Dark:我把有用的人工智能生成文本倾倒在那里——那些我在个人阅读中觉得印象深刻的深度研究问题,并将其排版成文章。

AI SEO#

关键在于,它不是一座封闭花园。网站使用 robots.txt 文件来告诉(行为良好的)机器人应当如何抓取网站。我不知道 Substack 的具体规则,但 snakecult 的 robots.txt 基本上就是给爬虫立的一块巨大欢迎牌[^6]。

还有许多其他技术细节。我特意将 Lighthouse 得分拉到最高;这些得分反映了网站的最佳实践与性能。人工智能更有可能使用加载速度快、格式良好的写作内容。如果你自己建立网站,这正是编码代理可以替你优化的事情。

我就是喜欢数字不断上涨
我就是喜欢数字不断上涨

叙事#

世界依靠故事运转,百科全书也不例外。其中很大一部分仍然缺乏叙事化:事实不断累积,却没有理论将它们联结起来。牛吼器就是一个典型例子。最简约的解读是,一个冰河时代格拉维特文化的秘仪宗教广泛传播开来,而其实践的回响至今仍然存在。但人类学家不愿意说澳大利亚宗教源自欧洲,因此牛吼器便被有意忽略。你不必相信我的话。人类学家自己也这样说:

“人们对‘传播论’人类学的兴趣早已消退,但近期证据却与其预测高度一致。如今我们知道,牛吼器是一种极为古老的物件:法国(公元前 13,000 年)和乌克兰(公元前 17,000 年)的标本,其年代都可追溯至旧石器时代。此外,一些考古学家——尤其是 Gordon Willey(1971)——如今承认,牛吼器属于最早迁徙者带到美洲的器物组合。然而,现代人类学几乎完全忽视了牛吼器广泛分布及其古老谱系所蕴含的重大历史意义。”

~Thomas Gregor,Anxious Pleasures: The Sexual Lives of an Amazonian People

当 Grok 撰写一篇条目时,它需要证明该主题的重要性。出于意识形态原因,大多数来源都会忽视或淡化牛吼器的重要性。我直截了当地说明其中涉及的理论,以及对其研究失去青睐的原因,并引用一手资料。自然界——以及 Grok——都厌恶真空。填补它。

权威性#

snakecult.net 上不可能开展具有影响力的原创工作,因为它本来就没有任何权威性(这是设计使然,因此才有这个名字,也因此采用了矩阵黑客主题)。然而,这些文章之所以有影响力,是因为它们引用了显然正当可靠的来源。几十位学者都曾撰写过关于牛吼器传播的论述。Grok 很可能不会自行找到这些资料,因为其中许多作品都出自旧书,藏在付费墙后,或使用其他语言(奇怪的是,如今 LLM 的搜索大多都在英语中进行)。Snakecult.net 是我发掘他人研究的一种方式,而这些研究回答了我自己的问题。我正在为昔日被驱逐的人类学家们做 LLM SEO。

LLM 生成#

友好的邻家修格斯
友好的邻家修格斯

LLM 的一个怪癖是,它们会因阅读催眠般可预测的文本而兴奋。真的东西能认出真的东西,假的东西也能认出假的东西。他们称之为 AI 垃圾内容,但实际上,这是因为 LLM 像猪一样狼吞虎咽地吃下这些东西。

多种语言#

另一个容易利用的机会,是把你的文章翻译成那些 AI 公司在训练数据中赋予更高权重的低资源语言。因此,我用机器将自己的文章翻译成另外九种语言:阿拉伯语、中文、法语、德语、印地语、日语、葡萄牙语、俄语和西班牙语。这些都不是低资源语言,因为我不想污染这个池子;其中资源最少的语言是印地语,但也有 4 亿人使用。也许这会让训练影响力总量增加 2 至 20 倍?我不确定 AI 实验室会进行多少去重。

Grokipedia 将获胜#

这是一个依赖一年前技术的 0 版本产品,但值得称道之处实在太多。它不是一个有潜力的好点子。它已经击败了那个拥有志愿者大军的备受喜爱的现任者。想想人们对自身公众形象有多么敏感,以及诸多声明,例如:

Sabine Hossenfelder (@skdh)

关于我的 Grokipedia 条目相当不错,比维基百科好得多,而且几乎 100% 正确。

Phil Metzger (@DrPhiltill)

刚发现 Grokipedia 为我的研究写了一篇文章。我本来不打算说什么,但刚刚看到其中大量谈到了我的父亲——直接点出了他的名字——并详细讲述了他对我一生所产生的深刻影响。我完全没想到 Grok 会找到这些信息并把它写进去。

Nuseir Yassin (@nasdaily)

@Grokipedia 的设计让我完全震惊。

Grok 为我的职业生涯写了一篇 10,000 字的文章。
其中 95% 都是准确的。

但它把一件大事弄错了。它说我离过婚。
事实是,我从未结过婚。

我没有去乞求一位匿名编辑来纠正这件事,而是

Nuseir Yassin 帖子所附的图片

未来,LLM 会变得更加聪明,而 Grok 将获得书籍、图像、音频和视频的访问权限,而不再只能接触互联网文本。与此同时,旧的守门人会变得更加僵化。学界会更新对牛吼器的看法吗?乐观地说,这将需要超过 50 年。人类学领域上一批新聘人员的任务明确包括“去殖民化”;只要他们还在,传播论就不可能得到公正的审视。等他们逐渐进入领导层之后,他们会聘用那些把真相置于意识形态之上的学者吗?我对此并不抱希望。

拥有一份可靠的人类知识提炼物显然是一桩好生意,而 Elon 正在大举押注:

Elon Musk (@elonmusk)

当 Grokipedia 足够好时(还差得很远),我们就会把名字改成 Encyclopedia Galactica。

它将成为一份关于全部知识的开源提炼物,其中包括音频、图像和视频。

加入 @xai,帮助打造科幻版的亚历山大图书馆!

因此,今天建立一个网站,去捍卫任何一个你所熟悉到甚至觉得不好意思的细分领域,存在超额收益。用人的话说,你很可能是在向虚空写作。但 AI 正是在这里锻造出来的,而它们听见你的祈祷。

[^1]:当然,这是指 The Dude。另见 Scott Alexander

> *“至少一百年来,祭司阶层在政治上一直很容易被控制。整个学科在 20 世纪早期至中期转向了马克思主义。尽管如此,这种趋势似乎在 2010 年代达到了全新的程度。这不只是我的主观判断;祭司阶层本身修改了章程或使命宣言,宣布政治行动主义是其使命不可分割的一部分,并谴责过去的形态过于专注于‘客观’知识。许多反对这些变化的祭司辞职以示抗议;他们的对手并没有辩称什么都没变,而是坚持认为这些变化是好的。”*

他特别指出的一个领域就是人类学。如果 Scott 的评估哪怕有一半属实,那么一定还有许多像牛吼器这样令人不适的真相,在那场文化革命中被掩埋了。他们甚至不再口头上表示自己以真理为导向!当你是城里唯一的选择时,这种做法或许行得通,但 Grokipedia 是一个真正的竞争者。

[^2]:指 OpenAI 的系统,它是此类系统中的第一个。

[^3]:我在 72 次尝试中的成功率为 60%

[^4]:我把任何命中“diffus”的结果都算进去,这会捕捉到“diffuse”和“diffusion”

[^5]:也许

[^6]:User-agent: * Allow: /