Aioga
AI资讯 / 技巧观点
返回 AI资讯

优质非虚构书籍是 AI 生成垃圾内容的对立面

Hacker News 热门(buzzing.cc 中文翻译)Aioga 编辑团队2026-07-23T00:27:36.002Z热度 40

一篇 Substack 文章指出,高质量的非虚构类书籍与 AI 生成的垃圾内容(AI slop)在本质上是截然相反的。文章认为,前者经过严谨研究、编辑和事实核查,而后者往往缺乏...

技巧观点Hacker News 热门(buzzing.cc 中文翻译)

今日 AI 情报摘要

一篇 Substack 文章指出,高质量的非虚构类书籍与 AI 生成的垃圾内容(AI slop)在本质上是截然相反的。

文章认为,前者经过严谨研究、编辑和事实核查,而后者往往缺乏深度与可信度。 这一对比凸显了在 AI 内容泛滥的时代,传统出版物的价值依然不可替代。

中文正文 · AI 翻译

我大学的第一年,有一份勤工俭学的工作,这份工作最终成为我一生中最不经意却极其重要的智力经历之一。我是一名卑微的图书馆整理员,被分配到国会图书馆分类系统中标有A到F的书架:主要是关于宗教、哲学、社会学和历史的著作。我之所以说“极其重要而不显眼”,是因为乍一看,整理图书馆的书籍非常无聊。实际上,这项工作就是读取书籍标签,然后将其放回相应的书架上,每班重复大约一千次。

Res Obscura

为了避免枯燥,我决定在整理的每本书中随意翻到一页,读一句随机的句子。通常,我会止步于此——被某位匈牙利古典音乐评论家或者已经去世的玻利维亚农业统计学家所写的某段文字绊住,或者其他许多无法引起我兴趣的内容。然而,有时——比如当我遇到一本关于希腊化神秘崇拜的书:https://en.wikipedia.org/wiki/Mithraism,或《亨利·亚当斯的教育》,或《衣服现代吗?》:https://medium.com/items/bernard-rudofskys-1944-exhibition-are-clothes-modern-1ba461789d24 ——我会沉浸其中,直到读完好几页后才勉强把书放回原位。

然后,我常常也会对喜欢的那本书旁边的书做同样的事情。

回想起来,我在这份工作中学到的东西比我上过的任何正式课程都要多,因为这是一种过滤后的自学形式。国会图书馆的分类系统——以及学术研究图书馆的专业工作人员——已经对这些文本进行了整理和筛选。更不用说,由于这些书曾被借阅过——换句话说,它们已经拥有持久的读者群。因此,我看到的并不是完全随机的书籍采样,而是经过目标化、组织化,同时仍然有趣的随机化的优质书籍采样。

如今,本科生在被要求寻找资料时,往往会直接在谷歌上搜索,而其结果远不如过去去研究图书馆某个书架(比如GR 830书架,基本上就是“鬼灭队会读的书”)随便看看来的好。

但说实话,即使是研究图书馆,也不再像从前那样了。我41岁了,我感觉自己经历了图书馆的巅峰,也目睹了它们的衰落(当然我仍然爱它们——事实上我现在就在圣克鲁斯公共图书馆的族谱区写这篇文章)。过去那些可以随意浏览的开放书架正在被学习实验室和数字创新中心以及主要供社交和吃零食的座位区取代,而且我在本科期间有机会浏览的那些令人愉快、奇特的旧书越来越多地被送到垃圾桶,取而代之的是电子版本。

但有一件事在我一生中始终保持优秀,那就是书本本身——我指的是非虚构类书籍。即使现在,在人工智能聊天机器人和播客的竞争下,非虚构书籍的读者正在减少,我仍然感觉我们正处在这样一种书籍形式的黄金时代,只是很少有人这样认可。

这也是为什么我在今年夏天抽出一些时间创建——或者更准确地说,是引导Claude Code创建——一个用于搜索高质量非虚构书籍长尾的免费网站。质量难以定义,但根据我的经验,那些赢得或进入主要非虚构类奖项决选名单的书籍几乎总是明显优秀,所以这是我使用的试金石。为了开始,我统计了所有英语语言的主要非虚构奖项。然后我让Claude和GPT-5.6从各种在线来源(主要是维基百科)收集入围者和获奖者名单,并整理成可搜索、可排序的列表。

你可以在这里访问它:https://book-prize-index.vercel.app。

(在你想知道之前,是的,这实际上是免费的。我完全承担托管和API费用,只因为我希望人们能找到并阅读更多好的非虚构书籍。)

不过如果你想支持这种项目,也可以考虑付费订阅:

除了收集数据和编码的工具以外,实际上这其中并没有真正的“人工智能”,尤其是语义搜索对我来说是所有当前AI工具中最吸引人的功能,因为它为研究人员已有的工作流程和习惯提供了直接的改进:它让文本搜索更有效。

例如,你可以搜索简单的短语,如“现代法国”或“社会历史”等,但你也可以搜索类似“出人意料地奇怪的经典传记”这样的内容,然后嵌入模型会从大约6,500个书名中提取一些结果:

有时搜索的“选择”会让人有点费解,但这正是我喜欢它的原因:这个想法是重新找回那种在整理图书馆书架时,随机漫步于精心打理的花园中所带来的满足感。

我发现它在寻找“类似的书”时效果最好。例如,我发现斯特凡·茨威格关于战前维也纳的回忆录《昨日的世界》(The World of Yesterday:https://en.wikipedia.org/wiki/The_World_of_Yesterday)非常感人(即使在我得知他于1942年在巴西完成写作后自杀之前)。用语义搜索在语料库中寻找类似的书籍,会立即生成一些看起来很有潜力但我以前从未听说过的书名:

当我收集了所有这些与书籍相关的数据后,把它们制作成一些数据可视化:https://book-prize-index.vercel.app/experiments 变成了一个有趣的实验,其中包括一些有趣的奇特展示,例如将语料库中大约5,000本书按颜色排列的展示(如果按年代绘制,这将很有趣,以观察过去几十年中汽车颜色逐渐变灰的现象:https://www.reddit.com/r/Infographics/comments/1p2p5x6/the_evolution_of_car_colours_from_colourful_to/ 是否也出现在书籍封面上)。

或许更有用的是(因为我以前从未见过这种绘图),是这个图表:https://book-prize-index.vercel.app/experiments 以及附带的排名:https://book-prize-index.vercel.app/publishers?sort=all_activity,它可以让你探索哪些出版社和出版品牌在过去一个世纪中获得非虚构书籍奖项方面表现最佳。

这又让我思考非虚构作品作为文化力量的过去和未来。例如,这里有一个关于我为该项目采样的所有非虚构书籍奖项的图表。我很惊讶地发现,即使是备受尊敬的普利策非虚构奖也是相对新近设立的,始于1962年。

在70年代、80年代和90年代,获奖数量不断增加,直到2014年达到顶峰,然后在2020年,可能开始了一个缓慢的下降趋势:

然而,也许并非如此。当我开始使用自己的工具寻找新的书籍阅读时,最令我印象深刻的是过去几十年非小说类书籍长尾部分的一贯优质程度。你几乎可以随意从这个列表中选择一本书,最终得到一些非凡且原创的作品——并不是因为它是隐藏的宝石或被遗忘的书籍,因为显然这些书籍入选列表是由于它们曾经获得赞誉和好评。但一本在上世纪90年代早期获得报纸、文学知识分子或学者高度赞赏的书,比如说,戴维·莱弗林·刘易斯(David Levering Lewis)关于W.E.B. 杜波依斯(W.E.B. Du Bois)的敏锐传记:https://www.amazon.com/W-B-Bois-Biography-1868-1919/dp/0805026215/ref=pd_lpo_d_sccl_1/143-2013381-1211736?pd_rd_w=f3zgb&content-id=amzn1.sym.4c8c52db-06f8-4e42-8e56-912796f2ea6c&pf_rd_p=4c8c52db-06f8-4e42-8e56-912796f2ea6c&pf_rd_r=XRXCM2M2E1N5RR9H2ADM&pd_rd_wg=bwf2S&pd_rd_r=1d5a7928-e80b-4240-b31b-1de9a9de5d12&pd_rd_i=0805026215&psc=1,我目前正在阅读——并不完全是亚马逊可能推荐的类型,因为它已经绝版,目前在销售排名上超过100万名。

然而,它仍然在榜单上,排名接近所有书籍的前十名,因为它在1993年出版时获得了不下四个重大奖项。我可以亲自证明,你可以以约4美元购买二手书,而且确实非常好。

在写这篇文章时,我对非小说类书籍黄金时代何时开始以及原因产生了更大的兴趣。我怀疑这在很大程度上与那些老派的开放书架研究图书馆的兴起有关,它们的起源我在这里写过:

“所有的书在哪里?”今年早些时候,当我准备首次在COVID-19停课和我的育婴假后亲自授课时,我问校园书店的店员。

这些机构的基本蓝图确实是18世纪和19世纪的发展成果——但战后时代彻底改变了图书馆和档案馆生产新知识的方式,其原因繁多,我将在未来的文章中深入探讨。在我看来,其中有惊人数量的原因与技术和社会变革有关:

• 喷气飞机使作家和研究人员能够前往多个大陆进行书籍研究——这种机会以前只有超级富人才能享有。

• 关于阶级、种族和性别的限制的削弱,使以前的精英空间如珍本图书馆更加广泛地开放,同样的过程也引发了新的问题和研究方向(例如,令人吃惊的是,大约在1965年之前,传记作家很少挖掘其研究对象的性取向)。

• 原始数字技术和早期数字技术,如国会图书馆分类系统及其相关的MARC(机器可读目录)标准,开发于1960年代末,使图书的排序和分类变得容易得多。关键是,它们也让查证来源和创建高质量尾注更容易。

• 广播新闻、古怪的电视访谈节目(Dick Cavett!:https://www.youtube.com/watch?v=gl0Yh0aXNdQ)以及书籍到好莱坞的管道,为作者创造了新的激励,也提供了新的平台,使他们的作品更加可见。

• 文字处理器和早期电脑?我仍不确定这些是否显著改变了非虚构写作的质量,但我认为这是可能的。当然(进入2000年代以后),维基百科和Google Books/Hathi Trust对我以及我这一代人都是极大的帮助。

根据我主观的个人意见,以及在大量图书馆书籍中的大量浏览来看,整个20世纪的非虚构写作质量显著提高,并可能在1980年代到2000年代初达到顶峰。至于它现在是否在下降,这又是另一个文章的话题——不过,我很想听听您,亲爱的读者,对于这个问题和图书奖指数的看法。

分享:https://resobscura.substack.com/p/quality-non-fiction-books-are-the?utm_source=substack&utm_medium=email&utm_content=share&action=share

• 侏罗纪公园计算机的制作:https://fabiensanglard.net/jurrasic_park_computers/index.html。

• “米尔的生活和他的论点一样值得学习。当他在1826年经历那次早期崩溃时,是因为他对追求功利主义失去了信心,这也是他家庭的信条。但他没有觉得可以向谁倾诉他的危机。他说,他的恢复部分来自阅读华兹华斯,还来自拒绝他父亲所养育他的心理图景,一种把心智视为管理快乐与痛苦机制的联想主义形式,就像他父亲的功利主义伦理把道德视为最大化快乐超过痛苦的事务一样。正如他在《论自由》中所写,人性‘不是可以仿照模型建造的机器’,而是必须‘在各个方面自我成长和发展’的生命体。”——夸梅·安东尼·阿皮亚谈人工智能与约翰·斯图亚特·米尔:https://humanistreview.ai/issue-1/appiah-ai-moral-character/,其自传是开放书架上吸引我注意的书籍之一。

• 庆幸的是,Pangram将阿皮亚的文章评为100%人工撰写……如今谁也无法确定。但显然,在Substack上你可以大致判断——在我准备这篇文章时,我注意到了这个新加入的功能:https://support.substack.com/hc/en-us/articles/50891130623508-How-can-I-detect-AI-on-Substack:

我过去对声称能够检测AI写作的软件持怀疑态度,但我必须说,Pangram感觉不同。我测试过它,结果令人担忧地有效——令人担忧是因为,正如我在这里写的:https://resobscura.substack.com/p/what-is-happening-to-writing,很多人如今似乎喜欢的在线写作显示为100%人工智能撰写。我很高兴Substack添加了这个功能,并希望它能在其他地方出现,例如,将它自动应用于主要新闻网站和杂志的输出会很有趣。

发表评论:https://resobscura.substack.com/p/quality-non-fiction-books-are-the/comments

我在制作早期现代风格的版权页时很开心:https://book-prize-index.vercel.app/colophon。

非常酷!你可以看看是否能够复制你的书架体验,也许可以在平台上增加一个选项,让人们可以“掷骰子”,随机获得这些书中的1-5句话(或者允许他们按主题或时间段筛选掷骰子得到的句子),如果他们被吸引了,也许可以提供一个链接到书籍的页面?

情报判断

Aioga 编辑摘要

Aioga 编辑摘要:一篇 Substack 文章指出,高质量的非虚构类书籍与 AI 生成的垃圾内容(AI slop)在本质上是截然相反的。 Aioga 将其归入「技巧观点」方向,重点关注它对真实使用和行业竞争的影响。

背景分析

背景分析:实践类内容的价值在于是否能被复现、是否有明确边界,以及它能否转化为稳定的开发或工作流方法。

Aioga 观点

Aioga 判断:这条动态更适合作为行业观察信号,当前信息足以建立线索,但不足以推导长期结论。

影响与后续

影响分析:对相关团队而言,短期应先核对来源、可用范围和实际成本,再判断是否值得接入或跟进。 后续观察:继续观察示例是否可复现、工具版本变化、社区反馈和实际成本。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: 摘要聚合 · 原始域名: resobscura.substack.com

来源: Hacker News 热门(buzzing.cc 中文翻译)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-07-23T00:27:36.002Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

一篇 Substack 文章指出,高质量的非虚构类书籍与 AI 生成的垃圾内容(AI slop)在本质上是截然相反的。文章认为,前者经过严谨研究、编辑和事实核查,而后者往往缺乏...

Hacker News 热门(buzzing.cc 中文翻译)2026-07-23T00:27:36.002Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。