HN 上有多少是 AI?
文章摘要
作者是 lcamtuf(Michał Zalewski,afl-fuzz 等工具的作者),发在他的 Substack「lcamtuf’s thing」上。全文很短,是一篇数据小调查,TL;DR 就在开头:截至 2026 年 6 月,每日头条中约 50% 是关于 AI 的、或者是由 AI 生成的。
开场先交代了立场。 他说自己和 Hacker News 的关系很复杂:这个站点是极客新闻最重要的聚合器,也是他这个博客的主要流量来源;但同时它有相当数量的有毒评论者,是一个「朝我这个方向扔侮辱的可靠来源」——他自嘲说如果想尝尝味道,这篇文章本身就被人叫过「注水」和「slop」。这段自嘲后来在 HN 讨论里被反复引用。
他指出这不是 HN 第一次被趋势主导。 这个站点由极客运营、为极客服务,所以并不能免疫于科技潮流——比如 2018 年前后有相当多聚焦加密货币和 NFT 的帖子。但他认为最近这次转变更深刻:几乎每一天,版面都被「关于 AI 的、由 AI 写的、或者被 AI 评论的」帖子所主导。他放了一张 2026 年 7 月 21 日的截图,标注为「HN AI 奇点」,同时坦承那是特别糟糕的一天,所以为了给出更诚实的评估,他分别在 2026 年 2 月和 6 月做了两次系统性调查。
2 月的原始调查方法。 为了了解信息流里 AI 相关话题占多少,他对整个 2 月的每日前 5 名做了采样。结果:2 月 4 日和 2 月 12 日,AI 占了 5 席中的 4 席;2 月 5 日可以说整个榜单都是(第 3 名是某 AI 厂商的「潜艇式营销」)。整个 2 月只有三天前 5 名里没有 LLM 新闻——2 月 1 日(第一条 AI 帖在第 7 名,然后是第 9)、2 月 9 日(第一条在第 8)、2 月 25 日(AI 在第 6、9、10)。
实验的第二部分是判断哪些帖子可能是 AI 写的,他用了 Pangram。他把 Pangram 描述为一个「非常好且保守」的 LLM 生成文本检测模型,并花了一段专门为检测器辩护:这类工具在技术人群里名声不好,但反对意见往往基于过时的假设或彻底的误解。他的核心论证是——这些工具能工作,并不需要 AI 写作在任何意义上「非人类」,只需要当前这批 LLM 的默认腔调是准确定性的:让它写同一篇文章两次,你会得到风格上相似的结果。单个的写作习性是像人的,但你的写作恰好组合出完全相同的那一套习性,可能性极低。
为了验证结果,他还人工复核了所有被标记的帖子,认为结论说得通,「如果说有偏差,Pangram 反而有几个漏报」。他举了 2 月 19 日第 3 名的帖子(《AI 不是同事,是外骨骼》)作为被标记的例子——那篇有 500+ 赞和 500+ 评论,他认为它有一大堆危险信号。
6 月的更新数据用了更细的分类。 他用纯黑色表示「纯粹的 AI 自我凝视」(厂商公告、关于这项技术优缺点的评论文章等),用斜纹图形表示那些重度倾向 AI 但有更广泛影响的帖子(例如 Instagram 的 AI 客服账号被黑一事);和之前一样,只是沾边的帖子(例如内存涨价的报道)不做标记。结论是:6 月上半月约 60% 的每日 HN 版面是 AI 相关或 AI 生成的,接近月底逐渐回落到约 50%——相比 2 月的 40% 有所上升。
文章正文到此为止。值得一提的是,作者在自己 Substack 的评论区里补了一条关于评论侧的链接(指向 marginalia.nu 上的一个 HN 相关页面),说明他本人也认为「帖子有多少是 AI」和「评论有多少是 AI」是两个不同的问题。
HN 评论精华
这条帖子 275 分、344 条评论。讨论很快就脱离了数据本身,变成一场关于「HN 是不是完蛋了」的大型集体情绪释放——怀旧、迁移建议(Lobsters、Usenet、自建论坛)、以及「抱怨 AI 的人是不是比 AI 帖本身更烦」的元争论,占了绝大部分篇幅。真正讨论方法论的只有零星几条。这条帖子最大的反讽被很多人点破:一条关于「HN 上 AI 太多」的帖子,本身就是一条 AI 帖,而且冲上了头版。
- 少数几条方法论质疑里,jdw64 开门见山:这篇文章的前提是 Pangram 的检测非常有效,「它在英语圈里真的被认为是可靠那一档吗?」回复是分裂的:bigfishrunning 说自己对 Pangram 的信心很低,「看起来误报和漏报都很多」;jrflo 说以他的经验它非常有效;gibspaulding 给了最实证的一条——Pangram 官网链了几份第三方评测,都指向 90+% 的检出率和接近 0% 的误报率;「显然这些可能是精挑细选的,但我至今没见过任何带支撑数据的反面论证(比如:这里有一个能让 Claude 吐出 Pangram 检测不到的文本的 prompt,或者这里有一篇 2018 年写的文章而 Pangram 说它是 AI)」。他的判断是:检测是一场军备竞赛,所以这可能会变(他预期会朝漏报方向变),但目前看来防守方在赢。tiagod 提了个很好的补充要求:「很想看到更长时间跨度的数据,从 LLM 之前开始。」
- seizethecheese 提出了分类过宽的质疑:他随机看了一天,被算作 AI 的文章是 Waymo 发布一个自动驾驶模型、以及一篇关于 Apple News 广告里骗局的帖子——「Waymo 的模型当然是 AI,Apple News 里的骗局也常常是 AI 生成的,但这不是什么 LLM 单一文化。」他还给了个有点刺的建议:「讽刺的是,这篇文章本可以用 LLM 来做分类、并公布 prompt 来改进,这样我们就能检视『是 AI』到底意味着什么。」dgellow 反驳说文章已经做了这个区分,热力图的图例里「关于 AI 的文章」和「由 AI 写的」就是不同颜色;ktm5j 则反手一击:「你只看了一天的 5 个帖子,然后就把其余所有天都归了类。看起来你自己也挺擅长用大刷子分类的。」
-
jerf 贡献了本帖被引用最多的一条,主题是过度敏感的 AI 检测器。他引用了作者自嘲被叫「slop」那句,然后说:「我们已经到了这样一个地步——几乎任何一篇文章,都几乎保证会有某个评论者的 AI 检测器过于敏感,指控作者是 AI 写的。我发誓有些人的检测器就是:」
def is_content_ai(content): return True他说这些人偶尔还会抱怨这世界上有多少东西是 AI 了——「呃……对啊,你的检测器长这样当然会这样」。他并不否认讨论作品的 AI 出处常常是有效话题(当 YouTube 把一个 AI 频道塞给他、短暂突破他的防线时,看到评论者试图警告大家是很暖心的),但他的结论是:「另一方面,那群因为到处看见 AI 而非常恼火、因为真的到处看见 AI 而到处看见 AI 的、非常恼火的合唱团,自己也正在变成一种麻烦。」下面 jjgreen 补了一刀,把那段代码改成了
def is_content_ai(_content)(参数根本没被用到)。 - 与之针锋相对的是 mschuster91 的辩护:「当绝大多数关于 AI 的文章是用 AI 写的,而且大量逆向工程甚至硬件破解社区的新人现在都让 AI 替他们干活时,连最后那些曾经『仅限人类』的领域也被污染了。人们当然会变得非常敏感。我来 HN 是读人写的字,不是读 LLM 幻觉出来的絮絮叨叨。」pton_xd 给了更悲观的版本:写作既难又耗时,大多数人对这个过程感到不适,而 AI 是通往清晰、有逻辑、有权威感的文本的极简捷径——「像含糖饮料和零食一样,人们抵抗不了」;再加上跟上所有人的压力,选择就很容易了:花几天起草和编辑,还是花几分钟和 LLM 聊聊再点发布?
- mgl 的怀旧帖引出了本帖最长的一条支线。他用一句「接入的民主化是有受害者的」开头,然后给了一份 HN 的编年史:15 年前 HN 是关于 bootstrapping 和早期 YC 明星;10 年前是全套 VC-企业酱汁;5 年前是加密货币、NFT 和我如何每季度换工作;「现在则是透过 AI 这块黑镜对未来的模糊一瞥」。他问「我们怎么才能跳回那个惬意的过去?」并观察到有效的做法似乎是朋友和朋友的朋友组成的小群——在 WhatsApp 或 Discord 上结合各自背景讨论极客新闻,但这些群非常策划化、非常封闭,而且仍然运行在巨头的社交平台上。回复里方案繁多:nemomarx 建议自建论坛加邀请/申辩制入群;rapnie 给了一整套(Matrix、Discourse、Signal、Fediverse/Bluesky、RSS);smalltorch 甚至贴了一个几条命令就能在 onion v3 服务上开论坛的原型。但也有不同意见:runarberg 说他 13 年前加入时看到的是「一堆自由意志主义者和风投,加上一些开源/函数式编程爱好者和少数有趣的极客项目」,他认为第一群人的视觉权重随时间增加了,因为「他们那种赚一大笔钱却不提供任何价值的项目,被我们的资本主义经济越来越多地验证了」。alphazard 给了本支线最有理论感的一条:「民主需要守恒的股份才能运作。个体最初怎么获得那份股份是一个自由度,但如果股份可以自由印刷,系统就是不稳定的。」他举的可运作实现是:邀请树、股东制公司、权益证明分布式账本。alfiedotwtf 一句话概括了整条支线:「永恒九月:AI 版。」
- 支持现状的一派同样声音很大。jrflo 的立场帖拿了很高的赞:「我的反应是:这个比例是恰当的。 AI 大概是(科技界)过去二十年发生的最大的事,所以它占据大量讨论是公平的。」mistyvales 的回复很有代表性:「我烦透了,但你 100% 是对的。我确信相当数量的活跃读者想要更多 AI 相关的文章。」happytoexplain 做了一个措辞上的精确纠正:以你选的这个指标(「大」)来说是恰当的,「不过那个词大概该是『预期之中』,因为『恰当』暗含了某种更广泛的、以人为本的正当性/善的概念」。反方 pydry 一句话反击:「对我来说更像又一轮区块链炒作周期。尤其是那部分——我们永远处在整个世界即将改变的悬崖边上,而最大的变化只是巨额资金易手,在一大群投资者中诱发了精神病。」pbkompasz 更短:「比元宇宙或猴子 NFT 还大?」brazukadev 提了个具体的反例:「差一点。iPhone 是 19 年前发布的。它当时(现在依然)比当前基于 LLM 的 AI 重要得多。」
- bunderbunder 给了这条线里最有共鸣的一条:「我有一部分同意。但也有一部分怀念早年的 Hacker News——那时题材要驳杂得多,似乎每天我都有机会了解到某个完全不同的东西。而这也许正是我想念的。 如今 Hacker News 感觉越来越像另一个社交媒体平台:大多是观点、战争故事和自我推销。那种曾如此定义早期网络的偶然发现感,在这里也正在褪去。」cromka 补了个机制解释:其他很酷的 hacky 东西被挤掉了,没人给它们投票,因为对 HN 现在吸引来的访客类型来说它们不再有吸引力——他推测现在有多得多的非技术、「让我成为百万富翁」的淘金人群,「这听上去很愤世嫉俗,但我基于纯逻辑推断,因为 AI 带来了技术知识的大规模民主化,这几乎不可避免」;他还举了另一个证据:更刻薄、更短、技术性更低、逻辑更少的一句话式评论变多了。
- ViktorRay 的长帖是本帖情绪的另一个高点:「过去 16 年,读科技新闻对我来说逐渐变得越来越不好玩了。有人记得第一次遇到 iPhone、或者 iPad 时的敬畏感吗?」他说那些日子里 Ars Technica 之类站点的评论虽然有时刻薄和义愤,但人们大体上对读科技充满热情,因为它提供了对更先进未来的一瞥;「现在这些站点的评论区里持续充满着巨大的负面、犬儒、愤慨和纯粹的滚沸怒气」。回复分成三种态度:Groxx 认为这份负面是挣来的——「当人们意识到推动科技的那些最大的人物中有很大一部分是狂热的反人类、极度种族主义、一有机会就引用纳粹语录、并且只因为他们能就打算尽可能多地剥削人时」,生态系统已不再按比例地充满做酷东西的书呆子。onion2k 给了最温和也最诚实的一条:「你老了 16 岁。你也变了。 HN 也变了,但只回望当年多美好、却没意识到自己的视角已经不同,意味着你错过了它为什么感觉更糟的一大部分原因。」Legend2440 则给了正面回应:「是的,而当我第一次看到 LLM 和图像生成器时,我体验到了类似的敬畏感。我们几十年没有过这样的东西了。」他接着说不幸的是很多人对此又消极又刻薄,「地方政客因为数据中心项目被人开枪。我们真的把剧本弄丢了。」
- 关于环境成本有一条颇具争议的交锋。yndoendo 说 AI 让他越来越远离 HN,理由包括环境危害(升高环境温度、把重金属带入地下水、在干旱地区减少人类可用水、恶劣的环境噪音),以及一个更结构性的论点:手写代码可以在 20 年前的电脑上完成,而 ML 框架绑定昂贵硬件,制造了超级付费才能玩的局面——本地方案是缩小贫富差距的唯一途径,数据中心方案则扩大它。 但反驳很直接:Aurornis 说那份关于环境温度的研究「糟糕到我不敢相信它正在成为人们用来反对数据中心的实际论据——他们在正下风方向几百米处才勉强测出温度上升」;Legend2440 说地下水重金属这条他第一次听说、表示怀疑,认为「大部分是那些出于别的原因不喜欢 AI、只是在找理由把它关掉的人的动机性推理」;linkregister 给了最具体的一条反驳:弗吉尼亚州 Loudoun 县是全美最富的县之一,也是全世界数据中心最密集的地方,却没有这里提到的这些外部性;他建议注意那些关于噪音、水和光污染的目击报告,与那些数据中心业主的显著政治活动之间的交集——「具体说,这些数据中心的运营者在许多不同的公共领域都是臭名昭著的坏人」,并在编辑里加了一句「真相在这个帖子里显然非常痛苦且不受欢迎」。同一条下面 2OEH8eoCRo0 给了一个完全不同的抱怨角度,也拿了不少赞:「我甚至不在乎环境这方面——它就是太……不 hacker、太无聊了。那些疯子、那些不合群者、那些反叛者都到哪去了?」
- 关于「有本事就自己过滤」这一派,llm_nerd 的挑战最锋利:已经有人做了「没有 AI 的 HN」过滤器并上过头版(他贴了 elijahpotter.dev/hnsansai),「所以,你们这些抱怨的人都在用它吗?如果没有,为什么不用?」他自答:「剧透——当有人说『我读腻了 X』,他们真正在说的是『我想让其他所有人别再谈 X 了』。这在 HN 的历史上反复发生,只是暴露了当人们觉得自己无法控制叙事时会变得多情绪化。如果 HN 不适合你,那就别来了?」讽刺的是,这条下面有大量实际存在的过滤器被贴出来:coldpie 写了浏览器扩展(enough-ai-on-hn)、dandrew5 维护了一个带 AI 过滤视图的阅读器、otherayden 运营 unslop.news(用 LLM 来过滤讨论 AI 的内容,他自嘲「讽刺地」),并给了一个宝贵的数据点:页面底部会显示前三页被过滤掉的比例,「基本上总是 50% 或更高」——这与 lcamtuf 的测量独立吻合。kbelder 对 otherayden 的回复只有一句:「那你为什么在这个帖子里?」
- 也有对「用 flag 解决」的现实主义泼冷水。xphos 提议大家发起「flag AI 帖」运动,krapp 解释了为什么这行不通:AI 相关文章是切题的(AI 生成的评论才不是),如果人们去 flag 它们,他们只会失去 flag 权限;他还相当确定「flag 运动」原则上就是违规的,尽管针对「政治」隐含地存在这样一场运动。他的结论很宿命:「除了抱怨(最终也会被过滤掉,因为这类抱怨同样违反指南)、闭嘴忍着(这是唯一符合指南的选项)、或者离开去更绿的牧场,谁也做不了什么。」
- 元讽刺这条线贡献了几条最精彩的短评。rzmmm:「读这些评论,似乎关于 AI 的元讨论才是 HN 上最热的按钮话题。」krater23:「很悲哀;一方面这是真的,另一方面这个故事本身也是关于 AI 的。(由 AI 从德语翻译)」slapshot:「100% 我不同意的评论都是 AI 生成的机器人和收钱的托。我自己的全都是人类生成的。」grebc 说「这年头 90% 的评论者是 AI/机器人」,thephyber 回敬:「而社交媒体上 91% 的统计数据是凭空捏造的。如果这真是个问题,为什么一个只有人类的社交媒体平台没有像野火一样火起来?」koliber 说他有一条几年前的评论被指控是 AI 生成的,「我把它当勋章戴,因为那是我 100% 手写的」。asveikau 提了个具体现象:「最近几个月我注意到,即使文章和 AI 毫无关系,也经常有评论试图把它拽向 AI,而且方式常常完全说不通。它有一种变成自身戏仿的本事。」
- 最精彩的元讽刺来自 mring33621,他用一段明显模仿 LLM 腔调的文字写道:「这是一个值得静坐思考的新问题!当前 Hacker News 体验的形状,无疑暗示着 AI 生成内容的丰沛。一种安静的方式去检验这个洞察,是去问 HN 社区本身,然后评估由此产生的回复中那些承重的表层特征。但归根结底,我们不都在等着解包自己的贯穿线吗?」——gryfft 的回复是全帖最有画面感的一句:「这就像把白噪音开到最大音量播放。我在想是不是所有的交流最终都会被渲染成一种均质的嗡嗡嘶声。」
- 还有几条冷知识和数据点值得记下。hugs 问有没有人记得「多年前有过光荣的一天,HN 头版每一条都是关于 Erlang 的」;philipkglass 精确地给出了答案:2009 年 3 月 11 日,并贴了 HN 的历史头版存档链接。0xbadcafebee 提供了另一个时代对照:「对比 2010 年代,那时头版 90% 是关于 NoSQL 的。」NoboruWataya 给了一份独立的非正式验证:他时不时会扫一遍前 10 名数数有几条是 AI 相关,结果非常一致地落在 4-6 这个区间,多数时候是 10 条里 5 条,很少低于 4 条,也很少超过 6 条;他说这个比例稳定到让他怀疑「是不是有人在往某个方向调节它」,并说自己的贡献方式是确保给那些他觉得有意思的非 AI 帖投票。mh- 补了一条关于评论侧机制的内幕:HN 确实有针对评论的 LLM 检测会自动 flag,但有个不幸的副作用——在讨论一篇 LLM 撰写的、文本量大的帖子时,引用足够大的一段原文有时会触发它。
- 最后,caidan 写了一封长长的情书给 HN,被很多人认为是本帖最好的一条。他把「科技」比作一个小游泳池,我们小时候跳进去、试图溅那些站在池外一脸困惑的家伙;随着我们互相泼水、按头、喷射,一种令人激动、永不停歇的狂热在我们内心积聚,于是我们泼得更用力,掀起拍打世界的巨浪,震得它注意到我们;随着更多人跳进来(或被推进来),浪潮席卷全世界,啃食整个社会的地基,曾经坚实的陆地崩塌进贪婪的水里,把它们无助的居民倾入漩涡。「而在那狂暴的全流之中,也许不完全在中心、但也离中心不远,有一个小小的、遮蔽着的泳池边酒吧,它橙色的招牌上依然欢快地显示着 Y Combinator 的那个 Y」。他说这个小酒吧最惊人的地方是绝对的稳定性,并贴了 2007 年 2 月 21 日的第一份存档快照:「看着眼熟吗?看到 pg 的帖子已经被挤下第一名了吗?」他的结尾是:「有时你能和那些掀起吞噬大地的巨浪的人聊天,有时你只是聊聊 JS 工具链有什么新东西。如果那天你特别幸运,你会发现自己被某个眼里闪着胜利狂光的黑客迷住,他正极其详尽地讲述自己对某个完全无意义的私人项目的偏执追求,而你不会觉得其中有一秒钟是浪费的。哪怕在你的临终病榻上。哪怕和多陪伴你所爱之人相比。」