πFS——把你的数据存进圆周率 π 里的文件系统
文章摘要
πFS 是一个恶搞性质的概念文件系统。它声称不再把你的数据浪费在硬盘上,而是直接”存进” 圆周率 π 之中。其理论基础是一个尚未被证明的数学猜想——π 是一个”正规数”(normal number),即它无限不循环的数字序列里,包含了任何可能出现的有限数字组合。既然如此,那么世界上任何一个文件,其实都”已经”作为某段序列存在于 π 之中了。
它的工作原理是:使用 Bailey–Borwein–Plouffe 公式去 π 里定位每一个字节的位置,本地只保存这些位置元数据,而不存储真正的数据内容。基于这个思路,πFS 自豪地宣称实现了”100% 压缩率”。
README 通篇技术解释夹杂着冷幽默:
- 由于文件本来就存在于 π 中(无论是否有人创建过它),还顺带”解决”了版权问题。
- 性能确实糟糕(存一个 400 行的文本文件要花五分钟),但作者乐观地把希望寄托在摩尔定律上。
- 未来路线图包括”基于云的 π 查询服务”以及”面向 Hadoop 的 πFS”。
本质上这是一个关于数据存储效率的玩笑,是对计算荒诞性的巧妙调侃,而非一个实用工具。
HN 评论精华
jamwise(951 赞)把 πFS 比作试图对”巴别图书馆”进行压缩:你用来表示数据地址所需的信息量,基本上和数据本身一样大。他借此引出信息论话题,并指出 LLM 代表了一种”真正有效”的有损压缩。
ainch 提出”科学即压缩”的观点:科学定律本身就是一种极致压缩,牛顿力学用极简的公式解释了海量现象——尽管他也承认这种类比有所简化。
ithkuil 分享了 3Blue1Brown 的视频,探讨”压缩与智能”之间的联系。
dang(版主)给出了历史背景,附上了多个可追溯到 2013 年的 πFS 旧帖链接,并说明在合适的时间间隔后重新提交是允许的。
讨论中反复出现的核心共识是:要在 π 里存储某段数据的”地址”,所需空间比原始数据本身还要大,因此这套方案从信息论上根本不可行——这恰恰也是这个玩笑的精髓所在。多位评论者还联想到博尔赫斯的《巴别图书馆》等”无限包含一切”的思想实验。