集智俱乐部 昨天
拯救2050:打造行星级预测系统,让人类看见未来
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

导语

人类文明正在同时逼近三条轨道的极限:AI能力奇点、城市经济奇点和地球系统临界点。它们不是同一件事,却通过能量、物质和GDP的共同流动被耦合在一起,可能在同一个历史窗口内叠加。面对这种耦合危机,我们在论文中提出了"Save 2050"计划:一个行星尺度的分布式集体预测系统,把人类和AI关于未来的判断汇聚起来,通过大规模模拟,生成可查询、可检视、可修正的"预测世界"。这篇文章将解释它为什么要被建造,它打算怎样运作,凭什么认为现在能做,以及它可能带来哪些我们必须提前面对的风险。

关键词:奇点危机、集体预测、预测聚合、长时间裁决、反身性治理、自稳态觉醒、未来引擎

张倩丨作者

张江丨审校

https://arxiv.org/pdf/2608.28703

一、预测这件事,正在变得不一样

我在集智俱乐部做科学传播这些年,接触过很多不同学科的研究者。有做气候模型的,有做城市缩放的,有做复杂网络的,也有做AI安全的。每个人都在自己的领域里做预测,对接下来几年、十几年甚至几十年的走向有自己的判断。但这些判断几乎从不交汇。做气候的人不知道AI领域下一步的技术路线可能怎样改变全球能源消耗,做AI的人也不太关心城市经济的超指数增长意味着什么样的热力学后果。

过去几年,我越来越强烈地感觉到一件事:单个领域的预测再精确,也只是拼图的一小块。真正危险的不是某一条轨道失控,而是好几条轨道在同一个时间窗口里同时逼近极限,并且它们之间是耦合的。你不能只看其中一条,因为它们会互相加速。

与此同时,AI预测在过去两三年发生了一件大事。到2026年,据Metaculus报道,AI预测系统在公开的前瞻性锦标赛中已经稳定超越普通公众,和活跃的人类预测者基本持平,并且在继续逼近顶级专业团队的水平。更关键的是,做一条高质量预测的成本已经降到了大约一美元。预测正在从一种昂贵的专家特权,变成一种廉价的、可以大规模生产的能力。

这两件事放在一起,自然会引出一个问题:如果预测变得便宜了,而我们面临的又是一个耦合的、跨领域的危机,有没有可能建一个系统,把分散在不同人、不同机构、不同AI模型里的预测汇聚起来,让人类第一次系统性地"看见"未来?

这就是我们这篇论文想要回答的问题。我们把这个计划叫做Save 2050。

二、奇点危机——三条轨道同时逼近极限

要理解Save 2050为什么被提出,首先需要理解它试图应对的是什么。论文用了一个概念来概括当前的处境,叫"奇点危机"。这不是一个比喻,而是可以用规模法则理论和动力学模型定量讨论的现象。

第一条轨道是AI能力奇点。从I. J. Good 1965年的"超级智能"设想算起,人们讨论这件事已经六十年了。核心逻辑是:如果一个系统足够聪明,它可以设计出比自己更聪明的系统,而那个更聪明的系统又能设计出更更聪明的系统,由此产生能力的正反馈增长。到2026年,大模型在通用推理、代码生成、科学发现等方面的进展速度,让这个假设不再只是哲学讨论。

第二条轨道是城市经济奇点。这个概念来自Bettencourt、West等人的城市规模法则研究。他们发现,大量社会经济和创新指标与城市人口之间存在超线性的标度关系:Y(N) ∝ Nβ,其中β大于1。翻译成动力学语言,就是城市越大,创新和经济活动越快,增长本身变成超指数的,在数学上会逼近一个有限时间内的奇点。技术革命可以推迟这个奇点,打开一段新的增长区间,但如果革命之间的间隔不断缩短,推迟就不等于解决。

第三条轨道是地球系统临界点。气候科学已经识别出若干可能发生突变的"翻转元件":格陵兰冰盖、亚马逊雨林、大西洋经向翻转环流等。一旦某个元件被推过临界点,变化可能是非线性的、突然的,而且不可逆。

这三条轨道是不同的现象,但论文强调的关键在于它们之间的耦合。GDP增长依赖能源和物质吞吐量,能量转换伴随耗散和熵产生。AI的训练和运行有已经被记录在案的碳足迹和能源成本,而按照能量消耗的层级金字塔结构,尖端技术的发展会间接驱动底层的乘数级能源消耗。技术既是GDP增长的输入又是它的产出,因此AI能力奇点和城市经济奇点有可能(虽然尚未被严格证明)在同一个历史窗口中出现。而它们共同推高的能源需求和熵产生,又加速了地球系统向临界点的逼近。

论文的用词很谨慎:这是耦合,不是等同。三条轨道通过能力、GDP、能量和物质的共同流动被同步起来,但不能被归约为同一件事。它们各有各的机制,各有各的不确定性,也各有各的时间尺度。但耦合本身就足够危险了:即使每条轨道单独看似乎还有缓冲空间,叠加以后的窗口可能比任何一条单独的轨道都要窄。

三、文明面对的两条路

面对这种耦合危机,人类文明有什么选项?

Wong和Bartlett在2022年提出过一个叫"渐近燃尽假说"的框架,给出了两条路径。

第一条是星际迁移。逻辑很直接:如果地球上的资源和空间不够用了,就向外扩张,获取更多的能源和物质基数。这是很多科幻小说和技术乐观主义者默认的方案。但论文指出,这条路可能极其狭窄。星际扩张需要的能源本身就是天文数字级别的,工程难度远超当前能力,而且废热和其他热力学约束可能比扩张的速度积累得更快。把太空殖民当作一般性解决方案,在物理上可能行不通。

第二条路是论文真正关注的:自自稳态觉醒(Homeostatic awakening)。

这个词听起来有点抽象。它的意思是:文明不再沿着一条无限加速的物质增长轨道前进,而是转变为一个能够维持自身长期存续条件的系统。不是停止发展,而是让发展从"越来越快地消耗"变成"能够自我调节地持续"。

自自稳态觉醒有两条思想根源。

一条来自"盖亚假说"(Gaia Hypothesis)。它把地球看作一个耦合系统,生物、大气、地质和气候过程之间可以产生稳定化的反馈。最近的研究从动力学行星过程、盖亚签名、生态韧性和主动推理等角度发展了这个直觉。

另一条来自"全球脑"(Global Brain)概念。它从信息的角度切入:人类、机构、通信网络和机器可以被组织为一个在行星尺度上感知、学习和协调的分布式认知系统。

把这两条根源合在一起,论文得出一个结论:自稳态觉醒需要的不只是个体价值观的转变,它需要一个全球性的自我调节和自我管理系统。更强的说法是:它需要一个行星尺度的"自指系统"(Self-referential)。这个系统能构建关于地球和人类社会的模型,用这个模型预测可能的未来,再把预测的结果反馈回集体调节中去。

Save 2050正是朝这个方向迈出的一步。它不是在说"我们来预言2050年会发生什么",而是在说"我们来建一个系统,让关于未来的判断可以被汇聚、被检视、被修正,让人类第一次拥有一个集体性的前瞻能力"。

四、Save 2050平台如何运作

Save 2050被设计为一个分布式计算平台,包含四个相互关联的功能。分布式是核心设计要求:预测、证据、计算和评估不需要集中在一台服务器、一个机构、一个模型或一个地理位置上。

第一个功能是预测聚合

它从一个开放注册机制开始。任何个人、机构、研究团队、公司、公共机构或AI代理,都可以注册一条预测。注册记录下预测的内容(用机器可读的形式)、时间范围、空间尺度、变量、概率或不确定性区间、条件、来源、作者或模型身份,以及它依赖的资源和证据。

注册不是简单的存档。它把一条预测变成分布式预测网络中的一个活跃节点。后续的预测可以引用它,以它为条件,修正它,反驳它,或者把它作为输入。系统显式地保留这些关系,而不是把所有预测当作独立的投票。

不同学科和系统的预测由此可以被编织在一起。一条关于能源政策的预测可能影响关于排放、价格、迁移、气候风险和政治响应的预测;那些预测又可能反过来改变原始预测的假设。聚合层把这些跨领域的依赖关系表示为一个有向的、版本化的网络,同时区分统计相关、信息影响和因果假设。

然后系统做三件事。首先,AI工具把异质的提交标准化为带有明确日期、地点、指标、不确定性范围和条件假设的命题。其次,一组分布式的聚合和模拟服务把已注册的预测耦合起来,让跨领域的后果变得可见。第三,平台产出多条连贯的轨迹,而不是把所有输入压缩成一个点估计。目标是尽可能准确、详细、有条件信息含量的预测,同时保留替代场景,识别每个场景成立的假设,并暴露不同来源的贡献和可靠性。

第二个功能是预测查询

一旦注册、聚合和模拟层就位,Save 2050的用法就类似于今天的搜索引擎。搜索引擎检索和组织关于已经发生的事的信息;Save 2050检索和组织关于可能发生的事的结构化预期。用户可以指定一个未来的时间和地点,提出一个具体问题,比如:"2050年7月5日傍晚,北京的天气和晚高峰交通会怎样?"平台会返回从已注册预测及其聚合中计算出的最可能的未来,连同概率范围、因果假设、来源和替代场景。

查询支持两种模式。第一种问的是平台当前最有依据的未来。答案是对分布式预测场的检索和综合:系统权衡已注册预测,考虑它们的依赖关系,纳入观测和模型输出,报告它的中心投射和围绕它的不确定性或分歧。

第二种模式允许查询者设想一个场景,请求系统据此构建一个可能的未来。比如,查询者可以指定一次快速的新能源技术转型、一场严重的地缘政治冲突,或者一个特定的城市规划决策。系统利用已注册预测、历史知识、领域模型和生成模型,在这些前提下生成一条连贯的轨迹。这是场景构建模式,不是在声称生成的未来是最可能的那个。

论文称之为"未来引擎"(Future Engine)。就像搜索引擎聚合了人类已经有的信息,未来引擎聚合人类关于未来的想象和判断,可搜索、可质询、可演化。

第三个功能是反馈与长时间裁决

这是平台的生命线。一条无法判定正误的预测,既不能激励预测者,也不能为聚合提供反馈信号。

反馈分两条轨道。第一条是事实锚定的奖励机制。随着时间推移,某些预测可以直接验证:天气观测、能源产量、经济指标、基础设施变化、特定公共事件是否发生。互联网可以充当初始的全球事实聚合器,新闻报道、官方发布、科学观测、传感器数据、公共记录等在线来源被自动收集,独立来源交叉核验以降低对单一报道的依赖。预测被验证后,系统可以通过金钱、声誉、访问权限或其他形式的认可来奖励其注册来源。

第二条轨道是长时间自动化裁决。这才是真正的难题。关于2050年的预测不能等到2050年才出结果。等了二十多年以后才兑现的激励,经过时间贴现,基本等于零。同时,有些预测涉及的是潜在的或反事实的状态,根本不会有单一的直接事实来提供完整的真相验证。

论文从期货市场借来了解决思路。期货之所以能维持"关于遥远未来的承诺",靠的是三套制度:标准化合约、保证金加逐日盯市、头寸可自由转让。映射到预测平台上,这三套制度构成了长时间裁决的骨架。

第一,预测的自动形式化,对应合约标准化。大语言模型可以把模糊的自然语言预测转化为可裁决的命题,带有明确的日期、指标和裁决来源。

第二,周期性临时评分,对应保证金与逐日盯市。平台必须周期性地给长时间预测打分,用阶段性的代理指标和"未来预测者的共识"(同行预测)作为最终真相的临时替代品,把一个遥不可及的终端裁决转化为连续的、可预期的临时裁决过程。

第三,预测头寸可转让,对应期货头寸的自由转让。当预测及其关联权益(代币、声誉、合约)可以自由交易时,预测者不需要"持有到2050年",随时可以退出并实现价值。

但论文也指出了一个根本性的区别:期货到期时有现货价格作为终极锚,套利提供最后的纠偏力量;而关于2050年的预测在中间阶段没有这样的锚,价格可能被噪声和情绪主导。市场制度本身不够,还需要同行预测机制作为"人工锚",在客观真相缺席时基于预测之间的关系来评分和激励(比如贝叶斯真相血清)。市场制度加人工锚的组合,可能是长时间裁决的现实方案。

第四个功能是预测重启

一个预测平台不能初始化一次就永远运行下去。随着时间推移,新的观测到达,事件被解决,制度变迁,某些假设过时。有些预测被自动验证,有些被证伪或变得无关,有些仍未解决但获得了新的证据。因此,预测的未来状态和整个已注册预测群体都可能发生变化。

重启从收集和验证新事实开始。已解决的预测带着验证记录和评分结果被关闭。被推翻、被取代或不再有意义的预测从活跃集合中退出。未解决的预测在其条件、变量或证据发生变化时被修订。参与者和AI代理可以针对更新后的状态注册新的预测。聚合层重新计算依赖关系、可靠性、场景和未来轨迹。每次重启生成一个版本化快照,让研究者可以比较平台在不同时间点的信念,追溯一条预测为什么变了,区分真正的改进与假设变动带来的变化。

预测重启是时间维度上的分布式计算。网络在注册、传播、观测、验证和重建之间持续交替。结果不是一个固定的预言,而是一个活的、有版本的、被集体维护的可能未来的模型。

五、现在是否能做?

论文从四个维度论证可行性

第一个维度是AI预测的成熟。论文提出过一个判断:"AI已经从大数据时代走到大模型时代,下一阶段将是大预测。"

在通用预测方面,有效预测系统的"配方"已经清楚了:前沿推理模型、迭代代理搜索、多模型集成、事后校准。在领域预测方面,"每个领域都会有自己的基础模型"这个愿景最先在气象学得到验证:机器学习天气模型在中期全球预报精度上已经超过传统的数值天气预测,推理成本几乎可以忽略。同时,LLM驱动的世界模拟器和基于代理的社会模拟,首次让"把社会系统放进模拟器"成为可能。

当然,大多数复杂现实问题的困难不在于任何单一领域,而在于系统之间的交互和耦合。提升复杂系统的预测需要跨领域、跨尺度地融合预测。如果所有预测都被翻译成语言,大语言模型本身就提供了一个可行的融合接口。不过实践表明,真正的瓶颈已经从"融合"转向"裁决":如何把模糊的自然语言预测形式化,并自动判定它们的最终正确性。

第二个维度是人类集体智能和制度环境的成熟。人类群体预测的有效性早已被证明。在大型预测锦标赛中,经过选拔和训练的普通预测者团队以显著优势击败了专家和情报分析师。而更重要的是制度环境的加速成熟。2024年以来,事件合约市场进入主流:Kalshi等平台作为在美国商品期货交易委员会注册的指定合约市场运营,月度预测市场交易量已达数百亿美元级别,监管机构开始制定专门规则。群体预测及其激励机制第一次拥有了合规的、可扩展的制度通道。

第三个维度是相关领域的支撑进展。在行星尺度上,以欧盟Destination Earth为代表的数字孪生计划,正在把集成预报和数据同化的范式扩展到整个物理地球。这恰好是论文所倡导的"基于模拟的预测聚合"的成熟原型:数十条轨迹并行演化形成对未来的概率分布,观测数据周期性地将分布收缩到已实现的状态。完整的"叠加、坍缩、再演化"循环在气象学中已经运作了几十年。

第四个维度是社会需求。从易经占卜到数学模型到人工智能,预测一直是人类关注的核心问题。传统预测的根本困境在于碎片化:不同人和机构做的预测从不交汇,因此预测从未突破规模和精度的限制。正如成功预测几只股票就能产生巨大回报,成功预测会创造巨大价值;一个预测聚合平台因此注定会出现。它和搜索引擎有深刻的相似性:搜索引擎聚合了人类已有的信息,预测聚合平台将聚合人类关于未来的判断,形成一个庞大的未来"事实"数据库,每个用户都可以像今天使用搜索引擎一样查询它。AI预测成本的数量级下降,让这个引擎在商业上第一次变得可持续。

六、长时间裁决:

怎样评判关于2050年的预测

三项关键技术中,论文把长时间自动化裁决排在第一优先级。道理很简单:裁决是预测平台的命脉。如果一条预测的正确性无法被判定,它既不能激励预测者,也不能为聚合提供反馈信号。

传统预测市场和众包平台只能裁决短期的、可数字化的事件。"明天会不会下雨""下届总统是谁"这类问题有明确的裁决时间和裁决标准。但Save 2050面对的预测完全不同:它们大多以自然语言表达,时间跨度长达几十年,指称模糊(比如"2050年的全球秩序"),远远超出现有平台的裁决能力。

论文从期货市场找到了制度模板。Robin Hanson三十年前就系统阐述过把期货机制引入"观念市场"和预测的想法,称之为"观念期货"。期货之所以能维持对遥远未来的承诺,靠的是三个制度支柱。

第一个支柱是合约标准化。映射到预测领域,就是预测的自动形式化。大语言模型可以把"全球秩序会大变"这类模糊表述转化成带有明确日期、指标和裁决来源的可裁决命题。这是所有裁决的前提。

第二个支柱是保证金加逐日盯市。映射过来,就是周期性临时评分。一条关于2050年的预测如果要等到2050年才能结算,经过时间贴现,激励几乎为零。期货交易者也不等到交割日,而是每天按市场价格结算盈亏。类似地,平台必须周期性地给长时间预测打分。

用什么打分?论文给出的方案是双轨的。一轨是阶段性代理指标:如果你预测的是2050年的海平面,那么2030年、2035年、2040年的观测数据可以作为中间锚点。另一轨是同行预测,也就是"未来预测者的共识":基于其他预测者的判断来评分。

第三个支柱是头寸可自由转让。当预测及其关联权益可以自由交易时,预测者不需要持有二十年才能获得回报,随时可以退出。这在制度上绕开了时间贴现的死局。

但论文没有回避一个根本性的困难。期货到期时,期货价格会向现货价格收敛,套利提供终极纠偏力量。但关于2050年的预测在中间阶段没有现货价格这样的锚。经典的"噪声交易者风险"文献早就证明,对于缺乏中间锚点的长期资产,套利无法纠偏,价格可能被噪声和情绪主导。

市场制度因此不够。还需要同行预测机制充当"人工锚"。这类机制(比如贝叶斯真相血清)的原理是:即使客观真相缺席,也可以根据预测之间的信息关系来评分和激励诚实报告。在工程实践中,UMA的Long Short Pair等合约模板已经允许在任意指标上构建期货式合成资产,由乐观预言机裁决。在监管层面,预测市场和期货的融合在美国已经开始。

市场制度加人工锚的组合,可能是长时间裁决的现实解法。

七、基于模拟的预测聚合:

预测作为"波函数"

如果裁决回答的是"对不对"的问题,聚合回答的就是"合在一起能看见什么"的问题。论文所设想的聚合,远比加权平均、极端化修正、市场聚合或集成学习激进得多:它是通过大规模模拟来聚合。

这个想法的骨架是这样的。首先,需要一个大规模的(可能是行星级的)模拟平台。任何一条预测都可以被放进这个平台,和其他事件、其他预测耦合起来,构建完整的未来场景。在这个意义上,每条预测像一个"波函数":不是对未来的断言,而是关于未来世界可能状态的一个分布。随着预测不断积累,它们相互"叠加",耦合和约束彼此,编织出一幅日益完整的未来图景。聚合器的任务是把这些叠加的可能性"坍缩"为一个或多个"预测现实":具体的、连贯的、可检视的未来世界。当时间推进到预测时刻,实际观测进入系统作为反馈,修正聚合器的模拟。这是一次"测量"对波函数的坍缩。之后系统从修正后的状态再次向前演化,生成新的关于未来的"波函数"。

这不只是比喻。数值天气预测中的集成预报正是这样运作的。数十条轨迹从略有不同的初始条件出发并行演化,形成对未来大气状态的概率分布。当观测到达时,数据同化把分布收缩向真实状态,集成再向前演化。完整的"叠加、坍缩、再演化"循环在气象学已经运作了几十年。近年来,数字孪生计划把这个范式扩展到了整个物理地球。LLM驱动的世界模拟器和基于代理的社会模拟,则首次让把社会系统放进模拟器成为可能。"世界模拟"的产品概念也开始在工业界出现。基于模拟的聚合,恰好站在几条技术曲线的交汇点上。

但论文也指出了三个必须克服的困难。

第一是社会系统的模拟保真度。物理系统服从方程,社会系统由具有反身性的人组成,模拟误差会随时间放大。

第二是模拟器本身的验证。一个错误的模拟器会自信地把未来坍缩到错误的现实上,这比一条错误的预测危险一个数量级。因此模拟器必须和预测者一样被纳入裁决和验证循环。

第三是输入接口。一条自然语言预测怎样被翻译成模拟器内部的一组扰动或约束?这恰好是大语言模型作为"翻译层"的用武之地。

八、反身性治理:谁来代表行星意志

论文首先澄清:Save 2050的首要意图是预测本身,忠实聚合人类关于未来的判断,而不是干预未来。但它必须面对一个内生于自身成功的可能性。

一旦行星尺度的预测成为现实,公众对平台的预测给予深度信任,预测就不再只是描述。它会塑造当下的行动,从而重塑未来,最终可能演化为自我实现的预言。换句话说,平台越成功,反身性就越不可避免。而反身性是双刃剑:预测改变了被预测的对象(索罗斯的反身性),当一个度量变成了目标,它就不再是好的度量(Goodhart定律)。当预测开始引导人类走向一个"被预测的未来",就必须问:谁在引导?

论文的回答是:真正有力的节点,不是可见的个人、组织、机器或大模型,而是弥散在全球系统中的集体智能。就像一个脑波不属于任何一个神经元,却忠实反映了整个大脑的状态,行星集体意识不属于任何人或机构,却应当是未来方向的最终裁定者。今天世界陷入危机,恰恰是因为可见的节点(政治机构、商业组织、个人精英)截获和篡夺了这种不可见的"公意"。

治理因此与前面说的聚合器汇合在一起:那个把无数预测叠加起来、坍缩为"预测现实"的模拟平台,恰好就是集体意识的"表征器官"。它让一种不属于任何人的行星意志第一次变得可见、可讨论、可问责。治理的对象不是"谁在平台上说了什么",而是"平台是否忠实地呈现了整体的涌现模式"。

但论文随即标记了一个古老而危险的陷阱。

自卢梭提出"公意"以来,"一种属于整体但不属于任何个人的意志"一直是人类政治中最崇高的概念,也最容易被篡夺:谁控制了表征公意的器官,谁就可以声称自己体现了公意。这是人类政治史上反复出现的剧本。

因此,表征器官绝不能被任何单一节点拥有。论文给出了几条底线:它必须是去中心化的协议而非公司资产;必须允许多个竞争性的表征者共存;必须端到端可审计、可挑战、可分叉;甚至可以探索"未来主义民主"式的方案,让平台本身由预测市场来治理。否则,"行星意志"就会变成垄断的完美借口。

九、风险:预言如何不变成陷阱

论文用了整整一节分析风险,分为五类。论文强调,这些风险大多不是外部威胁,而是内生于计划自身的成功。风险分析因此不是对计划的反驳,而是设计约束的一部分。

第一类是反身性风险。有两种失败模式。一种是悲观的自我实现:如果"预测世界"呈现一个不乐观的未来并被广泛信任,可能触发恐慌、短视的资源争夺或集体放弃,反而实现了那个悲观的未来。"如果失败是注定的,努力又有什么意义",这种心态本身就能把预测变成现实。另一种是自我挫败与扭曲:当预测被当作目标或政策输入,被预测的对象据此改变行为,推翻了原始预测(Goodhart定律),而一旦预测反复"失败",平台的信任资本迅速耗尽。缓解措施包括:把预测表述为条件概率("如果不采取行动,则……")而不是宿命论断言;并排呈现多个场景而非单一的"预测现实";通过治理机制约束反身性效应的方向。

第二类是认知单一化和系统性偏差。当平台上的预测者大量依赖同源AI模型和同源数据时,它们的误差是相关的。经典聚合依赖的独立性假设失效了,聚合不是在消除盲点,而是在放大盲点。更糟糕的是,如果"预测现实"由少数模拟器生成,模拟器的结构性偏差就被制度化了,并以"客观未来"的面目输出。缓解措施包括:在激励机制中明确奖励低相关性的预测者;要求多个独立的、竞争的模拟器;让模拟器本身也进入裁决和验证循环。

第三类是操纵与叙事俘获。一个被广泛信任的预测平台本身就是操纵的动机。大资本可以扭曲市场价格和"共识",修辞策略可以操纵自然语言裁决,而"表征器官"的运营者可能声称代表行星意志。这就是前面说的"篡夺公意"的陷阱。缓解措施包括:协议化和去中心化以避免单一实体控制;操纵检测和异常交易审计;在裁决中保留人类申诉和审查通道;保障社区的"分叉权",如果表征不再忠实,参与者可以带着数据和规则离开。

第四类是制度和监管风险。预测市场在大多数司法管辖区仍面临被归类为"赌博"的风险,跨境参与带来复杂的法律冲突。即使在已经合法化的市场中,也出现了向体育博彩漂移的迹象,用成瘾性交易替代了信息聚合。面向2050年的长期合约如果设计不当,还可能触碰非法集资和证券监管的红线。缓解措施包括:在现有监管框架内(比如事件合约的期货监管通道)做合规优先的设计;探索非货币激励(声誉、荣誉)来部分替代现金结算;和监管机构共同建设"沙盒"试验空间。

第五类是社会和伦理风险。这是最深层的风险。如果平台的参与者结构系统性偏斜(按地域、语言、阶层或数字鸿沟),所谓的"行星意志"就只是特权群体的意志披上了整体的外衣。不同文化对"好的2050年"的想象是不同的,一个单一的"预测世界"可能变成未来叙事的霸权。行星级预测所需要的海量数据也涉及隐私和数据权利。缓解措施包括:用多元价值和多场景表征取代单一的聚合指标;通过低门槛的参与和抗女巫攻击的身份验证确保广泛而真实的参与;在数据层建立数据最小化和用途限制规范。

十、路线图与开放问题

论文建议分三个阶段推进。

近期(1到5年):在一到两个垂直领域(比如气候相关事件、技术趋势)建设预测平台原型,重点攻克自然语言预测的自动形式化和裁决,验证开放众包和激励机制。

中期(5到15年):建设跨领域的基于模拟的聚合器,把已裁决的预测注入模拟平台,提供"未来引擎"查询服务,在合规框架内运营长时间预测合约。

远期(15年以上):把参与扩展到行星级别,完成反身性治理机制,让2050年的"预测世界"成为一个持续演化的公共审视对象,探索集体意识表征的制度化形式。

论文也坦诚地列出了几个尚未解决的理论和工程问题。

第一,基于模拟的聚合的严格理论。如何在数学上定义预测作为"可能性分布"在耦合系统中的叠加和坍缩,特别是跨领域联合分布的融合。

第二,长时间激励的极限。在时间贴现和锚点缺失的条件下,可实现的诚实激励的边界在哪里。

第三,集体意识的度量。如何检测和度量"整体的涌现模式",以便检验表征器官的保真度。

第四,可验证的治理。如何让"表征是否忠实"成为一个可公开核验的问题,而不引入中心化权威。

这些问题都还没有答案。但Save 2050的论文至少把它们以可讨论的工程形式提了出来。

论文的结尾用了一个比喻:一个在暗夜森林中疾驰的文明,需要的不是更快的速度,而是看见前方道路的能力。Save 2050的首要目标是预测,忠实聚合人类关于未来的判断。但它清楚地预见到,当预测足够准确、足够被信任时,预测可能超越描述,变成预言。这个计划最终是"拯救"2050还是"绑架"2050,取决于那个呈现未来的器官是属于所有人的,还是只属于它的建造者。

让未来变得可见、可讨论、可共同书写。这是一个技术问题,一个文明问题,也是未来二十年的必答题。

参考文献

[1] David L. Armstrong McKay, Arie Staal, Jesse F. Abrams, Ricarda Winkelmann, Boris Sakschewski, Sina

Loriani, Ingo Fetzer, Sarah E. Cornell, Johan Rockström, and Hans Joachim Schellnhuber. Exceeding 1.5

degrees c global warming could trigger multiple climate tipping points. Science, 377(6611):eabn7950, 2022.

doi:10.1126/science.abn7950.

[2] Kenneth J. Arrow, Robert Forsythe, Michael Gorham, et al. The promise of prediction markets. Science, 320

(5878):877–878, 2008.

[3] Amedeo Balbi and Manasvi Lingam. Waste heat and habitability: Constraints from technological energy

consumption. Astrobiology, 25(1):1–21, 2025. doi:10.1089/ast.2024.0082.

13Save 2050 A PREPRINT

[4] Peter Bauer, Bjorn Stevens, and Wilco Hazeleger. A digital twin of earth for the green transition. Nature Climate

Change, 11:80–83, 2021.

[5] Luís M. A. Bettencourt and Geoffrey B. West. A unified theory of urban living. Scientific American, 2010.

Overview of urban scaling and finite-time singularities.

[6] Luís M. A. Bettencourt, José Lobo, Dirk Helbing, Christian Kühnert, and Geoffrey B. West. Growth, innovation,

scaling, and the pace of life in cities. Proceedings of the National Academy of Sciences, 104(17):7301–7306, 2007.

doi:10.1073/pnas.0610172104.

[7] Sébastien Bubeck, Varun Chandrasekaran, Ronen Eldan, et al. Sparks of artificial general intelligence: Early

experiments with gpt-4. arXiv preprint arXiv:2303.12712, 2023. doi:10.48550/arXiv.2303.12712.

[8] David J. Chalmers. The singularity: A philosophical analysis. Journal of Consciousness Studies, 17:7–65, 2010.

[9] Congressional Research Service. Prediction markets: Policy issues for congress. Technical Report IF13187,

Congressional Research Service, 2025.

[10] J. Bradford De Long, Andrei Shleifer, Lawrence H. Summers, and Robert J. Waldmann. Noise trader risk in

financial markets. Journal of Political Economy, 98(4):703–738, 1990.

[11] Payal Dhar. The carbon impact of artificial intelligence. Nature Machine Intelligence, 2:423–425, 2020.

doi:10.1038/s42256-020-0219-9.

[12] Irving John Good. Speculations concerning the first ultraintelligent machine. In Advances in Computers, volume 6,

pages 31–88. Academic Press, 1965.

[13] Charles A. E. Goodhart. Problems of monetary management: The u.k. experience. Papers in Monetary Economics,

1, 1975. Reserve Bank of Australia.

[14] Robin Hanson. Could gambling save science? encouraging an honest consensus. Social Epistemology, 9(1):3–33,

1995.

[15] Robin Hanson. Shall we vote on values, but bet on beliefs? Journal of Political Philosophy, 21(2):151–178, 2013.

[16] Francis Heylighen. Conceptions of a global brain: An historical review. Evolution: Cosmic, Biological, and

Social, 2011.

[17] International Energy Agency. Energy and ai. Technical report, IEA, Paris, 2025. URL https://www.iea.org/

reports/energy-and-ai.

[18] Chris J. Jackson and Christian Criado-Perez. Why the fermi paradox may not be well explained by wong

and bartlett’s theory of civilization collapse. Journal of the Royal Society Interface, 21:20240140, 2024.

doi:10.1098/rsif.2024.0140.

[19] Eugenia Kalnay. Atmospheric Modeling, Data Assimilation and Predictability. Cambridge University Press, 2003.

[20] KPMG. Prediction markets: Paths to entry. Technical report, KPMG International, 2026.

[21] Rémi Lam, Adrián Sanchez-Gonzalez, Matthew Willson, et al. Learning skillful medium-range global weather

forecasting. Science, 382(6677):1416–1421, 2023. doi:10.1126/science.adi2336.

[22] Timothy M. Lenton, Johan Rockström, Owen Gaffney, Stefan Rahmstorf, Katherine Richardson, Will Steffen,

and Hans Joachim Schellnhuber. Climate tipping points—too risky to bet against. Nature, 575:592–595, 2019.

doi:10.1038/s41586-019-18812-7.

[23] Donella H. Meadows, Dennis L. Meadows, Jorgen Randers, and William W. Behrens. The Limits to Growth.

Universe Books, 1972.

[24] Metaculus. Ai forecasting in 2026: What 11 analyses say. Metaculus Research, 2026. URL https://www.

metaculus.com/notebooks/43363/ai-forecasting-in-2026/.

[25] Nolan Miller, Paul Resnick, and Richard Zeckhauser. Eliciting informative feedback: The peer-prediction method.

Management Science, 51(9):1359–1373, 2005.

[26] David R. Montgomery and Joana Hipólito. Resurrecting gaia: Harnessing the free energy principle to preserve

life as we know it. Frontiers in Psychology, 14:1206963, 2023. doi:10.3389/fpsyg.2023.1206963.

[27] Howard T. Odum. Self-organization, transformity, and information. Science, 242(4882):1132–1139, 1988.

doi:10.1126/science.242.4882.1132.

[28] OpenAI. Ai and compute. OpenAI Research, 2018. URL https://openai.com/research/ai-and-compute.

[29] Joon Sung Park, Joseph C. O’Brien, Carrie J. Cai, Meredith Ringel Morris, Percy Liang, and Michael S. Bernstein.

Generative agents: Interactive simulacra of human behavior. In Proceedings of the 36th Annual ACM Symposium

on User Interface Software and Technology, 2023.

14Save 2050 A PREPRINT

[30] Drazen Prelec. A bayesian truth serum for subjective data. Science, 306(5695):462–466, 2004.

[31] Ilan Price, Adrián Sanchez-Gonzalez, Ferran Alet, et al. Probabilistic weather forecasting with machine learning.

Nature, 637:84–90, 2024.

[32] Jean-Jacques Rousseau. Du contrat social. Marc Michel Rey, 1762.

[33] Ville A. Satopää, Jonathan Baron, Dean P. Foster, Barbara A. Mellers, Philip E. Tetlock, and Lyle H. Ungar.

Combining multiple probability predictions using a simple logit model. International Journal of Forecasting, 30

(2):344–356, 2014.

[34] Ricard Solé and Simon Levin. Ecological complexity and the biosphere: The next 30 years. Philosophical

Transactions of the Royal Society B, 377:20210376, 2022. doi:10.1098/rstb.2021.0376.

[35] George Soros. The Alchemy of Finance: Reading the Mind of the Market. John Wiley and Sons, 1987.

[36] Emma Strubell, Ananya Ganesh, and Andrew McCallum. Energy and policy considerations for deep learning in

nlp. arXiv preprint arXiv:1906.02243, 2019. doi:10.48550/arXiv.1906.02243.

[37] Philip E. Tetlock and Dan Gardner. Superforecasting: The Art and Science of Prediction. Crown, 2015.

[38] UMA Protocol. Long short pair (lsp) contract. UMA official documentation, 2024. URL https://docs.

umaproject.org/.

[39] Paul Voosen. Europe is building a "digital twin" of earth to revolutionize climate fore-

casts. Science, October 2020. URL https://www.science.org/content/article/

europe-building-digital-twin-earth-revolutionize-climate-forecasts.

[40] Fei-Yue Wang, Xiao Wang, Lingxi Li, and Li Li. Steps toward parallel intelligence. IEEE/CAA Journal of

Automatica Sinica, 3(4):345–348, 2016.

[41] Fei-Yue Wang, Jun Jason Zhang, and Xiao Wang. Parallel intelligence: Toward lifelong and eternal developmental

ai and learning in cyber-physical-social spaces. Frontiers of Computer Science, 2018. doi:10.1007/s11704-018-

7903-5.

[42] Fei-Yue Wang, Rui Qin, Juanjuan Li, Yong Yuan, and Xiao Wang. Parallel societies: A computing perspective of

social digital twins and virtual–real interactions. IEEE Intelligent Systems, 2020.

[43] Geoffrey B. West. Scale: The Universal Laws of Life, Growth, and Death in Organisms, Cities, and Companies.

Penguin Press, New York, 2017.

[44] Justin Wolfers and Eric Zitzewitz. Prediction markets. Journal of Economic Perspectives, 18(2):107–126, 2004.

[45] Justin Wolfers and Eric Zitzewitz. Interpreting prediction market prices as probabilities. Technical Report 12200,

National Bureau of Economic Research, 2006.

[46] Michael L. Wong and Stuart Bartlett. Asymptotic burnout and homeostatic awakening: A possible solution to the

fermi paradox? Journal of the Royal Society Interface, 19(190):20220029, 2022. doi:10.1098/rsif.2022.0029.

[47] Michael L. Wong, Marissa Duckett, Emilia S. Hernandez, Vahab Rajaei, and Kayla J. Smith. The process we

call earth: Relationships between dynamic feedbacks and the search for gaiasignatures in a new paradigm of

earthlikeness. Perspectives of Earth and Space Science, 5:e2023CN000223, 2024. doi:10.1029/2023CN000223.

[48] Eliezer Yudkowsky. Levels of organization in general intelligence. In Ben Goertzel and Cassio Pennachin, editors,

Artificial General Intelligence. Springer, 2007.

[49] Eliezer Yudkowsky. Intelligence explosion microeconomics. Technical report, MIRI, 2013.

参考文献可上下滑动查看

未来学读书会

我们正处在一个多重临界点同时逼近的时代:气候系统的翻转风险、生成式人工智能对知识生产的重塑、地缘冲突的加剧、人口结构来到历史性拐点,以太空探索为代表的科幻叙事正在从想象走向现实。这些都在迫使我们重新思考"未来"意味着什么。面对未来,技术加速主义的乐观与末世论的悲观都不足以回应复杂的现实,所以如何认识未来尤其重要,它会直接影响我们当下的判断和行动。未来学读书会希望从历史、方法与案例出发,把人工智能、地球系统、量子计算、生态临界、科幻叙事点等议题放入同一个跨学科框架中讨论:什么可以预测,什么只能准备,什么必须想象。我们希望在阅读与对话中,学习识别系统相变的信号,比较不同可能路径,为尚未到来的世界塑造更稳健、更开放的行动空间。

为此,集智俱乐部联合南京师范大学新闻与传播学院副研究员崔浩川、塔夫茨大学博士后章彦博共同发起「拯救2025:未来学」读书会,组织对该主题感兴趣的研究者与探索者共同研读前沿文献、交流研究思路。读书会将于2026年9月6日起,每周日14:00-16:00线上开展,持续约10周,包含主讲分享与讨论交流,并提供会后视频回放,诚邀相关领域研究者及跨学科兴趣者参与。

详情请见:「拯救 2050:未来学」读书会启动

推荐阅读

1. 集智科学研究中心:自我反省是 AI 能否越来越聪明的关键

2. Google DeepMind:为何AI只能模拟意识,而无法具现意识

3. 混沌巡游:让机器人 AI 学会自主行动

4.AI"社会实验室":模拟大型社会互动的世界模型

5.arXiv:面向具身智能的世界模型综述

6. 9900分可兑换"涌现"文化衫,报名任意读书会送299积分!

7. 集智学园精品课程免费开放,解锁系统科学与 AI 新世界

8. 高考分数只是张入场券,你的科研冒险在这里启航!

9. 加入集智字幕组:成为复杂科学知识社区的"织网人"

点击"阅读原文",报名读书会

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai gdp 张江
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论