过去一年,旧金山科技圈的谈资从百亿级算力集群直接跳到了万亿级。每过六个月,会议室白板上就多加一个零。美国大公司正在疯抢本十年内剩余的所有电力合同,抢购每一台能买到的变压器。从宾夕法尼亚的页岩气田到内华达的太阳能农场,数以亿计的GPU即将同时轰鸣。美国工业机器正在以半个世纪未见的规模重新启动,这感觉不像科技泡沫,更像战时动员的前夜。
AGI竞赛已经开跑。我们正在建造能思考、能推理的机器。到2025或2026年,这些机器会超过大多数大学毕业生。到本十年末,它们会比你我更聪明,我们将拥有真正意义上的超级智能。但大多数人对此毫无感知。英伟达的分析师还在琢磨2024年是不是已经到顶了,主流评论员还在重复“不过是预测下一个词”这种自欺欺人的话。真正有“态势感知”的人,全世界大概只有几百个,多数在旧金山和AI实验室里。
这些人几年前还被当成疯子,但他们信的是趋势线,而那些趋势线过去几年的预测全对了。接下来几年他们会不会继续对,没人敢打包票。但他们是我见过最聪明的一群人,而且他们正在亲手建造这项技术。如果他们对未来的判断哪怕接近正确,接下来的路会颠簸到难以想象。让我告诉你,他们看到了什么。
从GPT-4到AGI,数一数数量级就知道了
GPT-2到GPT-4,四年时间把AI从学前班水平拽到了聪明高中生水平。2019年的GPT-2连数到五都费劲,做文章摘要基本等于随机抽三句话贴上去。那时候技术人员兴奋的点是什么?是它偶尔能拼出几段像样的话,是在一个被反复筛选过的例子里,写出了一段关于安第斯山脉独角兽的勉强连贯的童话。它那个水平搁人类身上,大概就是话能说利索已经值得夸的幼儿园小朋友。
到了2023年,GPT-4来了。它考LSAT超过90%考生,SAT阅读超过97%,美国生物奥赛冲到99分位。你让它写代码,它能迭代调试;你让它解高中数学竞赛题,它能推理出来;你让它做费米估算,它能把步骤拆得清清楚楚。高中数学竞赛题集MATH,2021年刚发布时GPT-3正确率只有5%,一群顶级AI研究员开盘口赌未来几年不会涨,结果2022年中期直接飙到50%,现在超过90%。每次有人喊“这堵墙过不去”,墙就塌了。
这个跳跃不是魔术,是三个趋势叠加的结果。第一是算力,GPT-4的训练用了比GPT-2多大约三千倍的计算量。第二是算法效率,每过一年研究人员就能用同样多的计算量做出更好的模型,累积下来四年等于白捡了一百倍的有效算力。第三是“解绑”,就是去掉模型身上那些显而易见的蠢限制,比如让它在回答之前先打草稿而不是张嘴就来。这三样东西加在一起,有效计算规模从GPT-2到GPT-4涨了大约十万倍。到2027年底,算力每年涨零点五个数量级,算法效率每年也涨零点五个数量级,这两个趋势过去十年没断过,有效计算规模至少再涨十万倍。GPT-4训练三个月才跑完的东西,到时领先实验室一分钟就能干完,一天能跑出1440个GPT-4级别的模型。加上“解绑”的深化,到2027年就不是聊天机器人了,而是能像远程同事一样自己规划、自己试错、几天交完整成果的数字员工。所有能在电脑前完成的认知工作它全能干,这就是AGI。
从AGI到超级智能,智能爆炸不是科幻
别在人类水平上停住。一旦AGI出现,真正的戏码才开始。到2027年推理用GPU集群能支撑上亿个AI研究员的等效劳动力,它们不用睡觉不用社交,读论文按秒算,跑实验按万种方案并行。人类研究员一年憋几个算法优化点,一亿个呢?当前算法效率进步每年零点五个数量级,这帮AI研究员很可能把本来十年才能走完的进步压缩到一年以内。五年量级的效率提升一年搞定,这就是智能爆炸。
从AGI到超级智能不是慢慢改进,是直接冲过去冲到人类彻底看不懂的程度。它们的思维方式会像AlphaGo下出的第37手——人类觉得诡异离奇,事后复盘才知道那是天才手笔。我们连它们为什么那样做都可能永远无法理解,更别说控制了。和超级智能比起来,AGI也就是学前班积木。
数万亿资本涌入,但真正的瓶颈不在钱
Nvidia数据中心收入从140亿年化飙到900亿只用了一年。Meta单笔订单35万张H100,Amazon买了个1吉瓦数据中心园区就挨着核电站。微软和OpenAI在规划千亿美元集群对标国际空间站造价。到2030年单个训练集群可能干到100吉瓦,相当于美国目前发电量五分之一以上,总AI投资每年奔着8万亿美元。1996到2001年美国电信业投了相当于今天1万亿铺互联网,二战时美国借款超GDP的60%,这个量级不是没见过。
但真正的瓶颈是数据不是钱。互联网文本快被榨干了,Common Crawl去重后只剩30万亿token,Llama3已经吃掉15万亿。代码数据更惨,GitHub全部公开代码加起来也就几万亿。重复喂同一批数据超过16轮收益归零,翻来覆去读同一本教材只能培养背诵能力不是理解能力。实验室的人没在慌,他们全力砸钱搞合成数据、自对弈、强化学习,让模型像人类学数学那样慢慢消化——翻几页停下来想,跟同学讨论,做题错了再试,直到真通了。哪个实验室先攻下这道关,领先就是断崖式的。到了那天,这套技术方案的保密级别会跟核弹设计图一模一样。
现在的安全防线跟没设一样
领先的AI实验室天天嚷嚷自己在造AGI,说这是美国有史以来最强大的武器,但安全水平大概跟普通SaaS创业公司差不多。Google DeepMind自评安全等级从0到4,4级才有机会防住国家级情报机构,他们承认自己目前在0级。那些关键算法突破,现在去旧金山AI派对多听几耳朵就能攒出技术路线图,连精心策划的间谍行动都不用。
如果2027年要造出AGI,保护核心机密的窗口就是现在这12到24个月。错过了,关键算法就已经在中国实验室跑着了。更可怕的是控制比自己聪明的系统。RLHF靠人类打分来奖励好行为惩罚坏行为,对目前模型有效,但对超级智能呢?当AI生成一百万行它自己发明的新语言代码,人类评分员根本看不懂有没有后门,打分机制当场报废。全世界真正全职做超级对齐研究的人可能就几十个,面对的是人类历史上最失控的智能系统。
自由世界必须赢,而且必须赢得够多
超级智能会带来决定性的军事和经济优势。海湾战争里伊拉克是第四大军队,兵力装备跟联军基本持平,阵地加固到需要3比1优势才能啃。结果100小时地面战,联军死292人,伊拉克死2到5万,坦克损失31对3000。技术代差就是这种碾压。而超级智能带来的代差,比海湾战争还要大几个数量级。
中国没那么好对付。SMIC已经能量产7纳米芯片了,跟Nvidia A100用的制程同级别。华为昇腾910B性能大概只有同等Nvidia芯片的三分之一到一半,但差距没那么致命。更关键的是中国有一个美国没有的优势:建造速度。过去十年中国新增发电装机容量几乎等于美国全国现有总和,美国这边一个电厂从立项到并网轻松走十年。
一个拿到超级智能的专制政权会是什么样?百万台机器人执法,完美监控系统,零政变风险。这不是价值观问题,是几千年历史里最稳固的统治机器,而且可能是永久性的。美国必须赢,而且必须赢得足够多,才有余裕去处理安全、对齐、核不扩散这些麻烦事。如果只赢两个月,那就是疯了一样冲刺,没时间管安全。如果赢两年,就有空间去做正确的事。
最终都会变成国家项目
很多人觉得美国政府会一直袖手旁观,等私营实验室自己搞定超级智能再收网。不会的。当事情发展到那个地步,当私营实验室的安全漏洞已经被渗透到形同虚设,当智能爆炸的倒计时已经开始,美国政府不会坐视不管。到时候会有一个项目,可能不叫曼哈顿计划,但性质类似。你觉得美国政府会允许一个旧金山的创业公司掌控超级智能吗?好比让Uber去造原子弹,然后让它的CEO一个人决定什么时候按按钮?这不可能。
这个项目会怎么运作?核心研究团队会搬进SCIF敏感信息隔离设施,万亿级集群会在创纪录时间内建成,数百名顶尖研究人员会从实验室转入国家安全体系。他们会跟军方、情报界、能源部密切配合,在极高保密级别下推进AGI的最终冲刺。这个过程肯定会笨拙、低效、官僚化,和所有政府大项目一样。但除此之外还有别的选择吗?让Sam Altman和Elon Musk各自拥有自己的核武库?以自由市场的名义让超级智能的技术细节在GitHub上随便下载,然后等着看朝鲜先拿到?
最关键的变量不是项目会不会来,而是来的时候够不够早。如果政府等到智能爆炸已经开始了才介入,那核心机密已经泄露完了。如果能在2026或2027年提前启动,那还有机会做安全准备、建防御体系、拉盟友入伙。现在是2026年8月,距离2027年的AGI临界点不到一年半,距离2030年的超级智能也就四年出头。你正在读的这篇东西,准确来说不是预测,是已经启动的倒计时。真正有态势感知的人,全世界大概只有几百个。等所有人都反应过来,牌桌上可能已经没位置了。
项目怎么执行,比要不要项目更重要
前面说了,政府最终一定会下场。但怎么下场,比要不要下场关键一百倍。最理想的情况是2026年底或2027年初就启动,那时候核心机密还在,关键团队还没散,那边的渗透还没到不可收拾的地步。
这个项目具体长什么样?核心研究团队大概几百人,会搬进SCIF,就是敏感信息隔离设施,那种没有窗户、信号出不去、进门要过三道安检的地方。万亿级集群会在创纪录时间内建成,正常要十年的电厂审批流程会被跳过,环境审查会直接豁免,联邦政府会征用土地和输电走廊。几百名顶尖研究人员会从DeepMind、OpenAI、Anthropic这些地方转入国家安全体系,跟军方、情报界、能源部、商务部的人坐在一起干活。那感觉不会像硅谷创业公司,更像1943年的洛斯阿拉莫斯。
但这里面有个麻烦。这些AI研究员习惯了高薪、自由、随时跳槽的创业文化,突然让他们进政府项目,接受背景审查、行动受限、信息隔离、薪水还可能降一截,很多人会不乐意。有些人可能会跑,有些人可能会消极抵抗。那时候就得靠一批真正有使命感的人顶上。这跟曼哈顿计划一样,当时也不是所有顶尖物理学家都愿意去,去的那些都是真觉得这事关生死的人。现在也一样,愿意进SCIF的那几百号人,大概就是真正有态势感知的那几百号人。
更麻烦的是跨国协调。英国有DeepMind,日本和韩国有芯片供应链,整个欧洲有工业基础。不能单干,必须拉盟友。当年魁北克协议里丘吉尔和罗斯福约定共享核武器研发成果、不对彼此使用、不经双方同意不对第三方使用。现在的AI版本应该类似:共享AGI研发成果,协调安全标准,统一对中国技术出口的管控,共同部署防御性超级智能应用。同时还要对更广泛的国家提供一个“和平利用超级智能”的方案,类似艾森豪威尔的“原子和平”倡议。你放弃自己搞AGI,我们分享和平用途的好处,大家都不把超级智能武器化。
谁会被叫去执行这个项目
如果项目真的启动了,谁来负责?谁来当那个“格罗夫斯将军”管建设?谁来当那个“奥本海默”管科学?格罗夫斯那类人现在还在不在?当年他能用军方的绝对权威压制一群顶尖物理学家,同时协调全美国的工业资源,在三年内从零建成一个覆盖全国的核武器生产体系。现在的美国政府体系里,谁有这个魄力和执行力?没几个人。
奥本海默那类人呢?AI领域最顶尖的那批人,多数还在实验室里做研究、写代码、跑实验,他们不是没能力统筹全局,而是根本不想。他们选择做研究就是因为不想管人、不想搞政治。但真到那个节点,历史会找上他们。就像奥本海默本来也不想当实验室主任,他更想继续做理论物理。但事情到了那个份上,他接了。
项目外的世界会乱成什么样
就算美国成功启动了项目,外部世界不会等着。智能爆炸一旦开始,技术进步的速度就不是按年算了,是按周算的。这一周AI发现了一个新的算法优化,能省30%算力;下一周它用这个优化跑了更多实验,又找到了一个新架构;再下一周它开始设计下一代芯片。人类决策者的反应速度根本跟不上。
与此同时,中国的动作会越来越激进。不是因为他们想打仗,而是因为他们也看得到倒计时。如果他们判断美国领先一年就会获得决定性的军事优势,那他们可能觉得自己只剩一个选择:在差距还不太大的时候主动出手。网络攻击、供应链切断、甚至更极端的手段,全都有可能。
美国国内的混乱也会加剧。失业不是慢慢来的,是几个月内几千万白领发现自己被替代了。社会撕裂、政治极端化、对科技精英的仇恨爆发——这些都会在智能爆炸的同时发生。项目里那几百号人坐在SCIF里算对齐算法的时候,外面可能正在烧街。这个画面听起来夸张,但历史上每一次技术革命都伴随着社会动荡,而这次革命的速度是工业革命的几百倍。
这一切可能不会发生,但如果发生了呢
也可能一切都平安无事。可能数据墙真的推不过去,算力投入到头了,算法效率突然卡住,AGI推迟到2035年甚至更晚。可能中国内部出问题,自己把自己绊住了。可能安全措施虽然现在稀烂,但关键时刻突然有人站出来力挽狂澜。这些情况都有可能。
但问题在于,当前最核心的那批AI研发者,他们不觉得这些情况大概率会发生。他们日复一日看着自己实验室的进度条,看着内部实验数据,看着那帮最聪明的同事每天搞出来的新东西。他们说2027年AGI“惊人地可信”,说智能爆炸是“主要预期”。你让我选信谁——信那些亲手建造它的人,还是信那些说“不可能”的外部评论员?
如果这些人是错的,那没事,最多就是一场夸大的科技泡沫。但如果他们是对的,如果你现在读的这篇东西描述的世界真的在2027到2030年之间降临,那现在每一个没做的事、每一次拖延、每一句“还早”、每一个被忽视的安全漏洞,都会成为历史书上的血债。我们这一代人大概率会活到2030年。到时候回头看2026年,会怎么评价现在这个时刻?会说“那时候他们本来可以阻止的”?
我不知道自由世界能不能赢。但我知道,现在距离终局还有不到四年。真正有态势感知的人,全世界大概几百个。他们大概已经睡不好觉了。
总结: 从GPT-4到AGI只用了四年,智能爆炸可能把十年压缩成一年。数万亿资本正在涌入但数据才是真正瓶颈,安全防线形同虚设随时可能被对手偷走一切。最终这不会是硅谷创业游戏,会变成国家项目。如果这些都错了,我们最多尴尬几年;如果对了,我们现在做的每一件事都可能是人类历史上最后一次自由选择的机会。
原文期刊:Situational Awareness(个人研究专著)
发表日期:2024年
原文标题:Situational Awareness: The Decade Ahead
作者单位背景:Leopold Aschenbrenner,曾就职于OpenAI超级对齐团队,现独立研究者