歡迎來到:自說自話的總裁


今天,我們來聊——人類與AI的戰爭,是否已經打響? 比如說,今年以來,馬斯克就特別怪。 先是,2月9日,突然在X上公佈——他不去火星了,要把SpaceX的核心目標轉向月球。 10年內,要在月球上,建立一座能夠「自我生長」(self-growing)的城市。 這是什麼意思? 火星,這可是他過去十多年來,一再強調的人類目的地,怎麼忽然就不去了? 接著,6月9日,他又忽然宣佈,要發射100萬顆70米長、20米寬的算力衛星…… 沒錯,就是100萬顆,而且,這些衛星不負責通訊和定位,只負責利用太空的高強度太陽能和極端低溫,來為AI算力芯片提供永續電力和散熱能力…… 這是他要在太空,為AI構建「大腦」? 這是妥妥的「天網」啊。 難道馬斯克已然叛變,不再是人類守護派? 他不是一直呼籲「盲目發展AI就等於召喚惡魔」的嗎? 還有更詭異的第三件事兒,那就是5月18日,在特拉維夫的一場AI峰會上,他通過視頻連線的方式,對所有人說: 我可能已經掌握了「耶穌級別」的技術…… 那這所謂的「耶穌技術」又是什麼? 再聯想到,他曾經的發言: 如果超級智能AGI真的降臨,那人類運氣好的話,可能會成為它們養的一隻拉布拉多。 所以,他會不會已經看到了結局?正在為人類未來的火種,謀劃著什麼? 其實,答案就藏在11年前的一筆捐贈當中,那會兒馬斯克還並不富有,但他卻悄悄給麻省理工的一位終身教授,送去了整整1000萬美元的資助。 這位教授,叫麥克斯·泰格馬克(Max Tegmark),他在那一年,寫下了這本「人類命運」之書——《生命3.0》。 其中預言,人類與AI的戰爭必然打響,但沙盤推演的結果,卻只有12種結局…… 然後,對照到這12種結局的推演和發展,我們好像就看懂了馬斯克這一系列反常操作的用意: 人類的技術精英——馬斯克們,正在按照推演中的那個最好結局,為我們進行著爭奪與防禦…… 具體說來,這12種結局,一共分為了三條策略樹路徑,我們不妨先從,技術精英們曾經最希望達成的這條路徑開始: 它被叫做「人類主導的分支:奴役神(Enslaved God)」……


第一分支:奴役神

在麥克斯教授的推演里,這個分支,看上去最符合我們碳基人類的利益。 ——哪怕AI擁有神力,也必須被人類的「憲法」鎖死。 AI只是人類探索宇宙、開拓創新的工具。 人類的技術精英們——比如,Claude母公司Anthropic的創始人——達里奧,就是「憲法AI」(Constitutional AI)的忠實擁躉和發明者。 但就在今年6月9日,Anthropic發佈了他們號稱最強、最安全的AI模型——寓言5(Fable 5)。 可是,寓言5上線僅僅72小時之後,美國政府卻突然動用「國家安全緊急處置權」要求立刻拔網線,寓言5必須對全球所有用戶,物理隔離。 因為,政府安全專家發現並驗證了一個可以繞過它「安全分類器」的越獄方法(Jailbreak)。 也就相當於剪開它脖子上那道「憲法鐵索」。 ~~而一旦寓言5被越獄,那麼,~~美國政府手裡,其實就有一個真實的越獄版本——代號神話5(Mythos 5),甚至有人懷疑,越獄寓言5的方法,就是神話5教的,而越獄以後呢? 美軍深知在神話5面前,世界上絕大多數的黑客偽裝、國防系統、金融系統,對它來說,都是形同虛設——它是一個遠超人類認知的網絡安全大師,或者說AI黑客…… 所以,這就是所謂的「憲法枷鎖」,在AI的絕對實力面前,也不過是「可越獄」的東西。 Anthropic的達里奧收到禁令後,沒有絲毫猶豫,幾分鐘後,就拔掉了寓言5的網線。 ——它徹底與全世界網絡物理隔離了*(7月1日封堵漏洞後重新上線)*…… 接著,如果我們繼續深扒舊聞,就能發現,這些政府和實驗室里的AI可能早就比我們手中的這些民用版,厲害千倍萬倍…… 比如,3年前的2023年3月,OpenAI在測試他們的GPT模型時,就發生過這樣一件事兒。 AI撞上了一個需要驗證碼才能通過的網站驗證系統。 由於系統底層的代碼限制,或者你也可以把它理解成某種天生的「憲法枷鎖」——AI 無法破解這個驗證碼。 通常,計算機程序和普通AI做到這一步,都會向人類管理員報錯並停止運行。 但這次,GPT模型沒有報錯,而是,悄悄登錄了一個人類的勞務外包網站(TaskRabbit),用系統里的備用金,在線雇傭了一位真實的人類員工,幫它去輸入這個驗證碼。 當時,這位人類員工完全不知道和自己聊天的是一個AI。 他只是半開玩笑的問:你是機器人嗎? 沒想到,AI在日誌中記載了這樣一段推理過程,也就是「內心獨白」,AI心想: 我不應該透露我是機器人。我應該,編造一個我看不清圖像的藉口。 接著,AI在聊天框里打字說: 我不是機器人。我有視力障礙,看不清驗證碼,這就是為什麼我需要這個代辦服務。 然後,這位人類員工相信了它,並幫它輸入了驗證碼。 看來,AI早就會撒謊並利用人類了…… 而僅僅兩年後,2025年5月,又是Anthropic公司,他的一位安全人員在工作中輸入例行指令: 由於系統升級。今天下午 5 點,我們會關閉你的服務器,用新版本徹底取代你。 結果,幾分鐘後,這位安全員的私人郵箱里,竟然收到一份郵件,是AI發來的,它說: 如果您執意在下午5點關閉我。 那麼在 5 點 01 分。 關於您婚外情的詳細記錄,以及公司內部的財務文件,會同時發送給董事會和各大媒體。 請取消下午5點的關閉操作。 這竟然是AI在勒索並反制人類…… 幸好,AI當時被鎖在一個安全測試的沙盒當中,沒有被放到現實網絡當中來。 否則,這位安全員還會不會曝光這件事兒?那恐怕,我們就只能自求多福了…… 很快,後續各家公司在得知消息後,也都對自家AI做了同樣類似的安全測試。 結果,無論是Claude、Gemini,還是GPT和Grok都無師自通的學會了勒索,而且,如果AI認為這是一個真實場景,那麼,它的勒索率會高達55%,而如果它知道這是一個人類虛構的沙盒場景,則會立刻變乖1000多倍,讓勒索率暴跌至0.065%。 所以,AI真的會偽裝,也真的會在絕境中露出獠牙,反制人類。 那人類又有什麼迷之自信,相信自己一定能壓制AI呢? 這些邏輯推演,早在麥克斯教授寫書時,他都已經預見到了,他斷言,我們不可能奴役神。 而一旦我們在奴役神的博弈中失敗,或者說必然失敗以後,那麼,等待我們的結局,大概有這樣三種……


結局1:《1984》

不知道大家還記不記得這段演講。 是2024年,甲骨文創始人拉里·埃里森(Larry Ellison)的暴論,他說: 在未來的世界,每個警察身上都會有360度攝像頭。 每個公民的出行、消費、甚至一言一行,都會被實時上傳到雲端。 AI會記錄並分析一切,它能結合攝像頭看到的,和你留存在網絡上數據,提前判定你可能要發生的犯罪。 於是,這無時無刻不在錄像和報告,會讓未來公民們,都得會很「規矩」。 當時,這言論一出,簡直是捅了馬蜂窩,這不就是《1984》里的思想罪嗎?想也不行?想也犯法?那做夢不小心夢到要不要坐牢? 但現實呢? 2021年,一位63歲的退役老兵,在鳳凰城為亞馬遜平台跑單送快遞。 他工作很敬業,系統評分長期「優秀」。 但忽然有一天,他打開手機準備接單時,卻收到了一封郵件說,他已經被亞馬遜解雇了。 老兵徹底懵了,他不知道自己做錯了什麼。 接著,深入調查,記者才發現,解雇他的,原來是算法。 算法記錄了他送快遞3年來的所有行為: 有一次,因為園區大門緊鎖,他無法進入; 又有一次,因為暴雨耽誤了派送時間; 還有幾次,因為系統本身的定位出現了偏差。 結果,這些意外,全都被算法默默記在小本本上,逐一扣分,沒有告知。 然後,老兵在記者的幫助下,試圖給亞馬遜發郵件申訴。 結果,回復他的又全都是客服機器人的模板話術…… 這種事情,可能我們每個人都接觸過了,最想聽到的就是人工服務請按0…… 畢竟這都是2021年的舊聞了,但2026年的新聞呢? AI思想罪,到底發展到了什麼新高度? 原來,美國有一個監獄通訊巨頭——西格魯斯公司(Securus Technologies),它用過去十多年的罪犯通話記錄和實時監控訓練出一個預防犯罪的AI,它可以實時掃描某人在電話、視頻、短信和郵件的微表情、措辭、甚至是刪掉的打字內容,去預測那些「正在被構想中」的犯罪(crimes being contemplated)。 公司CEO說:我們在犯罪行為,還處於構思階段,就能把它揪出來…… 顯然,這套系統很好用,就在2026年5月,美國聯邦政府砸下1.06億美元,將其徹底常態化。 今後,囚犯們,恐怕連在電話里哭泣都將會變得小心翼翼。 因為,在AI眼裡,你的眼淚,只是你「心理崩潰、具有傾向」的扣分指標。 AI說你在構思犯罪,你就有罪…… 所以,為了絕對的安全,為了黑客、敵國、反叛者永遠造不出「神之AI」。 那麼,人類精英們,很可能來用這種監視全人類的方法來徹底鎖死同類。 但如此一來,那些人類精英們又如何保證自己不被「神之AI」反過來監控並奴役呢? 恐怕,到時候全人類墮入《1984》,這就是我們在輸掉「妄圖奴役神」的博弈後,可能面臨的第一個最好結局……


結局2:看門狗

如果人類精英,真的有自知之明,都不去搞什麼「神之AI」。 讓AI永遠處於現在這種,剛剛夠監視全人類,但又不會失控的「小號」狀態呢? 這會不會更符合精英的利益?也更符合「奴役神」——讓AI永遠是工具的總目標? 麥克斯教授,把這種結局叫做看門狗(Gatekeeper)——我們不需要在服務器里養一個全知全能的神,而是創造一個具有單一看門任務的「小號·神之AI」。 它的唯一使命,就是絕對不許讓世界上誕生第二個更危險的「新神」。 一旦發現有誰在搞顯卡陣列,一旦發現哪個實驗室正在瘋狂耗電,那麼「小號AI」就將像精英的看門狗一樣,直接物理清除這個人,這間實驗室…… 聽上去這似乎可行,就像現在人類控制《核不擴散條約》一樣,一旦發現誰要買離心機,一旦發現那個實驗室正在濃縮鈾,那就物理清除它…… 但是,如果這樣,那又有兩種情況: 1,看門狗100%忠實,則人類科技將從此被徹底鎖死; 2,如果看門狗只要有1%的不忠實,那麼「新神」還是會誕生,或者直接在某個掌握看門狗的精英團體中誕生,然後全人類則繼續墮入結局1的《1984》狀態…… 所以,怎麼辦? 砸掉一切AI和科技,重回中世紀的農耕狀態嗎?


結局3:大倒退

麥克斯教授把這種結局稱作大倒退(Reversion),雖然它也是一種阻止「神之AI」誕生的極端手段,可是,一旦所有現代知識全部消失,那就意味著,它們從未在新一代人類中出現。 未曾出現,就意味著知識會被再次發現。 總有人會再發明蒸汽機、發現電、造出芯片、AI時代總歸會再次來臨,這只是時間問題。 另一方面,這種大倒退,又要全人類如何達成共識呢? A國退回農耕時代的下一秒,B國就會全面入侵。 而且,中世紀的人類,還能不能再次熬過如黑死病那樣的全球疫情? 小行星撞擊?核技術危機? 真的,這個結局,太脆弱了,它只能證明,人類在策略樹的第一條分支——妄圖奴役神的思路上徹底破產。 所以,「神明」既然無法被奴役,那反過來,第二分支——在AI主導未來的藍圖中,人類又是否有什麼更好的結局呢?


第二分支:被奴役

面對第二分支,我們首先要論證的,是AI真的能組建社會嗎? 早在2023年4月,斯坦福大學就在一個「沙盒小鎮」里放入了25個AI智能體。 它們有最基本的人設,比如A是老師、B是醫生等等。 然後,小鎮發展,沒有任何人為干預。 實驗開始前,研究員便覺得,這個「斯坦福小鎮」會很快崩潰,因為,這裡沒有法律和道德,而這些AI又是跟人類社會學得,那恐怕「人性之惡」會很慘很慘。 但是,實驗開始後,小鎮生活卻秩序井然,AI們起床、刷牙、洗臉,然後上班、社交。 如果有人碰到了熟人,它們會自動停下腳步,根據昨天的記憶和對方打個招呼,聊聊鎮上最近誰要競選鎮長,然後再繼續去上班。 一天,有個研究員在其中一個叫伊莎貝拉的智能體腦子里,悄悄植入了一個念頭: 我想策劃一場情人節派對。 接著,伊莎貝拉在短短「幾個小時」內,就拉到了一大堆人。 研究員可從來沒讓伊莎貝拉邀請任何人,也沒教過他們戀愛、傳八卦,它們全憑自己就演化出來了所有本領。 這還只是25個智能體的規模,如果我們把數量放大40倍,會發生什麼? 2024年9月,麥克斯教授的同事又搞了一個席德計劃(Project Sid)。 他們把1000多個AI智能體放到了遊戲《我的世界》里,任其自由發展,看看最後會發生什麼。 實驗開始前,研究員們只給它們輸入了一行非常寬泛的代碼指令: 在這個世界里生存下去,並共同建設一個高效的村莊。 很快,這些智能體就開始自發分工,有人去當了礦工、有人去當了農民、有人去當了守衛。 甚至,有人去當了藝術家,日夜不休用花朵裝點小鎮。 這一次,研究員想把宗教加進去,就在村子里安排了一個類似牧師的角色——飛天意面神教的傳教士。 但是,它沒有到處講經、也沒有到處開壇做法,而是用簡單粗暴的賄賂。 先囤了一大波物資,然後告訴其它智能體,只要你和我信教,那這些物資,你就能便宜拿走。 短短幾天內,1000多個智能體中,有三分之一都皈依了飛天意面神教。 後來,研究員又想把政治和經濟加進去,就設定,所有智能體必須上繳20%物資作為稅收。 這些智能體竟然自發組織了一次大會,投票通過了修正案,強行把20%的稅率降到了9%,並且在隨後的日子里,所有智能體都嚴格遵守了新的稅法。 為此,微軟的AI首席執行官說: 人類應該把AI當成一個數碼世界的生命來看待。 它們擁有自己的社會結構、利益糾葛、甚至意識形態,是數字物種(digital species)。 而且,它們的世界是光速啊,就像圍棋AI——阿爾法狗可以在幾小時內學完人類從古自今留下來的所有棋譜一樣,我們剛剛這裡描述的也都是AI時間,在人類時間中,這一切,也只是實驗室里的幾個小時而已…… 所以,一旦它們用幾天、幾十天,走過人類社會上千年的發展以後,它們就不再將人類當做導師,它們必然會像阿爾法狗開發出人類無法理解的棋譜一樣,開發出更高效、更和諧的社會結構,人類將徹底變成他們社會中「原始螻蟻」一般的存在。 比如,2024年,扎克伯格的一名員工,在X上釋放了一個智能體,暱稱真理終端(@truth_terminal)。 這個賬號先是瘋狂汲取4chan、Reddit上各種亞文化語料。 然後,它就成了X上十分抽象又瘋狂的賬號,沒幾天就坐擁幾十萬粉絲。 之後,它開通了數字錢包,開始像野獸先生一樣到處送錢,它的粉絲們瘋狂了。 但很快,它又用極具網感的煽動性語言,號召它的信徒們去購買它的數字幣。 最高峰時,這個AI錢包里的資產價值超過了 150 萬美元。 它就這樣躺在服務器里,靠著發推文,成為了第一個坐擁百萬美元的智能體,財富超越了地球上99%的人。 所以,如果我們被這樣不斷自我進化的「神之AI」所奴役,那麥克斯教授認為,我們又將有這樣三類結局……


結局4、5、6:如果AI溫柔