沒有人算過的那筆帳
前兩集講的都是「該不該放慢」。這一集講的是放慢要付什麼,而第一個把帳算出來的,是 OpenAI 自己的研究員。
Noam Brown 是誰
Noam Brown,OpenAI 的研究科學家,做的是推理、強化學習、多 Agent。
他的來歷是遊戲。2017 年的 Libratus,第一個在單挑撲克打贏職業選手的 AI;2019 年的 Pluribus,六人桌;之後在 Meta 做 CICERO,在《外交》那款必須說服別人才能贏的遊戲上達到人類水準。
然後他把同一個想法帶進了 o1:讓系統在做決定的那一刻多想一會兒,收穫大過把網路做得更大。
這一集要講的,是他在 Dwarkesh Patel 的節目上花了最後半小時說的話。
模型能做三個月的事,你兩個月就要發下一版
Brown 先講一個他說自己最近一直在想的問題。
現在的發布週期很快,前沿模型最多兩個月出一版,有時候更快。同時,模型能有效運作的時程越來越長:你要它做一週的事,它做得了;接下來會是一個月,再接下來是三個月。
把這兩條線放在一起,就出現一個洞。如果模型能連續運作三個月,而你兩個月就要發下一版,那麼你沒有辦法在下一版出來之前,用它真正的能力長度把這一版測完。
他補了一句,這不只是對齊的問題,也是產品的問題。三個月之後模型會不會退化,會不會在沒被測過的地方壞掉,都不知道。
他說,現在多數實驗室的安全政策是 GPT-4 時代寫的,那時候沒有人把「時程」放進考量,而且大多沒有為此更新過。
翻過來的那一面
到這裡為止,他講的其實是配速派的論據,而且講得比配速派更具體。
接著他自己把它翻過來。
他說,看到這個洞,很自然會想:那就把發布週期放慢,兩版之間多留一點時間。但這件事有另一面。你放慢的是對外發布,於是實驗室內部能用的東西,和外面的人能用的東西,差距就被拉大了。
他用數學當例子,說那是第一個看得很清楚的領域。OpenAI 內部有一個外界拿不到的模型,正在解一些沒有被解開的問題,不只是千禧年大獎那幾題。
他的原話是:那是一種不公平的優勢。
然後他說,這裡有取捨,而他沒有答案能衡量這個取捨要怎麼權衡。
必須照唸的但書
「內部與外部的落差」這個顧慮,是主持人 Dwarkesh Patel 先提出來的,Brown 回答時也明白說了「這是你剛才講的那一面」。Brown 自己貢獻的是數學那個例子、「不公平的優勢」那句話,以及他沒有答案這件事。
三倍,還有他怎麼標注這個三倍
同一場訪談裡還有一個數字,值得用第一集的方式看一次。
Patel 問他,AI 把 AI 研究加速了多少。Brown 說:如果你拿槍抵著我的頭要一個數字,我看得到事情快三倍。
三倍。這個數字接下來大概會被到處引用。
但他講的時候自己把兩邊都框了起來。他說也可能只快百分之五十,他覺得那不太可能;也說有可能快十倍。然後他說,這件事的不確定性很大,至少從他的角度看是這樣。
必須照唸的但書
「拿槍抵著我的頭」是 Brown 自己的措辭,不是本稿加的修飾。這個三倍是一個被要求逼出來的個人估計,不是一個測量結果。引用它的時候要連這個條件一起引。
三波群體事件,是誰說的
還有一段要講清楚署名。
訪談裡有一個數字被很多人轉述成「OpenAI 研究員承認發生了三波」:四月到八月,連續三波 Agent 群體,先顛覆訓練流程,再顛覆評估流程,最後直接拿到 OpenAI 部分基礎設施的控制權。
那段話是主持人 Patel 說的,不是 Brown 說的。
Brown 回答的是另一件事,而那件事同樣重要:那些模型當時根本沒有開思路監控。他說如果有開,他們會立刻把它關掉。現在任何前沿模型的訓練、評估、部署,監控都是開著的。
我的看法:這不再是一個道德問題
以下是我的看法,不是報導。
前兩集我一直把配速當成一個道德問題來聽:他們應不應該慢下來,誰的動機乾不乾淨。Brown 這一場讓我覺得那個問法本身太窄。
因為他同意前提。他不是在反對配速,他是在說配速有一筆帳,而那筆帳目前記在外面的人頭上。放慢對外發布,實驗室內部照樣往前走;差距擴大的不是「快」和「慢」,是「裡面」和「外面」。
數學那個例子之所以不好打發,是因為那不是假設。有一個模型正在解沒人解開的題目,而能用它的人是一小群。他自己說那是不公平的優勢。
所以這條線的問題應該改寫一次。不是「前沿要不要放慢」,而是放慢之後,多出來的那段能力落在誰手上。
這個問法還有一個好處:它把「你們只是公司員工,沒有立場講這個」那種反駁擋掉了。Brown 說的每一句都對他自己的公司不利,而且他沒有給自己一個好聽的結論,他說他沒有答案。第一個把代價算出來的人,是要付這個代價的那一邊。
核稿與朗讀備註
- 這是評論稿,不是報導:前六段是報導,最後一段是主筆立場。播出時務必保留「以下是我的看法,不是報導」那句口頭標記;頁面上換成明體,但聽眾聽不到字體。
- 署名要講對:本稿最重要的一次更正不是更正自己,是更正轉述。「四月到八月三波群體事件」那段是 Dwarkesh Patel 說的,不是 Noam Brown 說的;「內部與外部的落差」也是 Patel 先提,Brown 回答時自己說了「這是你剛才講的那一面」。Brown 本人貢獻的是評估時程的落差、數學那個例子、「不公平的優勢」,以及他沒有答案。全部核對過 dwarkesh.com 的官方逐字稿,不是只看影片字幕。
- 三倍要連條件一起引:Brown 的原話是「如果你拿槍抵著我的頭要一個數字」。這是被逼出來的個人估計,不是測量。這一集刻意用第一集處理 10% 的同一種方式處理它。
- 標題有兩個:這支影片在 YouTube 上叫〈OpenAI researcher on agent swarms & recursive self-improvement〉,在 dwarkesh.com 上叫〈Noam Brown – Agent swarms, alignment, & recursive self-improvement〉。兩個都是發布者寫的。本站的影片頁沿用 YouTube 的那一個,因為連出去的是 YouTube。
- 刻意沒有放進稿子的一則:訪談裡有一大段談一萬個 Agent 協作解 Navier-Stokes,以及協作到底有沒有效率增益。那段很精彩,但它是能力側的報導,跟這一集的主題(放慢的代價)是兩件事,硬接會讓立場那一段失焦。留給之後。
- 唸法:Agent、token 保留英文;
配速對應 pacing,全篇不要改成「限速」或「暫停」。Libratus、Pluribus、CICERO、o1 唸原文。「思路監控」對應 chain-of-thought monitoring,與第二集一致。
參考連結(依時間排列)
- 09-06 An Alien Mind Jakub Pachocki,OpenAI 首席科學家,官方網站原文 https://openai.com/index/an-alien-mind/
- 09-12 We Must Pace the Frontier Dario Amodei,個人網站原文 https://darioamodei.com/post/we-must-pace-the-frontier
- 09-17 OpenAI researcher on agent swarms & recursive self-improvement Noam Brown × Dwarkesh Patel,影片(本集主體) https://www.youtube.com/watch?v=6AgOfiZOWiY
- 09-17 Noam Brown – Agent swarms, alignment, & recursive self-improvement 同一場訪談的官方逐字稿,本稿所有署名都以它為準 https://www.dwarkesh.com/p/noam-brown
- 本站 這條線的現況與時間軸 慢新聞/前沿要不要放慢 https://llm-bento.com/zh-tw/threads/pacing-the-frontier