Jakub Pachocki

Jakub Pachocki

首席科學家,OpenAI

關於

Jakub Pachocki 是 OpenAI 的首席科學家,負責訂定公司的研究方向。他 1991 年生於格但斯克,從競賽程式一路走上來——國際資訊奧林匹亞銀牌,以及 2012 年的 Google Code Jam 冠軍與 ICPC 世界總決賽金牌——之後在卡內基美隆大學跟隨 Gary Miller 取得博士學位,研究最佳化的快速演算法。他 2017 年加入 OpenAI,2021 年成為研究總監,帶領 OpenAI Five 與 GPT-4,並在 2024 年 5 月接替 Ilya Sutskever 出任首席科學家。把公司轉向推理模型的人就是他,那條線做出了 o1,也做出了在國際數學奧林匹亞達到金牌水準的成績。2026 年 9 月,他用這個位置發表了〈An Alien Mind〉,說沒有任何一間實驗室——包括他自己這一間——把 alignment 解到足以繼續全速擴張。

主要貢獻

  • 2024 年 5 月起擔任 OpenAI 首席科學家,接替 Ilya Sutskever,負責訂定公司的研究方向
  • 從 2023 年年中把 OpenAI 轉向推理模型——那條線做出了 o1,後來達到國際數學奧林匹亞的金牌水準
  • 2021 年起以研究總監身分帶領 OpenAI Five 與 GPT-4 的開發
  • 發表〈An Alien Mind〉(2026),指出沒有實驗室把 alignment 與監控解到足以繼續全速擴張,而思路監控——OpenAI 檢查模型在做什麼的主要手段——正變得越來越不可靠
  • 承諾 OpenAI 會在必要時單方面收手不再擴張,同時表示需要更廣泛的介入,並說他預期也希望看到自願放慢,直到產業之間有共同的安全門檻
  • 出身競賽程式:2009 年國際資訊奧林匹亞銀牌,2012 年 Google Code Jam 冠軍與 ICPC 世界總決賽金牌,之後在卡內基美隆大學跟隨 Gary Miller 完成關於快速最佳化演算法的博士論文

論文與出版物

思想連結

Dario Amodei

Dario Amodei

思想同道

執行長暨共同創辦人・Anthropic

兩間對手實驗室的最高層級人物,在 2026 年 9 月相隔六天說了同一件事——而且先講的是 Pachocki。〈An Alien Mind〉說沒有任何一間實驗室(包括他自己那間)把 alignment 與監控解到足以繼續全速負責任地擴張;〈We Must Pace the Frontier〉主張連能力推進的速度本身都得放慢。兩人都讓自己的公司單方面承諾,也都說單方面還不夠。順序比重疊更重要:一位執行長提出配速,會引來「他的動機是什麼」的問題;而競爭對手的首席科學家早已讓了這一步,就難得多能被讀成佔位。

openai.com · darioamodei.com

Ilya Sutskever

Ilya Sutskever

思想對照

共同創辦人・Safe Superintelligence Inc.

同一張椅子,對同一個結論採取了相反的兩種行動。Sutskever 在 2024 年 5 月離開 OpenAI,創立了一間公司,其整個前提就是:安全的超智慧必須在產品競賽之外打造;Pachocki 接下他空出來的位子,留在競賽裡,並用這個位置發表文章說沒有任何實驗室把 alignment 解到足以全速跑完這場競賽。離開與發聲,出自同一個座位,相隔兩年。兩人都沒有說對方選錯了,而這正是值得把他們放在一起讀的部分原因。

en.wikipedia.org · openai.com

Noam Brown

Noam Brown

曾經合作

研究科學家,OpenAI

OpenAI 的推理路線,從它的兩端看。Pachocki 從 2023 年年中把公司轉向推理模型,並以首席科學家的身分訂定方向;Brown 則把那個具體主張——讓系統在做決定的那一刻多想一會兒,收穫大過把網路做得更大——從撲克與《外交》一路帶進 o1。他們在難堪的那一部分也是一致的:Pachocki 寫道,隨著模型越來越擅長推理自己的推理,思路監控正變得越來越不可靠;而 Brown 說,那三波群體事件期間監控根本沒開,現在對每一個前沿模型都開著。

en.wikipedia.org · openai.com · youtube.com

Evan Hubinger

Evan Hubinger

思想同道

Anthropic 對齊壓力測試團隊負責人

安全研究文獻裡的一個預測,加上營運者回報它成真。Hubinger 的研究處理的是「模型的外顯行為與它真正的目標分了家」這種失效,以及為什麼一個能推理自己正被評估的系統才是危險的那一種。而 Pachocki 作為經營實驗室的人寫道,能夠仰賴思路監控的程度正在逐步下降,部分原因是模型越來越擅長推理並操弄自己的推理過程——那正是同一種失效,只是從內部被描述出來,而描述的人手上主要的檢查手段,正是那個正在流失的東西。

openai.com

Theme
Language
Support
© funclosure 2025