The Diary Of A CEO 這集訪談找來前 OpenAI 研究員、AI Futures Project 創辦人 Daniel Kokotajlo。影片用「200 萬美元封口」、「70%」和「2027」當賣點,但這些數字拆開來看,混合了真實事件、個人風險判斷與一連串尚未發生的假設。

Kokotajlo 離職時收到的文件包含不得批評公司與不得透露條款內容的要求。拒絕簽署時,他原以為約 200 萬美元的已歸屬股權會被收回;爭議曝光後,OpenAI 改變政策,他也在訪談中當場糾正主持人:錢最後有保住。因此,原標題並不是整件事目前的結果,而是他當時拒絕條款所承擔的風險。

Daniel Kokotajlo 在訪談中說明離開 OpenAI 時的不得批評條款

來源:影片畫面擷取自 YouTube/The Diary Of A CEO(約 18:10)

AI 2027 描繪的路徑,是 AI 先大量自動化程式開發,再接手 AI 研究本身,讓技術進展急遽加速。當實驗室、政府與國家都把它視為競賽,安全問題可能在部署壓力下被往後放。這是一套情境推演,不是認定世界會在某一天照表發生;Kokotajlo 也說,他對「AI 研究全面自動化」的中位時間已調整到 2028 年,團隊其他人的估計則落在 2030、2031 年左右。

影片反覆提到的「70%」也需要保留原本的範圍。Kokotajlo 特別說,他不是只指人類滅絕,而是把 AI 接管、讓人類失去實質控制權,以及其他嚴重災難都算進「事情變得非常糟」的結果。這是他的主觀風險估計,不是由實驗資料算出的機率;訪談也沒有充分挑戰模型進步速度、算力與能源、實體世界限制,以及預測失準後該如何重新校準。

訪談畫面顯示 AI 2040: Plan A 文件與 Daniel Kokotajlo