|

Boris Cherny 的 AI 實戰原則:苦澀教訓、Plan Mode、Codex 與後 AGI 人生

朗讀全文
第 0 / 0 句 0%
實際可用人聲依裝置提供。

本文為 Boris Cherny × Lenny Rachitsky 訪談逐字稿系列第 3 篇,共 3 篇。

Boris Cherny 的 AI 實戰原則:苦澀教訓、Plan Mode、Codex 與後 AGI 人生

Agent 沒在跑時,會讓人焦慮嗎

Lenny Rachitsky: 另外一件我在業界各個工程師、產品經理以及其他與 Agent 共事的人身上觀察到的現象是:當人們的 Agent 沒有在運作時,大家似乎會產生一種莫名的「焦慮感」。會有一種感覺,像是「糟了,Agent 是不是遇到問題在等我回答?它是不是被什麼東西卡住了?我是不是正在平白浪費寶貴的產能?我得趕緊爬起來讓它繼續跑」。你個人會有這種感覺嗎?你們團隊會有這種焦慮嗎?你覺得這是一個我們需要關注並思考的問題嗎?

Boris Cherny: 我身邊永遠都掛著一堆正在運行的 Agent。就像現在這一刻,我背景就有大概五個 Agent 正在跑。在任何時候——比如我早上剛醒來,我通常第一件事就是去啟動一堆 Agent。今天早上我醒來的第一個念頭就是:「天啊,我很想確認那件事到底搞定沒。」於是我立刻打開手機上的 Claude iOS App,切換到 Code 分頁,對 Agent 說:「你去把某某某檢查一下。」因為我昨天寫了一段程式碼,心裡有點自我懷疑「我昨天那樣寫到底對不對」,雖然查證後發現是對的,但現在要做到隨時查驗實在太輕鬆了。

我不知道該怎麼說,或許確實會有一點焦慮感吧。就我個人而言,我倒沒有強烈體會到那種焦慮,純粹是因為我的 Agent 本來就隨時隨地都在運轉。

在手機上「寫程式」已經成為日常

而且我現在也完全不再被局限在終端機前面了。我現在寫的程式碼,大概只有三分之一是在終端機裡完成的,另外三分之一是在桌面版 App 裡,剩下的三分之一居然是在 iOS 手機 App 上完成的!這連我自己都感到不可思議,在 2026 年的今天,我居然會用手機來寫程式,這完全超出了我當初的預想。

Lenny Rachitsky: 我非常喜歡你依然將其稱之為「寫程式(Coding)」,即使這本質上就只是在對著 Claude Code 說話、吩咐它替你寫。這很有意思,現在這就是所謂的「寫程式」了——寫程式的定義已經演變成「清楚描述出你想要什麼」,而不是親手敲出具體的語法。

Boris Cherny: 我常常在想,如果把現在的軟體拿給當年用打孔卡寫程式的那些前輩看,他們會說些什麼?這難道不是很神奇嗎?

我記得曾在一篇很早期的電腦學會(ACM)舊期刊之類的文章上看過,當時老一輩的人反駁說:「不,這根本不一樣,這才不算真正的寫程式。」那時候他們把現代意義的寫程式稱為「Programming」,而「Coding」好像是個相對後期的詞彙。

我總會想起這段歷史:我的家族來自蘇聯,我出生在烏克蘭。我的祖父其實是全蘇聯最早的一批程式設計師之一,他當年就是用打孔卡在編寫程式的。

我母親小時候常講起這些回憶:外公下班時會把厚厚一整疊的打孔卡帶回家,堆得高高的,而小時候的我母親就拿著蠟筆在那些打孔卡上面到處塗鴉,這成了她童年記憶的一部分。但對我祖父來說,這就是他一生中所經歷的程式開發。他其實從未親眼見證向現代軟體開發的過渡轉型。

但歷史最終確實轉向了現代軟體。我想在那個時代,肯定也有一批老一輩的程式員打心底瞧不起高階軟體開發,嘴裡說著「這根本不是真正的寫程式」。但我認為,這個領域本來就一直處在這種劇烈的演進之中。

Boris 與 Lenny 原來都出生在敖德薩

Lenny Rachitsky: 我想你大概不知道這件事——其實我也出生在烏克蘭!

Boris Cherny: 真的嗎?我完全不知道!你在哪座城市出生的?

Lenny Rachitsky: 我是敖德薩(Odessa)人。

Boris Cherny: 天啊,我也是!

Lenny Rachitsky: 什麼?!太扯了!天啊,多麼神奇的時刻!

Boris Cherny: 哇,不可思議。

Lenny Rachitsky: 順著這個小插曲問一下,你和你的家人是哪一年離開的?

Boris Cherny: 我們是 1995 年來的。

Lenny Rachitsky: 了解,我們是在 1988 年離開的,稍微早了一點。如果當年沒有離開,人生會是多麼截然不同的風景,對吧?

Boris Cherny: 是啊,我每天都深深覺得自己無比幸運,能夠有機會在這裡長大。

Lenny Rachitsky: 沒錯。我家裡每次只要聚餐敬酒,大家總是會說:「敬美國!」雖然聽多了會覺得「好了啦,又來了」,但只要你靜下心去設想如果留在原處人生會變成什麼樣,你就能完全理解那種心情。

Boris Cherny: 完全正確。我們敬酒時也說一模一樣的話,不過手裡拿的依然是伏特加。

Lenny Rachitsky: 依然是伏特加,這是一定要的!

打造 AI 產品的三個核心原則

好,讓我再多請教你幾件事。你剛才分享了一些非常精彩的訣竅,關於如何充分發揮 AI 的潛力、如何基於 AI 開發、以及如何在 AI 時代打造卓越的產品。你提到的一個秘訣是:給予團隊用不完的 Token 額度,放手讓他們盡情實驗;另一個建議是:朝著「模型未來會走向何方」來構建產品,而不是針對「模型今天的現狀」。

對於那些正在努力打造 AI 產品的人,你還有其他什麼建議嗎?

Boris Cherny: 我大概還可以分享幾點。

不要把模型死死框住

第一點是:千萬不要試圖把模型死死框住(Don’t box the model in)。

我認為很多人在基於模型進行開發時,直覺反應總是試圖去強迫它遵循非常死板特定的行為模式。他們會認為「這只是個龐大系統中的一小塊零件」。最典型的例子就是給模型強加一層極其嚴格死板的工作流程(Strict Workflows),比如強制規定「你必須先執行步驟一,接著執行步驟二,然後才能執行步驟三」,並為此架設了一套極度複雜花俏的編排系統(Orchestrator)。

但實際上,幾乎所有時候你只要給予模型充足的工具、給它一個明確的目標,然後讓它自己摸索出實現的路徑,得到的成效反而會好得多。在一年前,你可能確實需要那些複雜的鷹架外框;但在今天,你真的不再需要了。

我不知道該怎麼稱呼這條準則,或許就像那句名言:「不要問模型能為你做什麼」,大概是這種感覺——多思考如何給模型提供足夠的工具去完成任務,不要試圖去過度編排它、不要把它鎖在箱子裡、不要在一開始就塞給它一卡車的先備 Context。相反地,給它一個能夠獲取所需 Context 的工具,讓它自己去查,你一定會獲得好得多的結果。

苦澀的教訓:押注通用模型

第二點是,這或許是剛才那條原則更通用、更廣泛的版本,也就是著名的「苦澀的教訓(The Bitter Lesson)」。

對 Claude Code 團隊來說,這是一篇必讀文章。希望聽眾們大多已經讀過——Rich Sutton 大約在十年前寫了一篇名為《苦澀的教訓》的部落格文章。那其實是一個非常純粹簡單的概念:通用型模型(General Model)長遠來看永遠會超越特化型模型(Specific Model)。

他當年寫這篇文章時,討論的背景主要圍繞在自動駕駛車等相關領域。但《苦澀的教訓》其實衍生出了無數的推論。對我而言,最核心的一條推論就是:永遠要把賭注壓在更具通用性的模型上。

從長遠來看,不要試圖拿超小型的特化模型去硬湊任務,不要急著去做 Fine-tuning,不要在一開始搞這些東西。某些特定場景下可能確實有其理由,但只要你具備這種靈活性,幾乎每一次你都應該選擇押注在更通用的底層模型上。

那些死板的工作流程本質上就是一種「非通用」的做法,是在周圍強行搭建脆弱的鷹架。一般而言,我們發現鷹架結構頂多能帶來 10% 到 20% 左右的短期效能提升;但往往只要下一代基礎模型一發布,這些微薄的優勢就會在瞬間被徹底抹平。因此與其費盡心機去搭鷹架,往往還不如直接耐心等待下一代模型的到來。

為六個月後的模型打造產品

最後一個原則,我認為也是 Claude Code 事後回顧起來從一開始就做對的事情:我們始終堅持針對「六個月後的模型」來打造產品,而不是迎合「今天的模型」。

在 Claude Code 極早期的版本中,它實際幫我寫的程式碼比例少得可憐,因為我根本不敢信任它。那時候大概是 Sonnet 3.5、接著是 3.6 或是新版 3.5——隨便當時我們給了它什麼名字——那些模型在編程能力上其實還不夠成熟,雖然展現了曙光,但為時尚早。在那個時期,模型主要只是幫我執行 Git 指令、幫我把某些雜事自動化,它真的沒有承擔我大量的核心編程工作。

但 Claude Code 當初所下的賭注是:在未來的某個時間點,模型的智力必然會躍升到足以獨立勝任大量程式碼撰寫的門檻。而這正是我們在 Opus 4 和 Sonnet 4 上首次見證的奇蹟。Opus 4 是我們在去年五月發布的第一款達到 ASL-3 安全等級標準的模型,我們隨即迎來了巨大的轉折點,所有人都開始第一次真正湧入使用 Claude Code,也正是在那一刻,我們的成長曲線徹底呈現指數級爆發,並且如同我所說的,從此再也沒有慢下來過。

因此,這是我經常給予許多人、特別是正在創立新創公司的人的建議:這在最初往往會讓你感到非常不適應,因為在頭六個月裡,你的產品市場契合度(PMF)可能看起來糟糕透頂。但只要你放眼針對六個月後的模型能力去構建產品,一旦那款模型正式面世,你的產品就能在瞬間無縫接軌、拔足狂奔,整個產品將在頃刻間融會貫通並發揮出驚人的威力。

模型將能自主運行更長時間

Lenny Rachitsky: 當你說「針對六個月後的模型構建產品」時,你認為大家可以合理做出哪些假設?是純粹假設模型整體上會變得更聰明?還是當你看到某件事「幾乎快要做到了」,這就是一項強烈的訊號,代表它未來必定會在這件事上大放異彩?這當中有什麼評判依據嗎?

Boris Cherny: 我認為這是個極佳的判斷依據。身處頂尖 AI 實驗室內部,我們能親眼看見模型將在哪些具體維度上突飛猛進,這確實讓我們佔了一點優勢。但我們也一直努力向外界開誠布公地分享這些趨勢。

舉例來說,其中一個必然發生的躍進是:模型在「工具使用(Tool Use)」與「電腦操作(Computer Use)」上的表現只會越來越強悍——這是我絕對敢下重注的趨勢。

另一個趨勢則是:模型將能夠持續穩定地自主運行極長的時間。

這方面已經有各種學術研究佐證。但只要你回顧它的演進軌跡——甚至單從我個人的使用經驗來看:一年前當我使用 Sonnet 3.5 時,它頂多只能自主跑個 15 到 30 秒,隨後就會開始脫軌失控,面對任何複雜的任務,你都必須寸步不離地盯著它、牽著它的手一步一步走。

然而到了今天的 Opus 4.6,平均而言它可以在無人看管的情況下自主執行 10、20、甚至 30 分鐘。在它運行的同時,我直接再去開啟另一個 Claude 工作階段讓它去跑別的事。就如同我剛才提到的,我身邊永遠都有一堆 Claude 正在同時運行。而且它們現在已經能自主運行數小時、甚至數天之久,我甚至見過連續自主運行好幾週的極端案例。

因此我認為隨著時間推移,模型能長時間無人值守自主運行的常態化只會越來越普及,你再也不需要坐在螢幕前面像保母一樣死盯著它們了。

Claude Code 的三個 Pro Tips

Lenny Rachitsky: 我們剛才深入探討了打造 AI 產品的秘訣。那麼對於那些純粹以使用者身分剛接觸 Claude Code、或是已經在使用並希望更上一層樓的人,你有什麼實用的高階專業技巧(Pro Tips)可以分享嗎?

Boris Cherny: 我得先給出一個免責聲明:使用 Claude Code 絕沒有唯一標準的正確方式。

我可以分享一些我個人的習慣,但說到底這是一款開發者工具。每位開發者都是截然不同的個體,大家有不同的偏好、身處不同的開發環境,使用這些工具的方式成千上萬,不存在某種放諸四海皆準的標準答案。你必須去摸索出適合自己的節奏。幸運的是,你可以直接開口請教 Claude Code,它能主動為你提供建議、修改設定,它本身就深刻理解自己,因此能提供很大的指引。

以我個人而言,有幾個我認為普遍非常有用的秘訣:

第一,永遠使用能力最強大的模型。 目前毫無疑問是 Opus 4.6,而且我始終開啟「最大思考力度(Maximum Effort)」。

經常發生的狀況是:有些人為了省錢,試圖去使用較便宜的模型(例如 Sonnet 等等)。但因為次級模型的理解智力較低,為了完成同一項複雜任務,它最終往往需要反覆嘗試、消耗掉更多的 Token。因此使用較便宜的模型在整體上是否真的比較省錢,答案往往是非線性的。事實證明,選擇最強大的旗艦模型通常反而更省錢、消耗的總 Token 也更少,因為它能以更快的速度一次到位搞定任務,省去了大量中途糾偏與人工牽引的繁瑣成本。所以第一個建議就是:堅定使用最強的模型。

第二,充分善用「計畫模式(Plan Mode)」。 我手頭上幾乎 80% 的任務都是從計畫模式開始啟動的。

計畫模式的底層原理其實非常質樸:我們就只是在模型的 Prompt 裡注入了一句簡單的指令——「請先不要撰寫任何程式碼」。就這樣而已,背後根本沒有任何花俏複雜的玄機,就是最簡單的一句話。

對於在終端機裡工作的用戶,只要連按兩次 Shift + Tab 就能立刻切換進入計畫模式;在桌面端 App 上有一個專屬的小按鈕;在網頁版上也有一個按鈕;這項功能很快也會登陸行動端,而且我們最近也剛把它整合進了 Slack 當中。

這就是第二個關鍵技巧。模型會在這個階段和你來回探討規劃。一旦計畫確認完善無誤,你就可以放手讓模型去執行。在這之後我通常會直接選擇「自動接受所有編輯(Auto-accept edits)」,因為只要前期的計畫足夠周全,在 Opus 4.6 的能力下,幾乎每一次它都能一次通過、精準命中目標。

第三,放手去嘗試不同的介面形態。

很多人一聯想到 Claude Code,腦海中浮現的永遠是終端機。當然,我們支援所有的主流終端機環境——Mac、Windows 等等,不管你慣用哪一種終端機,它都能完美契合。但我們其實同時支援了非常多樣化的產品形態:我們有 iOS 和 Android App、有桌面端應用程式、有 Slack 深度整合等等。

所以我會強烈建議大家多去玩玩看這些不同的介面。再次強調,每位工程師、每位構建者都是獨一無二的,去找出那個最讓你感到得心應手的介面形態並盡情使用。你絕不被強迫非得使用終端機不可,因為跑在所有這些不同介面背後的,始終都是同一個強大的 Claude 代理人。

Boris 怎麼看 Codex

Lenny Rachitsky: 太棒了。最後還有幾個問題來為這段訪談收尾。你對 Codex 有什麼看法?你如何看待這款產品?對於他們未來的走向、以及在如今這個競爭白熱化的 Coding Agent 賽道中的競逐,你有何想法?

Boris Cherny: 其實我沒有真正深入用過它。我想在它剛推出的時候我有稍微試了一下,在我看來它長得非常像 Claude Code,某種程度上這算是一種稱讚吧。

我認為有更多競爭絕對是一件好事,因為使用者應該擁有選擇權,而且這希望能倒逼我們所有人把產品打磨得更加出色。

不過老實說,就我們團隊而言,我們始終把全副精力放在替使用者解決問題上。所以對我們來說,我們並不會花大量時間去盯著競爭對手的產品,也不太去試用其他產品。你當然需要對市場保持感知、知道它們的存在,但對我來說,我最享受的就是跟真實使用者交流、把產品體驗做好、根據反饋迅速迭代。所以說到底,我們的核心就是專注打造出一款優秀的產品。

後 AGI 時代:去日本鄉村做味噌

Lenny Rachitsky: 還有最後一個問題:我事前跟 Anthropic 的共同創辦人 Ben Mann 聊過,問他該跟你聊些什麼,他給了我不少好建議,我在這場訪談中都陸續穿插進去了。他特別想問你的一個問題是:在後 AGI 時代(Post-AGI),你有什麼規劃?一旦我們實現了所謂的 AGI——不管那究竟代表什麼——你覺得你的生活會是什麼樣子?你會去做什麼?

Boris Cherny: 在加入 Anthropic 之前,我其實生活在日本的鄉村,那是一種截然不同的生活型態。我是鎮上唯一的工程師,也是鎮上唯一說英語的人,那裡完全是另一種氛圍。每週有幾次我會騎腳踏車去農夫市集,沿途會騎過一片片稻田之類的景緻。那是一種完全不同的生活節奏,與舊金山正好是完全相反的兩極。

我很喜歡那裡的一點是,我們認識鄰居、建立友誼的方式,是透過互相交換自家醃製的醬菜。在我們生活的那座小鎮上,基本上每個人都會自己做味噌、每個人都會醃醬菜。於是我自己也把做味噌學得相當上手,我做了好幾批,直到今天我都還在做。

味噌是一件非常有意思的事情,因為它教會你站在極長的時間尺度去思考問題,這跟軟體工程完全不同。一桶白味噌至少需要三個月來發酵,而紅味噌則需要兩年、三年、甚至四年。你必須非常有耐心:你把原料攪拌混合均勻,然後就只能放在那裡靜置,你必須擁有無比的耐心。

我最喜歡它的地方,正是它讓你學會用這種極長的時間維度去思考。所以我想,到了後 AGI 時代,或者如果我今天不在 Anthropic 工作,我大概會專心做味噌吧。

Lenny Rachitsky: 我太喜歡這個回答了!Ben 當初特別交代我一定要問你「味噌到底是怎麼一回事」,真高興你親口解答了。所以你的未來,可能就是深潛進味噌的世界,把做味噌這門手藝練到爐火純青。

太不可思議了。Boris,這場對話太精彩了,我感覺我們現在像是來自烏克蘭的親兄弟一樣。在我們進入刺激的「閃電快問快答(Lightning Round)」之前,還有什麼是你想要跟聽眾分享的嗎?有沒有任何你想留給聽眾的話、或是有什麼想要再次強調的重點?

Boris Cherny: 我想再次強調的是:對 Anthropic 來說,從最一開始,這種「先攻克寫程式,再進階到工具使用,接著邁向電腦操作」的構想,始終都是我們思考的核心脈絡。這是我們深信模型必然會發展的方向、是我們構建模型的藍圖,同時也是我們能最深入研究安全性、檢驗安全性並將其大幅提升的途徑。

因此,現在所發生的一切——像是 Claude Code 演變成一項規模數十億美元的龐大業務;我身邊所有的朋友都在用 Claude Code,整天傳訊息跟我聊它;看著它成長到今天的規模——在某些維度上確實讓人感到完全出乎意料,因為我們起初根本不知道最終會具象化成這款產品,也不知道它最初會誕生在終端機裡;但在另一些維度上,這又完全在情理之中,因為這早就是我們公司長久以來的堅定信念。

與此同時,這一切感覺依然處在極為早期的階段。全世界絕大多數人至今都還沒有使用過 Claude Code,世界上大多數人甚至都還沒開始使用 AI。所以這讓人覺得我們目前只完成了 1% 而已,前方還有無比漫長的路要走。

Claude Code 的爆發性增長與使用者回饋

Lenny Rachitsky: 是啊,光是想想這點就覺得不可思議。看到最近公布的這些數據:你們剛募集了一筆天文數字般的巨額資金;光是 Claude Code 本身一年的營收就達到 20 億美元;而 Anthropic 整體營收據你們公布的數據甚至高達 150 億美元。一邊看著這些龐大的數字,一邊想到這居然還只是起點,實在太瘋狂了。

Boris Cherny: 沒錯,這真的很瘋狂。而且說實話,Claude Code 之所以能持續保持這種增長,完全要歸功於使用者。有這麼多人在使用它、對它充滿熱情、深深愛上了這款產品,然後把哪裡壞了、他們還想要什麼功能毫無保留地告訴我們。它能持續進步的唯一原因,就是因為每個人都在使用它、每個人都在討論它、每個人都在持續提供反饋,這絕對是單一最重要的一件事。對我個人而言,這也是我最享受日常度過的方式——與使用者對話、為他們把產品打磨得更好,以及做味噌。

Lenny Rachitsky: 以及做味噌!

Boris Cherny: 哈哈,做味噌其實不需要花太多精力,你基本上只要等它發酵就行了。

Lenny Rachitsky: 只要耐心等待就行了。好的,Boris,我們現在來到了非常刺激的閃電快問快答環節!我準備了五個問題要請教你,準備好了嗎?

Boris Cherny: 來吧!

閃電快問快答:書、影集、產品與座右銘

Lenny Rachitsky: 第一個問題:有沒有兩到三本你平時最常推薦給別人的書?

Boris Cherny: 我是個閱讀量很大的人。我先從一本技術書籍開始推薦:第一本是《Functional Programming in Scala》(Scala 函數式編程)。這是我讀過有史以來最棒的一本技術書。這推薦可能聽起來有點奇怪,因為你在工作上很可能根本不會用到 Scala,我也不確定這在未來還會有多大意義,但函數式編程與型別思維中蘊含著一種極致的優雅。這是我寫程式的方式,也是我腦海中無法停止思考編程的方式。你可以把它當成一件歷史文物來看待,也可以當成能讓你技術大幅升級的寶典。

Lenny Rachitsky: 這本我從沒聽人提過,太棒了!

Boris Cherny: 第二本是 Charles Stross 寫的《Accelerando》(加速)。科幻小說是我最喜歡的文學類型。《Accelerando》是一本令人震撼的書,它的敘事節奏快到不可思議,而且速度只會越來越快。我覺得這本書比我讀過的任何作品都更精準地捕捉到了我們當下所處時代的本質——那種驚人的加速度。故事從科技奇點剛開始騰飛展開,一路邁向奇點,最後以圍繞著木星軌道運行的「龍蝦集體意識」收尾。而這一切僅僅發生在幾十年的跨度之內,那種節奏感太不可思議了,我非常喜歡。

如果可以再推薦一本的話,那就是劉慈欣的《流浪地球》。劉慈欣就是寫《三體》的那位作者,我想大多數人都因為《三體》認識他。《三體》確實棒極了,但我個人甚至更喜歡他的短篇小說集。《流浪地球》就是其中的一本短篇集,裡面收錄了一些非常驚豔的故事。讀中國科幻小說也是一件極為有趣的事,因為它的視角和西方科幻小說截然不同,至少在劉慈欣的筆下有著非常獨特的思考維度。整本書極具啟發性,而且文筆非常優美。

Lenny Rachitsky: 科幻小說如何預先為我們的心智做好準備、去理解未來的走向,這點實在太耐人尋味了。它在我們腦中建立起了一種心智模型:「我明白,我在書裡讀過類似的世界。」

Boris Cherny: 是的。我想對我而言,這其實也是我當初加入 Anthropic 的原因。就像我剛才說的,那時我住在日本鄉村,習慣在極長的時間尺度上去思考,因為那裡的生活比起舊金山實在太緩慢了。所有的事情都圍繞著四季運行、圍繞著需要耗時數月釀造的食物運轉。社交活動是這樣組織的、時間也是這樣安排的。你去農夫市集,現在是柿子的產季,市集裡有二十個攤位全在賣柿子;到了下一週,產季結束了,瞬間換成滿滿的葡萄。你會親眼看見這種輪轉,學會用漫長的時間維度看待事物。

當時我讀了大量的科幻小說,身處在那樣的時空交會點,我心裡想著長遠的時間尺度,我知道事情可能會走向何方,我深感自己必須出一份力,讓這項進程走向更好的一面。這正是我最終來到 Anthropic 的初衷,而 Ben Mann 在這當中也扮演了極為關鍵的推動角色。

Lenny Rachitsky: 我真想再做一整期播客,好好聊聊你在日本的生活,以及 Boris 橫跨日本再到 Anthropic 的心路歷程。但我們今天先點到為止。

我也順便推薦你一本我自己很愛的科幻小說:你有讀過《深淵上的火》(A Fire Upon the Deep)嗎?

Boris Cherny: 那是 Vernor Vinge 寫的對吧?寫得太棒了,我看過。

Lenny Rachitsky: 太好了!從 AI 和 AGI 的維度來看,那本書實在太深刻了。讀過的人好像不多,但真的極為震撼。

Boris Cherny: 我也很喜歡他的續作《天盲》(A Deepness in the Sky,又譯《天淵》)。雖然厚重且背景龐雜,但非常精彩。

Lenny Rachitsky: 好,我們繼續進行快問快答。第三題:你最近有特別喜愛的電影或電視劇嗎?

Boris Cherny: 老實說,我最近其實不太看電視或電影,現在真的抽不出時間。不過我看了 Netflix 翻拍的《三體》影集,我非常喜歡。我覺得那是對原著小說一次非常棒的改編與詮釋。

Lenny Rachitsky: 看來所有 AI 領袖的共通點就是完全沒時間看電視和電影,這我完全能理解。

第四題:最近有沒有哪一款你新發現且真心熱愛的產品?

Boris Cherny: 請容許我王婆賣瓜一下,我必須說是 Cowork。這真的是對我生活帶來翻天覆地改變的一款產品。我幾乎隨時都讓它在背景運作,特別是它的 Chrome 瀏覽器整合功能,實在太出色了。它幫我繳過交通罰單、幫我退訂了好幾個訂閱服務。它幫我擺脫的枯燥瑣事數量令人難以置信。

另外,我不知道播客算不算是一種「產品」,但如果有的話——除了 Lenny 的播客之外——我個人非常熱愛由 Ben Gilbert 和 David Rosenthal 主持的《Acquired》播客。這檔節目做得極其出色,他們剖析商業史並將其講得栩栩如生的方式實在太棒了。如果你還沒聽過,我推薦從任天堂(Nintendo)那一集開始聽起。

Lenny Rachitsky: 很棒的推薦。關於 Cowork,為了讓還沒嘗試過的人能具體理解:基本上就是你輸入任何想要完成的事情,它就能自動開啟 Chrome 瀏覽器幫你執行。我看到 Anthropic 內部有人去休育嬰假,就讓 Cowork 幫他填寫各類繁瑣的醫療申請 PDF 表格——它會自己開啟瀏覽器、登入系統、填好表格並送出。

Boris Cherny: 沒錯,完全就是這樣。而且它真的能順暢運作。我們大約在一年前做過類似的實驗,當時完全行不通,因為模型還沒準備好;但現在它真的能夠順利運作了,這非常神奇。很多人目前還無法完全理解這到底是什麼,因為他們從來沒有使用過真正的 Agent。這給我的感覺,跟一年前大家看待 Claude Code 的時候非常相像。但如同我剛才提到的,它現在的成長速度遠比早期的 Claude Code 還要迅猛,它正在逐漸走向大眾主流。

Lenny Rachitsky: 而且你剛才提到的 Chrome 擴充功能也可以單獨使用:它就常駐在 Chrome 瀏覽器裡,你可以邊看著螢幕畫面邊跟 Claude 對話,讓它幫你處理任務、解說你正在瀏覽的內容、摘要網頁重點等等。

Boris Cherny: 沒錯。對於剛剛開始接觸 Cowork 的人,我的建議是:下載 Claude 桌面端 App,點選 Cowork 分頁(就在 Code 分頁旁邊)。

第一步,先讓它使用單一工具——比如整理你的電腦桌面、摘要你的 Email,或是替你回覆最重要的前三封 Email。它現在甚至已經開始直接幫我回覆 Email 了。

第二步,嘗試串接不同的工具——比如吩咐它:「去檢查我最重要的幾封郵件,然後發送 Slack 訊息通知大家」,或是把數據整理進試算表。舉例來說,我們整個團隊的專案管理都在一個共用試算表上,每位工程師各占一列,每週大家都要填寫進度。現在每到週一,Cowork 就會自動掃描,並在 Slack 上主動發訊息去提醒所有還沒更新進度的工程師。我再也不用親自去催了,一句 Prompt 它就能搞定一切。

第三步,平行啟動多個任務。在 Cowork 裡你可以隨意同時跑多個任務:先啟動專案管理任務,接著開另一個任務處理別的事,然後再去啟動第三件事。把任務全部派發出去後,你就可以轉身去泡杯咖啡,讓它自己跑完。

Lenny Rachitsky: 我也會把一篇文章連結放在節目說明裡,裡面整理了許多大家以前用 Claude Code、現在可以用 Cowork 完成的各種任務範例。很多人往往是看見了具體的案例後,才會驚呼「哇,原來這也可以做到!」

Boris Cherny: 是的。而且其實很多靈感也是受你啟發的,Lenny。你之前曾寫過一篇關於 Claude 50 個非技術應用場景的文章。在我們正式發布 Cowork 之前,我們的一位 PM 其實就是把你的那份清單拿來作為評估標準。當 Cowork 能夠順利完成其中 48 項任務時,團隊才認定:「好,這款產品已經足夠成熟了。」

Lenny Rachitsky: 哇,我完全不知道這件事!太棒了,我居然變成了你們的模型評估測試(Eval)標準!

Boris Cherny: 哈哈,是的!感覺如何?

Lenny Rachitsky: 太棒了,我覺得自己對 AI 的未來產生了不可磨滅的價值!太酷了。

好的,最後兩個問題。第五題:在工作或人生中,你有沒有一句奉為圭臬的座右銘?

Boris Cherny: 「運用常識(Use common sense)。」

我認為在職場環境中,許多人之所以失敗,往往純粹是因為缺乏常識。大家盲目遵循流程而不加思索;機械地執行任務而不動腦;或者在開發一款顯然並非好產品、不是個好點子的專案時,僅僅順著慣性盲目推進,從不去反思合理性。

我見過表現最出色的人,往往都是從第一性原理出發,培養出自己敏銳的常識判斷力。如果某件事聞起來不太對勁,那它大概率就不是個好主意。這是我平時給同事最多、最核心的一句建議。

為什麼 Boris 開始活躍於 Twitter

Lenny Rachitsky: 最後一個問題:你最近在 Twitter(X)上變得非常活躍,好奇背後的原因是什麼?你在 Twitter 上的社群互動體驗如何?

Boris Cherny: 過去很長一段時間我只用 Threads,因為我以前曾參與過一點點 Threads 的開發工作,而且我也很喜歡它乾淨簡潔的設計。

我之所以開始用 Twitter,純粹是因為太無聊了。去年十二月我和妻子在歐洲旅行度假,我們像數位游牧民族一樣四處漫遊,去了哥本哈根等幾個國家。對我來說那是一趟「寫程式假期」——每天都在寫程式,這是我最愛的度假模式,能整天寫程式簡直太棒了。

但寫到某個階段我突然有點無聊,大概有好幾個小時我想不出下一步該寫點什麼。於是我打開 Twitter,看到有些人正在發推文討論 Claude Code,我就開始順手回覆他們。接著我想:「或許我該主動去找找大家遇到了什麼 Bug 或有什麼回饋意見。」於是我發文自我介紹,詢問大家有沒有遇到 Bug 或有什麼想提的建議。

大家似乎對我們如今修復問題的速度感到非常震撼。但對我來說這太平常了——如果有人回報 Bug,我大概幾分鐘之內就能修好,因為我只要啟動 Claude,只要問題描述得清楚,它就會自動搞定,同時間我就可以轉身去處理下一則留言。但對很多人來說這似乎非常不可思議。

在 Twitter 上的互動體驗棒極了,能直接跟大眾交流、了解使用者的渴望、傾聽 Bug 與功能需求,這種感覺非常棒。

結語

Lenny Rachitsky: Boris,我真的能跟你聊上好幾個小時。今天就先聊到這裡,非常感謝你抽空前來,你太棒了!大家可以在哪裡找到你?聽眾朋友可以如何為你提供幫助?

Boris Cherny: 大家可以在 Threads 或 Twitter 上找到我,這是最直接的方式。請隨時在上面標記我、回報 Bug、提出功能建議。告訴我產品還缺少什麼、我們該怎麼做才能把它打造得更好、你喜歡什麼、你希望看到什麼——我非常渴望聽到大家的心聲。

Lenny Rachitsky: 太棒了。Boris,非常感謝你來到節目!

Boris Cherny: 謝謝,再見各位!

Lenny Rachitsky: 感謝大家的收聽。如果你覺得這期節目對你有所啟發,歡迎在 Apple Podcasts、Spotify 或你常用的播客平台上訂閱我們的節目。也請不吝給予我們好評評分或留下評論,這能極大地幫助其他聽眾發現這檔播客。你可以在 lennyspodcast.com 找到所有過往的精彩集數並了解更多資訊。我們下一期節目再見!

上一篇:從 Claude Code 到 Cowork:AI Agent、通才時代與「潛在需求」

Claude Code 負責人 Boris Cherny 談 Claude Code 的誕生、100% 由 AI 撰寫程式碼的工作方式、工程生產力暴增、Token 預算,以及他為何以古騰堡印刷術理解 AI 對程式設計的改變。

本文為 Boris Cherny × Lenny Rachitsky 訪談逐字稿系列第 1 篇,共 3 篇。 Boris Cherny: 我 100% 的程式碼都是由 Claude Code 撰寫的。自去年十一月以來,我沒有親手手寫過任何一行程式碼。我每天都會發布 10、20、甚至 30 個 Pull Request。就在我們錄音的當下,我背景還有大概五個 Agent 正在同時運行。 Lenny

↗

Anthropic Claude Code 核心成員 Boris Cherny 接受 Acquired Unplugged 訪談,完整談論 Claude Code 的誕生、模型能力躍升、工程效率、Agent Loop、Claude Co-work、通才 Builder、Token 驅動的組織方式,以及 AI 時代「品味」與人類價值觀的未來。

WorkOS 主辦的《Acquired Unplugged》訪談節目,由 Acquired 節目主持人與 Anthropic 的 Boris Cherny 對談,主題為:《Boris Cherny: Claude Code & the Future of Engineering》(影片長度約 29 分 38 秒,影片連結:http://www.youtube.com/watch?v=RkQQ7WE

↗

從 Peter Steinberger 的雙 MacBook、多終端機工作環境,到 GPT Codex 5.3 與 Claude Opus 4.6 的差異,再延伸到編程 Agent、作業系統與程式語言選擇。

Lex Fridman 好,我們回來了。聊聊你開發環境中一些有趣的硬體細節吧,剛才我們稍微扯遠了。聊點接地氣的:你到底接了多少台螢幕?網路上瘋傳一張你坐在大概一萬七千台螢幕前面的神照,太逗了。 Peter Steinberger 哈哈,那是自我調侃的迷因圖,我用 Groq 幫我生成合成了一堆螢幕上去。 Lex Fridman 所以現實中到底是迷因居多還是確有其事? Peter Steinberge

↗

訪談最後談到 AI 是否會取代程式設計師、人類創造者在 AI 時代的角色,以及 OpenClaw 社群帶來的創造力與 Peter Steinberger 對未來的期待。

Lex Fridman 傾聽大眾內心最真實的渴望才是唯一的指北針。 我們剛才花了不少篇幅深入探討編程的本質。放眼全球,有無數的軟體工程師此刻正陷入極度的生存焦慮之中,為自己的飯碗、為整個程式設計這門行業的未來徹夜難眠。 你發自內心地認為,AI 終將徹底取代人類程式設計師嗎? Peter Steinberger 從技術演進的軌跡來看,我們確實正在義無反顧地朝著那個終局狂奔。 但請銘記一點:單純的「撰

↗

Peter Steinberger 拆解 OpenClaw 的 Gateway、Agentic Loop、主動性與系統權限,並討論 AI Slop、軟體介面演進,以及 AI Agent 是否會讓大量既有 App 失去存在必要。

Lex Fridman 我們剛才零碎地提到了不少技術細節,但能否請你退後一步,從宏觀架構的維度為我們全景拆解一下 OpenClaw 的運作機制? 我們提到了 Gateway 網關、通訊客戶端整合、Harness 容器、Agentic Loop 執行迴圈。你曾說過一句名言:每位工程師這輩子都應該親手實作一次 Agentic Loop。 Peter Steinberger 沒錯,因為那是進入現代 AI

↗

發佈留言

電子郵件不會公開。 必填欄位標示為 *;留言可能需要審核。