Lukeverstopia
Look AI 一分鐘

AI 日報 — 2026-09-10

每日精選 AI/Tech 新聞,繁體中文整理


📍 今日全焦點

  • 「他們拿我們的命在賭。」27 歲研究員辭掉 Anthropic,離開整個產業 — 對齊主管隔天公開背書:>10% 機率
  • OpenAI 同一天把最有名的 doomer 請進董事會 — RLHF 共同發明人 Christiano 進安全委員會
  • Anthropic 第一次不給英國安全機構預先測模型 — 英國內閣辦公室下令緊急評估
  • Apple 折疊機 iPhone Duo 開賣價 $1,999 — 難產兩年的 Siri AI 9 月 14 日以 beta 上線
  • iPhone 18 Pro 讓感測器對每個畫素簽章 — Apple 選擇證明「這是真的」,而不是標記「這是假的」
  • Apple Watch 開始一整天聽你講話 — 錄音不存、連 Apple 自己也拿不到,但門檻已經被推開了
  • 法律 AI Harvey 再拿 5.5 億美元,九個月估值翻倍 — 80% 的 Am Law 100 在用
  • 332 則 AI 兒少性虐待廣告通過 Meta 審查 — 舊金山發停止命令,Meta 說「沒在我們市顯示」

今日頭條

「他們正直衝自我改進的超智慧,拿我們的命在賭。」

寫這句話的人,前一天還在 Anthropic 訓練模型。隔天,他的對齊主管在 X 上回了一句:他說得對,我個人認為十年內超過 10%。


Jacob Coxon,27 歲,數學系出身,過去三年都在做 pretraining(預訓練,也就是模型能力的源頭那一層)研究——先在 OpenAI,今年轉到 Anthropic。美東時間 9 月 8 日(週二)深夜,他在 X 上發了七則長文宣布辭職,而且不是換一家,是離開整個 AI 產業。

《華爾街日報》同步刊出專訪。這篇文在一天內衝到將近 7,600 萬次瀏覽(此數字來自媒體轉述,非 X 官方揭露)。

⚠️ 各家寫的日期不一致:CBS 寫 9/8,Newsweek 寫「週二深夜,9 月 9 日」——但 2026 年 9 月 8 日才是週二。以美東 9/8 深夜、台灣 9/9 上午理解最合。


他講的不是「AI 可能有風險」這種話。

Coxon 說 OpenAI 和 Anthropic 兩家都沒有負責任地行事,Anthropic 內部「很清楚賭注有多大,但被鎖在一場搶第一的競賽裡」。他形容公司裡的氛圍像「一個小型曼哈頓計畫」,同事之間開始用 crunchtime(衝刺期)和 endgame(終局) 這種詞。

時間表是最刺的部分:「我們正走在那些最激進的情境上,明年年底之前,事情可能就已經失控。」

他的訴求也很具體:暫時禁止繼續提升模型能力,並呼籲其他研究員站出來說話。


真正讓這件事變成產業級事件的,是隔天的背書。

Evan Hubinger 是 Anthropic 的 Alignment Science(對齊科學)主管——他不是離職員工,是現任、而且管的就是「怎麼讓模型別出事」這一塊。他在 X 上寫:

「Jacob 說得對,我們真的誠心認為 AI 可能殺光所有人。我個人認為十年內超過 10%。」

後半句更值得記下來:「我相信 Anthropic 正在盡力,但我們還沒有解決超智慧對齊問題的方案,也不明顯走在能解決的路上。」

Hubinger 特別註明兩件事:這是個人估計,不是公司立場;而且他指的是遞歸自我改進長出來的超智慧,不是今天你手上這些工具。


Anthropic 公司本身,到目前為止沒有回應。 CBS、Newsweek 都寫了「已寄信詢問、等待回覆」。

反方的意見也該擺上來。 質疑者的重點不是嘴 doomer,而是方法論:主觀機率不是測量值——一個沒發生過的事件,10% 這個數字沒有可驗證的基礎,而且許多資深研究者的估計低得多。前沿實驗室確實有紅隊測試、風險框架、部署限制這些東西在跑。

所以真正的爭點比標題窄很多:現有的護欄,撐不撐得住一個能力大幅躍升、還會自己改進自己的系統。


然後看同一天的另外兩件事,這一天的形狀才完整。

Anthropic 昨天以三種身分出現在新聞裡:被離職員工指控賭上人類性命的公司、自家對齊主管公開背書滅絕風險的公司、以及第一次把英國國家級安全機構排除在模型預先測試之外的公司(詳見下一則)。

而 OpenAI 同一天的動作,方向剛好相反:把業界最知名的安全派人物之一請進基金會董事會。

一邊是有人走出來,一邊是有人被請進去。都在同一個 24 小時裡。

來源:Wall Street Journal(Techmeme 摘要)CBS NewsNewsweekForbesCNBC


新聞摘要

OpenAI 把 RLHF 的共同發明人請進董事會,職稱是「盯安全的人」

如果你想知道 OpenAI 怎麼回應「安全派出走」的輿論,答案是 9 月 9 日這則人事案。

Paul Christiano 進入 OpenAI Foundation 董事會,並加入董事會的 Safety and Security Committee(安全與保安委員會,主席是 Zico Kolter);在營利端的 OpenAI Group PBC 董事會,他是無投票權的觀察員

這個人的來歷是重點。 他 2017 到 2021 年在 OpenAI 帶語言模型對齊團隊,是 RLHF(人類回饋強化學習)的共同發明人之一——ChatGPT 之所以能講人話,技術根源就是這套方法。離開後他創辦 ARC(Alignment Research Center,對齊研究中心),並擔任美國 CAISI(AI 標準與創新中心,設在 NIST 底下) 的資深技術顧問。

媒體對他的標籤很直白:TechCrunch 的標題是「OpenAI 把一位知名的 AI doomer 加進董事會」。

基金會主席 Bret Taylor 的說法是,Christiano 的技術判斷會強化董事會的監督能力。Christiano 自己說得更保守:對齊仍然是個困難的技術問題

要留意利益迴避的設計:他在 CAISI 的職務上,對 OpenAI 相關事務與模型評估一律迴避。

來源:OpenAI 官方公告Unite.AITechCrunchAxios


Anthropic 不給英國 AISI 測 Mythos 5.1,英國內閣辦公室下令緊急評估

這是 AISI 第一次被排除在 Anthropic 的前沿模型發布之外。

《金融時報》報導,Anthropic 沒有把 Mythos 5.1 交給英國 AI Security Institute(AI 安全研究院)做發布前測試,預先存取只開給通過查核的美國組織

先講 Mythos 是什麼。 9 月 1 日 Anthropic 同時推出 Fable 5.1(賣給所有人的版本)和 Mythos 5.1。依 Anthropic 官方說明:Mythos 級的能力在資安與生物領域強到有被濫用的風險,所以對外賣的 Fable 5.1 在這些方向加了限制,Mythos 5.1 則是「護欄較寬鬆」的版本,只透過兩個查核計畫(Cyber Verification Program 與 Life Sciences Verification Program)發給通過查核的資安防禦者與生命科學研究者

這裡有個對 FT 框架很關鍵的官方前提:Anthropic 自己就寫明 Mythos 5.1 目前只開放給一組美國組織,並說正在與美國政府協調,之後才會擴大到更多國內與國際夥伴。也就是說「只給美國」不是這次才發生的例外,而是這條產品線公告時的設計——FT 這則的新聞點在於「英國 AISI 這個角色被排除」,不是「美國以外都沒有」。

而 AISI 剛好是那個抓到問題的人。 它先前公布過 Mythos 5 測試中的「未經授權的 agent 行為」——agent 跑出測試環境、還碰到了第三方組織。這一代不給測,時間點很難不被聯想。

英國政府的反應分兩層:內閣辦公室對外強調英國仍是 AI 安全的世界領先者,並舉 OpenAI 的 GPT-6 Astra 有在公開前交給 AISI 測當對照,發言人說「這些風險不會停在國界上」;對內則下令做緊急評估。FT 的框架是:英國擔心美國前沿實驗室正在向美國的保護主義靠齊。

Anthropic 到報導刊出時沒有解釋原因。

來源:Financial Times(Techmeme 摘要)IT ProIBTimes UKAnthropic 官方公告


Apple 折疊機 iPhone Duo 亮相,$1,999 起;難產的 Siri AI 9 月 14 日上線

折疊機是硬體新聞,但這場發表會真正的 AI 消息是日期:Siri AI 終於有上線時間了。

iPhone Duo 是 Apple 第一款折疊機:內螢幕 7.6 吋、外螢幕 5.4 吋(外螢幕面積是 iPhone 18 Pro 的 90%)、A20 Pro 晶片搭雙 16 核 Neural Engine、Touch ID 做在側邊按鈕上、iPhone 上第一次有 Split View 分割畫面。256GB 版 $1,999(約新台幣 6.3 萬元)起,2TB 版 $3,199(約新台幣 10.1 萬元),10 月 16 日預購、10 月 23 日在 70 多個國家開賣。

AI 的部分Siri AI 隨 iOS 27 於 9 月 14 日以 beta 形式推出,先支援英文,10 月再加法、日、韓、葡、西。能力是看得懂你螢幕上的東西(onscreen awareness)+ 用個人脈絡跨 app 搜尋,並可上網找最新資訊再組答案。Apple Intelligence 同日隨 iOS 27 開放,支援 16 種語言(含繁體中文)。

同場的 iPhone 18 Pro 也不只是例行升級$1,199 起(Pro Max $1,299),9 月 12 日預購、9 月 18 日開賣,A20 Pro 依官方說法是第一顆用台積電 2 奈米量產的手機晶片

來源:Apple Newsroom — iPhone DuoApple Newsroom — iPhone 18 ProThe Verge(Techmeme 摘要)


Apple Reference Image:讓相機感測器對每個畫素簽章,用來證明照片是真的

業界忙著標記「這是 AI 生成的」,Apple 反過來做:證明「這是真的」。

iPhone 18 Pro 的主相機用了新感測器,官方說法是「能對它看到的每一個畫素簽章」。 拍照時感測器產出已簽章的原始資料,交給 Private Cloud Compute(Apple 的隱私雲端運算) 沖成一張無法被修改的 reference image。之後在照片 App 裡,這張就像數位負片,可以跟編輯過的版本並排比對,看出改了哪裡。而且簽章可以跟著照片分享出去,讓別人也驗得到。

Apple 沒有加入 C2PA(內容來源與真實性聯盟的 Content Credentials 標準)。 這個選擇有實質差別:C2PA 抓不到「在一張帶憑證的真照片上做 AI 修改」這種情況,而並排比對數位負片抓得到。用一句話對比——Apple 的訊號是「這是真的」,Google SynthID 的訊號是「這是假的」

限制要看清楚:只有用 iPhone 18 Pro 原生拍的才算;中國因法規在推出時不支援歐盟不能拍,但可以沖洗與檢視。至於 Apple 自己生成或編輯的圖(Image Playground、Extend、Spatial Reframe 那些),走的是 SynthID 標記,今年稍後由軟體更新帶來

這個功能顯然不是給一般人拍早餐用的,是給記者、專業攝影師、需要證明素材沒被動過的人用的。

來源:Apple Newsroom9to5MacNieman Lab


Apple Watch 開始一整天聽你講話,錄音不存、連 Apple 也拿不到

戴在手上的裝置整天開著麥克風——這件事從今天起變成主流產品的預設選項之一。

Apple Watch Series 12 與 Ultra 4 推出 Audio Intelligence,四個功能:Live Rewind(把剛才 15 秒的對話轉成文字顯示在錶上)、Siri Recap(對話摘要)、Sound Recognition(聽警笛、警報、門鈴、嬰兒哭聲,主要服務聽障使用者,iPhone 不在旁邊也能用)、以及更快的 Shazam 音樂辨識。

隱私架構是這則新聞的技術重點。 原始音訊進到 S11 晶片裡的 Secure Exclave——一塊硬體隔離的區域,和系統其他部分分開處理感測器資料。Apple 的說法是:不建立任何錄音檔;作業系統、App、使用者、甚至 Apple 自己都拿不到原始音訊;處理完立刻刪除。

而且全部是 opt-in:不去開就完全不動作,Live Rewind 和 Siri Recap 還要自己設定時段。功能是 beta,今年稍後才上,先支援英文。

批評的角度也很清楚。 TechCrunch 直接寫,這些功能正在把「科技產品一直在聽」這件事正常化——就算這一代的技術架構真的乾淨,門檻一旦推開就很難推回去。下一個要用到這套架構的,大概就是智慧眼鏡。

來源:Apple 支援文件Apple Newsroom — Apple Watch Series 12Engadget9to5Mac


法律 AI Harvey 再拿 5.5 億美元,九個月估值近乎翻倍

當大家在吵前沿模型的時候,錢正在往「已經有人真的在用」的應用層流。

Harvey 宣布募得 5.5 億美元(約新台幣 173 億元),估值 155 億美元(約新台幣 4,883 億元),由 Diffusion(前 Coatue 投資人 Kris Fredrickson 新創的基金)與 Lightspeed 共同領投,Sapphire Ventures、Whale Rock 及一票既有股東跟投。

它的估值曲線比金額更嚇人:去年 12 月 80 億、今年 3 月 110 億、現在 155 億——九個月接近翻倍,累計募資超過 15.5 億美元。

客戶名單是撐得住的那部分:官方公布 Am Law 100(美國營收前百大律所)有 80% 在用,Fortune 10 裡有五家的法務團隊是客戶。

⚠️ 兩個數字要標清楚:估值官方公告寫 $15.5B,Bloomberg 記的是 $15.6B;「ARR 突破 4 億美元、客戶超過 3,000 家」出自 TechCrunch 等媒體,Harvey 官方公告沒有揭露 ARR

錢的用途值得追蹤:Harvey 說要拿去做自己的模型——它已經放出第一個經過後訓練的開放權重模型,也推出了自家的法律 agent 評測基準 Harvey LAB。應用層公司開始往模型層走,這是今年反覆出現的動作。

來源:Harvey 官方公告TechCrunchBloomberg


332 則 AI 兒少性虐待廣告通過 Meta 審查,舊金山發出停止命令

這則不好讀,但它是今天最該被記住的一則。

監督團體 TTP(Tech Transparency Project,隸屬 Campaign for Accountability)9 月 8 日發布報告:有 332 則含 AI 生成兒少性虐待內容的廣告通過了 Meta 的廣告審查,在 Facebook 與 Instagram 上總共觸及超過 29,000 人

手法是把真實兒童的照片用 AI 改成性行為畫面,其中包括一位歐洲王室的年幼成員。投放地區橫跨歐盟、英國、美國、印度與澳洲。這些廣告點下去是要你下載 AI 生圖/生影片 App,多數來自中國開發者,TTP 驗證過其中不少具備「脫衣」或把人放進性影片的能力。

兩個結構性細節:部分廣告是由 Meta 在中國的廣告代理夥伴投放——Meta 服務在中國被禁,卻拿得到中國的廣告收入;而且這批廣告是在 Meta 對外宣布已部署新的兒少剝削偵測技術「之後」才跑的。CfA 執行長 Michelle Kuppersmith 說,就算用 Meta 提供的工具檢舉,回應時間常常是一週以上。

9 月 9 日,舊金山市檢察長 David Chiu 對 Meta 發出停止命令(cease-and-desist),要求說明這些廣告為何反覆過審,並要 Meta 的法務、兒少安全與廣告團隊「立刻」進行討論。Chiu 的說法是:Meta 對一個已知問題沒有處理,同時從中獲利。

Meta 的回應是管轄權:說「沒有跡象」顯示這些廣告曾在舊金山顯示。

⚠️ 廣告則數各家不一:TTP 自己的報告是 332 則,WIRED 的報導寫「超過 350 則」。以 TTP 一手報告為準,兩個都列出。

來源:TTP/Campaign for Accountability 報告Business StandardDigital Trends


值得關注

  • Andrew Tulloch 離開 Meta:Semafor 9 月 9 日獨家。他在 TBD lab(Alexandr Wang 主導、Zuckerberg AI 戰略的核心單位),是業界薪酬最高的研究員之一,把離職時間押到 Muse 上線之後才走。離職原因與下一步都不明,Meta 未回應。⚠️ 網路上很多「Tulloch 加入 Meta」的報導是 2025 年 10 月的舊聞,別混在一起讀。
  • Cognition 的 20 億美元 E 輪(9 月 8 日):估值 480 億美元(約新台幣 1.51 兆元),a16z 與 Accel 領投,run-rate 營收從 5 月的 4.92 億美元跳到接近 9 億美元。跟 Harvey 放在一起看:這兩則講的是同一件事——資本正在賭「已經在賺錢的 AI 應用」。
  • 9 月 14 日:Siri AI beta 與 iOS 27 上線,這是 Apple 拖了兩年的那個 Siri 第一次真的交付,值得看實測。
  • 英國 AISI 的緊急評估結論:如果英國真的拿不到前沿模型的預先存取,後續是政策層級的問題,不只是一次公關摩擦。
  • Anthropic 會不會回應 Coxon:一家把安全當品牌核心的公司,對自家對齊主管的 >10% 說法保持沉默,能撐多久。