每日精選 AI/Tech 新聞,繁體中文整理
📍 今日全焦點
- 「他們拿我們的命在賭。」27 歲研究員辭掉 Anthropic,離開整個產業 — 對齊主管隔天公開背書:>10% 機率
- OpenAI 同一天把最有名的 doomer 請進董事會 — RLHF 共同發明人 Christiano 進安全委員會
- Anthropic 第一次不給英國安全機構預先測模型 — 英國內閣辦公室下令緊急評估
- Apple 折疊機 iPhone Duo 開賣價 $1,999 — 難產兩年的 Siri AI 9 月 14 日以 beta 上線
- iPhone 18 Pro 讓感測器對每個畫素簽章 — Apple 選擇證明「這是真的」,而不是標記「這是假的」
- Apple Watch 開始一整天聽你講話 — 錄音不存、連 Apple 自己也拿不到,但門檻已經被推開了
- 法律 AI Harvey 再拿 5.5 億美元,九個月估值翻倍 — 80% 的 Am Law 100 在用
- 332 則 AI 兒少性虐待廣告通過 Meta 審查 — 舊金山發停止命令,Meta 說「沒在我們市顯示」
今日頭條
「他們正直衝自我改進的超智慧,拿我們的命在賭。」
寫這句話的人,前一天還在 Anthropic 訓練模型。隔天,他的對齊主管在 X 上回了一句:他說得對,我個人認為十年內超過 10%。
Jacob Coxon,27 歲,數學系出身,過去三年都在做 pretraining(預訓練,也就是模型能力的源頭那一層)研究——先在 OpenAI,今年轉到 Anthropic。美東時間 9 月 8 日(週二)深夜,他在 X 上發了七則長文宣布辭職,而且不是換一家,是離開整個 AI 產業。
《華爾街日報》同步刊出專訪。這篇文在一天內衝到將近 7,600 萬次瀏覽(此數字來自媒體轉述,非 X 官方揭露)。
⚠️ 各家寫的日期不一致:CBS 寫 9/8,Newsweek 寫「週二深夜,9 月 9 日」——但 2026 年 9 月 8 日才是週二。以美東 9/8 深夜、台灣 9/9 上午理解最合。
他講的不是「AI 可能有風險」這種話。
Coxon 說 OpenAI 和 Anthropic 兩家都沒有負責任地行事,Anthropic 內部「很清楚賭注有多大,但被鎖在一場搶第一的競賽裡」。他形容公司裡的氛圍像「一個小型曼哈頓計畫」,同事之間開始用 crunchtime(衝刺期)和 endgame(終局) 這種詞。
時間表是最刺的部分:「我們正走在那些最激進的情境上,明年年底之前,事情可能就已經失控。」
他的訴求也很具體:暫時禁止繼續提升模型能力,並呼籲其他研究員站出來說話。
真正讓這件事變成產業級事件的,是隔天的背書。
Evan Hubinger 是 Anthropic 的 Alignment Science(對齊科學)主管——他不是離職員工,是現任、而且管的就是「怎麼讓模型別出事」這一塊。他在 X 上寫:
「Jacob 說得對,我們真的誠心認為 AI 可能殺光所有人。我個人認為十年內超過 10%。」
後半句更值得記下來:「我相信 Anthropic 正在盡力,但我們還沒有解決超智慧對齊問題的方案,也不明顯走在能解決的路上。」
Hubinger 特別註明兩件事:這是個人估計,不是公司立場;而且他指的是遞歸自我改進長出來的超智慧,不是今天你手上這些工具。
Anthropic 公司本身,到目前為止沒有回應。 CBS、Newsweek 都寫了「已寄信詢問、等待回覆」。
反方的意見也該擺上來。 質疑者的重點不是嘴 doomer,而是方法論:主觀機率不是測量值——一個沒發生過的事件,10% 這個數字沒有可驗證的基礎,而且許多資深研究者的估計低得多。前沿實驗室確實有紅隊測試、風險框架、部署限制這些東西在跑。
所以真正的爭點比標題窄很多:現有的護欄,撐不撐得住一個能力大幅躍升、還會自己改進自己的系統。
然後看同一天的另外兩件事,這一天的形狀才完整。
Anthropic 昨天以三種身分出現在新聞裡:被離職員工指控賭上人類性命的公司、自家對齊主管公開背書滅絕風險的公司、以及第一次把英國國家級安全機構排除在模型預先測試之外的公司(詳見下一則)。
而 OpenAI 同一天的動作,方向剛好相反:把業界最知名的安全派人物之一請進基金會董事會。
一邊是有人走出來,一邊是有人被請進去。都在同一個 24 小時裡。
新聞摘要
OpenAI 把 RLHF 的共同發明人請進董事會,職稱是「盯安全的人」
如果你想知道 OpenAI 怎麼回應「安全派出走」的輿論,答案是 9 月 9 日這則人事案。
Paul Christiano 進入 OpenAI Foundation 董事會,並加入董事會的 Safety and Security Committee(安全與保安委員會,主席是 Zico Kolter);在營利端的 OpenAI Group PBC 董事會,他是無投票權的觀察員。
這個人的來歷是重點。 他 2017 到 2021 年在 OpenAI 帶語言模型對齊團隊,是 RLHF(人類回饋強化學習)的共同發明人之一——ChatGPT 之所以能講人話,技術根源就是這套方法。離開後他創辦 ARC(Alignment Research Center,對齊研究中心),並擔任美國 CAISI(AI 標準與創新中心,設在 NIST 底下) 的資深技術顧問。
媒體對他的標籤很直白:TechCrunch 的標題是「OpenAI 把一位知名的 AI doomer 加進董事會」。
基金會主席 Bret Taylor 的說法是,Christiano 的技術判斷會強化董事會的監督能力。Christiano 自己說得更保守:對齊仍然是個困難的技術問題。
要留意利益迴避的設計:他在 CAISI 的職務上,對 OpenAI 相關事務與模型評估一律迴避。
Anthropic 不給英國 AISI 測 Mythos 5.1,英國內閣辦公室下令緊急評估
這是 AISI 第一次被排除在 Anthropic 的前沿模型發布之外。
《金融時報》報導,Anthropic 沒有把 Mythos 5.1 交給英國 AI Security Institute(AI 安全研究院)做發布前測試,預先存取只開給通過查核的美國組織。
先講 Mythos 是什麼。 9 月 1 日 Anthropic 同時推出 Fable 5.1(賣給所有人的版本)和 Mythos 5.1。依 Anthropic 官方說明:Mythos 級的能力在資安與生物領域強到有被濫用的風險,所以對外賣的 Fable 5.1 在這些方向加了限制,Mythos 5.1 則是「護欄較寬鬆」的版本,只透過兩個查核計畫(Cyber Verification Program 與 Life Sciences Verification Program)發給通過查核的資安防禦者與生命科學研究者。
這裡有個對 FT 框架很關鍵的官方前提:Anthropic 自己就寫明 Mythos 5.1 目前只開放給一組美國組織,並說正在與美國政府協調,之後才會擴大到更多國內與國際夥伴。也就是說「只給美國」不是這次才發生的例外,而是這條產品線公告時的設計——FT 這則的新聞點在於「英國 AISI 這個角色被排除」,不是「美國以外都沒有」。
而 AISI 剛好是那個抓到問題的人。 它先前公布過 Mythos 5 測試中的「未經授權的 agent 行為」——agent 跑出測試環境、還碰到了第三方組織。這一代不給測,時間點很難不被聯想。
英國政府的反應分兩層:內閣辦公室對外強調英國仍是 AI 安全的世界領先者,並舉 OpenAI 的 GPT-6 Astra 有在公開前交給 AISI 測當對照,發言人說「這些風險不會停在國界上」;對內則下令做緊急評估。FT 的框架是:英國擔心美國前沿實驗室正在向美國的保護主義靠齊。
Anthropic 到報導刊出時沒有解釋原因。
Apple 折疊機 iPhone Duo 亮相,$1,999 起;難產的 Siri AI 9 月 14 日上線
折疊機是硬體新聞,但這場發表會真正的 AI 消息是日期:Siri AI 終於有上線時間了。
iPhone Duo 是 Apple 第一款折疊機:內螢幕 7.6 吋、外螢幕 5.4 吋(外螢幕面積是 iPhone 18 Pro 的 90%)、A20 Pro 晶片搭雙 16 核 Neural Engine、Touch ID 做在側邊按鈕上、iPhone 上第一次有 Split View 分割畫面。256GB 版 $1,999(約新台幣 6.3 萬元)起,2TB 版 $3,199(約新台幣 10.1 萬元),10 月 16 日預購、10 月 23 日在 70 多個國家開賣。
AI 的部分:Siri AI 隨 iOS 27 於 9 月 14 日以 beta 形式推出,先支援英文,10 月再加法、日、韓、葡、西。能力是看得懂你螢幕上的東西(onscreen awareness)+ 用個人脈絡跨 app 搜尋,並可上網找最新資訊再組答案。Apple Intelligence 同日隨 iOS 27 開放,支援 16 種語言(含繁體中文)。
同場的 iPhone 18 Pro 也不只是例行升級:$1,199 起(Pro Max $1,299),9 月 12 日預購、9 月 18 日開賣,A20 Pro 依官方說法是第一顆用台積電 2 奈米量產的手機晶片。
Apple Reference Image:讓相機感測器對每個畫素簽章,用來證明照片是真的
業界忙著標記「這是 AI 生成的」,Apple 反過來做:證明「這是真的」。
iPhone 18 Pro 的主相機用了新感測器,官方說法是「能對它看到的每一個畫素簽章」。 拍照時感測器產出已簽章的原始資料,交給 Private Cloud Compute(Apple 的隱私雲端運算) 沖成一張無法被修改的 reference image。之後在照片 App 裡,這張就像數位負片,可以跟編輯過的版本並排比對,看出改了哪裡。而且簽章可以跟著照片分享出去,讓別人也驗得到。
Apple 沒有加入 C2PA(內容來源與真實性聯盟的 Content Credentials 標準)。 這個選擇有實質差別:C2PA 抓不到「在一張帶憑證的真照片上做 AI 修改」這種情況,而並排比對數位負片抓得到。用一句話對比——Apple 的訊號是「這是真的」,Google SynthID 的訊號是「這是假的」。
限制要看清楚:只有用 iPhone 18 Pro 原生拍的才算;中國因法規在推出時不支援;歐盟不能拍,但可以沖洗與檢視。至於 Apple 自己生成或編輯的圖(Image Playground、Extend、Spatial Reframe 那些),走的是 SynthID 標記,今年稍後由軟體更新帶來。
這個功能顯然不是給一般人拍早餐用的,是給記者、專業攝影師、需要證明素材沒被動過的人用的。
Apple Watch 開始一整天聽你講話,錄音不存、連 Apple 也拿不到
戴在手上的裝置整天開著麥克風——這件事從今天起變成主流產品的預設選項之一。
Apple Watch Series 12 與 Ultra 4 推出 Audio Intelligence,四個功能:Live Rewind(把剛才 15 秒的對話轉成文字顯示在錶上)、Siri Recap(對話摘要)、Sound Recognition(聽警笛、警報、門鈴、嬰兒哭聲,主要服務聽障使用者,iPhone 不在旁邊也能用)、以及更快的 Shazam 音樂辨識。
隱私架構是這則新聞的技術重點。 原始音訊進到 S11 晶片裡的 Secure Exclave——一塊硬體隔離的區域,和系統其他部分分開處理感測器資料。Apple 的說法是:不建立任何錄音檔;作業系統、App、使用者、甚至 Apple 自己都拿不到原始音訊;處理完立刻刪除。
而且全部是 opt-in:不去開就完全不動作,Live Rewind 和 Siri Recap 還要自己設定時段。功能是 beta,今年稍後才上,先支援英文。
批評的角度也很清楚。 TechCrunch 直接寫,這些功能正在把「科技產品一直在聽」這件事正常化——就算這一代的技術架構真的乾淨,門檻一旦推開就很難推回去。下一個要用到這套架構的,大概就是智慧眼鏡。
法律 AI Harvey 再拿 5.5 億美元,九個月估值近乎翻倍
當大家在吵前沿模型的時候,錢正在往「已經有人真的在用」的應用層流。
Harvey 宣布募得 5.5 億美元(約新台幣 173 億元),估值 155 億美元(約新台幣 4,883 億元),由 Diffusion(前 Coatue 投資人 Kris Fredrickson 新創的基金)與 Lightspeed 共同領投,Sapphire Ventures、Whale Rock 及一票既有股東跟投。
它的估值曲線比金額更嚇人:去年 12 月 80 億、今年 3 月 110 億、現在 155 億——九個月接近翻倍,累計募資超過 15.5 億美元。
客戶名單是撐得住的那部分:官方公布 Am Law 100(美國營收前百大律所)有 80% 在用,Fortune 10 裡有五家的法務團隊是客戶。
⚠️ 兩個數字要標清楚:估值官方公告寫 $15.5B,Bloomberg 記的是 $15.6B;「ARR 突破 4 億美元、客戶超過 3,000 家」出自 TechCrunch 等媒體,Harvey 官方公告沒有揭露 ARR。
錢的用途值得追蹤:Harvey 說要拿去做自己的模型——它已經放出第一個經過後訓練的開放權重模型,也推出了自家的法律 agent 評測基準 Harvey LAB。應用層公司開始往模型層走,這是今年反覆出現的動作。
332 則 AI 兒少性虐待廣告通過 Meta 審查,舊金山發出停止命令
這則不好讀,但它是今天最該被記住的一則。
監督團體 TTP(Tech Transparency Project,隸屬 Campaign for Accountability)9 月 8 日發布報告:有 332 則含 AI 生成兒少性虐待內容的廣告通過了 Meta 的廣告審查,在 Facebook 與 Instagram 上總共觸及超過 29,000 人。
手法是把真實兒童的照片用 AI 改成性行為畫面,其中包括一位歐洲王室的年幼成員。投放地區橫跨歐盟、英國、美國、印度與澳洲。這些廣告點下去是要你下載 AI 生圖/生影片 App,多數來自中國開發者,TTP 驗證過其中不少具備「脫衣」或把人放進性影片的能力。
兩個結構性細節:部分廣告是由 Meta 在中國的廣告代理夥伴投放——Meta 服務在中國被禁,卻拿得到中國的廣告收入;而且這批廣告是在 Meta 對外宣布已部署新的兒少剝削偵測技術「之後」才跑的。CfA 執行長 Michelle Kuppersmith 說,就算用 Meta 提供的工具檢舉,回應時間常常是一週以上。
9 月 9 日,舊金山市檢察長 David Chiu 對 Meta 發出停止命令(cease-and-desist),要求說明這些廣告為何反覆過審,並要 Meta 的法務、兒少安全與廣告團隊「立刻」進行討論。Chiu 的說法是:Meta 對一個已知問題沒有處理,同時從中獲利。
Meta 的回應是管轄權:說「沒有跡象」顯示這些廣告曾在舊金山顯示。
⚠️ 廣告則數各家不一:TTP 自己的報告是 332 則,WIRED 的報導寫「超過 350 則」。以 TTP 一手報告為準,兩個都列出。
值得關注
- Andrew Tulloch 離開 Meta:Semafor 9 月 9 日獨家。他在 TBD lab(Alexandr Wang 主導、Zuckerberg AI 戰略的核心單位),是業界薪酬最高的研究員之一,把離職時間押到 Muse 上線之後才走。離職原因與下一步都不明,Meta 未回應。⚠️ 網路上很多「Tulloch 加入 Meta」的報導是 2025 年 10 月的舊聞,別混在一起讀。
- Cognition 的 20 億美元 E 輪(9 月 8 日):估值 480 億美元(約新台幣 1.51 兆元),a16z 與 Accel 領投,run-rate 營收從 5 月的 4.92 億美元跳到接近 9 億美元。跟 Harvey 放在一起看:這兩則講的是同一件事——資本正在賭「已經在賺錢的 AI 應用」。
- 9 月 14 日:Siri AI beta 與 iOS 27 上線,這是 Apple 拖了兩年的那個 Siri 第一次真的交付,值得看實測。
- 英國 AISI 的緊急評估結論:如果英國真的拿不到前沿模型的預先存取,後續是政策層級的問題,不只是一次公關摩擦。
- Anthropic 會不會回應 Coxon:一家把安全當品牌核心的公司,對自家對齊主管的 >10% 說法保持沉默,能撐多久。