Lukeverstopia
Look AI 一分鐘

AI 日報 — 2026-10-06

每日精選 AI/Tech 新聞,繁體中文整理


📍 今日全焦點

  • Anthropic 一天出現在四條新聞裡,而且都是別人在講怎麼少用它 — 五角大廈說停用、Meta/Microsoft 要員工戒、中國灰市在轉賣、訂閱太划算
  • Reflection 端出 501B 的 Beam — 西方開放權重第一次敢跟 GLM-5.2 並排,權重月底 Apache 2.0 放出
  • 紐約市議會把四家 AI 公司叫來宣誓作證 — 三位離職研究員同場,議長:「業界自律違反常理」
  • OpenAI 在歐盟給 ChatGPT 文字加隱形浮水印 — API 全球可選、預設關;Anthropic 8 月就全球強制了
  • 猶他州讓 AI 直接開處方 — 只限痘痘藥膏、前 100 人兩位醫師把關、月費 4.99 美元
  • 短訊 — ChatGPT 圖片生成旁要放廣告、19 歲創辦人做 3,499 美元的 agent 電腦、Cohere North 2、Altman 登 Vanity Fair

今日頭條

Anthropic 今天沒發任何新聞稿,卻出現在四條新聞裡——五角大廈說已停用、Meta 和 Microsoft 要員工少用、中國灰市在轉賣、SemiAnalysis 說它的訂閱划算到吃掉四成算力

所以今天 Anthropic 發生了什麼。直接列。

美東 10/5 一天之內,這家公司以四種身分出現在四家媒體:被國防部趕出門的供應商、被兩家科技巨頭「戒掉」的依賴、被中國灰市倒賣的商品、被分析機構算出「太慷慨」的訂閱服務。四條各自都不是頭條,並排起來講的是同一件事:Claude 太好用,所以每個人都在想怎麼少用它。


第一個身分:被趕出門,但拔不乾淨。

BBC 10/5 拿到一位國防部官員的一句話:「五角大廈已停止使用 Anthropic 的產品。」

回顧:國防部長 Hegseth 今年 2/27 把 Anthropic 列為**「供應鏈風險」(Supply Chain Risk,國防部原本用在外國對手廠商的安全評級),給了六個月**汰換期,理論上 8 月底就該結束。

但 BBC 的多位消息來源——包括前國防官員和承包商——說 Claude 上週都還在用,用途包括情報分析、研究,以及對伊朗的軍事行動。它嵌在 Palantir 的 Maven Smart System(五角大廈的情報整合平台)裡,負責整理大量資料、協助找目標。

喬治城大學 CSET 的 Lauren Kahn 一句話講完為什麼拖了這麼久:「一旦整合進去,要拔出來可能很痛。」

Anthropic 對 BBC 的聲明拒絕評論。法律線的現況:加州地院 8/27 判國防部的認定違憲並永久禁止執行,DC 巡迴上訴法院 9/25 卻 2:1 維持認定,兩個法院相反;川普 9/27 才私宴 Amodei。「停用」這句話出現的時間點,是法院分裂、白宮示好的夾縫裡。


第二個身分:客戶自己在戒。

The Information 10/5 報導,Meta 和 Microsoft 都在想辦法讓員工少用 Claude:

  • Meta:用 Claude Code 的員工從今年稍早的約 6 萬人掉到約 3 萬人。春天裁掉約一成員工(總數 7.8 萬)只能解釋一小部分,主要是公司把人推去自家的 Muse Code 和內部工具 MetaCode
  • Microsoft:原本估今年內部要花**至少 10 億美元(約新台幣 315 億元)**在 Claude 上,這個數字已砍掉超過三分之一,主管要工程師先用 GitHub Copilot。Microsoft 發言人向 PYMNTS 證實有這個導向

兩家都是 Anthropic 的競爭對手,自己做模型也做編程工具,少用對手的東西本來就合理。刺的是另一個數字:Anthropic 的上市申請文件寫著,近四分之一的營收來自兩個客戶,而且多數大客戶沒有長約。

⚠️ The Information 原文本報未能讀取;數字依 Investing.com、PYMNTS、Seeking Alpha 三家一致轉述。文件沒點名那兩個客戶是誰。


第三個身分:擋都擋不住的需求。

同一天 The Information 另一篇講中國的 token 轉賣灰市:用囤積的身分和 USDT 儲值的卡開 Claude 帳號,再透過代理轉售。本報只讀到摘要,但這條線不是新的——8 月 Oxford China Policy Lab 的研究就寫過,中國的「中轉站」以官方價格 70–90% 折扣賣 Claude 的 token,Anthropic 加了手機驗證、外國信用卡、生物辨識,每一道都有人繞。

Anthropic 是被明確禁止在中國賣的。需求還是自己長出一條供應鏈。


第四個身分:便宜到自己吃虧。

SemiAnalysis 10/5 實測兩家的訂閱方案在 agent 工作負載下換算成 API 的價值:Anthropic 的 200 美元方案約是 OpenAI 同級方案的 4 倍,整體約 5 倍。OpenAI 最近把 200 美元方案的額度砍了約一半,另推 500 美元方案。

但同一篇也算出代價:訂閱只佔 Anthropic 約一成營收,卻吃掉超過四成推論算力,把每一度電能賺的錢往下拉。

⚠️ SemiAnalysis 自列限制:單次量測誤差約 ±5%、快取讀取可能被低估、模型商可以隨時悄悄調額度(他們實測就撞到一個帳號被 A/B 測試砍兩成)。這是「現在這一刻」的數字。


所以呢。

國防部拔不掉、Meta 和 Microsoft 要花力氣才戒得掉、中國繞著禁令買、訂閱戶用到公司賠算力——四條新聞沒有一條是 Anthropic 自己想講的,但每一條都在證明同一件事:它的產品黏著度高到變成別人的問題。

對一家一個多月後要上市的公司,這是最好的廣告,也是招股書裡最難寫的風險段落。

來源:BBC(Yahoo 轉載)、aiweekly(BBC 摘述)、The Information(Meta/Microsoft,原文)、Investing.com(Yahoo 轉載)、PYMNTS、Seeking Alpha、The Information(灰市,原文)、The Decoder(8 月灰市研究)、SemiAnalysis


新聞摘要

Reflection 端出 501B 的 Beam:西方開放權重第一次敢跟 GLM-5.2 並排,權重月底 Apache 2.0 放出

兩個月前 WSJ 寫「美國的開放權重新創募不到錢」,今天其中一家把模型端出來了。

Reflection AI 10/5 發表 Beam:5,010 億參數的 MoE(Mixture of Experts,混合專家模型,每次只喚醒一部分參數),啟用 230 億,預訓練 23.8 兆 token,純文字輸入輸出,有效 context 100 萬 token。

官方最誠實的一句話值得整句抄:**「像 Kimi K3 這樣的前沿開放模型在原始能力上仍然領先,Beam 的優勢是推論時的效率。」**跑分也照這個邏輯看——

  • Terminal Bench 2.1:Beam 80.1,GLM-5.2 81.0,Qwen3.8-Max 86.6,Kimi K3 88.3
  • GPQA Diamond:90.5 vs 91.2 vs 92.6 vs 93.5
  • SWE-Bench Pro v2-Hard:77.2 vs Kimi K3 88.2

**跟 GLM-5.2 打平,跟 Qwen3.8-Max 和 Kimi K3 還有一段。**官方主打的是「用 3–4 倍更少的推論算力」做到跟 GLM-5.2 相當——但算法寫在腳註:FLOPs ≈ 2 × 啟用參數 × 平均生成 token 數,不含 prompt 預填與服務開銷,官方自己說是「近似算力比較,不是實測推論成本」。

訓練規模:預訓練 6,144 張 GB300、不到四週;RL 階段 1.05 萬張 GB300、四週、超過一億次 rollout。公司 6 月以 250 億美元投前估值募資,Nvidia、Sequoia、Citigroup 都在。兩位創辦人 Misha Laskin、Ioannis Antonoglou 都是前 DeepMind。

現在能拿到的是候補名單的早期存取,還在做最後紅隊測試;權重、技術報告、model card「本月稍晚」以 Apache 2.0 放出。

⚠️ model card 尚未發布,硬體需求官方沒寫;5,010 億參數 BF16 約需 1TB 記憶體,對個人讀者不是「可本地跑」的東西。Axios 10/4 說 10 月還會有其他西方開放權重模型跟上。

來源:Reflection 官方公告、TechCrunch、Semafor、Unite.AI、Axios(10 月西方開放權重)


紐約市議會把四家 AI 公司叫來宣誓作證,三位離職研究員同場:「業界自律違反常理」

這不是國會、不是加州,是一個城市的議會——而且是全美第一次。

10/5(週一),紐約市議會舉行 AI 風險聽證,Anthropic、OpenAI、Google、Meta 的代表宣誓作證:Anthropic 派 Frontier Red Team 負責人 Logan Graham,OpenAI 派政策發展主管 Morgan Dwyer,Google 派 AI 政策主管 Alice Friend,Meta 派立法政策主管 Shane Cahill。

同場作證的三位離職研究員,讀者應該都眼熟:

  • Jacob Coxon(9 月辭去 Anthropic 並離開產業的前預訓練研究員):**「照現在這條路,我認為人類失去對這些 AI 控制的機率超過一半,而且可能以人類滅絕收場。」**他另一句是給議員聽的:「『快速行動、打破東西、之後再修』對照片分享 App 行得通,對史上最強的技術不行。」
  • Daniel Kokotajlo(前 OpenAI,AI Futures Project 執行長):業界「以為解決了問題,其實只是貼了日後會脫落的膠帶」
  • Alex Turner(前 Google DeepMind):「我們很可能正在自家養出自己的對手——失準的 AI。」

議長 Julie Menin 的開場:**「認為 AI 產業會自律,違反所有常理。」**議會正在審 10 項法案,Fortune 點出的幾條:未經外部驗證機構核可、沒有人類關機能力不得部署,每次違規罰 2.5 萬美元;吹哨者可分得罰款;紐約人可對越獄工具造成的可預見傷害提告。

市長 Mamdani 的說法是 AI 管制需要聯邦層級行動——一個城市管不了前沿模型,但能決定自己要不要當第一個開罰單的地方政府。

⚠️ Fortune 稱 Kokotajlo 與 Turner 是收到傳票到場、SpaceX-AI 未出席並收到議長首張傳票,僅見該報;各公司代表的具體發言各家報導皆未詳述。

來源:Fortune、CNBC、ABC7 NY、Bloomberg(原文)


OpenAI 在歐盟給 ChatGPT 文字加隱形浮水印:API 全球可選、預設關——Anthropic 8 月就全球強制了

同一條法規,兩家公司給出兩種答案。

OpenAI 10/5 公布因應歐盟 AI 法案(第 50 條,8/2 起生效的透明義務)的做法,技術叫 textGrain:

  • ChatGPT 和 Codex 在歐盟產生的文字:未來幾週起加隱形浮水印
  • API:全球客戶可選擇開啟,支援部分模型,預設關閉
  • 偵測工具:初期只給核准的研究機構

原理跟 Anthropic 8 月那套同一路:不插隱藏字元,而是用一把秘密金鑰偏移「幾個字都通」時的選字,段落夠長才顯現。OpenAI 自列的限制很直白:能說「這段可能經 OpenAI 系統處理」,不能說是誰用的、人貢獻多少、誰擁有、內容對不對;驗不出也不代表人寫的。

偵測率(依 The Decoder 等轉述):心理學類文字 200 token 約 80%、400 token 約 95%,數學類明顯更低;換掉一成同義詞掉到 66%,換掉四分之一掉到兩成以下。

對照組:Anthropic 8/2 起全球所有產品強制開,API、Claude、Claude Code、雲端通路全包。OpenAI 選的是法規要求的地方才開,其他地方讓客戶決定。

**對開發者的實際意義:你用 OpenAI API 產的文字,預設沒有浮水印;用 Claude 的,有。**要不要讓產出可被溯源,現在是選廠商時的一個變數。

⚠️ OpenAI 官方頁本報未能直接讀取(403),內容依 OpenAI 開發者社群的官方轉貼與 The Decoder、aiweekly 一致轉述。

來源:OpenAI 官方(原文)、OpenAI 開發者社群(官方轉貼)、The Decoder、aiweekly


猶他州讓 AI 直接開處方:只限痘痘藥膏、前 100 人兩位醫師把關、月費 4.99 美元

美國第一次有州政府允許「醫師沒看過」的處方從 AI 手上送進藥局。

新創 Nolla Health 10/5 在猶他州上線 Nolla Derm:成年居民打開 App、驗證身分、填 10–15 分鐘問卷、五個角度掃臉,AI 從醫師預先核准的外用痘痘藥膏清單裡選一個,處方直接送藥局,月費 4.99 美元(約新台幣 157 元)。

授權機制是猶他州 AI 政策辦公室的**「監管緩解協議」(州的 AI 沙盒制度),效期 12 個月。範圍只有輕中度痘痘的外用藥膏**,嚴重痘痘、口服藥、A 酸都不行。

Bloomberg 的標題是「沒有直接人類監督」,實際條件分三階段:

  • 前 100 位病人:兩位猶他州執照醫師逐張審核後才送藥局
  • 第二階段:AI 直接開、醫師定期回顧——Nolla 部落格寫每週,同日新聞稿寫每日(兩份官方文件不一致,照列)
  • 第三階段:每月抽查至少 10%,後兩階段都還要州政府再核准

另有硬指標:與醫師判斷的一致率要維持 95% 以上、不良事件 24 小時內通報、藥局要揭露處方有 AI 參與。

「AI 開處方」聽起來很大,實際放出去的是最低風險的那一格——而且監督拿掉的速度,由州政府決定。

來源:Nolla Health 官方部落格、Nolla 新聞稿(PR Newswire)、Runtime Wire(猶他州協議條文)、Bloomberg(原文)


短訊四則:ChatGPT 圖片生成旁要放廣告、19 歲創辦人做 agent 電腦、Cohere North 2、Altman 登 Vanity Fair

  • ChatGPT 生圖時旁邊會出現廣告:OpenAI 宣布 10 月稍晚在美國測試視覺廣告,一小群廣告主,廣告放在生成圖片旁邊、不嵌進圖裡、有明確標示;敏感對話不投放,品牌安全由 DoubleVerify 和 IAS 驗證。從文字廣告走到視覺廣告,離「圖片本身就是廣告」只差一步。⚠️ OpenAI 官方頁未能讀取,依 BleepingComputer、Adweek(Yahoo 轉載)、Gadget Review 一致轉述
  • Ghost:3,499 美元、沒有螢幕的 agent 電腦:19 歲的 Zain Javaid 和三位共同創辦人做了 Core——一台裝 RTX Pro 4000 Blackwell 的桌機,預載 Qwen-3.8-Next、Qwen-3.8-27B、Gemma-4-31B,用手機 App 或語音操作,定價 3,499 美元(約新台幣 11 萬元)。a16z 領投 1,100 萬美元種子輪,10/5 開放預購、10 月底出貨。賭的是「agent 要有自己的電腦,不是借用你的」
  • Cohere North 2:企業 agent 平台改版,重點是跨 session 記憶、重寫的 harness、以使用者和部門為單位的 token 預算與上限,可以在雲端、本地或完全離線環境跑。價格不公開
  • Altman 登 Vanity Fair「New Establishment」榜首:雜誌停辦近十年的榜單重啟,Altman 排第一。被問 Brockman 的政治捐款是否跟他公開支持管制的立場不一致,他說**「我不認為那是公平的切法」**;談滅絕風險:「我假設有些人拿它來合理化追逐權力⋯⋯但不代表沒有真實的風險。」上週才被員工在 Slack 逼退捐款的總裁,老闆選擇不切割。

來源:Gadget Review(OpenAI 廣告)、BleepingComputer(原文)、TechCrunch(Ghost)、Cohere 官方、VentureBeat(North 2)、Vanity Fair(原文)、Vanity Fair 官方 X


值得關注

  • 「已停用」是採購狀態還是現場狀態:BBC 的消息來源說上週還在用。兩週內如果 DefenseScoop 或 Breaking Defense 這類軍事媒體找到 Maven 裡 Claude 仍在跑的證據,這句話就只是紙上的;如果 Palantir 或國防部公布替換完成的時程,才算真的拔掉了。
  • Anthropic 的招股書會不會補這一段:Bloomberg 說最快 11/9 那週開始路演。下一版申請文件若在客戶集中風險段落新增「主要客戶減少使用」的描述,代表 Meta/Microsoft 的縮減已經大到要揭露;沒加,就是那兩個客戶不是他們。
  • Beam 權重放出後的三個對照:官方說本月稍晚。看 model card 的硬體需求有沒有寫清楚、Artificial Analysis 這類第三方能不能重現「3–4 倍更省算力」、以及 Axios 說的其他西方開放權重模型有沒有在同一個月跟上。三件事有兩件成立,「西方開放權重」才從募資故事變成產品線。
  • 紐約那 10 項法案會不會走到委員會表決:議長已經把話講滿。年底前任何一條排進表決,紐約就是第一個對前沿模型「部署前驗證」立法的美國城市;沒有,這場聽證就是一次公開質詢。
  • textGrain 之後,Google 和 Meta 怎麼選:Anthropic 全球強制、OpenAI 歐盟強制+全球可選,兩個模板都出來了。Google 的 Gemini 和 Meta 的 Muse 若跟 OpenAI 一樣「法規要求才開」,歐盟以外的 AI 文字就會變成「只有 Claude 驗得出來」的局面。
  • Nolla 的第二階段核不核:前 100 位病人要先過兩位醫師的手,一致率門檻 95%。猶他州在第一階段結束後核准「醫師改為事後回顧」,等於承認那個數字夠用;不核准,這就是一次失敗的沙盒試驗,其他州會拿來當反例。