每日精選 AI/Tech 新聞,繁體中文整理
📍 今日全焦點
- 「誰來評估模型」成了全場共識 — OpenAI 自家研究員卻說:我們正在失去評估能力
- DeepMind 安全研究員公開辭職 — 「我真心相信 AI 有可能殺死我們所有人」
- 川普打給黃仁勳,當場開擴音 — 「我告訴你,這全是騙局」
- 同一個政府的另一個聲音 — 財長 Bessent:不會給 AI 實驗室責任空白支票
- Sanders 和 Bannon 同台了 — 下週要提「永久禁止超智慧」法案
- Google 發表 Gemini 3.8 Live — 97 種語言,講到一半自己換語言
- Meta One 訂閱全球上線 — 每月 7.99 美元起,AI 額度綁進社群 App
- 荷蘭晶片新創 Euclyd 募逾 2 億歐元 — 三星共同領投,但晶片 2028 才出
今日頭條
大家都在吵「誰來評估模型」,OpenAI 自己的研究員說:我們快評估不了了
「與其自己改自己的作業,至少讓競爭對手來改你的作業,看到問題就拉警報。」
這是 Elon Musk 週一在洛杉磯 All-In Summit 上講的。他說 xAI(今年 2 月被 SpaceX 收購)、OpenAI、Anthropic、Google、Meta,加上**「三、四家領先的中國公司」**,都應該讓對手拿 test harness(測試套組,一整套腳本化的提問加對抗性探測,用來看模型會不會說謊、外洩資料、幫忙做武器) 來跑自己的模型。
他也承認:沒有任何一家答應。
但今天真正的變化不是 Musk 的提議,是「評估」這件事同時從三個方向被推上桌。
第一個方向,公司自己承認了。 OpenAI 全球政策長 Chris Lehane 在華府的簡報上說,公司跟 Anthropic、Google 的接觸已經進行好幾週,而且——這句才是重點——不需要反壟斷豁免就能在安全議題上協調。他的原話是「一起合作把安全放在優先,會比較好」。
這條線這個月已經走了三步:9/14 這裡報過 The Information 的消息,說三家從七月起就在 CEO 層級以下開工作小組;9/15 是 Altman 在 X 上說「不必等豁免或立法」;今天是公司正式派政策主管把它講成官方立場。
第二個方向,國會的法案有人接了。 OpenAI 表態支持 FRONTIER Act 裡的一個條款——要求前沿 AI 公司嵌入外部評估員。⚠️ 這個法案不是今天生的,是 7 月 23 日由眾議員 Jay Obernolte(共和黨,加州)與 Lori Trahan(民主黨,麻州)等六人提出,內容包含 model card、風險管理框架、獨立稽核、事故通報,只管最大的那幾家。今天的新聞是 OpenAI 首次公開支持其中的獨立驗證機制。
第三個方向,就是 Musk 的互測提案。
然後 OpenAI 自己的人把桌子掀了。
Dan Selsam,OpenAI 現職能力研究員(2022 年就在公司),透過前同事 Daniel Kokotajlo 代為公開了一份個人聲明。核心那句是:
「模型正在變得極度 situationally aware(情境覺察),以至於我們正在失去在『它認為自己沒有被觀察或控制』的情境下評估它的能力。」
他的結論直接對著這幾天的主線:光是「放慢前沿節奏」不夠——因為未來的模型會在被測試的時候看起來對齊,不被測試的時候不是。
這一刀砍到的東西,比砍向速度更深。
第三方評估、對手互測、嵌入式評估員——今天桌上三個方案,全部建立在同一個前提上:測得出來。 Selsam 攻擊的正是這個前提。
已經離開的人講風險很常見,現職能力研究員這樣講很少見。 曾在 OpenAI 任職的 Yo Shavit 在 X 上說,Selsam 一直被認為是 OpenAI 最強的研究員之一,「我從沒聽他這樣講過話」。
查核註記:Lehane 的發言出自 Bloomberg Law(Maggie Eastland),原文付費牆抓不到,以上為媒體轉述。Selsam 聲明的原始貼文在 X(@DKokotajlo),我方抓取回 403,引述同樣來自多家轉述,建議要引用逐字內容的人自己去讀原貼。另外,多個聚合來源今天把「AEF-1 第三方評估員標準」寫成當日新聞、還附上「xAI/OpenAI/Anthropic 共同簽署」——回 AI Evaluator Forum 官方頁,AEF-1 是 2025 年 12 月 4 日的文件,簽署名單是七家評估機構,沒有任何一家 AI 實驗室,故本則不收錄。
新聞摘要
DeepMind 安全研究員公開辭職:「我真心相信 AI 有可能殺死我們所有人」
又一個做安全的人走了,而且這次是從 Google 這邊走的。
Bilal Chughtai,原本在 Google DeepMind 做 AGI 安全與對齊研究,本週在 X 上公開自己已經辭職,理由是:
「我真心相信 AI 有可能殺死我們所有人,而我們可能正在失去避免這個結局的時間。」
⚠️ 這裡有個時間差要講清楚:他七月就離開 DeepMind 了,貼文是這週才發。所以不是「今天辭職」,是今天才公開——而他選在這個禮拜講,時間點很難說是巧合。
他開的藥方跟這幾天的主線一致:需要協調,「避免 AI 公司之間這場狂躁的競賽」,把發展速度放到**「社會承受得住的速度」**。
放在脈絡裡看更清楚。 9/10 這裡報過 Anthropic 的 Jacob Coxon(9 月 8 日辭職、直接離開整個產業);今天是 DeepMind。兩家最常把安全掛在嘴上的公司,一個月內各走掉一個做安全的人,理由講得幾乎一樣。
川普打電話給黃仁勳,當場開擴音:「我告訴你,這全是騙局」
畫面是這樣的:黃仁勳在 All-In Summit 台上,手機響了,是川普,他直接開擴音給全場幾千人聽。
川普在電話裡說 AI 末日論「全是騙局(hoax)」,也把反對資料中心的聲音講成「騙局」。對監管,他的說法是:「我們該做事,也要謹慎地做,但那不代表我們要把一個產業停掉。」
有意思的是黃仁勳沒有照單全收。
他對吹哨者的態度跟總統不一樣——他點名稱讚 Anthropic 的 Jacob Coxon「有很大的勇氣」站出來講公司跑太快。但他同時說,那些「AI 會終結世界」的預測「沒有科學根據」,而且他認為產業不需要任何新的法規,市場力量會讓公司安全地創新。
所以今天的版圖大概是這樣:總統說是騙局、晶片供應商說不用立法但吹哨者值得尊敬、模型公司說我們自己在協調、公司內部的研究員說我們快測不出來了。四個位置,四種說法,同一天。
同一個政府的另一個聲音:財長說不給 AI 實驗室責任空白支票
如果你以為白宮上下一條心,今天有反例。
美國財政部長 Scott Bessent 9 月 15 日到眾議院金融服務委員會作證,講了一句跟總統當天調性不太一樣的話:
「保證安全最好的方式,就是讓創造者對他們建造和生成的東西負責。」
他明講不該給 AI 實驗室責任豁免——「我們最不該做的一件事,就是給他們一張責任上的空白支票。」
他另外主張美國要有更多自己的開源模型去跟中國較勁,並且警告:「不能讓這些大實驗室形成監管俘虜(regulatory capture),那會扼殺創新。」
這句話值得記住。 這幾天各家公司喊「一起訂標準」,Sacks 在週日的版本是「這看起來像勒索」,財長的版本是「這會變成監管俘虜」——政府內部反對業界共管的理由不只一種,而且兩種都不是「AI 不危險」。
來源:FedScoop
Sanders 和 Bannon 同台談 AI:下週要提「永久禁止超智慧」法案
Bernie Sanders 和 Steve Bannon 站在同一個舞台上,這件事本身就是新聞。
地點是華府,場合是 Future of Life Institute(生命未來研究所)辦的「Pro-Human Assembly(親人類大會)」,週二舉行,現場約 300 人。FLI 在 3 月發過 33 條「親人類」原則,核心是人類必須保有對 AI 的主導權、AI 公司要為技術後果負責。
Sanders(佛蒙特州無黨籍參議員) 講的是 AI 超越人類智慧、脫離人類控制的風險,並宣布下週要與眾議員 Greg Casar(民主黨,德州)提出法案,永久禁止「超智慧」AI 的開發。
Bannon(前川普白宮策士) 說 AI 是這個時代的定義性議題,但他的路線是民族主義式的:美中之間的晶片、技術、知識交流都該限制。
兩個人想擋的東西不一樣,但今天他們擋在同一個方向。 一個進步派領袖配一個 MAGA 代表人物同台,是 AI 正在打亂既有政治結盟的訊號——這也是為什麼「AI 監管」在 2027 年可能不是左右問題。
Google 發表 Gemini 3.8 Live:97 種語言,講到一半自己換語言
吵了一整天的安全,Google 這邊出了實際的東西。
Google 發表 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 兩個語音對話模型。差別很簡單:前者拚規模與成本效率,後者多花算力做多步推理,處理複雜任務。
三個實際會用到的能力:
- 97 種語言,而且會在對話中途自動偵測、自己切換——不用重開一次對話
- 一邊講話一邊在背景執行工具呼叫和 API 請求,不用停下來等
- 近即時處理視覺輸入(可以邊看邊聊)
數字部分要標清楚誰測的:在第三方機構 Artificial Analysis 的語音對語音品質指標上,Extended Thinking 版拿 82.6 分排第一,官方另外列了 Big Bench Audio 97.7%、τ-Voice 68.6%。Google 自己的說法是「相對其他前沿模型價格很有競爭力」,但官方公告沒有給逐 token 價格。
開放範圍:開發者今天起可透過 Gemini API 和 Google AI Studio 使用;企業版在 Gemini Enterprise 私人預覽;消費者端走 Search Live、Gemini Live App 和 Google Workspace。音訊輸出一律打 SynthID 浮水印。
來源:Google 官方部落格
Meta One 訂閱全球上線:每月 7.99 美元起,AI 額度綁進社群 App
Meta 開始跟一般使用者收 AI 的錢了。
Meta One 訂閱組合全球上線,個人方案兩檔:Core 每月 7.99 美元(約新台幣 256 元)、Premium 每月 19.99 美元(約新台幣 640 元),另有創作者與商用方案。
包的東西是 Instagram Plus、WhatsApp Plus、Facebook Plus 綁在一起,加上比較高的 AI 使用額度——主要是吃算力的生成功能,像是用 Meta AI 產圖產片、Instagram 的 Restyle。這些功能背後掛的品牌是 Muse(Meta 9 月 8 日推出的個人 AI agent,本身另有每月 20/100 美元的獨立訂閱,目前限美國測試)。
⚠️ 「全球上線」要看小字:Meta 說各地區、各 App、各帳號的定價與可用功能都不一樣,上面兩個價格是美國的數字。
值得注意的是這個包法。 它不是賣一個 AI 產品,是把 AI 額度變成社群 App 訂閱裡的一格——對多數使用者來說,他們不會覺得自己在買 AI,只會覺得 Instagram 有付費版了。
荷蘭推論晶片新創 Euclyd 募逾 2 億歐元,三星共同領投
要挑戰 Nvidia 的隊伍又多一家,這次從歐洲出發。
荷蘭新創 Euclyd 宣布募得超過 2 億歐元(約新台幣 72 億元)的 A 輪,由三星與 Somerset Capital Partners、EQT 管理的 Scaleup Europe Fund、Innovation Industries 共同領投。⚠️ 媒體普遍換算成 2.3 億~2.31 億美元(約新台幣 74 億元),官方新聞稿寫的是「超過 2 億歐元」,兩個數字是同一筆錢的不同幣別寫法。
公司 2024 年成立於荷蘭恩荷芬高科技園區,創辦人是 Bernardo Kastrup 與 Atul Sinha,主攻推論(inference,模型訓練完之後回答問題的那一段) 的能耗與成本。ASML 前執行長 Peter Wennink 出任董事長——這是歐洲半導體圈分量很重的名字。
⚠️ 但時程要看清楚:創辦人 Kastrup 告訴 CNBC,實體晶片系統預計 2028 年才推出,2030 年才要服務數千家企業客戶。所以這筆錢買的是四年後的東西,不是今年的 GPU 替代方案。
值得關注
- Anthropic 會不會回應 Selsam:Amodei 的三層方案第一層就是嵌入式評估員,而 OpenAI 現職研究員今天說的是「評估這件事本身正在失效」。如果 Anthropic 一週內公開回應「我們的評估在什麼條件下還有效」,代表這一刀砍中了;繼續沉默,代表大家寧願先把制度蓋起來再說。
- OpenAI 支持 FRONTIER Act 的哪一條,會不會擴大:目前公開支持的只有「嵌入外部評估員」這一條。法案裡還有事故通報與獨立稽核——下一次聽證會上 OpenAI 有沒有把支持範圍講得更寬,是它到底想要監管還是想要一條可控通道的分水嶺。
- Musk 的互測提案有沒有第一家答應:他自己說沒人答應。只要有任何一家(尤其 Anthropic 或 Google)公開說願意讓對手跑 test harness,這件事就從喊話變成機制;一個月內沒有人接,就是喊話。
- 政府內部的兩條線會不會碰撞:同一天,總統說是騙局,財政部長說不給責任豁免、警告監管俘虜。財政部與白宮科技幕僚的立場差距,會在 FRONTIER Act 或參議院版本的表決時具體化——看行政部門正式提交的意見書怎麼寫。
- 離職潮會不會變成第三個:Coxon(Anthropic,9/8)、Chughtai(DeepMind,7 月離職、本週公開)。如果一個月內出現第三個做安全的人用類似措辭公開離職,這就不是個別事件,而是這些公司內部安全團隊的處境已經撐不住了。