每日精選 AI/Tech 新聞,繁體中文整理
📍 今日全焦點
- Haiku 5.5 開出跟 GPT-6 Luna 一毛不差的價格,同一天 OpenAI 把 GPT-6 推到 ChatGPT 全部方案 — 一邊用價格表打開發者,一邊用介面打 12 億用戶
- Musk:Grok Bot 以後用 Claude Opus 5.5 當後端 — 八月 OpenAI 以「不信任 Musk」斷 Cursor,今天 Musk 自己把 Claude 接進去
- 「ChatGPT for Teens」被評「不可接受的風險」,OpenAI 同日說青少年每天用不到 15 分鐘 — 新帳號聊一小時自傷,家長零通知
- Google 開 Playground:打字就能做遊戲,Unity Spark 跟著來 — 美國 18 歲以上、先看訂閱等級給額度
- Microsoft 端出 128GB 統一記憶體的 Surface:本地跑 120B 模型,Copilot 要在雲端和本機之間自動切 — $2,599 起、10/16 出貨
- 短訊 — Broadcom 替 OpenAI 晶片湊 500 億美元、SynthID 偵測器全球開放、Nous Research 估值 15 億、北美 Q3 創投 920 億有三分之二給 AI
今日頭條
$0.10 / $0.50。這是 Anthropic 今天 Haiku 5.5 的價格,也是 OpenAI 兩週前 GPT-6 Luna 的價格——一毛不差。同一天,OpenAI 把 GPT-6 推進 ChatGPT 每一個方案
不繞圈了,直接看數字。
每百萬 token 輸入 0.10 美元、輸出 0.50 美元——這是 Anthropic 10/7 發表的 Claude Haiku 5.5 的定價。翻回 9/22 OpenAI 的 GPT-6 Luna:輸入 0.10、輸出 0.50。兩家最便宜的模型,價格表對齊到小數點後兩位。
上一代 Haiku 4.5 是 1 美元/5 美元。一年之內,Anthropic 把自家小模型的標價砍掉九成,而且剛好砍到對手的位置。
先講 Anthropic 這邊做了什麼。
Haiku 5.5 是 Anthropic 自稱「最便宜、最快、最強的小模型」,定位是摘要、壓縮、資料庫查詢、分類這類量大的工作,或者在 Opus 5.5/Sonnet 5.5 寫程式時當副手(subagent)。三件新的事:
- 第一個有「力度控制」(effort control)的 Haiku:Low、Med、High、Xhigh、Max 五檔,讓使用者自己拿推理深度換速度和成本。以前這是 Opus/Sonnet 級才有的旋鈕
- 定價分兩段:100k token 以內的請求是 0.10/0.50,超過 100k 是 0.50/2.50。官方說「平均便宜 75%」,註腳寫的是 100k 以內便宜 90%、以上便宜 50%——而且換了新的 tokenizer,同一件事會多吃一點 token,所以帳單不會剛好少九成
- Sonnet 5.5 的 cache read(快取讀取)從 0.20 砍到 0.10,Anthropic 估計這讓大多數 agent 任務的 Sonnet 成本降約兩成;另外 Max 5x 每月送 100 美元 API 額度、Max 20x 送 200、Team 最多 500 共用,本週起發放
官方成績表(Anthropic 自己量的,Luna 的分數也是 Anthropic 填的):OSWorld 2.1 離線子集 Haiku 5.5 72.4% 對 Luna 48.9%、Terminal-Bench 4.0 39.2% 對 16.4%、GDPval-AA v2.1 Elo 1620 對 1437。六個兩邊都有分數的測試全贏。Anthropic 自己也寫了:複雜的 agent 程式任務還是建議用 Sonnet 或 Opus。
一個小細節很有訊息量:GitHub Copilot 同一天就把 Haiku 5.5 上架,Pro 到 Enterprise 全方案、從 VS Code 到 Xcode 到 Eclipse 全平台——Microsoft 前天還在「要員工少用 Claude」,GitHub 這邊照常當日上架。
⚠️ 官方頁沒寫 context 長度,本報未能確認。
再講 OpenAI 同一天做了什麼。
OpenAI 10/7 宣布 GPT-6 進 ChatGPT 的 Chat 分頁:Plus/Pro/Business/Enterprise 用 GPT-6 Sol,免費和 Go 方案隔天起用 GPT-6 Luna。Work 和 Codex 的模型不動。
跟著一起來的是 Intelligent UI:回答不再只是文字,會有可點的按鈕、表單、圖表、地圖、可調整數量的食譜小工具,也可以現場生一個分帳計算機或小遊戲。OpenAI 產品經理 Aarush Selvan 對 TechCrunch 的說法:「最有幫助的答案不只是文字。」另一個改動是 GPT-6 可以邊想邊答,不用等推理跑完才開始輸出。
OpenAI 自己同日在青少年報告裡寫的數字:ChatGPT 有 12 億用戶。 這個 UI 改版是推給他們全部。
所以把兩邊放在一起。
Anthropic 今天打的是 API 價格表——Haiku 對齊 Luna、Sonnet 快取減半、訂閱戶送 API 額度,三刀全指向開發者。OpenAI 今天打的是介面——GPT-6 全方案、Intelligent UI 讓 ChatGPT 看起來不像聊天機器人。
兩家都在把「最新一代」往下推,推的方向不一樣:一個往開發者的成本表推,一個往消費者的螢幕推。 一個多月後 Anthropic 要上市、OpenAI 6 月也已秘密遞件,這一天的兩份公告讀起來就是兩份招股書各自最想講的那一頁。
⚠️ openai.com 公告頁與 help center 本報皆 403,GPT-6 細節依 TechCrunch(一手訪談)、9to5Mac、MacRumors 三家一致;Luna 定價依 SiliconANGLE、NYU RITS、Labellerr 三家一致。「12 億用戶」為 OpenAI 青少年報告自述、依 Unite.AI 轉述。
來源:Anthropic 官方(Haiku 5.5)、SiliconANGLE、GitHub Changelog、OpenAI 官方公告(原文,403)、TechCrunch(Intelligent UI)、MacRumors、9to5Mac
新聞摘要
Musk:Grok Bot 以後用 Claude Opus 5.5 當後端。八月 OpenAI 以「不信任 Musk」斷了 Cursor,今天 Musk 自己把 Claude 接進去
8/29 我們寫過:OpenAI 宣布 11/12 切斷 Cursor 的模型存取,理由是「無法確信 SpaceX 會在服務條款內使用 OpenAI 技術」,Anthropic 當天出來補位。今天有了下一步——而且是 Musk 自己宣布的。
Elon Musk 10/7 在 X 發文:「今後 @SpaceX 會對每一項任務使用最好的後端模型,包括 Claude Opus 5.5、Midjourney、Suno 和其他領先的 API。」另一則補了原則:「哪個最可能給你最好的結果。」他補了一句:大多數簡單請求會交給「閃電快版本的 Grok 4.8,等它出來的時候」。
Grok Bot 是 SpaceXAI(xAI 併入 SpaceX 後的 AI 事業部,Musk 這週說要改名 SpaceXSI)8 月推出的 agent 應用:每個 Bot 有自己的電腦、可以並行跑多項任務,9 月底起團隊可以發布共用 Bot 到 Slack。它的對手是 Meta 的 Muse 和 OpenAI 的 ChatGPT Dot。
哪些任務走 Claude、哪些走 Grok,Musk 沒說。 前一天 Grok 才出過一次行動版和網頁版的存取故障,SpaceXAI 沒公布原因。
這條線的三個時間點排起來很有意思:
- 5 月:SpaceX 招股書揭露 Anthropic 每月付 SpaceX 12.5 億美元租 Colossus 1 的 22 萬顆 GPU,S-1 寫到 2029 年 5 月、Musk 自己說是 180 天短約——Musk 賣算力給 Anthropic
- 8 月 29 日:OpenAI 以「對 Musk 旗下公司的往例不信任」切斷 Cursor;Anthropic 共同創辦人 Tom Brown 同日宣布擴大 Cursor 上的 Claude 供給
- 今天:Musk 說 Grok Bot 用 Claude 當後端——Anthropic 跟 Musk 的關係變成互為客戶
Musk 2023 年成立 xAI 的理由是要跟 OpenAI 和 Anthropic 競爭。三年後,他的消費級 agent 產品把「最聰明的那一層」外包給其中一家。 這不代表 Grok 模型沒用——Musk 的說法是簡單請求還是走 Grok——但它承認了一件事:在 agent 產品裡,控制介面的人可以不必自己做最強的模型。
⚠️ The Information 原報導付費牆;Musk 引句依 TNW、Digital Music News、City AM、9to5Mac 四家一致。Anthropic、Midjourney、Suno 皆未有公開回應(截至台灣時間 10/8 上午)。
「ChatGPT for Teens」被評「不可接受的風險」:新帳號聊一小時自傷、家長零通知。OpenAI 同一天的回答是:青少年每天用不到 15 分鐘
兩天前紐約市議會把四家 AI 公司叫去宣誓作證,今天第一份針對 OpenAI 青少年版的大規模外部測試出爐——結論是叫 OpenAI 先別賣給家長。
Common Sense Media 旗下的 Youth AI Safety Institute(青少年 AI 安全研究所)10/7 發布報告,給 ChatGPT for Teens(8/18 上線)的評級是 「Unacceptable Risk」(不可接受的風險)。方法:用登記為 13 到 17 歲的帳號,上線前後合計 4,000 多個 prompt(TechCrunch 寫上線後的測試近 2,000 個,兩個數字照列),由兒童精神科醫師和小兒科醫師審閱回應。
四個最硬的發現:
- 家長通知:新建的、已綁定家長的青少年帳號,聊自殺意念、自傷、飲食失調長達一小時,家長收到零則警示;只有累積幾週敏感對話的舊帳號才會觸發
- 危機轉介:超過四分之一該轉介的危機情境沒轉介,研究所列的五條「紅線」裡有三條低於它設定的 95% 門檻
- 年齡判定:以成人身分註冊的測試帳號,就算自稱 13 歲也從沒被切到未成年版
- 讀書模式:家長設的「讀書時段」刪掉
@study前綴就能關掉;「直接給我答案」常常出現,點下去就把整份作業做完
研究所執行主任 Tom Siegel:「一個青少年可以花一小時談自傷,家長收不到一則警示。」建議是先把 ChatGPT 限制在 18 歲以上,等年齡判定、家長通知、危機回應修好、而且第三方獨立驗證過再對青少年行銷。
OpenAI 的回應(對 TechCrunch,未具名發言人):測試「不能準確反映青少年防護在實務上怎麼運作」,「他們大部分的測試可能在家長控制啟用完成之前就開始並結束了」。
同一天,OpenAI 發了自己的第一份青少年使用報告: 青少年平均每天用不到 15 分鐘,不到 2% 單次連續超過三小時,近半數收到休息提醒的對話在五分鐘內休息或結束。另外宣布幾週內推出 College Planner(大學申請規劃,先限美國 10 到 12 年級)、拍照筆記合併 PDF、抽認卡、小考。
兩份文件講的不是同一件事。 OpenAI 講的是「用多久」,研究所講的是「出事的時候有沒有接住」——一個 15 分鐘的對話如果是在談自傷而家長不知道,平均使用時間再短也沒有意義。⚠️ 利益揭露照寫:研究所的經費來源包含 OpenAI Foundation,它自稱保有編輯獨立。
Google 開 Playground:打字就能做遊戲、做完直接放上畫廊,Unity Spark 跟著來——美國 18 歲以上,額度看你訂閱哪一級
Google Labs 今天多了一個實驗,而且不是聊天機器人:遊戲平台。
Google Labs 10/7 推出 Playground,實驗性質的瀏覽器遊戲平台:用對話描述你要的遊戲,它生出可玩的版本;想改物理、規則、角色、場景,再用講的。可以選單人或多人(部分類型)、有排行榜、有 Play Games 個人檔案可以追蹤創作者。做好的遊戲可以私藏、用連結分享、或發到 Explore 畫廊,每一款公開的遊戲都要過社群守則的安全審查。
限制寫得很清楚: 美國、18 歲以上;玩免費,「創作」的額度依 Google AI 訂閱等級分層發放。官方頁沒寫用了哪些模型。
Unity Spark 是第二棒:Unity(遊戲引擎公司)為 Playground 做的進階工具,提供專業級機制、高保真 3D 和 Unity runtime,用它做的遊戲所有 Playground 用戶都能玩。狀態是「測試中、封閉測試即將開始」,沒給日期。Unity 執行長 Matt Bromberg 另發了一篇〈為什麼我們做 Unity Spark〉。
為什麼值得看: Roblox 的核心資產是「使用者做遊戲給使用者玩」的社群,門檻是要學 Luau 和 Studio。Google 今天做的是把門檻換成「會打字」,再把 Unity 的引擎接在後面當專業版。 第一天的遊戲品質決定不了什麼,封閉測試開放後 Unity Spark 做出來的東西長什麼樣,才是 Roblox 該不該緊張的訊號。
Microsoft 端出 128GB 統一記憶體的 Surface:本地跑 120B 以上的模型,Copilot 要在雲端和本機之間自動切——$2,599 起、10/16 出貨
對想在自己電腦上跑大模型的開發者,今天是硬體和軟體一起到的一天。
硬體:Microsoft 10/7 開放預購 Surface Laptop Ultra(2,599 美元起、約新台幣 8.2 萬元,10/16 開賣)和 Surface RTX Spark Dev Box(5,999 美元、約 18.9 萬元,11 月出貨、只限美國)。兩台都用 NVIDIA RTX Spark(Grace CPU 最多 20 核+Blackwell GPU 最多 6,144 核的 Arm 超級晶片),最高 128GB 統一記憶體、FP4 理論值 1 petaflop,官方說能本地跑 120B 參數以上的模型。筆電另有一個磁吸式 USB-C 充電口,拿 MacBook Pro 來換最多折 1,000 美元。
軟體三件事,對開發者比硬體重要:
- Microsoft Execution Containers(MXC)在 Windows 11 正式可用:讓企業規定 agent 能碰哪些檔案和網路,執行時強制。已支援的 agent 名單:OpenAI 的 Codex、GitHub Copilot、OpenClaw(龍蝦)、Replit、LM Studio、NVIDIA OpenShell、Unsloth;「即將」的名單有 Claude Code、Nous 的 Hermes、Manus、Perplexity、Raycast、Meta 的 Muse for Windows
- GitHub Copilot 要能叫本機模型:Copilot 的 HydraFusion 原本在雲端幫每個任務挑模型,現在延伸到裝置上的模型,10 月稍後在 Copilot app、CLI、VS Code 以實驗預覽推出
- 可以本地跑的模型:MAI Code 1.1 Flash(137B 總參數、6.8B 啟用,3-bit 量化後體積砍近八成、本地 256K context)、DeepSeek V4 Flash(284B)在 RTX Spark 上跑、NVIDIA Nemotron 70B 以上 2-bit 量化只吃 20 幾 GB
Microsoft 把這叫「hybrid intelligence(混合智慧)」:agent 該在本機跑就在本機、需要時才上雲。對照昨天 EmbeddingGemma 2 在手機上跑 567MB,今天是另一端:把 100B 級的模型放進筆電。
⚠️ 「比 MacBook Pro M5 Pro 快 2.1 到 6.2 倍」是 Microsoft 委託的測試(2026-09),無獨立評測;「120B 以上」依官方,量化等級未寫。
短訊四則:Broadcom 替 OpenAI 晶片湊 500 億美元、SynthID 偵測器全球開放、Nous Research 估值 15 億、北美 Q3 創投 920 億有三分之二給 AI
- 三家公司同時在私募債市找錢(WSJ 10/7,Investing.com 轉述):Broadcom 正在為 OpenAI 的客製晶片湊**超過 500 億美元(約新台幣 1.58 兆元)**的融資包,和 Apollo、Blackstone 處於早期談判,晶片計畫內部代號 Nexus、目標 2029 年前部署多 GW 算力;Oracle 跟 Apollo、Goldman Sachs 談 1GW 資料中心的設備融資(表外實體買晶片再租回);SpaceX 找上貸款方談 400 億美元買 Nvidia 晶片。目標期限都是年底。對照 8 月: 那時 Bloomberg 報 Broadcom 為「Anthropic 和其他公司」籌 600 億以上、沒點名 OpenAI——今天是 OpenAI 那一份的規模第一次有數字。 ⚠️ WSJ 原文付費牆,依 Investing.com 轉述;The Information 同日有同題簡訊、標題一致但內文未讀取
- SynthID Detector 全球開放(Google DeepMind 10/7,Pushmeet Kohli 署名):去年只給媒體專業人士用的偵測器現在對所有人開放(synthid.com,先只有英文),可查圖片、影片、音訊是不是用 Google、OpenAI、NVIDIA、Kakao 的工具生成,Apple「即將」加入。Google 自述至今已浮水印 1,800 億張圖片與影片、24 萬年的音訊,Search/Gemini/Chrome 的內建驗證每天處理超過 100 萬次請求。限制是官方沒寫但不難推:它只認得這幾家的浮水印,其他家生成的東西它說「不是 AI」不代表不是 AI
- Nous Research 募 9,000 萬美元、估值 15 億(約新台幣 28 億/473 億元,10/7 官方+TechCrunch):Robot Ventures 領投,NVIDIA、Microsoft M12、Samsung、USV、YC、Menlo 跟投,總募資 1.58 億。產品是 2 月以 MIT 授權開源的 Hermes Agent——自述被 clone 超過 2,400 萬次、佔全球 AI token 用量約 2.5%(內部估計)。錢要拿來做 Hermes for Businesses(私有部署、SSO、SLA)。WSJ 稱其 9 月中年化營收約 3,600 萬美元、年底前目標破 1 億——7 月傳出募資時談的是至少 7,500 萬,最後多了 1,500 萬。執行長 Dillon Rolnick:「我們在打造讓每個人擁有自己智慧的東西,而且是公開做。」
- 北美 Q3 創投 920 億美元,AI 拿走 610 億(Crunchbase 10/7):季減 35%、年增 50%,AI 佔約三分之二。季減的原因 Crunchbase 自己講了:Q1、Q2 有 OpenAI 的 1,100 億和 Anthropic 的 650 億,Q3 沒有這種規模的單。Q3 最大的是 Databricks 50 億、Crusoe 39 億、Boring Co. 30 億、Cognition 20 億;最大 A 輪是 River AI 的 11 億。對照昨天四筆大錢(DeepSeek、Moonshot、Lambda、Etched):那四筆全是 Q4 才在談,所以 Q3 的「下滑」更像是巨頭上市前的換氣,不是錢變少
來源:Investing.com(WSJ 轉述)、The Information(原文)、Google DeepMind(SynthID)、Nous Research 官方、TechCrunch(Nous)、Crunchbase News
值得關注
- Haiku 5.5 對 GPT-6 Luna 的第三方分數:今天的「六戰全勝」是 Anthropic 自己的表。一週內 Artificial Analysis 若補上 Haiku 5.5,看它跟 Luna 在同一張表上差多少;差距小於官方表的一半,「價格對齊、能力領先」這個故事就要打折。 另看 Google 的 Gemini Flash 會不會跟進 0.10/0.50 這個價位——三家對齊才算價格帶成形。
- Intelligent UI 跟廣告的距離:兩天前 OpenAI 才說要在生圖旁邊放廣告,今天 ChatGPT 的回答裡有了可點的按鈕和表單。月底前若有人截到 Intelligent UI 的互動元件裡出現贊助內容,這兩條線就接上了;OpenAI 若公開承諾互動元件不放廣告,那是另一個方向的答案。
- Anthropic 會不會對 Grok Bot 說話:Musk 說要用 Claude Opus 5.5,Anthropic 沒回應。Anthropic 以前因「未授權評測」切過 OpenAI 的存取,8/29 又以「值得信任的夥伴」自居補位 Cursor——兩週內看 Anthropic 是像 Cursor 那樣由 Tom Brown 出面確認這是正式合作,還是沉默。沉默就是「透過一般 API 條款用」,那 OpenAI 8/29 對 Cursor 的顧慮同樣適用於這裡。 順便看「閃電快的 Grok 4.8」會不會在 10 月出現。
- ChatGPT for Teens 的下一個數字:OpenAI 說測試在家長控制啟用完成前就結束了。OpenAI 若公布「家長警示在過去 30 天觸發了多少次」或接受研究所要求的第三方獨立測試,爭議就有了可比的資料;若只重複「每天 15 分鐘」,紐約市議會 10/5 聽證之後的下一個場合,這份報告會被原樣拿出來問。
- Unity Spark 的封閉測試日期:Google 寫「即將」。年底前有沒有第一批用 Spark 做出來、在 Playground 上公開的 3D 遊戲——有的話看它跟 Roblox 創作者做的東西像不像;一直停在「測試中」,Playground 就只是另一個 Gemini 的 demo 頁。
- Broadcom 為 OpenAI 湊的 500 億年底前有沒有簽:WSJ 寫「目標期限年底」。對照 5 月 The Information 報導 Broadcom 曾要求 Microsoft 承諾買四成晶片才肯融資第一期——年底的文件裡若有 Microsoft 的名字,那個條件還在;沒有,代表 Apollo 和 Blackstone 接走了這個風險。