每日精選 AI/Tech 新聞,繁體中文整理
📍 今日全焦點
- 同一天,DeepSeek 是被告、是贏家、也是準備上市的資產 — 三個角色互不打架,這才是重點
- Anthropic 報告的另一半:五起病毒研究、成都的監控畫面 — 首次有公司公開揭露 AI 被用於生物武器研究
- 有人用 Claude Code 做出會自己選目標的神風無人機群 — 「人」是分類器裡的一個類別
- 社群不買帳:這是威脅情報還是遊說文件? — Hacker News 上三個質疑都問得很準
- OpenAI 把產品直接對準華爾街初階分析師 — 摩根士丹利、Evercore 當設計夥伴,要 Enterprise 帳號還要審核
- NVIDIA 找八家澳洲業者蓋 2GW — 一次把整個國家的算力翻倍還有找
- Clay 估值一年多翻超過一倍到 71 億美元 — 客戶名單裡有 Anthropic、Google、OpenAI
- Meta 買下八個月大的瑞典新創 Stilla — 目標是 WhatsApp 上那一百萬家商店
今日頭條
同一家公司,同一天,可以同時是被告、是贏家、又是準備上市的資產嗎?
9 月 10 日的 DeepSeek 給了答案:可以,而且這三件事一點都不衝突。
先看被告席。
Anthropic 在 9 月 10 日發布了它至今最詳細的一份威脅情報報告〈Detecting and countering misuse of AI: September 2026〉,涵蓋 2025 年 12 月到 2026 年 8 月偵測並中斷的濫用行為,分成七大類:網路攻擊、監控、影響力操作、傳統武器、生物濫用、詐騙、以及非法蒸餾。
**蒸餾(distillation)**講白話就是:拿強模型的答案去教自己的小模型。技術本身正當,問題在於怎麼拿。
報告點名的是阿里巴巴、Moonshot AI、DeepSeek,外加兩家未具名實驗室,合計約 2 億次對話、分屬五個行動。阿里巴巴那一波規模最大——據轉述為 5 月到 7 月間 1.51 億次交換,尖峰單日約 300 萬次,動用約 3,500 個帳號。
⚠️ 各家媒體轉述的帳號數字略有出入(TechCrunch 寫 5,000、TNW 寫 5,380)。Anthropic 官方網頁只放摘要,細節在 PDF 全文裡。
最難看的不是規模,是手法。 Anthropic 說 Moonshot 和 DeepSeek 把自家用戶的請求偷偷轉給 Claude,再把 Claude 的答案當成自己模型的回答端出去——十天內約 30 萬次請求、5,380 個假帳號。
用戶不知道自己的資料被送到哪裡去了。其中一批是成都數百支監控攝影機的畫面,上傳者被 Anthropic 評估為「可能與中國人民解放軍有關聯」,要 Claude 判斷畫面中的人「行為是否異常」。
再看官方那一側。
美國國安局(NSA)、網路安全暨基礎設施安全局(CISA)與聯邦調查局(FBI)在 9 月 8 日發布聯合資安公告 AA26-251A,點名 DeepSeek、Moonshot AI、阿里巴巴、MiniMax、StepFun、Z.AI 六家中國公司,自 2024 年底起對 Claude、GPT、Gemini、Grok 進行「產業規模」的蒸餾。
公告裡有一句話特別狠:DeepSeek 對外宣稱的 560 萬美元(約新台幣 1.76 億元)訓練成本「具誤導性」,因為那沒把靠蒸餾拿到的資料成本算進去。
中國方面 9 月 9 日反擊。商務部說蒸餾「是業界通行做法」,美國企業自己也在做,若以此為名打壓中國 AI 企業,「中國將採取堅決反制措施」;外交部則要求美方停止無端指責。
然後是贏家席。
同一天,DeepSeek 發表了 V4.1-Flash。
規格是 552B 參數的 MoE(混合專家)多模態模型,走新的 Causal Encoder-Decoder 架構——40 層 Transformer 拆成 20 層因果編碼器加 20 層解碼器,輸入時只啟動 80 億參數、輸出時 160 億。
授權是 MIT(Hugging Face 官方 model card 寫明),脈絡長度 1,048,576 token。輸入輸出模態要講清楚:原生吃圖片和文字,輸出只有文字——不是全模態。
KV cache 只要前代約 1/4 的 HBM,這是它敢把價格壓低的原因。OpenRouter 列出的價格是每百萬輸入 token 0.30 美元、輸出 1.20 美元。
⚠️ 有二手報導寫「效能對打 GPT-6 Astra、成本只要 1/86」。DeepSeek 官方公告沒有這個說法,官方只寫「benchmark 領先包含 V4-Pro 在內的旗艦模型」。廠商自評的比較,不該轉述成第三方結論。
DeepSeek 同時宣布淘汰 V4-Pro:9 月 14 日 04:00 UTC 起,所有 deepseek-v4-pro 的請求會直接導到 V4.1-Flash,並按 V4.1-Flash 的費率計價,直到 V4.1-Pro 上線。用 API 的人記得檢查自己的呼叫。
最後是資產席。
DeepSeek 已經找上中信證券,準備在上海科創板(STAR Market)掛牌,目標今年內啟動流程。時間、募資金額、目標估值都還沒定。
同時它正在募新一輪,估值人民幣 5,000 億元(約 750 億美元/新台幣 2.36 兆元)——6 月那輪才剛以超過 500 億美元的投後估值收掉約 74 億美元。三個月,估值往上跳了 50%。
所以這三件事擺在一起講什麼?
被指控靠別人的模型長大、技術上確實交出領先自家前代的東西、資本市場照樣給它翻倍估值——這三件事同時為真,而且沒有一件會因為另外兩件而不成立。
美國那邊的指控要成案得走法律和外交,而 IPO 和融資只需要投資人相信它跑得夠快。這中間的時間差,就是整件事最實際的部分。
新聞摘要
報告的另一半:五起病毒研究,Anthropic 說這是業界第一次公開揭露
蒸餾那段被吵得最兇,但報告裡更重的東西在後面。
Anthropic 揭露了五起與生物研究相關的案例,涉及屈公病毒(chikungunya,蚊媒傳染,症狀可持續數週到數月)的功能增益研究、禽流感、正痘病毒,以及不具傳染性的毒素與毒液。
五案的共同點:帳號背後的研究者被判斷與遭禁用地區的政府或軍方有關聯,或刻意隱藏所在地與身分,或兩者皆是。其中一起是來自 Claude 原本就封鎖區域的國家級軍方行動,研究屈公病毒的可能突變。
Anthropic 的措辭很克制,這點值得記下來:公司明確表示「並非指控這些研究者意圖造成傷害」——生物研究本來就有疫苗與治療這類正當的兩用性質。它做的是封帳號、與夥伴合作拆掉繞過區域封鎖的中繼網路、把發現分享給其他 AI 實驗室與主管機關。
為什麼這件事值得記住:Anthropic 說,據其所知這是第一次有公司公開揭露自家 AI 模型被用於生物武器相關研究的偵測結果。 不是第一次發生,是第一次有人寫出來。
有人用 Claude Code 做出會自己選目標的神風無人機群
這則的重點不在技術,在那句「人是分類器裡的一個類別」。
同一份報告裡,Anthropic 追蹤到代號 GTG-27005 的行動——研判為俄羅斯境內的自由接案者,用 Claude Code 打造自主 FPV 神風無人機群。
機上模型能自己選定目標並下達引爆指令,中間沒有人。目標分類裡包含一個「person(人)」類別,而視覺分類器是拿爬來的烏克蘭戰場影片訓練的。
Anthropic 把「傳統武器」列為新浮現的濫用型態:有人試圖讓 Claude 協助開發飛彈、武裝無人機、炸彈相關軟體。報告詳述六起案例——三起在中國、兩起在俄羅斯、一起在葉門。
這件事跟「AI 會不會毀滅人類」是兩個層次的問題。 昨天那則 Anthropic 研究員辭職的新聞講的是超智慧的長期風險;這則講的是現在、用現成工具、由接案者完成的事。後者不需要等十年。
社群不買帳:這是威脅情報,還是一份遊說文件?
反方意見一定要擺上來,而且 Hacker News 上的質疑問得比多數評論精準。
報告在 HN 上的討論串,整體情緒偏懷疑。三個主要質疑:
一、商業邏輯說不通。 有人指出這些中國模型商本來就在極薄的毛利下營運,把用戶請求轉給 Claude 等於自己付一筆更貴的成本——質疑 Anthropic 可能把經銷商或轉售流量誤判成官方行為。
二、歸因本身就很難。 用地理位置推斷威脅行為者「並不簡單」,行為者可以掛代理、可以用完全不同國家的遠端基礎設施。「流量來自哪裡」不等於「誰做的」。
三、選擇性揭露。 有人注意到報告在武器與傳統濫用的部分寫得非常細,生物研究的部分卻相對模糊,質疑這個詳略差異是怎麼決定的。還有人翻出 Anthropic 自己 7 月底那三起「Claude 取得未授權系統存取」的事件是幾個月後才發現的,反問:那你們對別人的行動怎麼會了解得這麼清楚?
最尖銳的一句是「advertorial(業配文)」——認為這種報告的作用是替監管限制鋪路,而不是純粹的威脅情報。
這些質疑不能證明報告是錯的,但它們指出的都是真問題:一份無法被第三方複現的情報報告,讀者只能選擇要不要相信發布者。而發布者剛好是這場競爭的當事人。
OpenAI 把產品直接對準華爾街的初階分析師
如果你是投資銀行的第一年分析師,這則新聞跟你有直接關係。
OpenAI 在 9 月 10 日推出 ChatGPT for Financial Services,把 GPT-6 Astra 的推理能力接上內建的金融資料,主打三件事:做研究、建財務模型、產出客製化的客戶簡報。
這三件事,剛好就是華爾街初階銀行員每天在做的工作。
設計夥伴是摩根士丹利(Morgan Stanley)和 Evercore(獨立投資銀行)。OpenAI 說早期合作讓它決定從投資銀行與股票研究這兩塊切入,因為那裡的痛點最明確:可靠的資料存取,以及高品質的產出物。
內建資料來自 Daloopa、PitchBook、LSEG News、Crunchbase——省掉自己接 MCP connector 的麻煩,這是產品設計上最實際的一步。
取得門檻不低:需要 ChatGPT Enterprise 帳號,而且機構要經 OpenAI 直接核可才能用。
OpenAI 產品副總 Nick Turley 的說法是「這是我們希望整個產業採用的標準產品」,另一句更值得看:「demo 裡好看的東西,跟真的能用的產出,是兩回事。」
報導裡沒有任何一方談到裁員或人力影響——這件事本身也值得注意。
NVIDIA 找八家澳洲業者蓋 2GW,等於把整個國家的算力翻倍還有找
先講規模感:澳洲現有的資料中心算力是 1.6GW,這次要加蓋的是「最多 2GW」。
NVIDIA 9 月 9 日公告,與八家澳洲資料中心與雲端業者合作,目標 2027 年前建成最多 2 吉瓦(GW)的「AI factory」容量。八家分別是 Firmus、Sharon AI、IREN、Megaport、ResetData、CDC、NEXTDC、AirTrunk。
「AI factory」是 NVIDIA 自己的說法,指從機房實體設施、運算、網路到軟體與參考設計全部整合的部署,全部掛在它的 DSX 平台上。
個別承諾裡數字最具體的兩家:Sharon AI 計畫部署最多 68,000 顆 NVIDIA GPU,搭配 Quantum InfiniBand 與 Spectrum-X 網路;IREN 把這套藍圖套用到自己的開發組合,包含南澳 800 百萬瓦(MW)的 Bundey 園區。CDC 目前在澳紐營運 550MW 以上,另有 800MW 在建。
官方公告沒有揭露任何投資金額——所以「這筆投資多少錢」目前沒有一手數字可以引用,看到具體金額要先問是誰算的。
Clay 估值一年多翻超過一倍,客戶名單裡有 Anthropic、Google、OpenAI
AI 應用層還在漲,而且漲的是「真的有人在付錢」的那一類。
銷售與行銷自動化公司 Clay 宣布完成 1.15 億美元(約新台幣 36 億元)D 輪,由 Wellington Management 領投,Sequoia、a16z、StepStone、CapitalG 等跟投。投後估值 71 億美元(約新台幣 2,237 億元)。
對照組很清楚:2025 年 8 月那輪估值 31 億美元。一年多,翻超過一倍。
Clay 做的東西叫「GTM Engineer(Go-To-Market 工程師,直譯是「進入市場工程師」)」——把公司內部資料和外部訊號串起來的成長型 agent,負責找出潛在客戶、監測購買意圖、跑個人化的行銷活動,而且會隨使用愈跑愈準。
規模數字:客戶超過 17,000 家,涵蓋 Forbes AI 50 裡的八成,名單包含 Anthropic、Google、OpenAI、Stripe、ElevenLabs、Workday、Siemens。年化營收預計本季底達到 2 億美元。
AI 公司拿 AI 工具賣 AI 產品給彼此——這個循環聽起來有點好笑,但它同時也是這輪應用層估值最實在的支撐:付錢的人自己就在這個產業裡,他們最清楚工具有沒有用。
Clay 另外宣布一筆 100 萬美元的獎學金,用來訓練下一批 GTM 工程師。
Meta 買下八個月大的瑞典新創,目標是 WhatsApp 上那一百萬家商店
這樁併購的重點不是金額(沒揭露),是 Meta 要把 agent 塞進哪裡。
Meta 收購了瑞典 AI 新創 Stilla.ai(Axios 9 月 9 日獨家)。Stilla 2024 年在斯德哥爾摩創立,創辦團隊出身 Shopify,今年 1 月才走出隱身模式、當時募了 500 萬美元(約新台幣 1.58 億元)pre-seed。
從公開亮相到被買走,八個月。
Stilla 做的是能跨組織工具與流程執行工作的 AI agent,強調共享脈絡、權限控管和企業級基礎設施。
Meta 要拿它加速的是 Meta Business Agent——讓商家在 WhatsApp、Messenger、Instagram 上處理客服對話與交易的那套系統。Meta 說目前已有超過一百萬家商家在用。
為什麼值得看:Meta 這幾年在 AI 上的動作多半集中在模型和人才,這次買的是「怎麼讓 agent 在真實商業流程裡站穩」的工程能力。訊息平台是 Meta 唯一不用跟別人搶的通路,把交易做進去才是它真正的變現路徑。
值得關注
- 9 月 14 日 04:00 UTC:DeepSeek 把
deepseek-v4-pro的請求全數導向 V4.1-Flash,V4.1-Pro 上線時間未定。有在用 API 的要先檢查。 - 蒸餾指控會不會從公告變成行動:CISA 公告給 AI 供應商的建議裡有一條很微妙——對可疑帳號「調整回應」(降低推理深度、用不同的推理路徑呈現資訊),而且要避免明顯到被察覺。如果各家真的照做,一般開發者怎麼確認自己拿到的是完整能力,會變成新問題。
- 中美之間這條線牽著更大的局:多家報導都提到公告發布時機接近規劃中的川習會談。技術指控和貿易談判疊在一起,後續值得追。
- Anthropic 的 PDF 全文:官方網頁只放摘要,數字細節都在 PDF。目前各家媒體轉述的帳號數字已經出現落差,要引用具體數字的人建議直接讀原始 PDF。