9月30日,DeepSeek 透過官方帳號宣布,把面向華為昇騰平台的編程基礎設施開源,包括計算和通訊方面的程式庫,並把高階語言 TileLang 放在這次發布的前面。路透社同日報道,DeepSeek 與華為一起推進以 128 顆昇騰 950 晶片組成的超節點。對要在昇騰上寫高效能程式的人,這是可以直接打開的程式碼。
開源的是哪一層
路透社引述 DeepSeek 的說法:開源的是昇騰平台的編程基礎設施。這一層位於模型之下。模型負責回答和推理;這一層負責讓計算真正跑在晶片上,包括怎麼下指令、怎麼在多顆晶片之間傳資料。
DeepSeek 把這件事說成建立一套可以自己掌握的圖形處理器軟件生態。它在聲明裡寫,第一步是要有一種通用、相對好寫、又能碰到硬件性能上限的高階語言。TileLang 就是它拿出來的那個語言。路透社報道,DeepSeek 稱 TileLang 的編程模型比 Nvidia 的 CUDA 更簡單。這是 DeepSeek 自己的比較。
開源的是工具,不是一顆新晶片。昇騰 950 仍是華為的硬件。這次放出的是圍繞它的程式庫和語言支援。兩個程式庫頁面今天可以打開:TileLang,以及 DeepGEMM-Ascend。
TileLang 為什麼被放在前面
晶片買得到,不代表工程師寫得出跑得動的程式。CUDA 長期是很多人工智能框架預設的那套寫法。換一套晶片,往往要把底層算子重寫一次。DeepSeek 的說法是,TileLang 用更高階的寫法包住這些細節,讓同一種描述可以對上不同硬件。
如果工作只是呼叫現成的模型接口,這次開源不會改到呼叫價格。如果在自建推理或訓練,而且機器是昇騰,這批程式庫就是入口:先看 TileLang 能不能描述你的算子,再看通訊庫能不能撐起多卡。
路透社把這次發布放在一個更早的背景裡:約兩星期前,華為公布了新一代人工智能處理器和超節點系統,並預期相關系統明年會較廣泛地用於模型訓練。那句「明年廣泛用於訓練」是華為當時的預期,路透社轉述,這次開源公告沒有附上證明。
128 卡超節點說了什麼
超節點指的是把多顆加速卡當成一組來調度。路透社寫,DeepSeek 稱華為在開發這套編程基礎設施時提供了完整支援,雙方一起推進基於 128 顆昇騰 950 的方案,並同時優化計算和通訊。
公告沒有給出這 128 卡在公開基準上的分數,也沒有寫已向一般雲端客戶開賣。可以核對的是兩件事:DeepSeek 說工具開源了,程式庫頁面存在。性能是否「接近硬件上限」,要等有人在自己的機器上重跑,公告本身沒有附上可覆核的測試表。
同一輪更大的模型為什麼還未公開
9月30日,Google 在官方網誌宣布新的前沿模型 Gemini 4 Argon。它先透過 Fairwind 計劃交給一批受信任的網絡防禦者。一般開發者、企業和消費者要等下一階段。Google 寫,它正參與美國政府的自願性發布前存取程序,會先收集早期測試者的意見、調整防護,再盡快擴大。
公告裡的使用範圍寫得很窄,數字則寫得很大。Google 稱 Argon 在長程軟件工程測試 DeepSWE v1.1 拿到 77.9%,輸出長度上限從 6.4 萬個詞元提高到 100 萬。導入價格是每 100 萬個輸入詞元 2 美元、每 100 萬個輸出詞元 10 美元,快取輸入約為輸入價格的百分之五;導入期結束後改為 4 美元和 20 美元。這些都是 Google 在公告裡的說法。
網絡防禦部分,Google 寫受信任的防禦者和它自己的內部團隊會拿到拿掉網絡防護欄的版本,用來尋找、驗證和修補漏洞。它又寫,Wiz 已在一項免費掃描計劃裡用 Argon,並在醫療軟件中找到一個先前前沿模型沒有找到的嚴重漏洞。公告沒有公開漏洞細節。一般人目前不能註冊試用。Google 說稍後會先給付費接口客戶和 Google AI Ultra 訂戶。
同一篇公告還寫了內部使用:有團隊用它調校量子子程序,一次例子裡比已發表的基線少用約四成的時空資源;另一組代理人在數據中心找出記憶體優化,推出後釋出超過 300 TiB,估計總節省在 500 TiB 到 1 PiB 之間。這些同樣是公司內部數字,外面還沒有獨立複核。
Sekoia 把模型接到客戶自己的系統
第三則沒有發新模型。路透社 9月30日報道,法國網絡安全公司 Sekoia 把名為 Elevate 的工具正式交給客戶。它在約 2,000 名客戶的早期試用之後推出。路透社引述公司的描述:客戶把自己選的人工智能模型接上這套平台,再配上分析威脅用的工具,讓模型自行分析安全事件。
早期試用的服務商向公司回報,調查時間最多縮到原來的五分之一。這是公司轉述的客戶反饋。行政總裁 Freddy Milesi 對路透社說,單靠模型算不上護城河,有效的是模型外面的那套系統。路透社列出的客戶包括法國電力公司 EDF、萬喜(Vinci),以及法國軍隊部。
把它和前面兩則放在一起,分工就清楚了。DeepSeek 開的是晶片上一層的工具。Argon 是一個還未公開的大模型,先給防禦者。Elevate 則假定客戶已經有模型,缺的是把模型嵌進調查流程的那一層。
相關討論:路透社關於 DeepSeek 與華為、Google 公告 Gemini 4 Argon、路透社關於 Sekoia Elevate。
總結
這輪最值得先打開的,仍是 DeepSeek 放出的昇騰編程工具:程式庫在,範圍也說得清楚。Argon 的公告數字更大,但一般人還進不去。Elevate 則把另一層說清楚:很多團隊接下來要補的,是模型外面那層能接上自己系統的工具。
