Beam 是美國公司 Reflection 在 10 月 5 日公布的第一個開放權重模型。它用稀疏專家混合架構,總參數 5010 億,每次只啟用約 230 億,定位是寫程式、推理和代理任務。公司寫明權重、技術報告和模型卡這個月稍後才放出,現在仍在做最後的紅隊測試,所以今天還不能把它當成已經可以下載的模型。
Beam 大在哪裡
Reflection 的說明把 Beam 寫成純文字模型。預訓練用了 23.8 萬億個詞元,集群是 6144 顆 NVIDIA GB300,公司說整段預訓練在四星期內跑完。中段訓練把有效上下文拉到 100 萬詞元。強化式學習則用 1.05 萬顆 GB300,跑了四星期、超過 1 億次推演。這些數字來自公司自己的文章。路透社同一天的報道也採用了 5010 億總參數、230 億啟用參數這組規格。
對想在自己的流程裡接一顆可自建模型的人,要看的是「開放權重」四個字有沒有兌現。公司說這個月會以 Apache 2.0 放出權重,並配上文件和微調所需的工具。在那之前,入口是公司文章裡的平台候補名單,給的是一小群人的早期使用,公開下載還沒有開始。
它說自己省在運算
公司把 Beam 放在西方開放權重模型的前緣,並說它在寫程式和代理任務上接近阿里巴巴的 Qwen 3.8-Max,推理分數則與智譜的 GLM-5.2 相當,同時推理運算少三至四倍。同一篇文章也寫,原始能力上 Moonshot 的 Kimi K3 仍然在前。路透社的報道沿用了這個比較,沒有另做獨立測試。
基準表上的分數是 Reflection 自己整理的。公司寫明,運算量是用啟用參數和生成詞元估算,不含提示預填和服務開銷,所以那是近似比較,不是實測帳單。把它讀成公司認為自己用更少運算做到相近分數。外部基準站在公布當日還沒有為 Beam 開獨立頁,第三方覆核仍未出現。
現在可以怎樣試
可以做的事有兩件。第一,到 Reflection 平台登記早期使用。第二,等公司說的這個月稍後:權重、技術報告、模型卡和開發者文件。公司還說會經分發夥伴和多個開放原始碼工具接上 Beam,讓人在既有的工作流程裡用它。
安全部分,公司說會在技術報告裡公布評估,並把內部用的部分安全測試開放出來。報告還沒有上線。權重公開之前,沒有一份可以自己覆核的模型卡。
Cohere 的 North 2 在管企業代理
同一天,加拿大多倫多的 Cohere 公布 North 2。它不是另一顆拿來比參數的聊天模型,而是企業用來跑代理的平台。官方文章寫,新的編排可以處理多步驟流程,並在需要批准的步驟把人留在回路裡。代理可以跨會話保留記憶,技能和資料庫可以在公司內共用,免得每個團隊重做一次。
費用放在 North Admin。管理員可以按使用者和代理看詞元用量,為個人和群組設消耗層級,也可以設全公司上限。部署可以是自建、虛擬私有雲、混合或內網,包括與外網隔離的環境。Cohere 的文章列出的新連接器包括 Slack、SharePoint、OneDrive、Outlook、Jira、Notion 和 GitHub。模型方面,公司說可以用 Cohere 自己的模型,也可以帶入其他模型。
文章舉的例子是韓國 LG CNS 和加拿大 Bell Cyber,沒有點名香港客戶。對上班要用代理、又要管花費和權限的團隊,這則的重點是上限和權限可以寫進管理台。
OpenAI 的文字浮水印先在歐盟做
OpenAI 在 10 月 5 日說明它怎樣回應歐盟《人工智能法》對生成文字要能被機器辨認的要求。技術名叫 textGrain,做法是在用詞裡留下統計信號,讀者看不見,偵測器可以找。公司寫,由當天起,全球的 API 客戶可以為指定模型選擇打開文字浮水印,預設是關。ChatGPT 和 Codex 則會在未來數星期,為歐盟的合資格用戶加上看不見的浮水印,公司寫明這不會在上線時變成全球預設。
人在香港打開 ChatGPT 網頁,公司寫的範圍是歐盟。若用的是 API,開關在客戶那邊,預設仍然是關。公司同時說,浮水印不能指出是誰生成,也不能證明版權;沒有偵測到浮水印,亦不表示文字一定由人寫成。它公布的一個測試是:約 400 個詞元的段落,把一成詞換成同義詞,偵測由約 92% 降到約 66%;換成四分之一則降到約 17%。這是OpenAI 說明裡自己的數字。
總結
這輪最值得先看的仍是 Beam。它是一顆新的開放權重模型,規格寫得很具體,但權重還沒有放出,分數也還沒有第三方覆核。North 2 處理的是企業怎樣限制代理的花費和權限。文字浮水印則是歐盟合規的第一步,上線時不會變成全球預設。三件事都還沒有走到今天下載就能用。
