Beam 501B 故事線

公告內容與 HN 反應一次看懂

sourcereflection.ai / HN 49969183

Lead: Beam 主打每 token 效率。HN 肯定開放,但嫌無貨交貨、成績輸中國模型。

A

關鍵規格

總參數
501B 稀疏 MoE
啟動參數
23B / token
預訓練
23.8 兆 token
RL 規模
10.5K GB300 跑四週
Rollout
超過 1 億次
上文長度
訓練 256K,Midtraining 延至 1M
授權
本月 Apache 2.0 釋出權重
狀態
最終 red-teaming,early access 登記中
B

時間線

  1. 2026-10-05Reflection 發布 Beam501B 開放權重預告,無權重、無報告,先開放登記
  2. 2026-10-06HN 討論 137 分 34 留言肯定開放,質疑空公告、圖表誤導、Demo 翻車
  3. 2026-10 月內權重與報告釋出Apache 2.0,加文件與微調全棧
  4. 之後下一代已在訓練目標每次逼近智能前沿
C

成績速覽

項目 Beam 對手 解讀
Terminal Bench 2.1 80.1 DeepSeek 90.6 / Kimi 88.3 接近 GLM 5.2,不如頂級
SWE Bench Pro v2-Hard 77.2 Kimi 88.2 / GLM 5.3 84.3 中段班
DeepSWE v1.1 44.4 DeepSeek 74.2 / Kimi 68.0 落後明顯
AIME 2026 97.8 GLM 5.2 99.2 數學強
HLE 無工具 36.2 Kimi 46.9 / Qwen 43.6 推理中段
推理效率 3-4 倍省算力 對齊 GLM-5.2 級分數 每 token 智商是賣點
D

RL 打法

11 萬併發,token 標版本12 秒送達全艦,跨 rack 流量減 75%落後 107 版、一天陳舊仍穩定先縮短再拉長,effort 參數可調無瀏覽任務也漲瀏覽分,會查文件調 OCR百萬環境池非同步 rollout快速更新穩定學習省 token 推理跨域泛化
E

HN 反應

立場 聲量 代表說法
空公告 高 無權重無 HF repo,先別吹
又大又貴又輸 高 比 DeepSeek V4.1 Flash 更大更貴,全輸
賣點是非中國 中 Western 前沿,吃政府合約客
圖表誤導 中 強對手藏折疊後,圖只放弱的
Demo 翻車 中 陸水謎題非近日,2025-08 已有
歡迎新玩家 低 多一個開放權重總是好事
Demo 爭議

陸水格點 180x90 號稱幾天前謎題。HN 指出 LessWrong 2025-08 已出現。 團隊本意未用此 RL,泛化論點仍成立,但說法不精確。

F

下一步

  • 等權重與技術報告,再評估導入。
  • 企業 coding 與 agent 工作,看重成本選 Beam。
  • 追頂級能力,看 Kimi 與 DeepSeek。
  • 關注 Apache 2.0 生態與微調全棧。