Skip to Content Facebook Feature Image

OpenRouter一周模型用量排名 Ox Alpha升上榜首 揭曉為智譜GLM-5.3-Flash

BasTech

OpenRouter一周模型用量排名 Ox Alpha升上榜首 揭曉為智譜GLM-5.3-Flash
BasTech

BasTech

OpenRouter一周模型用量排名 Ox Alpha升上榜首 揭曉為智譜GLM-5.3-Flash

2026年08月31日 10:36 最後更新:10:36

OpenRouter平台公布截至本周日(8月30日)的模型Token用量排名,匿名模型Ox Alpha以15.7萬億Tokens升上榜首,按周上升36%。該模型上周新上榜位列第二,已證實為智譜AI開源的GLM-5.3-Flash(320B-A18B),屬同一模型的不同計費路線。DeepSeek V4 Flash 0731則由上期榜首跌至第二位(12.3T,按周升6%),小米MiMo-V2.5以9.14T穩守第三(按周回落8%)。

OpenRouter一周模型用量排名 Ox Alpha升上榜首 揭曉為智譜GLM-5.3-Flash

OpenRouter一周模型用量排名 Ox Alpha升上榜首 揭曉為智譜GLM-5.3-Flash

最新Top 10排名

更多相片
OpenRouter一周模型用量排名 Ox Alpha升上榜首 揭曉為智譜GLM-5.3-Flash

OpenRouter一周模型用量排名 Ox Alpha升上榜首 揭曉為智譜GLM-5.3-Flash

Ox Alpha

Ox Alpha

GLM-5.3-Flash

GLM-5.3-Flash

Ox Alpha登榜首 揭曉智譜

Ox Alpha登榜首 揭曉智譜

1. Ox Alpha(GLM-5.3-Flash 匿名路線)— 15.7T tokens(↑36%,升上榜首)
2. DeepSeek V4 Flash 0731 — 12.3T tokens(↑6%,跌至第二)
3. 小米 MiMo-V2.5 — 9.14T tokens(↓8%,穩守第三)
4. GPT-5.6 Luna — 7.79T tokens(↑59%,升上第四)
5. 騰訊 Hy3 — 6.66T tokens(↓19%,跌至第五)
6. GLM 5.3 Flash(正式路線)— 6.16T tokens(新上榜)
7. NVIDIA Nemotron 3 Ultra(免費)— 5.33T tokens(↑12%,穩守第七)
8. DeepSeek V4 Flash 0423 — 5.2T tokens(↓5%,跌至第八)
9. Gemini 3.7 Flash — 3.95T tokens(↑120%,微升一級)
10. 騰訊 Hy4 preview — 3.07T tokens(新上榜)

緊隨其後的包括智譜GLM 5.2(2.99T,↓12%,跌出十大)、MiniMax M3(免費版)(2.57T,新上榜)及DeepSeek V4 Pro 0423(1.77T,↓4%,跌出十大)。

Ox Alpha

Ox Alpha

市場觀察

Ox Alpha上周以11.6T新上榜並列第二,本周以15.7T升上榜首,突破15T關口。智譜AI於8月底正式發布並開源GLM-5.3-Flash,確認該模型即為Ox Alpha本尊;今期Ox Alpha匿名路線仍居首,其正式計費路線GLM 5.3 Flash亦以6.16T新進十大排第六,兩個名次屬同一模型,合計用量達21.9T。姊妹模型GLM 5.3錄得1.33T(↑171%)排第十九位,反映智譜系列整體採用率急升。

騰訊Hy4 preview新進十大排第十,Hy3則由第四位跌至第五(↓19%)。Google Gemini 3.7 Flash按周急升120%,由第十位微升至第九位。

十大以外,OpenAI GPT-5.6 Sol(1.7T,↑29%)、月之暗面Kimi K3(1.57T,↑19%)及Anthropic Claude Opus 5(1.46T,持平)緊隨其後。MiniMax M3付費版本周位列第十六位(1.52T,↓11%),智譜GLM 5.2及DeepSeek V4 Pro 0423雙雙跌出十大。

GLM-5.3-Flash

GLM-5.3-Flash

智譜GLM-5.3-Flash(MIT授權,HuggingFace有權重)是GLM-5系列首個原生多模態模型,支援文字、圖像及影片輸入,1M上下文,並採用稀疏與線性混合注意力降低運算成本。匿名測試期間該模型曾錄得單日4.5T用量,一度拋離DeepSeek。OpenRouter上Ox Alpha與GLM 5.3 Flash兩個名次現已可確認屬同一模型,合計為全平台最大單一模型用量。中國模型在Top 20中佔12席,主導地位持續。

以上為截至周日的OpenRouter平台數據,排名每周更新。

Ox Alpha登榜首 揭曉智譜

Ox Alpha登榜首 揭曉智譜

OpenRouter平台一周模型用量排名中最神秘的「匿名者」終於揭曉。智譜AI(Z.ai)於8月26日晚正式發布並開源GLM-5.3-Flash(320B-A18B),並確認該模型正是此前以「Ox Alpha」匿名身份登上OpenCode及OpenRouter、一度並列OpenRouter用量榜第二位的模型。GLM-5.3-Flash是GLM-5系列首個原生多模態模型,已同步開放API,接入ZCode、智譜清言及GLM Coding Plan。

神秘開發商stealth旗下Ox Alpha於8月20日晚間無預警登陸OpenRouter,屬「Stealth Model」匿名盲測

神秘開發商stealth旗下Ox Alpha於8月20日晚間無預警登陸OpenRouter,屬「Stealth Model」匿名盲測

Ox Alpha免費測試一周 曾並列用量榜第二

智譜在正式發布前,將模型以「Ox Alpha」匿名身份放在OpenCode及OpenRouter免費接受真實調用。在上周(截至8月23日)的OpenRouter一周數據中,Ox Alpha以11.6萬億Tokens(11.6T)新上榜並列第二位,與DeepSeek V4 Flash 0731並列,一度引發業界對其開發商的猜測。OpenCode平台8月26日披露,該模型六天內處理了42萬億Tokens,位列其模型用量榜第一。智譜表示,相關請求全部由國產芯片集群提供算力,匿名測試既是檢視模型在真實編程及智能體任務中的表現,亦是壓力測試服務系統能否承受長上下文帶來的持續負載。

OpenRouter一周模型用量排名 DeepSeek V4 Flash蟬聯榜首 Ox Alpha新上榜直取第二位

OpenRouter一周模型用量排名 DeepSeek V4 Flash蟬聯榜首 Ox Alpha新上榜直取第二位

320B激活18B參數 編程能力逼近Claude Opus 4.8

據智譜公開資料,GLM-5.3-Flash總參數達3,200億(320B),每次推理激活180億(18B)參數,是首個採用稀疏注意力與線性注意力混合架構的開源前沿模型,支持約100萬Tokens上下文,可接收文本、圖像及視頻輸入並輸出文本。模型以30萬億Tokens多模態語料預訓練,相較GLM-5.3,注意力計算量及KV緩存分別降低3.01倍及4.44倍。

在全球權威的Artificial Analysis Intelligence Index中,GLM-5.3-Flash取得57分,與Anthropic旗下Claude Opus 4.8最高檔得分持平;在智譜自研Z.ai Code Bench測試中,其編程表現獲29.0分,與Claude Opus 4.8的29.5分差距不足一分。

定價約為GLM-5.3十分之一 活動期低至二十分之一

價格成為該模型另一焦點。GLM-5.3-Flash API標價約為每百萬輸入、輸出Token 0.15美元及0.50美元,約為旗艦GLM-5.3(1.40美元及4.40美元)的九分之一至十分之一;限時折扣期內(至9月9日)更低至約十八分之一至二十分之一。智譜另稱,完成同一任務的成本約為Claude Opus 4.8的40分之一。

全程以國產加速芯片部署 單Token成本達英偉達GPU水平

部署方面,智譜基於SGLang搭建面向國產加速芯片的推理引擎,採用編碼、預填充及解碼分離的EPD架構,配合內存、通信及緩存優化,服務性能較初始基線提升約3倍,單Token成本已達與主流英偉達GPU相當的水平。模型權重以MIT許可證在Hugging Face開源。

GLM-5.3-Flash正式上架首周(8月26日起)錄得1.71T Tokens,位列第12位;其前身Ox Alpha的免費預覽期已結束,OpenRouter舊有「stealth/ox-alpha」頁面已轉介至正式命名的z-ai/glm-5.3-flash路線。

你 或 有 興 趣 的 文 章