多家內地科技企業先後通過來港IPO的上市聆訊,當中包括兩家AI獨角獸MiniMax與智譜,以及GPU企業天數智芯。
智譜官網
之前市場已傳出,上述3家公司上市集資規模均達數億美元。
港交所(00388)資料顯示,MiniMax(上海稀宇極智科技)是在昨天通過上市聆訊,中金與瑞銀是聯席保薦人。該公司是一家全球化的AI大模型公司,以MiniMax M2、Hailuo-02和Speech-02為核心的自研大模型組合,具備長上下文處理能力,可理解、生成並融合文本、視覺、音頻等多種模態。
圖片來源:MiniMax官網
該公司的核心AI原生產品包括MiniMax、海螺AI、MiniMax語音、Talkie/星野,以及面向企業和開發者的開放平台。截至今年9月底,該公司的AI原生產品,累計為來自超過200個國家及地區的逾2億名個人用戶,以及來自超過100個國家及地區的10萬餘名企業以及開發者提供服務。
不過,MiniMax在過去3年多仍錄得虧損,於2022年、2023年及2024年度母公司擁有人應佔虧損分別為7372.8萬美元、2.69億美元及4.65億美元;2025年首9個月虧損增至5.12億美元。
被譽為中國「AI六小虎」之一的智譜,則在上周五通過上市聆訊,中金是獨家保薦人。該公司致力於開發先進的通用大模型,根據弗若斯特沙利文的資料,按2024年的收入計,智譜在中國獨立通用大模型開發商中位列榜首,在所有通用大模型開發商中位列第2名,市場佔有率6.6%。
圖片來源:智譜官網
智譜在過去3年多同樣持續虧損,於2022年、2023年及2024年度公司權益持有人應佔虧損,分別為1.43億元(人民幣‧下同)、7.88億元及29.56億元;2025年上半年虧損23.51億元。
天數智芯則由華泰國際擔任獨家保薦人。該公司提供針對不同行業的通用GPU產品及AI算力解決方案,產品組合主要包括通用GPU芯片及加速卡,以及定制AI算力解決方案(包括通用GPU服務器及集群)。
天數智芯官網
該公司於過去3年多也持續虧損,於2022年、2023年及2024年度母公司擁有人應佔虧損,分別為5.24億元、7.91億元及8.92億元;2025年上半年虧損6.09億元。
另外,生物製藥公司瑞博生物、陰極銅製造商金潯資源、醫療器械手術機器人公司精鋒醫療,亦於昨天通過來港IPO的上市聆訊。
OpenRouter平台一周模型用量排名中最神秘的「匿名者」終於揭曉。智譜AI(Z.ai)於8月26日晚正式發布並開源GLM-5.3-Flash(320B-A18B),並確認該模型正是此前以「Ox Alpha」匿名身份登上OpenCode及OpenRouter、一度並列OpenRouter用量榜第二位的模型。GLM-5.3-Flash是GLM-5系列首個原生多模態模型,已同步開放API,接入ZCode、智譜清言及GLM Coding Plan。
神秘開發商stealth旗下Ox Alpha於8月20日晚間無預警登陸OpenRouter,屬「Stealth Model」匿名盲測
Ox Alpha免費測試一周 曾並列用量榜第二
智譜在正式發布前,將模型以「Ox Alpha」匿名身份放在OpenCode及OpenRouter免費接受真實調用。在上周(截至8月23日)的OpenRouter一周數據中,Ox Alpha以11.6萬億Tokens(11.6T)新上榜並列第二位,與DeepSeek V4 Flash 0731並列,一度引發業界對其開發商的猜測。OpenCode平台8月26日披露,該模型六天內處理了42萬億Tokens,位列其模型用量榜第一。智譜表示,相關請求全部由國產芯片集群提供算力,匿名測試既是檢視模型在真實編程及智能體任務中的表現,亦是壓力測試服務系統能否承受長上下文帶來的持續負載。
OpenRouter一周模型用量排名 DeepSeek V4 Flash蟬聯榜首 Ox Alpha新上榜直取第二位
320B激活18B參數 編程能力逼近Claude Opus 4.8
據智譜公開資料,GLM-5.3-Flash總參數達3,200億(320B),每次推理激活180億(18B)參數,是首個採用稀疏注意力與線性注意力混合架構的開源前沿模型,支持約100萬Tokens上下文,可接收文本、圖像及視頻輸入並輸出文本。模型以30萬億Tokens多模態語料預訓練,相較GLM-5.3,注意力計算量及KV緩存分別降低3.01倍及4.44倍。
在全球權威的Artificial Analysis Intelligence Index中,GLM-5.3-Flash取得57分,與Anthropic旗下Claude Opus 4.8最高檔得分持平;在智譜自研Z.ai Code Bench測試中,其編程表現獲29.0分,與Claude Opus 4.8的29.5分差距不足一分。
定價約為GLM-5.3十分之一 活動期低至二十分之一
價格成為該模型另一焦點。GLM-5.3-Flash API標價約為每百萬輸入、輸出Token 0.15美元及0.50美元,約為旗艦GLM-5.3(1.40美元及4.40美元)的九分之一至十分之一;限時折扣期內(至9月9日)更低至約十八分之一至二十分之一。智譜另稱,完成同一任務的成本約為Claude Opus 4.8的40分之一。
全程以國產加速芯片部署 單Token成本達英偉達GPU水平
部署方面,智譜基於SGLang搭建面向國產加速芯片的推理引擎,採用編碼、預填充及解碼分離的EPD架構,配合內存、通信及緩存優化,服務性能較初始基線提升約3倍,單Token成本已達與主流英偉達GPU相當的水平。模型權重以MIT許可證在Hugging Face開源。
GLM-5.3-Flash正式上架首周(8月26日起)錄得1.71T Tokens,位列第12位;其前身Ox Alpha的免費預覽期已結束,OpenRouter舊有「stealth/ox-alpha」頁面已轉介至正式命名的z-ai/glm-5.3-flash路線。