回上列表
GLM-5.3-Flash此次部署運行在超過10萬顆國產AI加速器組成的集群上,是一次此前缺少成熟經驗參考的大規模部署。
智譜GLM首席科學家唐杰披露,從GLM-5.3-Flash首次運行在國產AI加速器上,到完成全部生產流量承載,僅用了兩周時間。在這個過程中,系統端到端吞吐能力提升3.2倍。GLM-5.3驅動的Infra Agent參與了推理系統優化過程,幫助分析性能瓶頸、提出優化方案,並完成部分代碼修改。
GLM-5.3-Flash的硬件利用效率與單Token成本達到主流NVIDIA(NVDA.US)GPU相當水平。
上述系統已投入真實使用。GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上線,6天Token調用量超過62萬億。(jl/u)~
阿思達克財經新聞
網址: www.aastocks.com
智譜(02513.HK)披露首個RSI成果 10萬國產卡用GLM造GLM
2026/09/18 13:00
智譜(02513.HK)GLM團隊披露國內大模型首個公開的生產環境遞歸自我改進(RSI)工程化實踐,由GLM-5.3驅動的Infra Agent完成了GLM-5.3-Flash推理基礎設施的設計、調試與優化,實現模型對自身運行系統的反向改進,是國內大模型廠商首次公開跑進生產環境的RSI案例。GLM-5.3-Flash此次部署運行在超過10萬顆國產AI加速器組成的集群上,是一次此前缺少成熟經驗參考的大規模部署。
智譜GLM首席科學家唐杰披露,從GLM-5.3-Flash首次運行在國產AI加速器上,到完成全部生產流量承載,僅用了兩周時間。在這個過程中,系統端到端吞吐能力提升3.2倍。GLM-5.3驅動的Infra Agent參與了推理系統優化過程,幫助分析性能瓶頸、提出優化方案,並完成部分代碼修改。
GLM-5.3-Flash的硬件利用效率與單Token成本達到主流NVIDIA(NVDA.US)GPU相當水平。
上述系統已投入真實使用。GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上線,6天Token調用量超過62萬億。(jl/u)~
阿思達克財經新聞
網址: www.aastocks.com
![]() |

