【智譜GLM:AI在十萬卡國產集群上自建推理系統 兩周推理吞吐大幅提升】今日,智譜GLM團隊披露遞歸自我改進方向首個工程化實踐進展,也就是讓AI自己動手改進自己的運行系統。具體來說,由GLM-5.3驅動的Infra Agent在超過10萬張國產芯片組成的集群上,從零搭建並調試推理服務,不到兩周把整體處理速度提升到原來的3倍,硬件利用效率和單Token成本接近與主流英偉達GPU相當水平。這套系統已投入真實使用,GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上線,6天Token調用量超過62萬億。這是國內大模型廠商首次公開將「AI自我改進」用於生產環境,意味着AI不再只是寫代碼,還能參與整個推理系統的工程閉環。