【導讀】8月27日,2026中國國際大數據產業博覽會在貴陽開幕。會上,海光信息首發了一套新架構——“Agent to Token開放計算架構”。這個詞聽起來有些技術化,但核心邏輯并不復雜:大模型正在加速落地到真實業務,Agent成了連接模型與應用的關鍵角色,而詞元(Token)則是衡量算力投入與業務產出之間的基本單位。怎么高效地把算力轉化成詞元,再讓詞元支撐起Agent的業務閉環,是眼下很多行業客戶面臨的現實問題。海光這套架構的思路,是用CPU和DCU雙芯協同,把Agent調度和詞元生成放在同一個算力框架里統一管理,同時從算力、互連、安全、軟件棧四個維度做開放,試圖為國產算力在智能時代找到一條務實的落地路徑。

雙芯協同貫通Agentic AI全鏈負載
當前,大模型加速向產業場景滲透,Agent正成為AI落地真實業務的核心抓手。詞元作為連接業務需求、算力投入與服務產出的關鍵載體,其生產效率、單位成本與供給穩定性,直接決定Agent應用深度與詞元經濟商業化落地進程。
針對這一趨勢,海光首發“Agent to Token開放計算架構”,面向詞元經濟完整價值周期,打通“業務需求—智能體調度—詞元生產—結果交付”閉環,精準匹配Agentic AI負載特征。
該架構通過“CPU+DCU”雙芯及開放互連體系,將Agent調度與詞元生成納入統一算力架構,為詞元規模生產、成本核算和行業應用提供系統級計算支撐。
其中,海光CPU承擔Agent業務流的系統樞紐職能,覆蓋數據預處理、多智能體沙箱隔離、任務編排決策、記憶體分級存儲、向量數據庫檢索五大核心模塊;DCU聚焦詞元生成側的并行計算加速,承擔批量解碼、KV緩存優化、預處理加速、長序列支撐等任務。雙芯協同可根據Agent并發規模、任務復雜度與詞元生成量級動態調配資源,將算力精準轉化為詞元生產力。

四維開放構建產業協同底座
隨著詞元經濟加速滲透實體產業,異構資源協同、模型高效遷移、安全可信與生態接入等問題,成為產業規模化落地的核心訴求。海光“Agent to Token開放計算架構”在算力、互連、安全、軟件棧四個維度全面開放,為多樣化算力提供從Agent任務調度,到詞元生產的完整組織方式。
算力開放支持海光雙芯原生組合、異構芯片交叉適配等多種部署模式,靈活匹配不同場景詞元生產需求;
互連開放以自研HSL高速互連協議為核心,突破傳統帶寬瓶頸,提升芯片間數據流轉效率;
安全開放依托芯片級內生安全能力,為Agent業務運行與詞元流轉提供全鏈路可信保護;
軟件棧開放通過全棧開發工具鏈適配百余種主流AI框架,大幅降低模型遷移與開發門檻,加速詞元價值轉化。
開放性進一步擴大了架構的適配范圍,打破了算力供給邊界,為國產算力生態協同提供了對接框架,加速詞元價值向實體產業落地轉化。依托光合組織生態,海光將進一步聯合整機、軟件及行業伙伴推進產品適配,推動國產CPU、DCU和不同加速卡在統一計算體系下調配應用。行業用戶可沿用部分現有設備,并根據業務增長分階段擴容,推動算力資源更高效落地實體業務。
結論
海光這次發布的“Agent to Token開放計算架構”,本質上是在回應一個行業痛點:大模型能力很強,但落地到具體業務時,算力怎么調度、資源怎么分配、成本怎么核算,這些問題還沒有一套成熟的體系化方案。海光的做法是把CPU擅長的調度管理和DCU擅長的并行計算放在一起協同,覆蓋從任務編排到詞元生產的完整鏈條。





