7月25日,國內領先的端側智能計算國產GPU芯片及解決方案供應商速顯微電子科技有限公司(速顯微電子)召開發(fā)布會,發(fā)布面向下一代AI與異構計算的雷神統(tǒng)一計算架構(Thorsianway Unified Computing Architect-
ure—TUCA架構),以及應用于具身智能等AI場景的GPGPU處理器“天衡1100”(TH1100)。
發(fā)布會由速顯微電子COO巴宇澄主持。公司聯(lián)合創(chuàng)始人兼總經理王攀博士講述了速顯微自創(chuàng)立以來始終堅持自研GPU全棧技術為核心的企業(yè)戰(zhàn)略,并透露公司正在數字存算一體以及將大模型寫死在芯片上的“模型即芯片”等先進技術領域進行攻關。


公司創(chuàng)始人兼董事長項天博士宣布:公司將以天津總部為新立足點,加碼布局全國市場,并將與南開大學、天津大學等高校結成產學研合作機構,為具身智能產業(yè)提供自主可控、生態(tài)友好、高效節(jié)能的算力GPU產品。
天津市津南區(qū)相關領導,公司戰(zhàn)略合作伙伴代表,投資人及多家生態(tài)鏈上市公司董事長,高管等出席活動并見證發(fā)布。
雷神計算架構:破解算力適配之困,塑造高性能芯片價值商業(yè)閉環(huán)
TUCA架構是速顯微電子自主研發(fā)、面向下一代AI與異構計算場景的軟硬件協(xié)同計算架構,可結合速顯微電子自研GPGPU、AI加速芯片及異構計算硬件,覆蓋從應用開發(fā)、算子編譯、運行時調度到硬件執(zhí)行的關鍵計算鏈路,構建統(tǒng)一、高效、可擴展的異構計算軟件底座,幫助開發(fā)者和行業(yè)客戶更高效地使用異構算力,推動芯片能力向應用價值轉化。

統(tǒng)一異構算力底座
TUCA為GPGPU、AI加速器、CPU等異構計算提供統(tǒng)一軟件抽象層與運行支撐,通過統(tǒng)一開發(fā)范式降低適配復雜度,方便調用底層算力。系統(tǒng)層面協(xié)同設計軟硬件,優(yōu)化調度、內存、同步及多設備協(xié)同效率。
統(tǒng)一編程接口
TUCA提供統(tǒng)一編程接口,支持GPGPU和AI開發(fā),封裝底層硬件差異,降低向速顯微平臺遷移的成本。面向AI推理、并行計算、矩陣、圖像等任務,其接口和運行時簡化開發(fā)部署,提升效率,降低適配門檻。
生態(tài)兼容與遷移適配
TUCA面向主流AI框架、模型部署工具鏈和行業(yè)應用環(huán)境進行適配設計,支持模型遷移、算子適配、應用集成和行業(yè)生態(tài)建設,能夠幫助客戶降低從既有生態(tài)遷移到速顯微計算平臺的難度,使芯片產品不僅具備硬件算力優(yōu)勢,也具備面向應用落地的軟件生態(tài)支撐能力。
高性能加速庫支持
TUCA內置面向AI與通用計算的加速庫,并針對自研芯片深度優(yōu)化,支撐AI推理、圖像處理、機器人視覺、工業(yè)計算等應用,開發(fā)者可直接調用,加速部署。編譯層深度融合硬件,支持算子融合、訪存與布局優(yōu)化,協(xié)同編譯器和運行時,提升資源利用效率,減少數據移動與等待,保障復雜任務穩(wěn)定執(zhí)行。
開源共建與生態(tài)擴展
TUCA核心組件規(guī)劃采用MIT License等寬松開源協(xié)議,支持二次開發(fā)、修改、商用分發(fā)和生態(tài)共建。開源共建不僅有助于提升平臺透明度和開發(fā)者信任,也有利于加速算法、工具鏈、行業(yè)應用和解決方案的落地,形成圍繞速顯微芯片產品的長期生態(tài)價值。
全場景靈活部署
TUCA面向機器人、自動駕駛、工業(yè)視覺、醫(yī)療、科學計算、圖形、數據及大模型等場景,依托統(tǒng)一軟件棧與異構算力提升效率、加速落地,并實現(xiàn)平滑生態(tài)遷移,推動芯片向系統(tǒng)級方案轉化。作為速顯微面向具身智能與邊緣AI的關鍵布局,TUCA連接硬件與應用,是構建產品、生態(tài)與商業(yè)閉環(huán)的橋梁。
天衡1100GPGPU:異構SoC協(xié)同,精準匹配邊緣AI計算場景
“天衡1100”是公司自主研發(fā)的首顆面向邊緣AI推理場景的GPGPU SoC芯片。芯片集成高性能GPU計算簇、通用CPU簇、多媒體處理子系統(tǒng)和豐富的系統(tǒng)接口,依托全面國產生態(tài),面向邊緣AI推理場景構建國產可控方案,滿足行業(yè)客戶長期供貨穩(wěn)定性需求。
異構SoC協(xié)同設計,多模塊互聯(lián)高效協(xié)同
“天衡1100”采用一體化異構SoC架構,通過CPU和GPU協(xié)同設計及軟硬件聯(lián)合調度,實現(xiàn)計算任務合理分配,提升能效與吞吐能力,增強多場景泛化能力。芯片集成了CPU、GPGPU、ISP、視頻編解碼單元及高速外設接口,經高速互聯(lián)總線形成統(tǒng)一片上系統(tǒng),顯著降低數據交互延遲,提高傳輸效率,使圖像輸入、視頻處理、AI推理、輸出與控制反饋形成高效閉環(huán),滿足邊緣智能設備對實時性與穩(wěn)定性的需求。

大容量內存滿足多任務處理需求
“天衡1100”支持最高128GB板載高速內存配置,內存帶寬85.3GB/s,為邊緣AI推理、多路視頻處理、大模型推理和復雜數據處理任務提供充足的數據吞吐支撐。應對機器人、工業(yè)視覺和自動駕駛等場景時,TH1100可以支持更大的模型、更復雜的中間特征緩存和更多路傳感器數據處理,在處理多任務并發(fā)的需求上游刃有余。
AI算力矩陣配置靈活度高
“天衡1100”支持FP32、FP16、FP8、INT8、INT4、FP4等多種精度計算,能夠根據不同AI模型和應用場景,在計算精度、性能和能效之間進行靈活匹配。這種混合精度算力配置能夠覆蓋從高精度計算到低功耗推理的多類需求,在AI推理常用的FP4混合精度計算方面,TH1100可提供50TOPS算力;在支持稀疏計算的場景下,F(xiàn)P4稀疏算力可達100TOPS。
多媒體能力優(yōu)異,輕松應對高清視頻需求
“天衡1100”集成高性能多媒體子系統(tǒng),可向多路攝像頭輸入、高清視頻處理、圖像增強、視頻分析和AI感知任務提供支撐。
通過雙路ISP、多媒體處理單元和豐富外設接口,“天衡1100”可以為機器人、工業(yè)檢測、自動駕駛和智慧醫(yī)療等應用提供更強的環(huán)境感知和數據處理能力。
AI任務引擎高效,強勁處理數據流處理
“天衡1100”內置24個Tensor Core(TC),可高效執(zhí)行矩陣運算,面向AI推理中的矩陣乘法、卷積、Trans-former關鍵算子和張量計算任務提供硬件加速能力。
同時,Tensor Memory Accelerator(TMA)支持多維張量數據搬運,可減少數據搬運與計算執(zhí)行之間的等待開銷。TC與TMA的協(xié)同工作,有助于提升AI算子的執(zhí)行效率,使系統(tǒng)在處理復雜模型和高吞吐推理任務時具備更好的性能表現(xiàn)。
外設接口豐富,智能生態(tài)互聯(lián)場景廣闊
“天衡1100”對邊緣計算的良好支持、雙路ISP設計以及豐富的外設接口匹配等特性,可連接攝像頭、顯示設備、存儲設備、網絡模塊、工業(yè)控制接口和多類傳感器,用于視覺感知、AI推理、路徑規(guī)劃、任務決策和控制反饋,缺陷檢測、質量分析和實時圖像處理。在智慧醫(yī)療場景中,可用于醫(yī)學影像處理、牙科影像分析和AI輔助診斷等應用。
師出同門,攻堅“中國芯”:中國科大團隊打造端側智能計算核心企業(yè)
速顯微電子創(chuàng)建于2015年,是國內最早成立的GPU設計公司之一,專注于嵌入式GPU芯片及相關系統(tǒng)解決方案的研發(fā),并創(chuàng)新地將數字存算設計與GPU IP結合,同時開展大模型參數硬化在GPU芯片的技術研發(fā)。
公司在相關領域擁有超過十年的深厚技術積累,具備芯片架構設計與核心IP開發(fā),硬件算子,SoC與操作系統(tǒng)研發(fā),應用模型與系統(tǒng)驗證,工具鏈構建以及系統(tǒng)集成與生態(tài)建設的全鏈條技術研發(fā)和工具配套能力,是國內極少數實現(xiàn)全鏈條自主設計的IC企業(yè),在天津、蘇州、合肥,深圳等地設立有研發(fā)中心。

公司創(chuàng)始人兼董事長項天博士,聯(lián)合創(chuàng)始人兼總經理王攀博士創(chuàng)業(yè)十年來,聯(lián)合一批同樣出自中國科大博士、碩士背景的核心團隊和產業(yè)資深人士,秉承相同的價值觀和工作理念,將公司打造成為行業(yè)賽道中不可忽視的力量。
近年來,公司相關產品聚焦云端或車規(guī)級高端市場,面向消費級物聯(lián)網的低功耗、低成本解決方案。速顯微研發(fā)的GC系列是全球第一款集成GPU的MCU芯片。2019年量產的GC9003是國內第一款能跑3D圖形的車規(guī)MCU。目前,GC90系列芯片已形成完整產品矩陣:GC9003芯片通過AEC-Q100車規(guī)級認證并累計出貨超百萬顆;GC9002芯片獲評“玄鐵優(yōu)選芯片”;GC9005芯片可同時處理1080P渲染和語音人臉識別。
通過多年發(fā)展,速顯微電子相關產品已廣泛應用于汽車智能座艙、工業(yè)控制、國防軍工等領域。
2025年,速顯微電子作為起草單位參與了工信部主導的《半導體集成電路圖形處理器(GPU)》國家標準制訂工作。公司創(chuàng)始人兼董事長項天博士作為標準核心起草人參與相關工作。
2026年,公司在“天衡”GPGPU 為代表的IP內核產品上實現(xiàn)了圖形處理與AI增強計算的深度融合。
貫通生態(tài),布局津南,共贏數智未來
發(fā)布會上,速顯微電子與深度機智(北京)科技有限公司(深度機智)、國儀量子技術(合肥)股份有限公司(國儀量子)分別簽署戰(zhàn)略合作協(xié)議簽約,向外界進一步展示了公司日益蓬勃和頗具競爭力的戰(zhàn)略生態(tài)圈。
深度機智是由北京中關村學院與中關村人工智能研究院聯(lián)合孵化的物理AI企業(yè),專注物理人工智能技術研發(fā)。雙方在未來的戰(zhàn)略合作中,將依托速顯微電子的國產GPU算力基礎,展開針對物理AI產業(yè)生態(tài)構建、技術落地、場景賦能、產業(yè)升級等方面的深度合作,共同推動物理AI技術從底層創(chuàng)新走向規(guī)模化產業(yè)應用。

國儀量子是國內少數具備電子束精密儀器自主研發(fā)生產能力的高端儀器企業(yè),在電子光學系統(tǒng)、納米級精密加工與檢測等底層技術方向上擁有深厚技術儲備。根據協(xié)議約定,雙方將規(guī)劃依托速顯微電子在AI ROM(人工智能只讀存儲器)模型固化芯片領域的技術積累與產業(yè)資源,以及國儀量子在電子束精密儀器領域的研發(fā)制造能力,圍繞AI ROM相關業(yè)務開展合作。
速顯微電子在發(fā)布會上官宣總部遷址天津市津南區(qū),并進行了新總部揭牌儀式。

天津市津南區(qū)為吸引優(yōu)質半導體和芯片設計企業(yè),以《津南區(qū)促進集成電路產業(yè)發(fā)展的指導意見(試行)》等為政策依據,構建了從企業(yè)入駐、研發(fā)到成長的全生命周期政策支持體系。未來將積極為速顯微電子等新質生產力企業(yè)的發(fā)展提供支持,做好保障。
項天董事長表示,速顯微電子在津南區(qū)布局研發(fā)、市場與總部一體化項目,依托津南區(qū)數字產業(yè)和半導體領域的產業(yè)支持,積極吸收南開大學等天津高校的人才資源,規(guī)劃產學研用項目合作。未來,公司會將上市培育與地方產業(yè)建設同步推進,助推區(qū)、市兩級數智產業(yè)集群加速壯大,為天津市數字經濟發(fā)展貢獻產業(yè)力量。