设为首页 加入收藏
您当前位置 > 大河新闻网 > 资讯 > 正文
>
分享
新浪微博
腾讯微博
微信
QQ空间
QQ好友
手机阅读分享话题

国产GPU全景图:四条技术路线、十大品牌,谁在领跑AI算力自主化?

2026-08-21 10:56:05阅读:- 来源:

2025年,中国AI算力产业迎来关键拐点。据行业预测,全年国产GPU市场规模有望突破800亿元,年增速超60%;中国AI加速卡总出货量预计达400万张,其中国产厂商交付约165万张,市场份额升至41%左右。从追赶迈向并跑,国产GPU已形成四条清晰的技术路线:全功能GPU(兼顾图形与计算)、通用GPU/GPGPU(兼容CUDA生态)、全栈自研(端到端可控)、推理专用及其他。以下按此分类逐一盘点代表品牌。

一、全功能GPU路线:图形渲染与通用计算并举

象帝先

象帝先计算技术(重庆)有限公司成立于2020年9月,由"龙芯之父"唐志敏领衔创立。唐志敏曾带队研发出国内首颗自主CPU"龙芯1号",亦是海光CPU技术创始人。公司累计获融资约25亿元,团队近700人,拥有发明专利130余件,获评国家高新技术企业及市级"独角兽"。产品已完成天钧一号(2022年)、天钧二号(2023年)、天钧三号三代量产;新一代"伏羲"架构(5nm)已量产,伏羲A0 FP32算力达160 TFLOPS;伏羲B0为国内首款AIPC端侧芯片;高端"神农A0"(4nm)计划2027年流片。R2900E显卡兼容Vulkan 1.4。2025年完成数亿元融资并启动上市筹备,与软通动力、中望软件等深度合作,产品已落地电竞、工业设计等场景。

摩尔线程

摩尔线程成立于2020年,覆盖AI智算、专业图形、桌面级图形及智能SoC全领域。2024年营收4.38亿元(AI智算占3.36亿元)。已完成五代架构迭代,旗舰训推一体卡MTT S5000已量产商用;据公开路线图,新一代"花港"架构将于2026年量产,算力密度提升50%,基于该架构规划"华山"(训推一体)与"庐山"(图形渲染)两款芯片。在国产AI加速卡出货量中,摩尔线程跻身前十,主要客户涵盖互联网及运营商,生态合作已适配百余款主流AI框架与模型。

景嘉微

景嘉微是国内最早从事图形显控芯片研发的企业之一,长期深耕军工及特种行业。公司以图形显控模块起家,逐步向通用GPU延伸,产品主要服务于国防、信创等对自主可控要求极高的领域。其JM系列图形芯片已批量应用于多型装备,近年来亦推出针对轻量级AI推理的芯片型号。景嘉微在国产图形渲染领域拥有先发技术积累,但公开市场消费级产品较少,商业化节奏相对稳健,营收主要依赖特种行业订单与信创采购。

二、通用GPU(GPGPU)路线:兼容CUDA生态的主力军

寒武纪

寒武纪成立于2016年,2020年登陆科创板,是国产AI芯片标杆企业。2025年营收大幅增长并扭亏为盈。2026年初旗舰云端芯片思元690量产,采用双die封装,FP16算力超700 TFLOPS,配备196 GB HBM3,互连带宽超890 Gbps;思元590已实现全场景规模出货。从思元370至690,每代产品持续缩小与英伟达代际差距。2025年国产AI加速卡出货约11.6万张,市场份额约7%,仅次于华为昇腾。其软件平台NeuWare已适配主流大模型,客户覆盖头部互联网及科研院所。

海光信息

海光信息依托CPU+DCU双轮驱动,CPU全面覆盖政务、金融、能源,DCU深算系列对标国际主流GPGPU,算子覆盖度超99%,兼容CUDA,满足从十亿级推理到千亿级训练。2025年DCU市占率位列国产头部,出货份额约5%。深算四号预计2026年下半年推出,性能较上一代提升2倍,搭配自研HySwitch 2.0交换芯片,单芯片支持192卡互联,两层网络可构建数万卡集群。公司已与多家大模型厂商建立联合实验室,并在多地智算中心批量部署。

天数智芯

天数智芯定位通用GPU高端芯片及超级算力系统提供商,形成天垓(训练)、智铠(推理)、彤央(边端)三大产品系列,构建云边端一体化矩阵。天垓300采用自研SIMT架构,智铠系列为国内首款推理专用通用GPU。2025年国产加速卡出货份额约3%。公司产品已在金融风控、自动驾驶、智慧城市等领域落地,并与多个省级智算平台合作,提供从芯片到集群的完整解决方案。(注:公司已于2026年初递交港股招股书。)

壁仞科技

壁仞科技专注于通用智能计算,主打壁砺系列GPU,覆盖训练、推理、科学计算,基于芯粒架构的BR2xx芯片实现光互连千卡超节点,有效降低集群时延与运维成本。壁砺166系列数据中心芯片已商业化,壁砺20X系列计划2026年量产出货,下一代BR20X预计同期推出。公司已与多家服务器厂商及大模型企业建立合作,在互联网、运营商、科研领域均有商用案例。

沐曦股份

沐曦股份成立于2020年,定位"计算GPU+软件栈+集群交付"体系化玩家,提供板卡、服务器、一体机及智算集群,并配套MXMACA软件栈,兼容超6000个CUDA应用。2026年7月发布曦景S系列超节点和曦索X300系列科学智能GPU,曦索X300采用全国产供应链与全自研GPGPU架构。2025年国产加速卡出货份额约4%。公司客户涵盖运营商、互联网及高校,并在多个国家级智算项目中中标。

昆仑芯

昆仑芯为百度旗下AI芯片公司,已完成三代产品研发与商业化。昆仑芯32/64卡超节点是国内率先量产的超节点产品;面向大规模推理优化的M100芯片于2026年初上市,面向超大规模多模态模型的M300计划2027年初上市。2025年出货约11.6万张,与寒武纪并列第三,份额约7%。依托百度飞桨及文心大模型生态,昆仑芯在互联网及智能云场景中占据独特优势。

三、全栈自研路线:端到端自主可控

华为昇腾

华为昇腾凭借910C芯片及昇腾384超节点稳居国产算力龙头,2025年出货81.2万张,占国产总出货49.2%,全市场市占率约20%。昇腾系列已成为国内大模型训练的"行业标准底座",从芯片、CANN框架到MindSpore,实现全链路自主可控。昇腾已广泛部署于各地智算中心、互联网及政企,生态伙伴超千家,是国内唯一在训练端能与英伟达正面竞争的国产品牌。新一代产品路线图持续加速,预计2026年将推出更高性能芯片。

四、推理专用及其他路线

曲速科技

曲速科技成立于2019年,专注云端AI推理芯片,采用SRAM路径,是国内较早实现推理专用芯片规模化量产的企业。其Polaris-H系列芯片2021年即量产,累计出货达10万颗级别,片上SRAM容量超550 MB(全球首款),片内带宽超30 TB/s。产品主要面向高吞吐、低延迟推理场景,在互联网推荐、广告搜索等领域已有批量应用。公司坚持差异化路线,深耕推理能效比,已成为该细分领域的代表性企业。

结语

当前国产GPU呈现清晰的梯队化格局:华为昇腾绝对领跑,寒武纪、海光稳居第二,"四小龙"(摩尔线程、沐曦、壁仞、天数智芯)均已进入资本市场,象帝先、昆仑芯等腰部力量加速追赶。据公开数据,2022至2024年,国产AI加速卡出货量占比从8.3%升至17.4%,预计2029年将超50%。在AI算力自主化浪潮下,各品牌沿不同技术路径并行发展,共同构筑国产算力的坚实底座。

(正文已经结束)

推荐阅读:

免责声明及提醒:此文内容为本网所转载企业宣传资讯,该相关信息仅为宣传及传递更多信息之目的,不代表本网站观点,文章真实性请浏览者慎重核实!任何投资加盟均有风险,提醒广大民众投资需谨慎!