PG(中国大陆)电子·控股有限公司-官网

国产算力体系如何支撑全球百万亿词元的智能体推理刚需?-PG电子控股有限公司
关闭
国产算力体系如何支撑全球百万亿词元的智能体推理刚需?
作者:小编 日期:2026-07-20 点击数: 

  

国产算力体系如何支撑全球百万亿词元的智能体推理刚需?

  寒武纪MLU590集群算力对标英伟达A100,海光DCU在大模型训练效率上达A100的92%,综合成本降低18%。

  华为昇腾950PR推理芯片计划出货75万片,内置三级存储架构优化长上下文推理显存占用。

  国产AI芯片自给率从2021年的10%提升至2026年的41%,海外头部算力品牌在华市场份额已降至8%。

  壁仞科技推出NPO光互连超节点方案,支持单节点1024卡scale-up扩展,通信时延压缩至3微秒。

  华为昇腾950超节点搭载1024张昇腾卡,可灵活扩展至50万卡规模,输出1 EFLOPS FP8算力。

  美团LongCat-2.0模型在5万多张国产芯片上完成1.6万亿参数训练,验证了国产集群承载万亿参数模型的可行性。

  我国已建成42座万卡集群,算力总规模与智能算力规模均跃居全球第二,“十四五”期间年均增速约30%。

  2026年算力网首次被列入国家六张战略性基础设施阵列,与电网、通信网并列。

  国家数据局发布词元交易政策,推动“词元”成为可量化、可结算的数字贸易新品类。

  西部绿电成本约0.2-0.3元/度,仅为欧美国家的1/4,生成100万Token电力成本仅个位数人民币。

  “算电协同”写入政府工作报告,新能源富集区通过电力市场化交易进一步压低智算中心用电成本。

  国产API调用成本可低至0.3美元/百万Token,仅为美国同类产品的1/16。

  智谱GLM-5在国产服务器上完成算子级优化,长序列部署成本砍半,单台可部署7440亿参数模型。

  中国开源模型全球下载占比达17.1%,首次超越美国,约80%的硅谷初创公司采用中国开源模型。

  国产模型在OpenRouter平台周调用量连续五周超越美国,最新一周达12.96万亿Token,全球前六均为中国模型。

  智谱GLM-5、DeepSeek V4已完成与华为昇腾、寒武纪、摩尔线程等七大国产芯片平台的全栈适配。

  阿里平头哥PPU芯片兼容CUDA生态,功耗比H20低30%,帮助用户低成本迁移。

  海外用户调用国内算力占比约1/4,业务增长超300%,覆盖东南亚、中东、拉美。

  汕头“来数加工”试点实现数据不出境、词元合规出海,月内日均调用量从1亿升至百亿。

  2026年我国日均Token调用量从2024年初的1000亿飙升至140万亿,两年增长超千倍。

  智能体时代单次交互可触发多轮模型调用,推理算力需求已全面超越训练,预计2027年推理算力占比将突破70%。

  字节跳动宣布投建1GW超大规模智算中心,全线采用昇腾国产算力底座,整条国产算力产业链迎来确定性爆发。 (以上内容均由AI生成)PG电子平台上有哪些类型和风格的游戏可供选择?

顶部