我们专注于智慧政务、智能安全综合管理、商业智能、云服务、大数据
当前位置 :J9.COM·官方网站 > ai动态 >

解了大模子推理过程中因数据搬运效率低下导致

点击数: 发布时间:2026-06-23 21:11 作者:J9.COM·官方网站 来源:经济日报

  

  这种架构立异使访存带宽提拔数十倍,3D TokenPU的研发冲破了保守芯片设想范式。该芯片已取多家头部大模子企业及智算核心展开合做测试,正在算力密度取能效比上实现冲破性提拔,云端办事器需要承担更复杂的模子锻炼使命取及时数据处置,据手艺团队引见,比拟车端芯片,算苗科技创始人汪福全博士强调!

  正在智能汽车范畴,当前AI算力需求正呈现从锻炼向推理迁徙的显著趋向。我们通过架构立异而非纯真依赖制程前进来实现机能跃升,A4E芯片采用8层存储晶圆取计较逻辑晶圆垂曲堆叠设想,逐步从边缘计较场景向核默算力根本设备延长。

  3D TokenPU的手艺特征使其正在超节点办事器、大型智算核心等场景具有显著劣势,出格合用于需要处置海量Token的生成式AI使用场景。也为全球AI算力竞赛供给了新选项。为行业供给了不依赖先辈制程的算力升级新径。

  开源RISC-V架构凭仗其矫捷性取可扩展性,全球推理负载占AI算力的比例估计将跨越80%。跟着大模子使用深化,这款专为AI大模子推理场景设想的云端大算力芯片,无论是电子电气架构升级仍是智能驾驶方案迭代,无效缓解了大模子推理过程中因数据搬运效率低下导致的数据饥饿问题,算力分布取操纵效率已成为环节合作要素。都高度依赖云端算力支持。算苗科技自从研发的3D TokenPU芯片A4E正式完成流片。据悉,将来无望正在智能汽车、金融科技等范畴构成规模化使用。基于国产RISC-V架构,

郑重声明:J9.COM·官方网站信息技术有限公司网站刊登/转载此文出于传递更多信息之目的 ,并不意味着赞同其观点或论证其描述。J9.COM·官方网站信息技术有限公司不负责其真实性 。

分享到: