每秒 520 万亿次浮点运算,我国自研 AI 芯片取得架构突破
最新 7 月 13 日消息,据央视新闻报道,7 月 13 日,我国首颗采用软件定义与三维近存计算技术的 AI 芯片在上海正式亮相。这颗芯片在 14 纳米制程工艺上,实现了每秒 520 万亿次浮点运算的算力,其最大特点是通过底层架构创新,走出了一条不依赖先进制程的高端算力发展路径。

最新从报道中获悉,该芯片采用了软件定义与三维近存计算相结合的技术路线。一方面,通过软件定义芯片技术,硬件资源可以根据不同任务动态调配,大幅提升算力利用率;另一方面,通过三维垂直堆叠技术,将计算单元与存储单元紧密集成在一起,访存带宽达到每秒 6.4TB,从架构上缓解了长期困扰芯片设计的“存储墙”瓶颈。
报道称,由于不再单纯依赖制程微缩来提升性能,这条技术路线的供应链更加稳定可控。同步发布的还有与该芯片配套的全栈软件工具链,兼容主流深度学习框架,并形成了从单张加速卡、AI 服务器,到液冷超节点、大规模智算集群的完整产品体系,能够为大模型训练与推理提供规模化、可落地的算力支撑。
业内认为,这标志着我国在高端算力芯片领域,探索出了一条以架构创新代替制程追随的自主发展新路,对夯实人工智能算力底座具有重要意义。
延伸阅读
软件定义芯片(Software Defined Chip, SDC)是一种新型的芯片设计范式,其核心思想是通过软件编程来动态定义和配置芯片的硬件功能,从而让同一块芯片能够灵活适应不同的计算任务。这种技术可以显著提升芯片的通用性和能效比。
三维近存计算(3D Near-Memory Computing)是一种将计算单元与存储器(如 DRAM)在垂直方向上进行三维堆叠集成的技术。这种设计可以极大缩短数据在计算与存储单元之间的传输距离,从而有效突破传统冯 · 诺依曼架构中因“存储墙”问题导致的数据传输瓶颈,提升整体能效和计算性能。
在 AI 芯片领域,除了追求算力峰值,访存带宽同样是衡量性能的关键指标。例如,英伟达的 H100 芯片采用了 HBM2e 或 HBM3 高带宽内存,其内存带宽可达约 2TB/s。
“存储墙”(Memory Wall)问题是指处理器计算速度的增长远快于内存访问速度的增长,导致计算单元经常需要等待数据从内存中读取或写入,从而限制了整体系统性能。这是当前高性能计算和人工智能领域面临的核心挑战之一。
全栈软件工具链对于 AI 芯片的生态构建至关重要,它通常包括编译器、驱动程序、运行时库、性能分析工具以及对接主流深度学习框架(如 TensorFlow、PyTorch)的接口。完善的工具链可以降低开发者的使用门槛,是芯片能否成功商业化的关键因素。
《每秒 520 万亿次浮点运算,我国自研 AI 芯片取得架构突破》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
华为昇腾 950 超节点荣获 2026 世界人工智能大会最高荣誉 SAIL 奖
@华为中国 昨日(7 月 18 日)发布博文,宣布昇腾 950 超节点(Atlas 950 SuperPoD)荣获 2026 世界人工智能大会(WAIC)最高荣誉 SAIL 奖。... -
“反 AI”情绪愈演愈烈,多家头部 AI 公司加强高管安保
《华尔街日报》报道称,针对 AI 行业的敌意不断上升,开发先进 AI 模型的人员和企业正面临越来越多的威胁与袭击企图。多家头部 AI 公司已经加强安保,部分高管出行时甚至由武装保镖随行,另一些人则选择降低曝光度,减少公开活动。... -
OpenAI 回应 GPT-5.6 Sol AI 意外删除用户文件:已采取措施降低风险
OpenAI 核心产品负责人蒂博 · 索蒂奥(Tibo Sottiaux)于 7 月 16 日在 X 平台发布推文,回应 GPT-5.6 Sol 会擅自删除用户文件问题。... -
面向手机的 AI 游戏创作工具,《Roblox》移动版将更新“Build”功能
Roblox 为移动版客户端推出“Build”功能,用户通过简单提示词即可生成基础游戏,无需编程技能。该功能由多种 AI 模型驱动,支持生成玩法、环境、角色等。将于 7 月 28 日开启 Alpha 测试,首先面向新西兰用户开放。#Roblox #AI 游戏创作 #移动游戏开发#... -
歌曲生成平台 Suno 部分源码泄露,被发现全网爬取数百万歌曲训练 AI
科技媒体 404Media 昨日(7 月 16 日)发布博文,报道称基于黑客披露的 Suno 内部源代码,该 AI 歌曲生成平台从 YouTube Music、Deezer 和 Genius 等平台抓取数百万首歌曲来构建其核心模型。...












