国芯科技DPNPU新IP产品最新进展,单核支持0.5~4.8TOPS灵活算力配置
电子发烧友网综合报道 国芯科技发布公告称,其自主研发的神经网络处理器DPNPU(Dataflow Parallel NPU)新IP产品,在公司内部测试中取得了圆满成功。
国芯科技表示,公司最新推出的这款神经网络处理器DPNPU新IP产品,专为端侧与边缘计算设计,是一款高性能的AI处理器。它针对人工智能应用中复杂多变的计算任务,进行了多方面的优化,力求在功耗、性能和灵活性之间达到最佳平衡,从而为各类智能设备提供高效、可靠且易于扩展的算力支持。
国芯科技的DPNPU单核具备0.5~4.8 TOPS的灵活算力配置能力,并支持算力的线性扩展,能够根据不同场景的需求,提供定制化的AI算力解决方案。
在架构设计上,国芯科技的DPNPU采用了符合RISC-V指令集架构(RISC-V ISA)标准的创新开放架构。该架构通过将RISC-V核心与高性能神经网络加速单元在架构层面进行深度融合与优化,并设计了专用的TDS(Task Distribution&Synchronization)硬件调度引擎作为核心控制单元,将网络模型中的算子序列转化为高效的节点化任务流,实现了任务管理、数据流控制与AI专用计算的统一高效调度。此外,该新IP产品还采用了脉动阵列高效动态融合技术,确保了设备在长时间运行中的稳定性和卓越能效表现。
DPNPU内置了90多种神经网络算子,全面覆盖了CNN、RNN等神经网络架构,并支持LSTM、GRU等RNN变体。通过RISC-V指令和硬件通用性设计,该产品可扩展支持更多算子,为适配未来不断涌现的AI模型预留了充足的空间。同时,DPNPU还支持训练后量化(PTQ)技术,提供了对称量化、非对称量化、逐层量化和逐通道量化四种方式,并支持INT8和FP16混合精度量化。在保持模型精度的前提下,该新IP产品大幅减少了计算资源和存储空间的占用,实现了精度与性能的完美平衡。
此外,DPNPU还集成了公司自研的PCD(Parameter Compression&Decompression)模块,支持参数压缩与硬件自动解压缩技术,有效缓解了数据吞吐瓶颈,降低了带宽压力,进一步提升了整体系统性能。
为了降低AI应用开发的门槛,国芯科技围绕自研的DPNPU构建了一套完整的软件生态——CCore NPU Studio。该生态集成了完整易用的工具套件、驱动和运行时软件,缩短了从开发到部署的周期,提升了AI应用的落地效率。其中,CCore NPU Studio工具套件为DPNPU提供了端到端的模型部署能力,包括模型转换、预处理、量化、编译、仿真等工具软件;CCore NPU Runtime则提供了DPNPU运行时推理支撑,涵盖了推理框架软件和各种扩展软算子库;CCore NPU Driver则适配了RISC-V等主流CPU平台,支持Linux/RTOS/Bare-metal等不同应用环境需求。
随着人工智能技术的加速渗透,工业控制、智能家电、汽车电子、医疗健康等关键领域对AI芯片的需求日益增长。与云端AI相比,端侧与边缘侧AI具备实时响应、数据隐私保护、低网络依赖等显著优势,这对芯片的能效比和算力密度提出了更高要求。国芯科技的DPNPU在架构可行性、能效表现及软件栈方面均已完成验证,为后续公司NPU技术的持续研发以及端侧和边缘侧AI芯片的发展和应用奠定了坚实基础。
国芯科技表示,公司对上述DPNPU新IP产品拥有完整的知识产权。本次神经网络处理器DPNPU新IP产品的研发成功,是公司在人工智能领域长期坚持创新驱动的结果,预计将对公司未来的市场拓展和业绩成长性产生积极影响。
声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。
举报投诉
-
NPU
+关注
关注
2文章
425浏览量
22404 -
国芯科技
+关注
关注
0文章
220浏览量
5126
发布评论请先 登录
相关推荐
热点推荐
集聚算力设备与技术,2027甘肃绿色算力展会,兰州AI算力展
大会全称:2027中国(甘肃)绿色算力产业博览会暨东数西算产业合作大会
China (Gansu) Green Computing Industry Expo & East‑W
发表于 09-13 12:03
香橙派11款AI算力产品怎么选?从芯片规格到场景适配的经验分析
最近梳理香橙派基于昇腾的AI产品线,发现已经推出了11款之多,从352TOPS的服务器算力卡到5.2W的边缘视觉板都有覆盖。作为一个长期关注嵌入式AI硬件的工程师,我想从实际工程选型的
发表于 08-19 19:35
TOPS到底是什么?一文看懂AI算力单位与INT8精度
聊起AI芯片、嵌入式开发板和AI PC,总能看到“XX TOPS@INT8” 的参数。很多人只知道数字越大算力越强,却未必明白TOPS究竟在衡量什么、INT8又为何总是和它绑定出现。今
芯驰科技座舱全场景覆盖夯实量产领先
4月24日,2026北京国际汽车展览会期间,国产芯片领军企业芯驰科技全面展示了备受期待的AI座舱芯片X10的最新进展,并同步推出了X9SP增强版。通过X9系列的持续迭代精进与X10的架构革新,芯驰深耕座舱
边缘AI算力临界点:深度解析176TOPS香橙派AI Station的产业价值
310P芯片的底层架构,深度剖析这款产品的技术细节、算力门槛及其在实际产业落地中的真实价值。
一、176TOPS的产业门槛:为何这是边缘算
发表于 03-10 14:19
紫光国芯IPO新进展,聚焦DRAM存储技术
电子发烧友网报道 近日,西安紫光国芯半导体股份有限公司(以下简称“紫光国芯”)在资本市场迈出关键一步,向陕西证监局提交了IPO辅导备案,辅导券商为中信建投证券,正式开启A股上市征程。
算力高达 1100 TOPS!内置 Jetson AGX Orin 模组的高算力服务器
CSB1-N4AGXOrin最高可配置4个NVIDIAJetsonAGXOrin(64GB)计算节点,算力最高1100TOPS(INT8)。支持
MWC Doha 2025|美格智能全新发布60 Tops AI算力、支持Linux系统的SNM982高算力AI模组
11月25日,在MWCDoha展会期间,美格智能全新发布基于高通QCS8650平台研发设计的SNM982高算力AI模组。搭载Linux5.15系统,AI算力超过60
芯科科技分享在物联网领域的最新进展
Labs(芯科科技)亚太区业务副总裁王禄铭、中国大陆区总经理周巍及台湾区总经理宝陆格就公司技术路线、产品策略及市场趋势回答了媒体提问。三位高管围绕安全认证、无线连接、边缘计算等议题,介绍了公司在物联网领域的最新进展。
DisplayPort汽车扩展标准新进展,显示系统灵活性和效率大幅提升
电子发烧友网报道(文/李弯弯)2025年10月27日,VESA(视频电子标准协会)在深圳益田威斯汀酒店举办新闻发布会,详细介绍了DisplayPort汽车扩展标准(DP AE)的最新进展,同时分享了
AI算力模组TS-SG-SM9系列产品规格书
/FP16/BF16/FP32混合精度计算,可支持16路高清视频实时分析,灵活应对图像、语音、自然语言等场景,可广泛应用于智算服务器、边缘智算盒、工控机、无人机、AIoT等种类型
发表于 10-27 17:12
•4次下载
算力高达 275 TOPS!EC-AGXOrin 边缘计算主机
采用NVIDIAJetsonAGXOrin(64GB)模组,算力可达275TOPS,支持多种AI大模型和深度学习框架。支持22路1080P视
国芯科技DPNPU新IP产品最新进展,单核支持0.5~4.8TOPS灵活算力配置
评论