0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

积算科技上线赤兔推理引擎服务,创新解锁FP8大模型算力

全球TMT 来源:全球TMT 作者:全球TMT 2025-07-30 21:44 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群


北京2025年7月30日 /美通社/ -- 近日,北京积算科技有限公司(以下简称"积算科技")宣布其算力服务平台上线赤兔推理引擎。积算科技PowerFul-AI应用开发平台与赤兔合作,打造高性价比的模型轻量化部署方案。用户通过远程算力平台预置的模型镜像与AI工具,仅需50%的GPU算力即可解锁大模型推理、企业知识库搭建、智能体开发,加速大模型在智能问答、报告生成、客服助手、智能体等典型行业场景的落地。


赤兔推理引擎由北京清程极智科技有限公司(以下简称"清程极智")开发,并联合清华大学团队发布开源版本。其核心价值在于,打破了FP8模型原生部署时GPU必须支持FP8精度的要求。通过底层算子优化(如GeMM、MoE的指令级重构)和编译技术创新,赤兔早在今年三月即首次实现在非FP8精度卡上原生运行FP8高精度模型,并确保推理过程几乎零精度损失。

积算科技联合清程极智,完成了赤兔推理引擎在积算科技PowerFul-AI应用开发平台上的验证测试。测试结果表明,赤兔推理引擎在积算科技PowerFul-AI平台上运行稳定、性能表现优异,满足双方兼容性认证的各项标准,能够快速完成DeepSeek、Qwen等大模型推理部署,并支持基于非FP8精度GPU卡实现FP8模型部署,相比于使用BF16精度部署,GPU算力需求减半。以部署DeepSeek-R1-671B为例,原需4台8卡机2560GB显存,现仅需2台8卡机1280GB显存即可满足要求。

积算科技PowerFul-AI平台携手赤兔推理引擎,将为AI大模型应用开发打造"成本减半、零性能损耗"的解决方案,提供构建企业知识库开发、智能体搭建等功能,助力企业用户灵活快速构建大模型通用应用及个性化端到端解决方案。

PowerFul-AI是积算科技的大模型应用落地解决方案,能够为AI大模型落地应用提供高效、易用、安全的端到端开发平台,帮助企业及科研机构高效开发部署AI大模型应用。目前,PowerFul-AI已经全面适配DeepSeek R1、DeepSeek V3等模型。用户只需选择镜像和模型文件,并配置模型所需的算力资源,即可快速完成模型部署,实现DeepSeek的"分钟级"上线。

积算科技诞生于全球生成式AI浪潮,专注于智能算力服务市场,致力于成为中国最具价值的智能算力服务商,聚焦互联网、运营商、高校、新能源汽车等领域的多家头部客户提供算力服务。公司拥有万卡级先进智能算力资源池,提供裸金属、智能算力系统、专属智能算力系统等算力服务产品,适用于大模型训练与推理、算法研究、大数据分析、自动驾驶、智能科学计算等多元场景。其运维和服务团队具备大规模智能算力系统设计建设、大模型开发应用及性能优化能力,可提供全栈大模型应用开发服务支持,并根据客户需求提供灵活服务模式。

审核编辑 黄宇

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • AI
    AI
    +关注

    关注

    91

    文章

    41107

    浏览量

    302585
  • 大模型
    +关注

    关注

    2

    文章

    3771

    浏览量

    5271
收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    神州鲲泰携手趋境科技推出大模型推理智能调度解决方案

    近日,华为中国合作伙伴大会现场,神州鲲泰与趋境科技正式签订生态合作协议,并联合推出面向企业级大模型推理场景的智能调度解决方案。
    的头像 发表于 04-17 15:12 413次阅读
    神州鲲泰携手趋境科技推出大<b class='flag-5'>模型</b><b class='flag-5'>推理</b>智能<b class='flag-5'>算</b><b class='flag-5'>力</b>调度解决方案

    海光DCU完成阶跃星辰基座模型Step 3.5 Flash推理适配

    近日,海光DCU正式完成对阶跃星辰旗舰开源基座模型Step 3.5 Flash的全流程适配与深度调优。得益于新一代海光DCU原生支持FP8精度、超越主流旗舰产品的更大显存等核心优势,高效完成Step 3.5 Flash FP8
    的头像 发表于 03-26 09:48 637次阅读

    边缘AI临界点:深度解析176TOPS香橙派AI Station的产业价值

    Station的出现,标志着边缘AI不再仅仅是“云端的缩水版”,而是具备独立生命周期的“边缘原生”节点 。它不仅能在本地完成推理,还能通过丰富的接口控制物理世界,通过大内存加载复杂的决策
    发表于 03-10 14:19

    Hailo-8卡 + RK3588实测!26TOPS加持,助力AI视觉升级!

    近年来,AI视觉在边缘端应用广泛,行业对AI推理硬件的要求也日益提升。传统CPU在CNN等视觉模型推理任务中逐渐显露瓶颈,而专用AI加速器成为破局的关键。 Hailo-8 AI
    的头像 发表于 03-02 16:46 415次阅读
    Hailo-<b class='flag-5'>8</b><b class='flag-5'>算</b><b class='flag-5'>力</b>卡 + RK3588实测!26TOPS加持,助力AI视觉升级!

    从训练到推理:大模型需求的新拐点已至

    在大模型产业发展的早期阶段,行业焦点主要集中在大模型训练所需的投入。一个万亿参数大模型的训练可能需要数千张GPU芯片连续运行数月,成本高
    的头像 发表于 02-05 16:07 1027次阅读
    从训练到<b class='flag-5'>推理</b>:大<b class='flag-5'>模型</b><b class='flag-5'>算</b><b class='flag-5'>力</b>需求的新拐点已至

    进迭时空发布新一代RISC-V AI CPU芯片,满足端侧大模型需求

    FP8数据精度原生AI推理,还是首颗完整支持芯片级虚拟化的RISC-V产品。   硬件配置上,K3配备8颗高性能X100大核,主频2.4GHz,单核性能与ARM A76相当,60TOPS的AI
    的头像 发表于 01-30 14:06 9501次阅读

    华为荣获服务商互联能力成熟度模型参编证书

    在2025互联网大会期间,互联网服务论坛在成都成功举办。论坛现场举行了《
    的头像 发表于 12-31 11:50 803次阅读

    从云端集中到边缘分布:边缘智如何重塑网络布局

    随着大模型推理延迟进入毫秒级时代,整个科技行业都意识到:网络的规则正在被改写。这场变革的核心,正是从云端集中式计算向边缘分布式智能的范式转移。据行业多家分析机构综合预测,全球AI基
    的头像 发表于 12-25 11:34 606次阅读
    从云端集中到边缘分布:边缘智<b class='flag-5'>算</b>如何重塑<b class='flag-5'>算</b><b class='flag-5'>力</b>网络布局

    积木+3D堆叠!GPNPU架构创新,应对AI推理需求

    电子发烧友网报道(文/李弯弯)2025年,人工智能正式迈入应用推理时代。大模型从实验室走向千行百业,推理需求呈指数级爆发。然而,高昂的推理成本与有限的
    的头像 发表于 12-11 08:57 8074次阅读

    湘军,让变成生产

    脑极体
    发布于 :2025年11月25日 22:56:58

    国产AI芯片真能扛住“内卷”?海思昇腾的这波操作藏了多少细节?

    反而压到了310W。更有意思的是它的异构架构:NPU+CPU+DVPP的组合,居然能同时扛住训练和推理场景,之前做自动驾驶算法时,用它跑模型时延直接降了20%。 但疑惑也有:这种
    发表于 10-27 13:12

    与电力的终极博弈,填上了AIDC的“电力黑洞”

    ),专注于提供人工智能训练与推理所需的服务、数据服务和算法服务。AIDC采用异构计算架构,结
    的头像 发表于 09-22 02:43 9009次阅读

    杭州灵汐类脑智集群实现大模型快速推理

    据悉,“杭州灵汐类脑智集群”已于7月底实现了大模型快速推理API的企业服务试运行。该集群由杭州灵汐类脑科技有限公司牵头搭建运营,中国电信、中国电子科技南湖研究院以及脑启社区作为合作方
    的头像 发表于 08-18 16:06 1116次阅读

    超低延时重构AI推理体验!白山云发布“大模型API”产品

    优势,打造超低延时、超稳定、简单易用的API接口服务,降低大模型应用成本和开发门槛,助力企业和个人用户快速开启AI创新之旅。专注边缘推理,构建“云边端”
    的头像 发表于 07-02 17:26 1253次阅读
    超低延时重构AI<b class='flag-5'>推理</b>体验!白山云发布“大<b class='flag-5'>模型</b>API”产品

    软通智中标韶关公共服务平台项目

    日前,软通动力旗下软通智中标《韶关公共服务平台(一体化
    的头像 发表于 05-22 16:19 1160次阅读