您的位置:首页 > 互联网

万卡万P万亿参数通用算力!摩尔线程夸娥智算中心解决方案重磅升级

发布时间:2024-07-04 11:02:15  来源:互联网     背景:

7月3日,上海——摩尔线程重磅宣布其AI旗舰产品夸娥(KUAE)智算集群解决方案实现重大升级,从当前的千卡级别大幅扩展至万卡规模。摩尔线程夸娥(KUAE)万卡智算集群,以全功能GPU为底座,旨在打造国内领先的、能够承载万卡规模、具备万P级浮点运算能力的国产通用加速计算平台,专为万亿参数级别的复杂大模型训练而设计。这一里程碑式的进展,树立了国产GPU技术的新标杆,有助于实现国产智算集群计算能力的全新跨越,将为我国人工智能领域技术与应用创新、科研攻坚和产业升级提供坚实可靠的关键基础设施。

此外,摩尔线程联合中国移动通信集团青海有限公司、中国联通青海公司、北京德道信科集团、中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司(排名不分先后)分别就三个万卡集群项目进行了战略签约,多方聚力共同构建好用的国产GPU集群。

摩尔线程创始人兼CEO张建中表示:“当前,我们正处在生成式人工智能的黄金时代,技术交织催动智能涌现,GPU成为加速新技术浪潮来临的创新引擎。摩尔线程矢志投身于这一历史性的创造进程,致力于向全球提供加速计算的基础设施和一站式解决方案,为融合人工智能和数字孪生的数智世界打造先进的加速计算平台。夸娥万卡智算集群作为摩尔线程全栈AI战略的一块重要拼图,可为各行各业数智化转型提供澎湃算力,不仅有力彰显了摩尔线程在技术创新和工程实践上的实力,更将成为推动AI产业发展的新起点。”

AI主战场,万卡通用算力是标配

大模型自问世以来,关于其未来的走向和发展趋势亟待时间验证,但从当前来看,几种演进趋势值得关注,使得其对算力的核心需求也愈发明晰。

首先,Scaling Law将持续奏效。Scaling Law自2020年提出以来,已揭示了大模型发展背后的“暴力美学”,即通过算力、算法、数据的深度融合与经验积累,实现模型性能的飞跃,这也成为业界公认的将持续影响未来大模型的发展趋势。Scaling Law将持续奏效,需要单点规模够大并且通用的算力才能快速跟上技术演进。

其次,Transformer架构不能实现大一统,和其他架构会持续演进并共存,形成多元化的技术生态。生成式AI的进化并非仅依赖于规模的简单膨胀,技术架构的革新同样至关重要。Transformer架构虽然是当前主流,但新兴架构如Mamba、RWKV和RetNet等不断刷新计算效率,加快创新速度。随着技术迭代与演进,Transformer架构并不能实现大一统,从稠密到稀疏模型,再到多模态模型的融合,技术的进步都展现了对更高性能计算资源的渴望。

与此同时,AI、3D和HPC跨技术与跨领域融合不断加速,推动着空间智能、物理AI和AI4Science、世界模型等领域的边界拓展,使得大模型的训练和应用环境更加复杂多元,市场对于能够支持AI+3D、AI+物理仿真、AI+科学计算等多元计算融合发展的通用加速计算平台的需求日益迫切。

多元趋势下,AI模型训练的主战场,万卡已是标配。随着计算量不断攀升,大模型训练亟需超 级工厂,即一个“大且通用”的加速计算平台,以缩短训练时间,实现模型能力的快速迭代。当前,国际科技巨头都在通过积极部署千卡乃至超万卡规模的计算集群,以确保大模型产品的竞争力。随着模型参数量从千亿迈向万亿,模型能力更加泛化,大模型对底层算力的诉求进一步升级,万卡甚至超万卡集群成为这一轮大模型竞赛的入场券。

然而,构建万卡集群并非一万张GPU卡的简单堆叠,而是一项高度复杂的超 级系统工程。它涉及到超大规模的组网互联、高效率的集群计算、长期稳定性和高可用性等诸多技术难题。这是难而正确的事情,摩尔线程希望能够建设一个规模超万卡、场景够通用、生态兼容好的加速计算平台,并优先解决大模型训练的难题。

夸娥:国产万卡万P万亿大模型训练平台

谷歌今天最新股价

夸娥(KUAE)是摩尔线程智算中心全栈解决方案,是以全功能GPU为底座,软硬一体化、完整的系统级算力解决方案,包括以夸娥计算集群为核心的基础设施、夸娥集群管理平台(KUAE Platform)以及夸娥大模型服务平台(KUAE ModelStudio),旨在以一体化交付的方式解决大规模GPU算力的建设和运营管理问题。

基于对AI算力需求的深刻洞察和前瞻性布局,摩尔线程夸娥智算集群可实现从千卡至万卡集群的无缝扩展,旨在满足大模型时代对于算力“规模够大+计算通用+生态兼容”的核心需求,通过整合超大规模的GPU万卡集群、极 致的计算效率优化以及高度稳定的运行环境,以万卡智算集群的新超 级工程,重新定义国产集群计算能力的新标准。

元气森林 纤茶

夸娥万卡智算解决方案具备多个核心特性:

超大算力,万卡万P:在集群计算性能方面,全新一代夸娥智算集群实现单集群规模超万卡,浮点运算能力达到10Exa-Flops,大幅提升单集群计算性能,能够为万亿参数级别大模型训练提供坚实算力基础。同时,在GPU显存和传输带宽方面,夸娥万卡集群达到PB级的超大显存总容量、每秒PB级的超高速卡间互联总带宽和每秒PB级超高速节点互联总带宽,实现算力、显存和带宽的系统性协同优化,全面提升集群计算性能。

超高稳定,月级长稳训练:稳定性是衡量超万卡集群性能的关键。在集群稳定性方面,摩尔线程夸娥万卡集群平均无故障运行时间超过15天,最长可实现大模型稳定训练30天以上,周均训练有效率在99%以上,远超行业平均水平。这得益于摩尔线程自主研发的一系列可预测、可诊断的多级可靠机制,包括:软硬件故障的自动定位与诊断预测实现分钟级的故障定位,Checkpoint多级存储机制实现内存秒级存储和训练任务分钟级恢复以及高容错高效能的万卡集群管理平台实现秒级纳管分配与作业调度。

极 致优化,超高MFU:MFU是评估大模型训练效率的通用指标,可以直接反应端到端的集群训练效率。夸娥万卡集群在系统软件、框架、算法等层面一系列优化,实现大模型的高效率训练,MFU最 高可达到60%。其中,在系统软件层面,基于极 致的计算和通讯效率优化等技术手段,大幅提升集群的执行效率和性能表现。在框架和算法层面,夸娥万卡集群支持多种自适应混合并行策略与高效显存优化等,可以根据应用负载选择并自动配置最 优的并行策略,大幅提升训练效率和显存利用。同时,针对超长序列大模型,夸娥万卡集群通过CP并行、RingAttention等优化技术,有效缩减计算时间和显存占用,大幅提升集群训练效率。

全能通用,生态友好:夸娥万卡集群是一个通用加速计算平台,计算能力为通用场景设计,可加速LLM、MoE、多模态、Mamba等不同架构、不同模态的大模型。同时,基于高效易用的MUSA编程语言、完整兼容CUDA能力和自动化迁移工具Musify,加速新模型“Day0”级迁移,实现生态适配“Instant On”,助力客户业务快速上线。

万众一芯,共建大模型应用生态

万卡集群的建设需要产业界的齐心协力,为实现大模型创新应用的快速落地,让国产算力“为用而建”。发布会现场,摩尔线程携手中国移动通信集团青海有限公司、中国联通青海公司、北京德道信科集团、中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司(排名不分先后),分别就青海零碳产业园万卡集群项目、青海高原夸娥万卡集群项目、广西东盟万卡集群项目进行了战略签约。

借助摩尔线程先进的夸娥全栈智算解决方案,各方将携手共建强大的全国产智算平台,以加速产业数字化转型和高质量发展。夸娥万卡智算集群项目标志着国产AI算力基础设施的又一重大进展,将为各地的数字经济发展注入新活力。

图注:摩尔线程与中国移动通信集团青海有限公司战略签约

图注:摩尔线程与中国联通青海公司、北京德道信科集团战略签约

图注:摩尔线程与中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司战略签约

发布会后,无问芯穹、清程极智、360、京东云、智平方等五家合作伙伴代表纷纷登台,分享了摩尔线程夸娥智算集群如何助力其在大模型训练、大模型推理、具身智能等不同场景和领域的创新,展现了夸娥智算集群在实际应用中的巨大潜力与广泛适用性。

摩尔线程愿与广大行业伙伴并肩同行,发挥全栈AI的力量,加速推动一个由万卡智算集群为强大底座,多领域伙伴共建、广泛赋能数字经济的国产智算生态,共同开启一个属于大模型与生成式人工智能的新时代,为美好世界加速。在WAIC期间,摩尔线程将在上海世博展览馆(H2馆D616)开展“全栈AI 为美好世界加速”的主题成果展示,包括加速卡、服务器、超融合一体机和AIGC应用在内的摩尔线程全栈AI产品悉数亮相,并携手众多行业合作伙伴联合展示基于夸娥智算集群的丰富行业大模型与应用方案。

关于摩尔线程

秦港股份上市日期查询

摩尔线程成立于2020年10月,以全功能GPU为核心,致力于向全球提供加速计算的基础设施和一站式解决方案,为各行各业的数智化转型提供强大的AI计算支持。

我们的目标是成为具备国际竞争力的GPU领军企业,为融合人工智能和数字孪生的数智世界打造先进的加速计算平台。我们的愿景是为美好世界加速。


返回网站首页

本文评论
值得买科技第三季度营收2.09亿元「值得买科技市值」
10 月 31 日消息,北京值得买科技股份有限公司(证券简称:值得买)近日发布 2022 年第三季度报告。数据显示,报告期内,该公司营业收入208,784,298. 21 元,相比上年同期下降28.44%;归属于...
日期:11-14
ai音乐创作app「AI音乐工具 Udio更新 可制作长达15分钟音乐」
5月6日 消息:AI音乐工具Udio最近宣布了一系列新功能的更新,这些更新致力于帮助用户创作出更长、更连贯的音乐作品,为音乐制作者提供了更多的创作自由和可能性。Udio的新更新中...
日期:05-06
荣耀90pro「性能灭霸来了!荣耀90 GT手机明天发布:要把性能做到超乎想象」
快科技12月20日消息,今天荣耀手机官方发布海报表示,性能灭霸”荣耀90 GT手机将在明晚(12月21日)19:00正式发布。海报上文字为超凡帧画 性能制霸”,代表荣耀90 GT将搭载全新的超凡...
日期:12-20
消息称苹果已在研发A19仿生芯片和M5系列芯片 但推出还要两年「iphone a12仿生芯片」
8月21日消息,据外媒报道,从此前的消息来看,苹果下月将推出的iPhone 15系列中的两款Pro,将搭载苹果自研的A17仿生芯片,搭载M3芯片的Mac新品,最快有望在10月份推出。xbox巨无霸手柄...
日期:08-21
Facebook误关多款第三方应用遭开发者投诉_facebook举报用户
北京时间6月27日,据国外媒体报道,由于自动监控平台系统调整,过去几天Facebook错误关闭了多款第三方应用。已有多名开发者就这一问题进行投诉。 有开发者在论坛上表示:“我的一...
日期:07-30
从“乙游”到“AI恋”,这届年轻人为啥和“AI”谈恋爱了?
声明:本文来自于微信公众号 娱乐独角兽(ID:yuledujiaoshou),作者:赤木瓶子,授权转载发布。2013年上映的科幻电影《HER》的剧情,在十年后的现实世界有了更为具体的呈现。电影中,男...
日期:06-24
虚幻引擎是什么软件「虚幻引擎 5.2 发布,原生支持 Apple Silicon」
5月16日 消息:Epic Games宣布推出虚幻引擎5.2(Unreal Engine5.2/ UE5.2)。Epic Games表示,虚幻引擎5.2进一步扩展了UE5开创性的工具集,继续实现最先进的实时3D创作工具的承诺。...
日期:05-16
三星c5530_三星c550底座拆卸
是一款推出于2009年的功能手机,它的设计简洁、流畅,大大提升了用户的使用体验。在当时手机市场上,它被誉为前无古人后无来者的佳作之一。今天我们就来一起了解一下这款手机的相...
日期:06-03
Brave 发布注重隐私保护图像和视频搜索功能 人工智能内容生成导致谷歌搜索变得更糟
8月4日消息:Brave 网络浏览器的开发商 Brave Software 为了减少对「大型科技」竞争对手的依赖,该公司调整了其搜索引擎,使其能够使用自己的图像和视频索引。图片来自Brave该公...
日期:08-04
旅游列车市场经营权第一次公开招商:去往大东北、大西北_旅游列车和普通列车的区别
快科技6月29日消息,国铁招商平台公布了7月10日至8月31日期间各地经由兰新铁路、兰新高铁去往新疆方向,经由嫩林铁路去往黑龙江漠河方向等旅游列车市场经营权的中商企业名单。...
日期:06-30
​由OpenAI支持的机器人公司1X获得1亿美元投资 计划推家庭服务机器人
**划重点:**1. 高德打车特价车开放时间小米真无线降噪耳机3 Pro空间音频...
日期:01-12
MUS消失应用商店 网易音乐坎坷社交路
  来源:北京商报  推出过多款泛娱乐社交App的网易云音乐继续“上新”,但这次过程比较坎坷。9月27日上午,网易云音乐宣布,正式面向全量用户开放音乐社交App MUS,但傍晚即表示...
日期:09-28
律师详解:谁该为瑞幸造假事件担责?「瑞幸打假泰国山寨店败诉 此前已声明没有在泰国开店」
12月4日 消息:据南方都市报报道,12月1日,泰国知识产权和国际贸易中央法庭对一起商标版权纠纷案件做出了判决:中国瑞幸咖啡公司败诉,立刻执行。这起案件涉及到泰国皇家50R集团(50...
日期:12-04
三伏天养生6大禁忌 这些东西要少吃「三伏天养生六大要诀,你记住了吗?」
据报道,7月11日迎来了传统的三伏天。三伏天通常在小暑和处暑之间,是一年中最炎热潮湿的时期。而在这个时段,我们需要特别注意一些养生禁忌。首先,忌猛吃冷饮,因为冷饮会使人体内...
日期:07-11
百度发布AIGC教育行业营销解决方案 包括轻舸、擎舵、商家bot_百度ai营销是什么东西
9月18日 消息:9月15日,百度发布了首个 AIGC 教育行业营销解决方案。这个解决方案包括三个营销工具和两个创新产品,旨在提高教育行业广告营销的效率和效果。解决方案中的三个营...
日期:09-18
酷6销售部门裁员20% 被免职副总微博炮轰盛大
  每经记者 谢晓萍 发自北京  继2011年3月 李善友 辞去CEO职务后,酷6再一次经历重大人事变动。  昨日(5月18日),酷6传媒有限公司(以下简称酷6)宣布,公司计划重组其销...
日期:07-28
郭明錤:新iPad mini 7最早将在2023年底推出「ipad mini7什么时候发布」
近日,知名分析师郭明錤在其个人社交帐号上预测苹果将在2023年推出全新一代的iPad mini 7,而且此前有媒体爆料称苹果折叠屏iPad将会在2025年取代现有的iPad mini产品。而郭明錤...
日期:12-29
Runway竟然完败Pixverse?3款AI视频生成模型测试
要点:Pixverse和Pika的视频生成质量在测试中接近,分别为74.5分和73.5分,而Runway效果最差,仅为64.5分。Pixverse模型平衡,能处理运动幅度和保持一致性,特别在2.5D镜头效果惊艳,但...
日期:01-26
同比增长713%,真我GT5刷新真我3K-4K档首销纪录「真我gt5g多少钱」
通信世界网消息(CWW)真我realme五周年越级大作,真我GT5于上午10点全渠道正式开售。截至10:30,真我GT5打破真我3K+价位段首销纪录,相比上代同比增长713%,再度延续火爆热销大势。作为...
日期:09-04
信息安全头部企业信安世纪积极拥抱鸿蒙,已完成鸿蒙原生SDK核心版本开发
(原标题:信息安全头部企业信安世纪积极拥抱鸿蒙,已完成鸿蒙原生SDK核心版本开发) 从今年9月华为宣布全新鸿蒙HarmonyOS NEXT蓄...
日期:12-02