页面加载中,请稍候
来源:电子工程专辑发布时间:2023-07-271511浏览
询问 AI还记得那家造出最大芯片的公司Cerebras吗?最近,他们计划与总部位于阿联酋阿布扎比的人工智能和云计算企业Group42(简称“G42”)合作打造了一台人工智能超级计算机CondorGalaxy1,该计算机基于Cerebras的大芯片,将于今年在美国加州圣克拉拉附近组装。
Cerebras首席执行官安德鲁·费尔德曼(AndrewFeldman)告诉EETimes,CondorGalaxy1将由64个互联的CerebrasCS-2晶圆级人工智能加速器组成,这笔交易价值“超过1亿美元”。
继CondorGalaxy1之后,Cerebras和G42这对战略合作伙伴还计划在美国境内外再建立8个类似的64-CS-2集群。预计到2024年底,将总共实现576个CS-2系统的连接。
这项计划总成本预计将超过9亿美元。
“G42正在寻找一家在构建、管理和操作超级计算机方面拥有专业知识的合作伙伴,而行业中没有几家能像我们(Cerebras)这样,有那么多人才能够实施大规模的生成式人工智能模型以及操作、清理和管理大数据集。我们可以提供具有快速计算能力的基础设施,它易于使用、灵活,并且拥有出色的协作记录。”费尔德曼说,“这就是他们选择我们的部分原因。”
CondorGalaxy1算得上是首个,主要硬件和集成商都是初创企业的超级计算机规模AI加速器,同时它还验证了GPU之外,其他专用AI硬件也有市场。过去5年来,AI硬件领域一直很火爆,并吸引了数十亿美元的风险投资。
费尔德曼将这笔交易描述为“多方面的挑战”,首先这“这对英伟达(Nvidia)来说是一个挑战。对那些超大规模企业来说更是一个挑战。它仿佛在挑明一件事,‘看,你不需要这些大公司的帮忙,也能完成惊人的计算量。’”
![]()
Cerebras首席执行官安德鲁·费尔德曼(AndrewFeldman)站在运往新CondorGalaxy1超级计算集群的运输箱上。(来源:RebeccaLewington/CerebrasSystems)
虽然谷歌、AWS、Meta和微软这样的超大规模企业,一直以来都是大规模人工智能计算的明显潜在客户,但他们迄今为止的选择几乎都NvidiaGPU芯片和/或内置加速器。这笔交易告诉了世人,除了这些超大规模企业,做AI加速器的其他市场潜力。
“人工智能正在吞噬世界,”费尔德曼说,“这种情况到处都在发生,这在那些还不为人熟知的领域创造了新需求。”
仅用了10天,计划中的CondorGalaxy1集群的一半(32个CS-2系统)已在圣克拉拉启动并运行。
“摆在我们面前的是一个巨大的机会,而且很紧迫。”费尔德曼说,“趁这个好时机,我们应该尽早创建一些最强大的AI解决方案,来帮助客户解决问题并在这个新领域建立特许经营权。这一切都给我们带来了紧迫感。”
资料显示,G42是一家总部位于阿联酋的企业集团,由9家公司组成,拥有22,000名员工,并且已经拥有中东最大的区域云。
将使用CondorGalaxy1的G42公司包括起源人工智能研究院(IIAI,InceptionInstituteofArtificialIntelligence),该机构负责制作模型并帮助企业在整个中东部署模型;高科技医疗保健公司M42是G42与穆巴达拉投资公司(MubadalaDevelopmentCompany)的合资企业,专注于获得医疗数据的新见解,包括基因组测序。
CondorGalaxy1部署的第一阶段,也就是32个CS-2系统,已经在运行G42的工作负载,期间任何过剩的算力都通过Cerebras的其他云产品进行出售。
虽然G42拥有该集群,但Cerebras将管理和运营它。12周内,Cerebras和G42会将该集群的规模增加一倍,达到64架CS-2。全面投入使用后,CondorGalaxy1将提供总共5400万个AI核心和84TB内存,总共4exaFLOPS的AI计算能力(FP16)。
![]()
加利福尼亚州圣克拉拉科洛沃(Colovore)主机托管设施中的CondorGalaxy1AI超级计算机的一部分(来源:RebeccaLewington/CerebrasSystems)
费尔德曼表示,选择在美国部署CondorGalaxy1的部分原因是速度。他说:“我们希望以令人难以置信的速度实现这一目标,而且我们在美国可以非常迅速地采取行动。我们采用水冷系统,而这里有现成的设施,可以提供兆瓦级别电力和水。”
每个CS-2系统的峰值持续功率为23kW,因此完全体的64位集群峰值功率将近1.5MW。圣克拉拉的Colovore中心还拥有Cerebras现有的16-CS-2AI超级计算机“Andromeda”。
到明年年中,Cerebras和G42计划在德克萨斯州奥斯汀和北卡罗来纳州阿什维尔建造另外两台64-CS-2AI超级计算机:CondorGalaxy2和CondorGalaxy3。这些机器将连接到CondorGalaxy1,总共192个CS-2节点,算力为12exaFLOPS(FP16)。
到明年年底,另外六台与CondorGalaxy1尺寸相同的机器将在美国境外调试并与其他机器连接。
与美国境内的设施一样,G42将拥有这些集群,但它们将由Cerebras设计、建造和运营。两家公司将共同转售任何过剩算力。
目前公司仍在考虑美国以外的具体部署地点,因为费尔德曼注意到,地缘政治将对这个重要集群技术产生影响。
费尔德曼说:“我们(Cerebras)有着最快的人工智能处理器、最快的人工智能系统,我们正在与美国监管机构就可以部署该技术的地点进行商议。”
费尔德曼表示,Cerebras仍将管理和运营海外集群,查看每个IP地址的每项工作并控制机器。他认为,虽然人工智能很强大并且可以被恶意使用,但人工智能专用机器被用于军事和密码学,通常需要64位计算(CS-2不支持双精度)。他说,作为常规云技术管理的一部分,安全威胁已经得到了很好的理解。
总体而言,G42和Cerebras将根据合同,新增多达9个集群(576个CS-2节点,在FP16下实现36exaFLOPS)。假设成本结构相同,整个交易的价值可能超过9亿美元。
![]()
Cerebras的CS-2晶圆级大芯片(来源:CerebrasSystems)
(本文授权编译自EETimes,原文参考链接:Cerebras Sells $100 Million AI Supercomputer, Plans Eight More,BySallyWard-Foxton)
编译:LuffyLiu
新闻来源:电子工程专辑,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。
暂无评论哦,快来评论一下吧!
2026-06-12
2026-07-15