Google推新一代Cloud TPU 支持Meta Llama 2
来源:林佳楠发布时间:2023-08-302502浏览
询问 AIGoogle Cloud发布人工智能(AI)相关服务更新,包括新一代云端张量处理器(Cloud TPU),并宣布由NVIDIA H100 GPU支持的A3运算服务,将于下个月普遍开放(General availability)。
为期三天的Google Cloud Next 2023于旧金山举行,服务更新仍与生成式人工智能(Generative AI)有关。相关人员指出,业界对GPU需求确实前所未见,Google Cloud同时支持TPU与GPU,有更多弹性服务客户。
Google Cloud运算和机器学习架构副总Mark Lohmeyer指出,A3服务曾于5月I/O大会预告,将于下个月普遍开放,比起A2的训练速度提升3倍,带宽则增加10倍。他并强调,NVIDIA是最重要的战略伙伴之一。
接着宣布推出Cloud TPU v5e,比起前代TPU v4,训练速度可提升2倍,推论速度则可增加2.5倍。合作伙伴如Character AI使用Google Cloud服务时,同时会用到GPU支持的A3,以及Google Cloud TPU。
Lohmeyer也谈到,AI工作负载的算力需求高,需要特殊设计的硬件及相应的软件堆叠支持;目前整体算力需求确实来到一个时代少见的转折点。
被问到国内的用户是否可使用A3服务?Lohmeyer则回应,A3在全球许多地区都可使用,未来在国内、大中华区也可使用,但未透露具体时程。至于NVIDIA GPU供不应求,Google Cloud如何确保A3服务稳定?
Lohmeyer表示,产业对GPU的需求确实前所未见,团队持续与客户密切合作,提供他们所需的机器学习资源。此外,Google Cloud是业界唯一同时提供GPU与TPU者,有多一点弹性可服务客户。
另一方面,AI模型托管平台Vertex AI也扩大支持更多模型,包括Meta Llama 2、Anthropic Claude 2等。
Google Cloud云端AI及产业解决方案副总June Yang强调,团队持续支持开源模型生态系,Google Cloud提供自家及其他业者的模型,种类属业界最多。针对Llama 2模型,还提供微调、基于人类反馈的强化学习的服务,也是业界唯一。
客户对生成式AI的主要需求,在于查找及聊天相关的应用,因此Vertex AI也提供这两类的优化服务,让企业用户可轻松打造自家的查找平台和对话式服务。同时,Google Workspace、Duet AI协作助理、云端网安服务也都有服务更新。
Google Cloud第2季营收达80亿美元,年增28%,占母公司Alphabet总营收约1成。相关人员指出,云端服务是Google成长最快速的事业体之一。
Google也持续拓展全球数据中心据点,目前共有37座区域级数据中心(每个区域内含数个可用区)。位于亚太地区的数据中心位于台湾、香港、新加坡、东京、大阪、首尔、悉尼、墨尔本、雅加达、德里及孟买。
责任编辑:朱原弘
新闻来源:DIGITIMES科技网,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。

