阿里巴巴推出2款开源大型语言模型
来源:陈端武发布时间:2023-08-042820浏览
询问 AI阿里云于8月3日发表开放原始码大型语言模型(LLM)Qwen-7B和Qwen-7B-Chat,每个模型有70亿个参数。2个模型的程序码、模型权重和文件将免费提供给全球学者、研究人员和商业机构。然而,月活跃用户超过1亿的公司在使用这两种模式之前必须向阿里云申请许可。
根据路透(Reuter)及CNBC报导,阿里云在4月发表名为通义千问的大型语言模型。通义千问有多个版本,参数数量各不相同。阿里云表示,Qwen-7B和Qwen-7B-Chat是通义千问的2个小型版本,目标是协助中小企业开始使用AI。
Meta于7月发布名为Llama 2的类似开放原始码模型,此举引起广泛兴趣。专家表示,开放原始码模型可能削弱ChatGPT开发商OpenAI和Google目前享有的市场主导地位。
阿里云表示,通义千问有参数数量更多的版本,但并未透露其最大的模型包含多少参数。Meta的最大版本Llama 2有700亿个参数。
除了阿里云,腾讯等国内大陆科技巨擘最近几个月也在积极开发自己的AI模型。
虽然阿里云无法从开放原始码技术中赚取授权费,但开放LLM可望为其AI模型带来更多用户。2023年稍早,Meta向研究人员开放其Llama大型语言模型,并正在与其他科技公司合作以促进其采用。微软(Microsoft)在7月表示,将在Azure云端运算服务上提供Meta的Llama 2。
阿里云尚未宣布这样的合作关系,但其LLM若在市场上取得成功,可能会吸引云端供应商将其提供给客户。
责任编辑:张兴民
新闻来源:DIGITIMES科技网,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。

