腾讯「混元」大型语言模型开放企业使用
来源:陈端武发布时间:2023-09-081389浏览
询问 AI腾讯于9月7日宣布开放国内大陆企业透过腾讯云使用其「混元」大型语言人工智能(AI)模型。
根据路透(Reuter)及SCMP报导,腾讯在深圳举办的生态系统峰会上表示,混元已成为其50多项产品和服务的基础。混元提供一系列功能,包括影像生成、撰写文案和文字识别,可应用于金融、社群媒体、电子商务和电玩等多个产业。
腾讯表示,混元拥有逾1,000亿个参数,并接受超过2万亿个Token训练。相较之下,OpenAI的GPT-3在2020年包含1,750亿个参数,Meta的Llama 2模型在2023年拥有700亿个参数。相较于Llama 2,混元产生幻觉(hallucination),即生成错误信息却将其当成事实的情况也减少30%。
腾讯副总裁姜杰表示,混元能使用中文和英文对话,在撰写数千字的长文和解决某些数学问题等领域比ChatGPT表现更好。例如,混元能生成一篇有4,000多个中文字的农业相关研究论文,这是GPT-4办不到的。而混元在数据训练方面也将主流开放框架的速度提高1倍。
责任编辑:张兴民
新闻来源:DIGITIMES科技网,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。


