阿里云开源通义千问14B模型,周靖人:持续拥抱开源开放

访客1年前AI生活165

9月25日,阿里云开源通义千问140亿参数模型Qwen-14B及其对话模型Qwen-14B-Chat,免费可商用。Qwen-14B在多个权威评测中超越同等规模模型,部分指标甚至接近Llama2-70B。阿里云此前开源了70亿参数模型Qwen-7B等,一个多月下载量破100万,成为开源社区的口碑之作。

Qwen-14B是一款支持多种语言的高性能开源模型,相比同类模型使用了更多的高质量数据,整体训练数据超过3万亿Token,使得模型具备更强大的推理、认知、规划和记忆能力。Qwen-14B最大支持8k的上下文窗口长度。

阿里云开源通义千问14B模型,周靖人:持续拥抱开源开放

图1:Qwen-14B在十二个权威测评中全方位超越同规模SOTA大模型

Qwen-14B-Chat是在基座模型上经过精细SFT得到的对话模型。借助基座模型强大性能,Qwen-14B-Chat生成内容的准确度大幅提升,也更符合人类偏好,内容创作上的想象力和丰富度也有显著扩展。

Qwen拥有出色的工具调用能力,能让开发者更快地构建基于Qwen的Agent(智能体)。开发者可用简单指令教会Qwen使用复杂工具,比如使用Code Interpreter工具执行Python代码以进行复杂的数学计算、数据分析、图表绘制等;还能开发具有多文档问答、长文写作等能力的“高级数字助理”。

百亿以内参数级别大语言模型是目前开发者进行应用开发和迭代的主流选择, Qwen-14B进一步提高了小尺寸模型的性能上限,从众多同尺寸模型中冲出重围,在MMLU、C-Eval、GSM8K、MATH、GaoKao-Bench等12个权威测评中取得最优成绩,超越所有测评中的SOTA(State-Of-The-Art)大模型,也全面超越Llama-2-13B,比起Llama 2的34B、70B模型也并不逊色。与此同时,Qwen-7B也全新升级,核心指标最高提升22.5%。

阿里云开源通义千问14B模型,周靖人:持续拥抱开源开放

图2:Qwen-14B性能超越同尺寸模型

用户可从魔搭社区直接下载模型,也可通过阿里云灵积平台访问和调用Qwen-14B和Qwen-14B-Chat。阿里云为用户提供包括模型训练、推理、部署、精调等在内的全方位服务。

8月,阿里云开源通义千问70亿参数基座模型Qwen-7B,先后冲上HuggingFace、Github的trending榜单。短短一个多月,累计下载量突破100万。开源社区出现了50多个基于Qwen的模型,社区多个知名的工具和框架都集成了Qwen。

阿里云开源通义千问14B模型,周靖人:持续拥抱开源开放

通义千问是落地最深、应用最广的中国大模型,国内已有多个月活过亿的应用接入通义千问,大量中小企业、科研机构和个人开发者都在基于通义千问开发专属大模型或应用产品,如阿里系的淘宝、钉钉、未来精灵,以及外部的科研机构、创业企业。

浙江大学联合高等教育出版社基于Qwen-7B开发了智海-三乐教育垂直大模型,已在全国12所高校应用,可提供智能问答、试题生成、学习导航、教学评估等能力,模型已在阿里云灵积平台对外提供服务,一行代码即可调用;浙江有鹿机器人科技有限公司在路面清洁机器人中集成了Qwen-7B,使机器人能以自然语言与用户进行实时交互,理解用户提出的需求,将用户的高层指令进行分析和拆解,做高层的逻辑分析和任务规划,完成清洁任务。

阿里云CTO周靖人表示,阿里云将持续拥抱开源开放,推动中国大模型生态建设。阿里云笃信开源开放的力量,率先开源自研大模型,希望让大模型技术更快触达中小企业和个人开发者。

阿里云还牵头建设了中国最大的AI模型开源社区魔搭ModelScope,团结全行业的力量,共同推动大模型技术普惠和应用落地。过去两个月内,魔搭社区的模型下载量从4500万飙升到8500万,增幅接近100%。

本站部分文章来自互联网,文章版权归原作者所有。如有疑问请联系QQ:362580117!

相关文章

分析师们纷纷看好 GDSA,但 GDSA 还面临各种挑战!

分析师们纷纷看好 GDSA,但 GDSA 还面临各种挑战!

2020 年 2 月 6 日,据路透社报道,中国四大智能手机厂商华为、小米、OPPO 和 vivo 正在联手打造一个生态平台“全球开发者服务...

逐浪大航海时代,中国技术正扬帆远航

逐浪大航海时代,中国技术正扬帆远航

搭乘一个多小时的公交车前往线下网点、排队、拿表、填写资料、提交,之后就是漫长的等待…… 等待网点工作人员将填写好的资料整理、汇总、定期批量运送...

打破内存墙的新利器成行业“热搜”!持久内存让打工人也能玩转海量数据+高维模型

打破内存墙的新利器成行业“热搜”!持久内存让打工人也能玩转海量数据+高维模型

不得不说,Colossal-AI训练系统这个开源项目的涨星速度是真快。 在“没十几块显卡玩不起大模型”的当下,它硬是只用一张消费级显卡,成功...

腾讯“混元”AI大模型登顶CLUE总榜,彰显自然语言理解领域强大实力

腾讯“混元”AI大模型登顶CLUE总榜,彰显自然语言理解领域强大实力

5月24日,腾讯“混元”AI大模型在CLUE(中文语言理解评测集合)总排行榜、阅读理解、大规模知识图谱三个榜单同时登顶,一举打破三项纪录。 据...

李彦宏宣布启动”文心杯”创业大赛,参赛者最高可获千万大奖 同时设立10亿创投基金促进大模型生态

5月31日,百度创始人、董事长兼首席执行官李彦宏在摩根大通全球中国峰会期间宣布,百度将设立10亿元人民币的百度文心投资基金,旨在推动大模型生态...

新算力 新赋能 新未来——第十八届CCF全国高性能计算学术年会在云上成功举行

新算力 新赋能 新未来——第十八届CCF全国高性能计算学术年会在云上成功举行

长风破浪会有时,直挂云帆济沧海!中国高性能计算正以前所未有的速度、能力、魄力和干劲,赋能千行百业的数智化转型升级,...

发表评论    

◎欢迎参与讨论,请在这里发表您的看法、交流您的观点。