阿里云开源通义千问14B模型,周靖人:持续拥抱开源开放

2023-09-25 20:57 来源:中国经济网

  9月25日,阿里云开源通义千问140亿参数模型Qwen-14B及其对话模型Qwen-14B-Chat,免费可商用。Qwen-14B在多个权威评测中超越同等规模模型,部分指标甚至接近Llama2-70B。阿里云此前开源了70亿参数模型Qwen-7B等,一个多月下载量破100万,成为开源社区的口碑之作。

  Qwen-14B是一款支持多种语言的高性能开源模型,相比同类模型使用了更多的高质量数据,整体训练数据超过3万亿Token,使得模型具备更强大的推理、认知、规划和记忆能力。Qwen-14B最大支持8k的上下文窗口长度。

  图1:Qwen-14B在十二个权威测评中全方位超越同规模SOTA大模型

  Qwen-14B-Chat是在基座模型上经过精细SFT得到的对话模型。借助基座模型强大性能,Qwen-14B-Chat生成内容的准确度大幅提升,也更符合人类偏好,内容创作上的想象力和丰富度也有显著扩展。

  Qwen拥有出色的工具调用能力,能让开发者更快地构建基于Qwen的Agent(智能体)。开发者可用简单指令教会Qwen使用复杂工具,比如使用Code Interpreter工具执行Python代码以进行复杂的数学计算、数据分析、图表绘制等;还能开发具有多文档问答、长文写作等能力的“高级数字助理”。

  百亿以内参数级别大语言模型是目前开发者进行应用开发和迭代的主流选择, Qwen-14B进一步提高了小尺寸模型的性能上限,从众多同尺寸模型中冲出重围,在MMLU、C-Eval、GSM8K、MATH、GaoKao-Bench等12个权威测评中取得最优成绩,超越所有测评中的SOTA(State-Of-The-Art)大模型,也全面超越Llama-2-13B,比起Llama 2的34B、70B模型也并不逊色。与此同时,Qwen-7B也全新升级,核心指标最高提升22.5%。

  图2:Qwen-14B性能超越同尺寸模型

  用户可从魔搭社区直接下载模型,也可通过阿里云灵积平台访问和调用Qwen-14B和Qwen-14B-Chat。阿里云为用户提供包括模型训练、推理、部署、精调等在内的全方位服务。

  8月,阿里云开源通义千问70亿参数基座模型Qwen-7B,先后冲上HuggingFace、Github的trending榜单。短短一个多月,累计下载量突破100万。开源社区出现了50多个基于Qwen的模型,社区多个知名的工具和框架都集成了Qwen。

  通义千问是落地最深、应用最广的中国大模型,国内已有多个月活过亿的应用接入通义千问,大量中小企业、科研机构和个人开发者都在基于通义千问开发专属大模型或应用产品,如阿里系的淘宝、钉钉、未来精灵,以及外部的科研机构、创业企业。

  浙江大学联合高等教育出版社基于Qwen-7B开发了智海-三乐教育垂直大模型,已在全国12所高校应用,可提供智能问答、试题生成、学习导航、教学评估等能力,模型已在阿里云灵积平台对外提供服务,一行代码即可调用;浙江有鹿机器人科技有限公司在路面清洁机器人中集成了Qwen-7B,使机器人能以自然语言与用户进行实时交互,理解用户提出的需求,将用户的高层指令进行分析和拆解,做高层的逻辑分析和任务规划,完成清洁任务。

  阿里云CTO周靖人表示,阿里云将持续拥抱开源开放,推动中国大模型生态建设。阿里云笃信开源开放的力量,率先开源自研大模型,希望让大模型技术更快触达中小企业和个人开发者。

  阿里云还牵头建设了中国最大的AI模型开源社区魔搭ModelScope,团结全行业的力量,共同推动大模型技术普惠和应用落地。过去两个月内,魔搭社区的模型下载量从4500万飙升到8500万,增幅接近100%。

查看余下全文
(责任编辑:符仲明)
手机看中经经济日报微信中经网微信
当前位置     首页 > 新闻 > 国内时政更多新闻 > 正文
中经搜索

阿里云开源通义千问14B模型,周靖人:持续拥抱开源开放

2023年09月25日 20:57   来源:中国经济网   

  9月25日,阿里云开源通义千问140亿参数模型Qwen-14B及其对话模型Qwen-14B-Chat,免费可商用。Qwen-14B在多个权威评测中超越同等规模模型,部分指标甚至接近Llama2-70B。阿里云此前开源了70亿参数模型Qwen-7B等,一个多月下载量破100万,成为开源社区的口碑之作。

  Qwen-14B是一款支持多种语言的高性能开源模型,相比同类模型使用了更多的高质量数据,整体训练数据超过3万亿Token,使得模型具备更强大的推理、认知、规划和记忆能力。Qwen-14B最大支持8k的上下文窗口长度。

  图1:Qwen-14B在十二个权威测评中全方位超越同规模SOTA大模型

  Qwen-14B-Chat是在基座模型上经过精细SFT得到的对话模型。借助基座模型强大性能,Qwen-14B-Chat生成内容的准确度大幅提升,也更符合人类偏好,内容创作上的想象力和丰富度也有显著扩展。

  Qwen拥有出色的工具调用能力,能让开发者更快地构建基于Qwen的Agent(智能体)。开发者可用简单指令教会Qwen使用复杂工具,比如使用Code Interpreter工具执行Python代码以进行复杂的数学计算、数据分析、图表绘制等;还能开发具有多文档问答、长文写作等能力的“高级数字助理”。

  百亿以内参数级别大语言模型是目前开发者进行应用开发和迭代的主流选择, Qwen-14B进一步提高了小尺寸模型的性能上限,从众多同尺寸模型中冲出重围,在MMLU、C-Eval、GSM8K、MATH、GaoKao-Bench等12个权威测评中取得最优成绩,超越所有测评中的SOTA(State-Of-The-Art)大模型,也全面超越Llama-2-13B,比起Llama 2的34B、70B模型也并不逊色。与此同时,Qwen-7B也全新升级,核心指标最高提升22.5%。

  图2:Qwen-14B性能超越同尺寸模型

  用户可从魔搭社区直接下载模型,也可通过阿里云灵积平台访问和调用Qwen-14B和Qwen-14B-Chat。阿里云为用户提供包括模型训练、推理、部署、精调等在内的全方位服务。

  8月,阿里云开源通义千问70亿参数基座模型Qwen-7B,先后冲上HuggingFace、Github的trending榜单。短短一个多月,累计下载量突破100万。开源社区出现了50多个基于Qwen的模型,社区多个知名的工具和框架都集成了Qwen。

  通义千问是落地最深、应用最广的中国大模型,国内已有多个月活过亿的应用接入通义千问,大量中小企业、科研机构和个人开发者都在基于通义千问开发专属大模型或应用产品,如阿里系的淘宝、钉钉、未来精灵,以及外部的科研机构、创业企业。

  浙江大学联合高等教育出版社基于Qwen-7B开发了智海-三乐教育垂直大模型,已在全国12所高校应用,可提供智能问答、试题生成、学习导航、教学评估等能力,模型已在阿里云灵积平台对外提供服务,一行代码即可调用;浙江有鹿机器人科技有限公司在路面清洁机器人中集成了Qwen-7B,使机器人能以自然语言与用户进行实时交互,理解用户提出的需求,将用户的高层指令进行分析和拆解,做高层的逻辑分析和任务规划,完成清洁任务。

  阿里云CTO周靖人表示,阿里云将持续拥抱开源开放,推动中国大模型生态建设。阿里云笃信开源开放的力量,率先开源自研大模型,希望让大模型技术更快触达中小企业和个人开发者。

  阿里云还牵头建设了中国最大的AI模型开源社区魔搭ModelScope,团结全行业的力量,共同推动大模型技术普惠和应用落地。过去两个月内,魔搭社区的模型下载量从4500万飙升到8500万,增幅接近100%。

(责任编辑:符仲明)

閸掑棔闊╅崚甯窗
涓浗缁忔祹缃戠増鏉冨強鍏嶈矗澹版槑锛�
1銆佸嚒鏈綉娉ㄦ槑鈥滄潵婧愶細涓浗缁忔祹缃戔€� 鎴栤€滄潵婧愶細缁忔祹鏃ユ姤-涓浗缁忔祹缃戔€濈殑鎵€鏈変綔鍝侊紝鐗堟潈鍧囧睘浜�
銆€ 涓浗缁忔祹缃戯紙鏈綉鍙︽湁澹版槑鐨勯櫎澶栵級锛涙湭缁忔湰缃戞巿鏉冿紝浠讳綍鍗曚綅鍙婁釜浜轰笉寰楄浆杞姐€佹憳缂栨垨浠ュ叾瀹�
銆€ 鏂瑰紡浣跨敤涓婅堪浣滃搧锛涘凡缁忎笌鏈綉绛剧讲鐩稿叧鎺堟潈浣跨敤鍗忚鐨勫崟浣嶅強涓汉锛屽簲娉ㄦ剰璇ョ瓑浣滃搧涓槸鍚︽湁
銆€ 鐩稿簲鐨勬巿鏉冧娇鐢ㄩ檺鍒跺0鏄庯紝涓嶅緱杩濆弽璇ョ瓑闄愬埗澹版槑锛屼笖鍦ㄦ巿鏉冭寖鍥村唴浣跨敤鏃跺簲娉ㄦ槑鈥滄潵婧愶細涓浗
銆€ 缁忔祹缃戔€濇垨鈥滄潵婧愶細缁忔祹鏃ユ姤-涓浗缁忔祹缃戔€濄€傝繚鍙嶅墠杩板0鏄庤€咃紝鏈綉灏嗚拷绌跺叾鐩稿叧娉曞緥璐d换銆�
2銆佹湰缃戞墍鏈夌殑鍥剧墖浣滃搧涓紝鍗充娇娉ㄦ槑鈥滄潵婧愶細涓浗缁忔祹缃戔€濆強/鎴栨爣鏈夆€滀腑鍥界粡娴庣綉(www.ce.cn)鈥�
銆€ 姘村嵃锛屼絾骞朵笉浠h〃鏈綉瀵硅绛夊浘鐗囦綔鍝佷韩鏈夎鍙粬浜轰娇鐢ㄧ殑鏉冨埄锛涘凡缁忎笌鏈綉绛剧讲鐩稿叧鎺堟潈浣跨敤
銆€ 鍗忚鐨勫崟浣嶅強涓汉锛屼粎鏈夋潈鍦ㄦ巿鏉冭寖鍥村唴浣跨敤璇ョ瓑鍥剧墖涓槑纭敞鏄庘€滀腑鍥界粡娴庣綉璁拌€匵XX鎽勨€濇垨
銆€ 鈥滅粡娴庢棩鎶ョぞ-涓浗缁忔祹缃戣鑰匵XX鎽勨€濈殑鍥剧墖浣滃搧锛屽惁鍒欙紝涓€鍒囦笉鍒╁悗鏋滆嚜琛屾壙鎷呫€�
3銆佸嚒鏈綉娉ㄦ槑 鈥滄潵婧愶細XXX锛堥潪涓浗缁忔祹缃戯級鈥� 鐨勪綔鍝侊紝鍧囪浆杞借嚜鍏跺畠濯掍綋锛岃浆杞界洰鐨勫湪浜庝紶閫掓洿
銆€ 澶氫俊鎭紝骞朵笉浠h〃鏈綉璧炲悓鍏惰鐐瑰拰瀵瑰叾鐪熷疄鎬ц礋璐c€�
4銆佸鍥犱綔鍝佸唴瀹广€佺増鏉冨拰鍏跺畠闂闇€瑕佸悓鏈綉鑱旂郴鐨勶紝璇峰湪30鏃ュ唴杩涜銆�

鈥� 缃戠珯鎬绘満锛�010-81025111 鏈夊叧浣滃搧鐗堟潈浜嬪疁璇疯仈绯伙細010-81025135 閭锛�

鍏充簬缁忔祹鏃ユ姤绀� 锛� 鍏充簬涓浗缁忔祹缃� 锛� 缃戠珯澶т簨璁� 锛� 缃戠珯璇氳仒 锛� 鐗堟潈澹版槑 锛� 浜掕仈缃戣鍚妭鐩湇鍔¤嚜寰嬪叕绾� 锛� 骞垮憡鏈嶅姟 锛� 鍙嬫儏閾炬帴 锛� 绾犻敊閭
缁忔祹鏃ユ姤鎶ヤ笟闆嗗洟娉曞緥椤鹃棶锛�鍖椾含甯傞懌璇哄緥甯堜簨鍔℃墍    涓浗缁忔祹缃戞硶寰嬮【闂細鍖椾含鍒氬钩寰嬪笀浜嬪姟鎵€
涓浗缁忔祹缃� 鐗堟潈鎵€鏈�  浜掕仈缃戞柊闂讳俊鎭湇鍔¤鍙瘉(10120170008)   缃戠粶浼犳挱瑙嗗惉鑺傜洰璁稿彲璇�(0107190)  浜琁CP澶�18036557鍙�

浜叕缃戝畨澶� 11010202009785鍙�