关注公众号

关注公众号

手机扫码查看

手机查看

喜欢作者

打赏方式

微信支付微信支付
支付宝支付支付宝支付
×

通义千问14B模型开源,“免费可商用”

2023.9.25

原文地址:http://news.sciencenet.cn/htmlnews/2023/9/509255.shtm

9月25日,阿里云开源通义千问140亿参数模型“Qwen-14B”及其对话模型“Qwen-14B-Chat”,免费可商用。

阿里云CTO周靖人介绍说,Qwen-14B是一款支持多种语言的高性能开源模型,最大支持8k的上下文窗口长度;相比同类模型使用了更多的高质量数据,整体训练数据超过3万亿Token,使得模型具备更强大的推理、认知、规划和记忆能力。

百亿以内参数级别大语言模型是目前开发者进行应用开发和迭代的主流选择,Qwen-14B进一步提高了小尺寸模型的性能上限,并从众多同尺寸模型中冲出重围:在MMLU、C-Eval、GSM8K、MATH、GaoKao-Bench等12个权威测评中,Qwen-14B超越所有测评中的SOTA大模型,也超越了Llama-2-13B,部分指标接近Llama2-70B。

65113fa7e4b03b5da6d00510.png

  ?

Qwen-14B在十二个权威测评中全方位超越同规模SOTA大模型。 图源:QWEN TECHNICAL REPORT

现在,用户可从魔搭社区直接下载模型,也可通过阿里云灵积平台访问和调用Qwen-14B和Qwen-14B-Chat。阿里云为用户提供包括模型训练、推理、部署、精调等在内的全方位服务。

国内已有多个月活过亿的应用接入通义千问,大量中小企业、科研机构和个人开发者都在基于通义千问开发专属大模型或应用产品,如阿里系的淘宝、钉钉、未来精灵等;浙江大学联合高等教育出版社基于Qwen-7B开发了智海-三乐教育垂直大模型,已在全国12所高校应用,可提供智能问答、试题生成、学习导航、教学评估等能力,模型已在阿里云灵积平台对外提供服务,一行代码即可调用;浙江有鹿机器人科技有限公司在路面清洁机器人中集成了Qwen-7B,使机器人能以自然语言与用户进行实时交互,理解用户提出的需求,将用户的高层指令进行分析和拆解,做高层的逻辑分析和任务规划,完成清洁任务。

周靖人表示,阿里云将持续拥抱开源开放,希望让大模型技术更快触达中小企业和个人开发者,推动中国大模型生态建设。

推荐
关闭