通义千问14B 模型开源十二测评全方位超越同规模SOTA 大模型

  • 来源:电脑报
  • 关键字:规模,模型,下载量
  • 发布时间:2023-10-27 16:32

  9 月25 日,阿里云开源通义千问140 亿参数模型Qwen-14B 及其对话模型Qwen-14B-Chat,免费可商用。Qwen-14B 在多个权威测评中超越同等规模模型,部分指标甚至接近Llama2-70B。阿里云此前开源了70 亿参数模型Qwen-7B 等,一个多月下载量破100 万,成为开源社区的口碑之作。

  Q w e n - 1 4 B是一款支持多种语言的高性能开源模型,相比同类模型使用了更多的高质量数据,整体训练数据超过3 万亿Token,使得模型具备更强大的推理、认知、规划和记忆能力。

  Qwen 拥有出色的工具调用能力,能让开发者更快地构建基于Qwen 的Agent(智能体)。开发者可用简单指令教会Qwen 使用复杂工具,比如使用Code Interpreter 工具执行Python 代码以进行复杂的数学计算、数据分析、图表绘制等;还能开发具有多文档问答、长文写作等能力的“高级数字助理”。

  用户可从魔搭社区直接下载模型,也可通过阿里云灵积平台访问和调用Qwen-14B 和Qwen-14BChat。阿里云为用户提供包括模型训练、推理、部署、精调等在内的全方位服务。

  通义千问是落地最深、应用最广的中国大模型,国内已有多个月活过亿的应用接入通义千问,大量中小企业、科研机构和个人开发者都在基于通义千问开发专属大模型或应用产品,如阿里系的淘宝、钉钉、未来精灵,以及外部的科研机构、创业企业。

  阿里云CTO 周靖人表示,阿里云将持续拥抱开源开放,推动中国大模型生态建设。阿里云笃信开源开放的力量,率先开源自研大模型,希望让大模型技术更快触达中小企业和个人开发者。

  阿里云还牵头建设了中国最大的AI 模型开源社区魔搭ModelScope,团结全行业的力量,共同推动大模型技术普惠和应用落地。过去两个月内,魔搭社区的模型下载量从4500 万飙升到8500 万,增幅接近100%。

……
关注读览天下微信, 100万篇深度好文, 等你来看……
阅读完整内容请先登录:
帐户:
密码: