新京报客户端

好新闻 无止境

立即打开
通义千问开源Qwen2.5 开源模型累计下载量突破4000万
新京报 记者 罗亦丹 编辑 王进雨
2024-09-19 18:08

新京报贝壳财经讯(记者罗亦丹)9月19日,云栖大会上,阿里云CTO周靖人发布通义千问新一代开源模型Qwen2.5,其涵盖多个尺寸的大语言模型、多模态模型、数学模型和代码模型,每个尺寸都有基础版本、指令跟随版本、量化版本,总计上架100多个模型,刷新业界纪录。


从数据上看,Qwen2.5全系列模型都在18T tokens数据上进行预训练,相比Qwen2,整体性能提升18%以上,拥有更多的知识、更强的编程和数学能力,支持128K的上下文长度,可生成最多8K内容。模型能够响应多样化的系统提示,实现角色扮演和聊天机器人等任务。在指令跟随、理解结构化数据(如表格)、生成结构化输出等方面Qwen2.5都进步明显。


专项模型方面,用于编程的Qwen2.5-Coder和用于数学的Qwen2.5-Math都比前代有了实质性进步。Qwen2.5-Coder在多达5.5T tokens的编程相关数据上作了训练;Qwen2.5-Math支持使用思维链和工具集成推理(TIR)解决中英双语的数学题。


多模态模型方面,视觉语言模型Qwen2-VL-72B正式开源,Qwen2-VL能识别不同分辨率和长宽比的图片,理解20分钟以上长视频,具备自主操作手机和机器人的视觉智能体能力。


生态上,通义与海内外的开源社区、生态伙伴、开发者共建生态网络,截至2024年9月中旬,通义千问开源模型下载量突破4000万,Qwen系列衍生模型总数超过5万个,成为仅次于Llama的世界级模型群。


校对 穆祥桐


来阅读我的更多文章吧
罗亦丹
新京报记者
记者主页
相关推荐
阿里发布新一代千问3模型,其8种模型版本全部开源
科技
阿里AI驱动战略见效,AI收入连续七个季度三位数增长
科技
中国电信天翼AI开放平台上线
科技
工信部:人形机器人主流产品已实现“站得住、走得稳、跑得快”
科技
大厂暗战人形机器人:阿里百度构建生态 腾讯美团突入研发深水区
科技
阿里吴泳铭:近期发布基于Qwen2.5-Max的深度推理模型
科技
四维度实测更新后Manus:任务成功率上升,复杂任务仍难胜任
科技
大模型震荡时刻:DeepSeek掀桌百度开源 免费成必答题
科技
春耕:坚决把牢粮食安全的主动权
北京
双城科创密码:“寻龙诀”与“造海经”
新京号

新京报报料邮箱:67106710@bjnews.com.cn