阿里通义千问开源 Qwen2.5 大模型,号称性能超越 Llama
2024-09-20 07:21:31人工智能 IT之家 汪淼
Qwen2.5 涵盖多个尺寸的大语言模型、多模态模型、数学模型和代码模型,每个尺寸都有基础版本、指令跟随版本、量化版本,总计上架 100 多个模型。
感谢最新网友 西窗旧事、动感超人233 的线索投递!
最新 9 月 19 日消息,在今天的 2024 云栖大会上,阿里云 CTO 周靖人发布通义千问新一代开源模型 Qwen2.5,其中,旗舰模型 Qwen2.5-72B 号称性能超越 Llama 405B。
Qwen2.5 涵盖多个尺寸的大语言模型、多模态模型、数学模型和代码模型,每个尺寸都有基础版本、指令跟随版本、量化版本,总计上架 100 多个模型。
Qwen2.5 语言模型:0.5B、1.5B、3B、7B、14B、32B 以及 72B;
Qwen2.5-Coder 编程模型:1.5B、7B 以及即将推出的 32B;
Qwen2.5-Math 数学模型:1.5B、7B 以及 72B。
除了 3B 和 72B 的版本外,通义千问所有的开源模型都采用了 Apache 2.0 许可证。用户可以在相应的 Hugging Face 仓库中找到许可证文件。
除此之外,通义千问还通过 Model Studio 提供了旗舰语言模型 Qwen-Plus 和 Qwen-Turbo 的 API,还开源了相比上个月发布的版本有性能提升的 Qwen2-VL-72B。
阿里云官方透露,截至 2024 年 9 月中旬,通义千问开源模型累计下载量已突破 4000 万,成为仅次于 Llama 的世界级模型群。
最新从 2024 云栖大会获悉,阿里云宣布通义千问推荐模型全线降价,最高降幅可达 85%。
赞一个! ()
相关文章
- 2024 胡润中国人工智能企业 50 强公布:寒武纪 2380 亿
- 阿里通义万相 2.1 模型宣布升级:首次实现中文文字视频
- 开源媒体播放器 VLC 下载破 60 亿次,预览本地 AI 字幕
- 英伟达迷你超算遭友商嘲讽:宣传 FP4 算力,实际“不如买
- 银河通用发布全球首个端到端具身抓取基础大模型 Grasp
- 雷蛇推出“AI 游戏伴侣”Project AVA:支持实时指导 +
- 京东方 CES 2025 发布行业首款 65 英寸 4K 超高清“AI
- 微软开源 140 亿参数小语言 AI 模型 Phi-4,性能比肩 GP
- 微软承认必应 AI 图像生成器 PR16“开倒车”,现回滚至
- 西藏地震期间“小孩被埋”等 AI 图大量传播,严重可追责