通义千问系列产品重大发布，性能大幅提升

2024年9月19日云计算 mingzhi

9月19日云栖大会，阿里云CTO周靖人针对通义千问系列进行了重大发布。

升级旗舰模型Qwen-Max，性能接近GPT-4o

当天发布的通义旗舰模型Qwen-Max全方位升级，性能接近GPT-4o。目前，通义官网和通义APP的后台模型均已切换为Qwen-Max，继续免费为所有用户提供服务。用户也可通过阿里云百炼平台调用Qwen-Max的API。

相比上一代模型，Qwen-Max在训练中使用了更多的训练数据、更大的模型规模、更强的人类对齐，最终达到了更高的智能水平。在MMLU-Pro、MATH、GSM8K、MBPP、MultiPL-E、LiveCodeBench等十多个权威基准上，Qwen-Max表现接近GPT-4o，数学能力、代码能力则超越了GPT-4o。数学和代码所代表的推理能力是大模型智能水平的最重要体现。

语言模型方面，Qwen2.5开源了7个尺寸，0.5B、1.5B、3B、7B、14B、32B、72B，它们在同等参数赛道都创造了业界最佳成绩，型号设定充分考虑下游场景的不同需求，3B是适配手机等端侧设备的黄金尺寸；32B是最受开发者期待的“性价比之王”，可在性能和功耗之间获得最佳平衡，Qwen2.5-32B的整体表现超越了Qwen2-72B。

重磅开源Qwen2.5，性能超越Llama座

通义千问新一代开源模型Qwen2.5中的旗舰模型Qwen2.5-72B性能超越Llama 405B，再登全球开源大模型王座。Qwen2.5全系列涵盖多个尺寸的大语言模型、多模态模型、数学模型和代码模型，每个尺寸都有基础版本、指令跟随版本、量化版本，总计上架100多个模型，刷新业界纪录。

Qwen2.5全系列模型都在18T tokens数据上进行预训练，相比Qwen2，整体性能提升18%以上，拥有更多的知识、更强的编程和数学能力。Qwen2.5-72B模型在MMLU-rudex基准（考察通用知识）、MBPP 基准（考察代码能力）和MATH基准（考察数学能力）的得分高达86.8、88.2、83.1。

Qwen2.5支持高达128K的上下文长度，可生成最多8K内容。模型拥有强大的多语言能力，支持中文、英文、法文、西班牙文、俄文、日文、越南文、阿拉伯文等 29 种以上语言。模型能够丝滑响应多样化的系统提示，实现角色扮演和聊天机器人等任务。在指令跟随、理解结构化数据（如表格）、生成结构化输出（尤其是JSON）等方面Qwen2.5都进步明显。

通义万相全面升级，全新视频生成模型发布

同日，可生成影视级高清视频的通义万相全面升级，在影视创作、动画设计、广告设计等领域大显身手。即日起，所有用户可通过通义APP及通义万相官网免费体验。

据介绍，通义万相首批上线文生视频、图生视频功能，在文生视频功能中，用户输入任意文字提示词，即可生成一段高清视频，支持中英文多语言输入，并可以通过灵感扩写功能智能丰富视频内容表现力，支持16:9、9:16等多种比例生成；在图生视频功能中，支持用户将任意图片转化为动态视频，按照上传的图像比例或预设比例进行生成，同时可以通过提示词来控制视频运动。

现场，阿里云演示了该模型强大的运动生成和概念组合能力，输入「穿着滑冰鞋的小兔子在冰面上灵活移动的可爱场景」，通义万相仅用数分钟就能生成一段高清、逼真的视频。

通义万相视频生成大模型集成了多项创新技术，有效解决画面表现力和大幅度运动等视频生成技术难题。针对运动生成和物理模拟等难点优化算法，实现了大幅度主体运动和运镜控制，并有效模拟真实世界物理特性；设计了高压缩比、高质量视频VAE框架，有效降低视频信息冗余，并保持高质量视频重构能力；同时，基于轻量微调框架和精选数据集优化训练，在中式传统元素、风格化视频生成上表现更好。

去年7月，通义万相图像生成大模型首次亮相，目前已累计生成7500万张图片。云栖大会现场，通义万相宣布视觉生成大模型全面升级为Diffusion Transformer框架，同时结合通义千问复杂提示词解释能力，有效提升画面表现力、语义理解能力、可控生成能力。随着通义万相视频生成模型的发布，通义大模型已覆盖文本生成、图像理解、视频理解、音频理解、图像生成、视频生成等全模态场景。

通义灵码AI编程能力再进化，说几句话就能开发网页

随着通义大模型能力的全面提升，阿里云通义灵码迎来重磅升级，从一年前只能完成基础的辅助编程任务，进化到几句话就能完成需求理解、任务拆解、代码编写、修改BUG、测试等开发任务，最快几分钟可从0到1完成应用开发，提升数十倍开发效率。

自去年首次亮相以来，通义灵码已入职中华财险、哈啰集团、长安汽车等公司，累计生成代码超10亿行,是国内最受欢迎的辅助编程工具。全新升级的通义灵码模拟了人类程序员的能力，可完成更复杂、更全面的任务；通义灵码还可以脱离专业IDE软件，在web端直接执行缺陷修改、需求分析、代码实现、问题排查等任务工作流，兼具架构师、开发工程师、测试工程师等多种岗位技能，大幅缩短了应用的开发周期。

例如，真人程序员手动开发一个网页，通常需要1天的时间完成需求分解、写代码、测试等任务；现在，人类只需要输入需求，通义灵码5分钟就能完成整个过程。阿里云表示，未来只要有创意，不懂代码也能开发应用和软件。

大会现场，一位13岁的中学生在通义灵码上输入几句话，2分钟就生成了一个python语言编写的倒计时网页；现场还有参会者，用通义灵码修改开源魂斗罗游戏代码，在9个代码文件2000多行代码里，几分钟就精准修改了游戏角色的生命值、跳跃高度等参数。

目前，通义灵码已广泛应用于金融、制造、互联网、交通、汽车、能源等行业。在 Gartner 首个AI代码助手魔力象限报告中，阿里云成为唯一进入挑战者象限的中国科技公司。

三款主力模型再次降价

继5月首次大幅降价后，阿里云百炼平台上的三款通义千问主力模型再次降价。Qwen-Turbo价格直降85%，低至百万tokens 0.3元，Qwen-Plus和Qwen-Max分别再降价80%和50%。其中，Qwen-Plus推理能力追平GPT4，可应用于复杂任务，是效果、速度及成本均衡的最优选择，降价后，Qwen-Plus性价比达到业界最高，同等规模较行业价格低84%。同时，阿里云百炼平台还为所有新用户免费赠送超5000万tokens及4500张图片生成额度。

自首次宣布降价后，阿里云百炼付费客户数较上一个季度增长超过200%，大批企业和开发者放弃私有化部署，选择直接在百炼上调用各类AI大模型。目前，阿里云百炼已服务超30万客户，包括一汽、金山、猎聘、哈啰集团、国家天文台等众多知名企业和机构。本次通义第二轮降价，将继续提升AI在各行各业的渗透率。

About
Latest Posts

mingzhi

发表评论 取消回复

发表评论取消回复