9月19日云栖大会,阿里云CTO周靖人宣布,通义旗舰模型Qwen-Max全方位升级,性能接近GPT-4o。通义官网和通义APP的后台模型均已切换为Qwen-Max,继续免费为所有用户提供服务。用户也可通过阿里云百炼平台调用Qwen-Max的API。
相比上一代模型,Qwen-Max在训练中使用了更多的训练数据、更大的模型规模、更强的人类对齐,最终达到了更高的智能水平。在MMLU-Pro、MATH、GSM8K、MBPP、MultiPL-E、LiveCodeBench等十多个权威基准上,Qwen-Max表现接近GPT-4o,数学能力、代码能力则超越了GPT-4o。数学和代码所代表的推理能力是大模型智能水平的最重要体现。
相比2023年4月的初代通义千问大模型,Qwen-Max的理解能力提升46%、数学能力提升75%、代码能力提升102%、幻觉抵御能力提升35%、指令遵循能力提升105%,模型与人类偏好的对齐水平更是有了质的飞跃,提升了700%以上。(李记)
国家网信办推进持证亮牌工程,规范互联网新闻
今年以来,国家网信办持续推进互联网新闻信息服务“持证亮牌”工...(0 )人阅读时间:2025-08-06谷歌Chrome浏览器将新增生物识别验证提升密码安
谷歌正在为安卓版Chrome浏览器开发一项新的安全功能,以增...(0 )人阅读时间:2025-08-06上海闵行警方破获顺风车抢单外挂案,涉案金额
近日,上海闵行警方根据某出行平台提供的线索,成功抓获一名开发...(0 )人阅读时间:2025-08-05滴滴顺风车外挂案告破,嫌疑人被捕涉案200万元
近日,滴滴出行发布了关于打击顺风车外挂软件的最新进展。根据通...(0 )人阅读时间:2025-08-05