通义千问升级旗舰模型Qwen-Max,性能接近GPT-4o

huofenghuang2024-09-19 14:40:42TechWeb.com.cn

9月19日消息,在今日开幕的云栖大会上,阿里云CTO周靖人宣布,通义旗舰模型Qwen-Max全方位升级,性能接近GPT-4o。通义官网和通义APP的后台模型均已切换为Qwen-Max,继续免费为所有用户提供服务。用户也可通过阿里云百炼平台调用Qwen-Max的API。

相比上一代模型,Qwen-Max在训练中使用了更多的训练数据、更大的模型规模、更强的人类对齐,最终达到了更高的智能水平。在MMLU-Pro、MATH、GSM8K、MBPP、MultiPL-E、LiveCodeBench等十多个权威基准上,Qwen-Max表现接近GPT-4o,数学能力、代码能力则超越了GPT-4o。数学和代码所代表的推理能力是大模型智能水平的最重要体现。

相比2023年4月的初代通义千问大模型,Qwen-Max的理解能力提升46%、数学能力提升75%、代码能力提升102%、幻觉抵御能力提升35%、指令遵循能力提升105%,模型与人类偏好的对齐水平更是有了质的飞跃,提升了700%以上。

2023站酷CUBE设计大会,聚焦“AI与热爱”

12月6日,2023站酷CUBE设计大会在厦门举行。大会以“AI与热爱”为主题,由美图与站酷联合举办,邀请了多位创意先锋进行分享,旨在构建设计新生态,以AIGC内容生产新范式为创意人持续赋能,共同提升设计价值。美图与...

中国电信:在通用大模型方面今年还会有新的成果

在昨日晚间的2023半年度业绩会上,中国电信公告称,2023年上半年营收2586.8亿元,同比增长7.7%;净利润201.53亿元,同比增长10.2%。同时,在会上,中国电信董事长兼首席执行官柯瑞文表示,中国电信在通用大模型方面今...

视频号先动手,数字人商业化成迷

数字人的商业化之路,仍然是一片迷途。最近,腾讯视频号成为全网第一个向数字人开炮的平台。它修订了有关达人直播的细则,将“挂机录播”内容改成了“非真实直播”内容,里面提到,使用插件、AI等工具生成虚拟形象进...

macOS版ChatGPT被指以纯文本存储AI对话,OpenAI紧急更新修复

7月4日消息,开发者PedroVieito于2天前在Thread平台发布动态,表示macOS版ChatGPT应用会以纯文本方式存储用户对话,OpenAI公司今天回应称已更新其应用,对存储在Mac设备上的聊天记录进行了加密处理。6月26日报道,Op...

分析师:苹果计划在今年6月的WWDC 2024上发布一系列生成式AI工具

1月8日消息,据外媒报道,一位长期关注苹果的分析师表示,苹果计划在2024年6月份举办的WWDC(WWDC2024)大会上发布一系列基于生成式人工智能(AI)的工具,包括改进版的Siri,这些新工具将是iOS18的关键部分,代表着...

上一篇:华为徐直军:智能化时代的企业应该具备“六个A” 特征
下一篇:何小鹏驾驶“全球首款AI汽车”亮相阿里云栖大会