AI奇点网10月31日报道丨今天下午,在一年一度的 2023 云栖大会现场,阿里云正式发布千亿级参数大模型通义千问大模型。阿里云CTO周靖人宣布,阿里大模型的家族迎来年度最强升级,也宣布通义千问 2.0 版本正式发布。
根据官方特供的信息,在MMLU、C-Eval、GSM8K、HumanEval、MATH等等10个国际主流的大模型Benchmark测评当中,通义千问2.0版本的综合表现超越ChatGPT(GPT-3.5)以及Meta的Llama-2-70B,正在加速追赶GPT-4,与GPT-4的PK里边也是不分伯仲,略逊一筹。
阿里云首席技术官周靖人透露,过去6个月,通义千问2.0在性能上取得巨大飞跃,相比4月发布的1.0版本,通义千问2.0在复杂指令理解、文学创作、通用数学、知识记忆、幻觉抵御等能力上均有显著提升。
英语任务方面,通义千问2.0在MMLU基准的得分是82.5,仅次于GPT-4.通过大幅增加参数量,通义千问2.0能更好地理解和处理复杂的语言结构和概念。
在更为本土化的中文任务方面,通义千问2.0版本以明显优势在中文测评C-Eval基准获得了最高分,这是由于模型在训练中学习了更多中文语料,进一步强化了中文理解和表达能力。
在数学推理、代码理解等领域,通义千问2.0进步明显。在推理基准测试GSM8K中,通义千问排名第二,展示了强大的计算和逻辑推理能力;在HumanEval测试中,通义千问得分紧跟GPT-4和GPT-3.5。该测试主要衡量大模型理解和执行代码片段的能力,这一能力是大模型应用于编程辅助、自动代码修复等场景的基础。
在发布新一代通义千问大模型2.0版本的同时,阿里云官方还宣布,基于通义大模型训练的8大行业模型全面上线,它们分别是:
截至10月,阿里云已与60多个行业头部伙伴进行深度合作,推动通义千问在办公、文旅、电力、政务、医保、交通、制造、金融、软件开发等领域的落地。
周靖人提到,通义千问自今年4月首次发布以来,受到社会广泛关注。据介绍,通义千问 2.0 模型参数达到千亿级别,不管是在阅读理解还是逻辑思维、数据等方面,都有大幅度提升,能够全面的达到国际先进水平。
伴随着新版大模型的推出,通义千问 App 也随之发布,支持语音对话等功能,用户开始可以下载相关 App 进行体验。
周靖人指出,阿里云最先提出了“模型即服务”的创新理念,阿里云拥有从大模型底层算力与构筑,到大模型上层应用的拓展落地,再到围绕大模型开展生态建设的全方位立体能力。通过多年的技术积累,阿里云已经搭建了完善 AI 基础设施,建立了完善的 AI 大模型训练平台,能够为大家提供一个非常完善的模型推理服务。
上一篇:阿里云发布通义千问大模型2.0丨微软向Win11用户推送Copilot智能助理丨微软自曝GPT-3.5参数规模仅200亿
下一篇:B站发布官方版本的AI视频总结功能:一键生成关键节点时间戳,快速总结长视频的内容梗概
聚焦智能天文光学系统,打造人类“天眼”。
一家机器人公司如何穿越行业“死亡谷”?
教师职业三重变革:从编制铁饭碗到流量新战场,谁在定义未来教育者?
苹果发布超薄iPhoneAir,评价两极,或为折叠屏预热。
你是不是也经常遇到“AI配音”的视频?
苹果还没有熟透。
豆包
博思白板 — boardmix AI
扣子-AI办公
千问
讯飞绘文
讯飞绘文-免费AI写作
扣子-AI办公app
AI小聚
ZeroGPT
网站地图
阿里旗下通义千问大模型2.0版本正式发布:千亿级参数赶超ChatGPT,同时发布8大垂直行业大模型应用
AI奇点网10月31日报道丨今天下午,在一年一度的 2023 云栖大会现场,阿里云正式发布千亿级参数大模型通义千问大模型。阿里云CTO周靖人宣布,阿里大模型的家族迎来年度最强升级,也宣布通义千问 2.0 版本正式发布。
根据官方特供的信息,在MMLU、C-Eval、GSM8K、HumanEval、MATH等等10个国际主流的大模型Benchmark测评当中,通义千问2.0版本的综合表现超越ChatGPT(GPT-3.5)以及Meta的Llama-2-70B,正在加速追赶GPT-4,与GPT-4的PK里边也是不分伯仲,略逊一筹。
阿里云首席技术官周靖人透露,过去6个月,通义千问2.0在性能上取得巨大飞跃,相比4月发布的1.0版本,通义千问2.0在复杂指令理解、文学创作、通用数学、知识记忆、幻觉抵御等能力上均有显著提升。
英语任务方面,通义千问2.0在MMLU基准的得分是82.5,仅次于GPT-4.通过大幅增加参数量,通义千问2.0能更好地理解和处理复杂的语言结构和概念。
在更为本土化的中文任务方面,通义千问2.0版本以明显优势在中文测评C-Eval基准获得了最高分,这是由于模型在训练中学习了更多中文语料,进一步强化了中文理解和表达能力。
在数学推理、代码理解等领域,通义千问2.0进步明显。在推理基准测试GSM8K中,通义千问排名第二,展示了强大的计算和逻辑推理能力;在HumanEval测试中,通义千问得分紧跟GPT-4和GPT-3.5。该测试主要衡量大模型理解和执行代码片段的能力,这一能力是大模型应用于编程辅助、自动代码修复等场景的基础。
在发布新一代通义千问大模型2.0版本的同时,阿里云官方还宣布,基于通义大模型训练的8大行业模型全面上线,它们分别是:
通义灵码-智能编码助手通义智文-AI阅读助手通义听悟-工作学习AI助手通义星尘-个性化角色创作平台通义点金-智能投研助手通义晓蜜-智能客服通义仁心-个人专属健康助手通义法睿-AI法律顾问截至10月,阿里云已与60多个行业头部伙伴进行深度合作,推动通义千问在办公、文旅、电力、政务、医保、交通、制造、金融、软件开发等领域的落地。
周靖人提到,通义千问自今年4月首次发布以来,受到社会广泛关注。据介绍,通义千问 2.0 模型参数达到千亿级别,不管是在阅读理解还是逻辑思维、数据等方面,都有大幅度提升,能够全面的达到国际先进水平。
伴随着新版大模型的推出,通义千问 App 也随之发布,支持语音对话等功能,用户开始可以下载相关 App 进行体验。
周靖人指出,阿里云最先提出了“模型即服务”的创新理念,阿里云拥有从大模型底层算力与构筑,到大模型上层应用的拓展落地,再到围绕大模型开展生态建设的全方位立体能力。通过多年的技术积累,阿里云已经搭建了完善 AI 基础设施,建立了完善的 AI 大模型训练平台,能够为大家提供一个非常完善的模型推理服务。
上一篇:阿里云发布通义千问大模型2.0丨微软向Win11用户推送Copilot智能助理丨微软自曝GPT-3.5参数规模仅200亿
下一篇:B站发布官方版本的AI视频总结功能:一键生成关键节点时间戳,快速总结长视频的内容梗概
追觅「上天」,官宣成立天文BU|最前线
聚焦智能天文光学系统,打造人类“天眼”。
三临绝境,三度翻盘:一家机器人公司的15年“极限求生”
一家机器人公司如何穿越行业“死亡谷”?
招生锐减、硕博下沉、AI创业——教师职业的破与立
教师职业三重变革:从编制铁饭碗到流量新战场,谁在定义未来教育者?
OpenAI CEO奥特曼点赞iPhone Air,分析师直呼:它只是苹果的试验品
苹果发布超薄iPhoneAir,评价两极,或为折叠屏预热。
偷走全红婵声音,在网上卖鸡蛋?你看的明星带货直播,可能是AI偷来的……
你是不是也经常遇到“AI配音”的视频?
库克不再「挤牙膏」:iPhone薄了,AI缺席
苹果还没有熟透。
豆包
博思白板 — boardmix AI
扣子-AI办公
千问
讯飞绘文
讯飞绘文-免费AI写作
扣子-AI办公app
豆包
博思白板 — boardmix AI
扣子-AI办公
千问
讯飞绘文
讯飞绘文-免费AI写作
扣子-AI办公app
AI小聚
ZeroGPT