首頁 >科技週邊 >人工智慧 >阿里雲發佈通義千問2.0，效能加速追趕GPT-4

阿里雲發佈通義千問2.0，效能加速追趕GPT-4

PHPz轉載: 2023-11-01 20:21:28934瀏覽

在2023杭州云栖大会上，阿里云首席技术官周靖人发布千亿级参数大模型通义千问2.0。在10个权威测评中，通义千问2.0综合性能超过GPT-3.5，正在加速追赶GPT-4。

据报道，通义千问2.0在过去六个月取得了巨大的进步。与四月发布的1.0版本相比，通义千问2.0在复杂指令理解、文学创作、通用数学、知识记忆和幻觉抵御等方面的能力都显著提升。目前，通义千问的综合性能已经超过了GPT-3.5，并且正在加快追赶GPT-4的步伐

通义千问2.0在MMLU、C-Eval、GSM8K、HumanEval、MATH等10个主流Benchmark测评集上的得分整体超过了Meta的Llama-2-70B，胜率比OpenAI的Chat-3.5高了九成一，比GPT-4高了四成六，且与GPT-4的差距进一步缩小

中英文理解能力是大语言模型的基本功。英语任务方面，通义千问2.0在MMLU基准的得分是82.5，仅次于GPT-4，通过大幅增加参数量，通义千问2.0能更好地理解和处理复杂的语言结构和概念;中文任务方面，通义千问2.0以明显优势在C-Eval基准获得最高得分，这是由于模型在训练中学习了更多中文语料，进一步强化了中文理解和表达能力。

在数学推理、代码理解等领域，通义千问2.0进步明显。在推理基准测试GSM8K中，通义千问排名第二，展示了强大的计算和逻辑推理能力;在HumanEval测试中，通义千问得分紧跟GPT-4和GPT-3.5，该测试主要衡量大模型理解和执行代码片段的能力，这一能力是大模型应用于编程辅助、自动代码修复等场景的基础。

以上是阿里雲發佈通義千問2.0，效能加速追趕GPT-4的詳細內容。更多資訊請關注PHP中文網其他相關文章！

math gpt llama

陳述：

本文轉載於：51cto.com。如有侵權，請聯絡admin@php.cn刪除

上一篇：微軟和西門子聯手將生成式AI引進製造業，讓模擬時間從數週縮短到幾分鐘下一篇：微軟和西門子聯手將生成式AI引進製造業，讓模擬時間從數週縮短到幾分鐘

看更多