千億規模參數，阿里雲通義千問進化到2.0：性能超GPT-3.5，加速追趕GPT-4-人工智慧-PHP中文網

首頁

科技週邊

人工智慧

千億規模參數，阿里雲通義千問進化到2.0：性能超GPT-3.5，加速追趕GPT-4

王林

Oct 31, 2023 pm 06:17 PM

入門千億參數通義千問2.0

阿里云于10月31日正式发布了千亿级参数大模型通义千问2.0。根据10个权威测评结果显示，通义千问2.0的综合性能超过了GPT-3.5，并且正在快速迎头赶上GPT-4。当天，通义千问APP在各大手机应用市场上线，任何人都可以通过该APP直接体验最新模型的能力

过去 6 个月，通义千问 2.0 在性能上取得巨大飞跃，相比 4 月发布的 1.0 版本，通义千问 2.0 在复杂指令理解、文学创作、通用数学、知识记忆、幻觉抵御等能力上均有显著提升。目前，通义千问的综合性能已经超过 GPT-3.5，加速追赶 GPT-4。

千億規模參數，阿里雲通義千問進化到2.0：性能超GPT-3.5，加速追趕GPT-4

通义千问 2.0 综合性能超过 GPT-3.5，正在加速追赶 GPT-4

在MMLU、C-Eval、GSM8K、HumanEval、MATH等10个主流Benchmark测评集上，通义千问2.0的得分整体超越Meta的Llama-2-70B，相比OpenAI的Chat-3.5是九胜一负，相比GPT-4则是四胜六负，与GPT-4的差距进一步缩小

中英文理解能力是大语言模型的基本功。英语任务方面，通义千问 2.0 在 MMLU 基准的得分是 82.5，仅次于 GPT-4，通过大幅增加参数量，通义千问 2.0 能更好地理解和处理复杂的语言结构和概念；中文任务方面，通义千问 2.0 以明显优势在 C-Eval 基准获得最高得分，这是由于模型在训练中学习了更多中文语料，进一步强化了中文理解和表达能力。

在数学推理、代码理解等领域，通义千问 2.0 进步明显。在推理基准测试 GSM8K 中，通义千问排名第二，展示了强大的计算和逻辑推理能力；在 HumanEval 测试中，通义千问得分紧跟 GPT-4 和 GPT-3.5，该测试主要衡量大模型理解和执行代码片段的能力，这一能力是大模型应用于编程辅助、自动代码修复等场景的基础。

千億規模參數，阿里雲通義千問進化到2.0：性能超GPT-3.5，加速追趕GPT-4

通义千问 2.0 发布

通义千问更成熟了，也更好用了。通义千问 2.0 在指令遵循、工具使用、精细化创作等方面作了技术优化，能够更好地被下游应用场景集成。通义大模型官网上线了多模态和插件功能，支持图片输入、文档解析等细分任务。

与此同时，基于通义大模型训练的 8 大行业模型组团上线，他们分别是通义灵码 - 智能编码助手、通义智文 - AI 阅读助手、通义听悟 - 工作学习 AI 助手、通义星尘 - 个性化角色创作平台、通义点金 - 智能投研助手、通义晓蜜 - 智能客服、通义仁心 - 个人专属健康助手、通义法睿 - AI 法律顾问。8 大行业模型面向当下最受欢迎的多个垂直场景，使用领域数据进行专门训练。用户可以在官网直接体验模型功能，开发者可以通过网页嵌入、API/SDK 调用等方式，将模型能力集成到自己的大模型应用和服务中。

千億規模參數，阿里雲通義千問進化到2.0：性能超GPT-3.5，加速追趕GPT-4

通义大模型家族全面升级，8 大行业模型组团上线

截至到10月份，阿里云已经与60多个行业的领军伙伴开展了深度合作，推动通用千问在办公、文旅、电力、政务、医保、交通、制造、金融、软件开发等领域的实际应用

周靖人表示，阿里云计划在不久的将来开源通义千问的72B版本。此前，阿里云已经先后开源了7B和14B版本的模型，这些模型的累计下载量已经超过100万。阿里云将继续支持各行业的开发者利用通义千问开源模型进行模型和应用的创新

千億規模參數，阿里雲通義千問進化到2.0：性能超GPT-3.5，加速追趕GPT-4

通义千问 72B 即将开源

以上是千億規模參數，阿里雲通義千問進化到2.0：性能超GPT-3.5，加速追趕GPT-4的詳細內容。更多資訊請關注PHP中文網其他相關文章！

陳述

本文轉載於：机器之心。如有侵權，請聯絡admin@php.cn刪除

最新的最佳及時工程技術的年度彙編Apr 10, 2025 am 11:22 AM

對於那些可能是我專欄新手的人，我廣泛探討了AI的最新進展，包括體現AI，AI推理，AI中的高科技突破，及時的工程，AI培訓，AI，AI RE RE等主題

歐洲的AI大陸行動計劃：Gigafactories，Data Labs和Green AIApr 10, 2025 am 11:21 AM

歐洲雄心勃勃的AI大陸行動計劃旨在將歐盟確立為人工智能的全球領導者。一個關鍵要素是建立了AI Gigafactories網絡，每個網絡都有大約100,000個高級AI芯片 - 2倍的自動化合物的四倍

微軟對AI代理申請的統一方法：企業的明顯勝利微軟最近公告的新AI代理能力清晰而統一的演講給人留下了深刻的印象。與許多技術公告陷入困境不同

向員工出售AI策略：Shopify首席執行官的宣言Apr 10, 2025 am 11:19 AM

Shopify首席執行官TobiLütke最近的備忘錄大膽地宣布AI對每位員工的基本期望是公司內部的重大文化轉變。這不是短暫的趨勢。這是整合到P中的新操作範式

IBM啟動具有完整AI集成的Z17大型機Apr 10, 2025 am 11:18 AM

IBM的Z17大型機：集成AI用於增強業務運營上個月，在IBM的紐約總部，我收到了Z17功能的預覽。以Z16的成功為基礎（於2022年推出並證明持續的收入增長

5 Chatgpt提示取決於別人並完全相信自己Apr 10, 2025 am 11:17 AM

解鎖不可動搖的信心，消除了對外部驗證的需求！這五個CHATGPT提示將指導您完全自力更生和自我感知的變革轉變。只需複制，粘貼和自定義包圍

AI與您的思想危險相似Apr 10, 2025 am 11:16 AM

人工智能安全與研究公司 Anthropic 最近的一項[研究]開始揭示這些複雜過程的真相，展現出一種令人不安地與我們自身認知領域相似的複雜性。自然智能和人工智能可能比我們想像的更相似。窺探內部：Anthropic 可解釋性研究 Anthropic 進行的研究的新發現代表了機制可解釋性領域的重大進展，該領域旨在反向工程 AI 的內部計算——不僅僅觀察 AI 做了什麼，而是理解它在人工神經元層面如何做到這一點。想像一下，試圖通過繪製當有人看到特定物體或思考特定想法時哪些神經元會放電來理解大腦。 A