搜索
首页科技周边人工智能AI首次超越人类!腾讯、阿里的NLP模型,比你更懂中文

​在AI科技圈,「中文语言理解」一直是一个难以攻克的问题。因为在全世界所有的语言中——中文的难度系数是最高的。

AI首次超越人类!腾讯、阿里的NLP模型,比你更懂中文

举例来讲,就下面这句简简单单20个字的句子,都绝对能让不少外国人深感崩溃。

下雨天,我骑车差点摔倒,好在一把把把把住了。​

AI首次超越人类!腾讯、阿里的NLP模型,比你更懂中文

然而,在最新的中文语言理解领域权威榜单CLUE中,腾讯和阿里的AI模型却先后超越了人类的成绩!实在让人不禁感慨:这年头,还有什么是AI做不了的吗?

AI首次超越人类!腾讯、阿里的NLP模型,比你更懂中文

最新一期CLUE最新排名

CLUE的全称是Chinese Language Understanding Evaluation,即「中文语言理解测评基准」。

就像英语的GLUE和SuperGLUE,CLUE是一组评估机器能够像人类一样理解和响应中文文本的任务,上线于3年前,也是第一个大规模的中文语言评估基准,旨在推动NLP技术的不断进步和突破。

在CLUE的官网上,有语料库、排行榜、预训练模型和代表性的数据集等资料可供选择。包括文本相似度、分类、上下文推理、阅读理解在内的17项测评任务,其介绍在官网上都有很详尽的展示。

AI首次超越人类!腾讯、阿里的NLP模型,比你更懂中文

今年11月22日,阿里巴巴的AI模型「AliceMind」获得了86.685的高分,稳居总排行榜首位的同时,也一举打破了由人类(HUMAN)在该系列测试中保持的纪录。

值得一提的是,这也是人工智能在该系列测试中——首次超越人类。

巧合的是,短短4天后,腾讯的「混元AI大模型」在测试中以86.918的高分再次刷新了纪录——这甚至比AliceMind的成绩还要高0.233分。

中国两大互联网巨头你方唱罢我登场,说明人工智能在不同领域和方面都有超越人类的能力。

上周五,阿里云计算部门也在一篇文章中表示,「这标志着中国对AI模型的理解,达到了一个新的水平」。

中国的大型科技公司正努力改进他们的自然语言处理 (NLP) 系统,这些系统被用于支持如阿里巴巴的语音激活虚拟助手,腾讯的小微和AliGenie,以及机器翻译和垃圾邮件检测等其他功能。

今年早些时候,由百度研发的AI模型「度晓晓」写出的作文,尽管错误地使用了不少互联网俚语和生僻词,但仍在高考得分中高于绝大多数学生。

此外在最新排行榜上,中国智能手机制造商OPPO和外卖巨头美团的人工智能模型,也分别排在第四和第五位。

尽管如此,一些研究人员表示:虽然机器在某些语言任务上可以比人类做得更好,但大多数人工智能模型在真正理解语言的复杂性之前,还有很长的路要走。

去年,由美国阿拉巴马州奥本大学和Adobe的研究部门联合研究发现,许多在某些理解任务上表现优于人类的AI,仍无法分辨出单词被随机打乱的句子。

参考资料:

https://www.cluebenchmarks.com/rank.html

https://www.scmp.com/tech/big-tech/article/3201294/tencent-and-alibabas-ai-models-understand-chinese-better-humans-new-rankings-show

https://www.techtimes.com/articles/284084/20221128/tencent-alibaba-ai-tech-tops-chinese-language-comprehension-humans-ranks.htm

https://english.newstracklive.com/news/ai-models-from-tencent-and-alibaba-are-superior-to-humans-at-understanding-chinese-sc71-nu355-ta355-1259160-1.html

以上是AI首次超越人类!腾讯、阿里的NLP模型,比你更懂中文的详细内容。更多信息请关注PHP中文网其他相关文章!

声明
本文转载于:51CTO.COM。如有侵权,请联系admin@php.cn删除
一个提示可以绕过每个主要LLM的保障措施一个提示可以绕过每个主要LLM的保障措施Apr 25, 2025 am 11:16 AM

隐藏者的开创性研究暴露了领先的大语言模型(LLM)的关键脆弱性。 他们的发现揭示了一种普遍的旁路技术,称为“政策木偶”,能够规避几乎所有主要LLMS

5个错误,大多数企业今年将犯有可持续性5个错误,大多数企业今年将犯有可持续性Apr 25, 2025 am 11:15 AM

对环境责任和减少废物的推动正在从根本上改变企业的运作方式。 这种转变会影响产品开发,制造过程,客户关系,合作伙伴选择以及采用新的

H20芯片禁令震撼中国人工智能公司,但长期以来一直在为影响H20芯片禁令震撼中国人工智能公司,但长期以来一直在为影响Apr 25, 2025 am 11:12 AM

最近对先进AI硬件的限制突出了AI优势的地缘政治竞争不断升级,从而揭示了中国对外国半导体技术的依赖。 2024年,中国进口了价值3850亿美元的半导体

如果Openai购买Chrome,AI可能会统治浏览器战争如果Openai购买Chrome,AI可能会统治浏览器战争Apr 25, 2025 am 11:11 AM

从Google的Chrome剥夺了潜在的剥离,引发了科技行业中的激烈辩论。 OpenAI收购领先的浏览器,拥有65%的全球市场份额的前景提出了有关TH的未来的重大疑问

AI如何解决零售媒体的痛苦AI如何解决零售媒体的痛苦Apr 25, 2025 am 11:10 AM

尽管总体广告增长超过了零售媒体的增长,但仍在放缓。 这个成熟阶段提出了挑战,包括生态系统破碎,成本上升,测量问题和整合复杂性。 但是,人工智能

'AI是我们,比我们更多''AI是我们,比我们更多'Apr 25, 2025 am 11:09 AM

在一系列闪烁和惰性屏幕中,一个古老的无线电裂缝带有静态的裂纹。这堆积不稳定的电子设备构成了“电子废物土地”的核心,这是身临其境展览中的六个装置之一,&qu&qu

Google Cloud在下一个2025年对基础架构变得更加认真Google Cloud在下一个2025年对基础架构变得更加认真Apr 25, 2025 am 11:08 AM

Google Cloud的下一个2025:关注基础架构,连通性和AI Google Cloud的下一个2025会议展示了许多进步,太多了,无法在此处详细介绍。 有关特定公告的深入分析,请参阅我的文章

IR的秘密支持者透露,Arcana的550万美元的AI电影管道说话,Arcana的AI Meme,Ai Meme的550万美元。IR的秘密支持者透露,Arcana的550万美元的AI电影管道说话,Arcana的AI Meme,Ai Meme的550万美元。Apr 25, 2025 am 11:07 AM

本周在AI和XR中:一波AI驱动的创造力正在通过从音乐发电到电影制作的媒体和娱乐中席卷。 让我们潜入头条新闻。 AI生成的内容的增长影响:技术顾问Shelly Palme

See all articles

热AI工具

Undresser.AI Undress

Undresser.AI Undress

人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

Undress AI Tool

免费脱衣服图片

Clothoff.io

Clothoff.io

AI脱衣机

Video Face Swap

Video Face Swap

使用我们完全免费的人工智能换脸工具轻松在任何视频中换脸!

热工具

PhpStorm Mac 版本

PhpStorm Mac 版本

最新(2018.2.1 )专业的PHP集成开发工具

Atom编辑器mac版下载

Atom编辑器mac版下载

最流行的的开源编辑器

WebStorm Mac版

WebStorm Mac版

好用的JavaScript开发工具

SecLists

SecLists

SecLists是最终安全测试人员的伙伴。它是一个包含各种类型列表的集合,这些列表在安全评估过程中经常使用,都在一个地方。SecLists通过方便地提供安全测试人员可能需要的所有列表,帮助提高安全测试的效率和生产力。列表类型包括用户名、密码、URL、模糊测试有效载荷、敏感数据模式、Web shell等等。测试人员只需将此存储库拉到新的测试机上,他就可以访问到所需的每种类型的列表。

EditPlus 中文破解版

EditPlus 中文破解版

体积小,语法高亮,不支持代码提示功能