搜索
首页科技周边人工智能小米AI实力再次得到验证,声音识别算法能力居国际前列

最近,小米在声音识别算法方面取得了最新的进展,其算法模型在性能方面领先于其他机构,并在国际排名中名列前茅。这一突破是小米在Google发布的AudioSet音频标记任务中取得的

Google 将 AudioSet 数据集分为三个子集,前两个子集用于训练,被合并称为 “AudioSet-2M”。正是在这个合并后的训练集中,小米的声音识别算法模型在业界突破了50 mAP,刷新了音频标记技术指标。此外,小米还发布了一个 Mini 版模型,适合资源受限的场景。

这项技术的突破意味着小米的声音识别算法能力再次突破,在小米的众多智能硬件设备应用此项技术后,可以更敏锐地捕捉和识别环境声音,大幅提升硬件的智能化程度,从而为用户创造更加便捷的智能生活体验。

与此同时,小米声音识别算法下的音频标记技术能力,有力推动了业界前沿研究的相关研发进程。

小米此次精进后的声音识别算法,它能够广泛应用于小米的智能设备中。音频标记算法能够识别广泛的环境声音,比如婴儿的啼哭声、动物叫声、汽车引擎声、爆炸声、烟雾警报、门铃声、水流声等,并让环境中的声音以文字等模态表达,让声音被“看”见。这可以让硬件设备更加智能,为用户带去更高效和更准确的声音识别体验。

小米手机中的“小米闻声”功能可以监测包括火警、婴儿啼哭、烧水壶声等在内的14种重要环境音,并通过手机通知栏进行文字推送。这项功能有效地帮助了听障人士的生活,而小米手环也可以同步显示和接收这些声音信息

这项算法在智能家居设备上的应用则更加广泛。当前,小米的声音识别算法已经应用于众多的智能家居设备中,比如米家摄像头的宝宝哭声监测功能,它能在监测到宝宝哭声的时候,实时向用户手机推送通知。Xiaomi Sound 音箱也搭载了声音识别功能,它能够识别家用报警器、婴儿啼哭、火警、流水、猫叫、狗叫等六种用户关心的家居环境声音。小米健康 APP 的睡眠鼾声监测,则可以帮助跟踪用户睡眠时的鼾声梦话。

为了更好的发挥这项算法的潜力,小米通过其 AIoT 平台生态,为这项算法技术的应用提供了广阔的空间。目前,小米的声学语音团队已将自研声学语音技术全面应用于小米手机、音箱、电视、耳机、手表、机器人等 79 个品类,共计 5000多款智能产品中。

而在声音识别算法所属的人工智能领域,小米更是积极投入其中,作为小米长期持续投入的底层赛道之一。据悉,小米自2016年组建AI团队以来,人工智能团队经过7年6次扩展,人员规模已达3000多人。同时,小米 AI 技术能力也已经覆盖了视觉、声学、语音、NLP、知识图谱、机器学习、大模型、多模态等众多方向,并全面赋能了手机、汽车、AIoT、机器人等众多业务板块。今年4月,小米正式组建了 AI 大模型团队,全面拥抱大模型,目前陆续有了一些应用尝试。其中第一个应用大模型,就是将智能语音助理小爱同学升级了大模型版本,并开启邀请测试。

小米AI实力再次得到验证,声音识别算法能力居国际前列

以上是小米AI实力再次得到验证,声音识别算法能力居国际前列的详细内容。更多信息请关注PHP中文网其他相关文章!

声明
本文转载于:搜狐。如有侵权,请联系admin@php.cn删除
在线学习和被动攻击算法指南在线学习和被动攻击算法指南Apr 13, 2025 am 11:09 AM

介绍 数据是从社交媒体,金融交易和电子商务平台等来源的前所未有的速度生成的。处理这种连续的信息流是一个挑战,但它提供了

您需要查看的3台Openai' s的动手实验 - 分析Vidhya您需要查看的3台Openai' s的动手实验 - 分析VidhyaApr 13, 2025 am 11:06 AM

介绍 您在讲话之前真正思考和理性多久?当前最新的LLM GPT-4O已经在不花很多时间做出回应的情况下提供了令人印象深刻的回应。但是想象一下它是否开始服用

如何访问OpenAi O1? - 分析Vidhya如何访问OpenAi O1? - 分析VidhyaApr 13, 2025 am 11:05 AM

介绍 草莓在市场上!!!我希望这将像其他OpenAI最新车型带来的人工智能的最新进步一样富有成果。 我们一直在等待GPT-5这么长时间

使用llamaindex构建多文件代理抹布使用llamaindex构建多文件代理抹布Apr 13, 2025 am 11:03 AM

介绍 在人工智能快速发展的领域中,处理和理解大量信息的能力变得越来越重要。输入多文件代理抹布 - 一个功能强大的应用

免费学习SQL的YouTube频道 - 分析Vidhya免费学习SQL的YouTube频道 - 分析VidhyaApr 13, 2025 am 10:46 AM

介绍 掌握SQL(结构化查询语言)对于追求数据管理,数据分析和数据库管理的个人至关重要。如果您是从新手开始的,或者是经验丰富的专业人士,请寻求改进,

具有多模式和Azure文档智能的抹布具有多模式和Azure文档智能的抹布Apr 13, 2025 am 10:38 AM

介绍 在基于数据运行的当前世界中,关系AI图(RAG)通过关联数据并绘制关系来对行业产生很大影响。但是,如果一个人可以再进一步多怎么办

在生成AI时代负责的AI在生成AI时代负责的AIApr 13, 2025 am 10:28 AM

介绍 现在,我们生活在人工智能时代,我们周围的一切都在一天变得更加聪明。最先进的大语言模型(LLM)和AI代理,能够执行复杂的任务

GPT-4O vs OpenAI O1:新的Openai模型值得炒作吗?GPT-4O vs OpenAI O1:新的Openai模型值得炒作吗?Apr 13, 2025 am 10:18 AM

介绍 Openai已根据备受期待的“草莓”建筑发布了其新模型。这种称为O1的创新模型增强了推理能力,使其可以通过问题进行思考

See all articles

热AI工具

Undresser.AI Undress

Undresser.AI Undress

人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

Undress AI Tool

免费脱衣服图片

Clothoff.io

Clothoff.io

AI脱衣机

AI Hentai Generator

AI Hentai Generator

免费生成ai无尽的。

热门文章

R.E.P.O.能量晶体解释及其做什么(黄色晶体)
3 周前By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O.最佳图形设置
3 周前By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O.如果您听不到任何人,如何修复音频
3 周前By尊渡假赌尊渡假赌尊渡假赌
WWE 2K25:如何解锁Myrise中的所有内容
4 周前By尊渡假赌尊渡假赌尊渡假赌

热工具

MinGW - 适用于 Windows 的极简 GNU

MinGW - 适用于 Windows 的极简 GNU

这个项目正在迁移到osdn.net/projects/mingw的过程中,你可以继续在那里关注我们。MinGW:GNU编译器集合(GCC)的本地Windows移植版本,可自由分发的导入库和用于构建本地Windows应用程序的头文件;包括对MSVC运行时的扩展,以支持C99功能。MinGW的所有软件都可以在64位Windows平台上运行。

螳螂BT

螳螂BT

Mantis是一个易于部署的基于Web的缺陷跟踪工具,用于帮助产品缺陷跟踪。它需要PHP、MySQL和一个Web服务器。请查看我们的演示和托管服务。

安全考试浏览器

安全考试浏览器

Safe Exam Browser是一个安全的浏览器环境,用于安全地进行在线考试。该软件将任何计算机变成一个安全的工作站。它控制对任何实用工具的访问,并防止学生使用未经授权的资源。

SublimeText3 Mac版

SublimeText3 Mac版

神级代码编辑软件(SublimeText3)

Dreamweaver Mac版

Dreamweaver Mac版

视觉化网页开发工具