0

0

爆火的生成式AI,能让智能音箱起死回生吗?

王林

王林

发布时间:2023-06-06 08:05:39

|

1079人浏览过

|

来源于搜狐

转载

智能音箱这类如今几乎已经被大量消费者遗忘的产品,在此前经历了2017年、2018年的“疯狂”之后,早已不再是大多数消费者关注的对象。就在大家以为智能音箱会昙花一现时,chatgpt的横空出世似乎让智能音箱有了焕发第二春的可能,也给了这个在走下坡路的行业一个新的机遇。那么,智能音箱与如今爆红的生成式ai能擦出火花吗?

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

爆火的生成式AI,能让智能音箱起死回生吗?

生成式AI之于智能音箱行业,或许就是久旱逢甘霖。根据相关市场调查数据显示,2023年第一季度,受产品同质化严重和消费者需求下降等因素的叠加影响,国内智能音箱在线上的监测零售量为157万台、再次下跌40.6%,而在整个2022年,智能音箱国内全渠道销量为2631万台、同比下降了28%。

为什么曾经被各大巨头寄予厚望、甚至被视为可能是智能家庭入口的智能音箱,会在近年来滑入深渊呢?原因其实只有一个,那就是智能音箱真的不够智能。

在智能音箱这一概念火热的2017年,业界曾有关于智能音箱的重心到底应该在“智能”、还是“音质”上的讨论。最终,腾讯听听、苹果HomePod等一系列注重音质的产品,用它们的惨烈失败证明智能音箱的卖点只有可能是智能化。

爆火的生成式AI,能让智能音箱起死回生吗?

然而遗憾的是,绝大多数智能音箱的智能化程度只能用“捉襟见肘”来形容,而各大厂商对于ASR(语音识别)、NLP自然语义处理、远场拾音等人工智能和声学技术的进步,又实在有些过于乐观。其实智能音箱从技术层面来说很简单,它的工作模式就是收集用户的声音,然后将音频发到服务器上、再计算并产出结果,最终将结果发送到智能音箱上变成具体的行为,比如打开某个应用或是回复用户的提问。

没错,智能音箱本身其实与人工智能并不沾边,小爱同学、小度、天猫精灵的真身藏在了相应的服务器端上。这一切也导致了决定智能音箱使用体验的关键是远场拾音技术,也就是在复杂的声学环境下准确捕捉用户语音指令的能力,毕竟总不能出现用户说“讲个笑话”,智能音箱听成“放首歌”了吧。

爆火的生成式AI,能让智能音箱起死回生吗?

智能音箱的解决方案,则是使用大规模麦克风阵列来收集声音,但其中却有一个痛点一直得不到解决,那就是语音唤醒(keyword spotting)。大家在使用智能音箱时,需要用到诸如“Hi,Siri”、“小爱同学”、“小度小度”这样的唤醒词,让智能音箱知道你在和它说话,这也就意味着智能音箱缺乏主动服务的能力。更为重要的是,由于技术的限制,智能音箱长期以来只能理解简单的指令,比如“音量调大一点/调小一点”、“播放某某人的某某歌”等,再复杂一些的语句识别起来往往就很难。

而ChatGPT、文心一言这类生成式AI之于智能音箱的意义,就是前者可以帮助智能音箱理解更加复杂的语句,并提供更加自然的交流。相信使用过微软Bing Chat、百度文心一言或ChatGPT的朋友应该就知道,在与这类生成式AI对话时,并不需要用诸如“Hi,ChatGPT”这样的开场白,直接输入内容即可开始对话进程。

爆火的生成式AI,能让智能音箱起死回生吗?

由于生成式AI是在基于大规模语言模型(LLM,Large Language Model)的基础上,加入了人工标注数据和从人类反馈中进行强化学习技术,再辅以知识图谱技术,即一种将知识写成结构化三元组(包含实体、概念和关系)的多关系图,让AI得以理解人类指令的含义,并最终从庞大的信息数据库中选择内容进行回答。

简单听记
简单听记

百度网盘推出的一款AI语音转文字工具

下载

ChatGPT这类产品相比于Siri、小爱同学最大的变化,就是有了多轮对话的能力。相比Siri几乎是“鱼的记忆”,ChatGPT则可以一直与用户对话,再加上对于情绪更清晰的感知,让用户以为真的是在与活生生的人对话。对于一个消费级产品而言,用户显然并不在乎背后的技术原理有多么高深,而是关注它能否解决问题或是满足需求。

爆火的生成式AI,能让智能音箱起死回生吗?

生成式AI的魅力就在于它的能力上限很高,其中典型的例子就是微软的Microsoft Copilot,同时它还能在一定程度上满足用户的社交需求,如今在海外已有创作者借助ChatGPT,推出了以自己为模型的“虚拟伴侣”,并收获了超过1000名用户。总的来说,将生成式AI与智能音箱结合几乎能补足后者的短板,使得其在消费级赛道拥有了可堪一用的智能化水平。

事实上,部分智能音箱厂商已经行动起来了。例如今年2月,百度在预热文心一言时,小度就已宣布将融合文心一言,打造针对智能设备场景的AI模型“小度灵机”;4月天猫精灵接入“鸟鸟分鸟”模型打造的“AI嘴替”,同时宣布接入阿里巴巴的通义千问

爆火的生成式AI,能让智能音箱起死回生吗?

但需要指出的是,生成式AI并非“万能灵药”。就目前来说,一切生成式AI都面临着一个不可避免的问题,那就是算力资源的稀缺。最近生成式AI天花板GPT-4“变笨”的消息引发了诸多关注,相比于刚刚发布时的状态,如今GPT-4的文本代码质量全方位下降已然成为了用户的共识。

没错,其实不仅是GPT-4,诸如ChatGPT、文心一言等面向公众的这类产品都出现了类似的情况,用户量的增加导致了大模型性能的下降。

现在生成式AI领域面临的核心问题,就是算力资源紧张、无法应对汹涌而来的用户,而为了确保用户体验,这类产品就只能降低大模型的性能、减少生成内容的时间来给服务器“减负”。相较之下,智能音箱的存量市场规模无疑更加庞大,所以在接入生成式AI后,几乎不可避免地会遇到类似的问题。

爆火的生成式AI,能让智能音箱起死回生吗?

未来很有可能会出现的情况,是智能音箱的智能化水平呈现出一条抛物线,初期用户体验会跨越式提升,但随着用户规模的不断增加,智能化表现反而可能会“退化”回数年前的水平。

相关专题

更多
php源码安装教程大全
php源码安装教程大全

本专题整合了php源码安装教程,阅读专题下面的文章了解更多详细内容。

0

2025.12.31

php网站源码教程大全
php网站源码教程大全

本专题整合了php网站源码相关教程,阅读专题下面的文章了解更多详细内容。

0

2025.12.31

视频文件格式
视频文件格式

本专题整合了视频文件格式相关内容,阅读专题下面的文章了解更多详细内容。

2

2025.12.31

不受国内限制的浏览器大全
不受国内限制的浏览器大全

想找真正自由、无限制的上网体验?本合集精选2025年最开放、隐私强、访问无阻的浏览器App,涵盖Tor、Brave、Via、X浏览器、Mullvad等高自由度工具。支持自定义搜索引擎、广告拦截、隐身模式及全球网站无障碍访问,部分更具备防追踪、去谷歌化、双内核切换等高级功能。无论日常浏览、隐私保护还是突破地域限制,总有一款适合你!

6

2025.12.31

出现404解决方法大全
出现404解决方法大全

本专题整合了404错误解决方法大全,阅读专题下面的文章了解更多详细内容。

18

2025.12.31

html5怎么播放视频
html5怎么播放视频

想让网页流畅播放视频?本合集详解HTML5视频播放核心方法!涵盖<video>标签基础用法、多格式兼容(MP4/WebM/OGV)、自定义播放控件、响应式适配及常见浏览器兼容问题解决方案。无需插件,纯前端实现高清视频嵌入,助你快速打造现代化网页视频体验。

3

2025.12.31

关闭win10系统自动更新教程大全
关闭win10系统自动更新教程大全

本专题整合了关闭win10系统自动更新教程大全,阅读专题下面的文章了解更多详细内容。

2

2025.12.31

阻止电脑自动安装软件教程
阻止电脑自动安装软件教程

本专题整合了阻止电脑自动安装软件教程,阅读专题下面的文章了解更多详细教程。

1

2025.12.31

html5怎么使用
html5怎么使用

想快速上手HTML5开发?本合集为你整理最实用的HTML5使用指南!涵盖HTML5基础语法、主流框架(如Bootstrap、Vue、React)集成方法,以及无需安装、直接在线编辑运行的平台推荐(如CodePen、JSFiddle)。无论你是新手还是进阶开发者,都能轻松掌握HTML5网页制作、响应式布局与交互功能开发,零配置开启高效前端编程之旅!

2

2025.12.31

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
MongoDB 教程
MongoDB 教程

共17课时 | 1.7万人学习

ASP 教程
ASP 教程

共34课时 | 3万人学习

麻省理工大佬Python课程
麻省理工大佬Python课程

共34课时 | 5万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2025 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号