
韶音,开始下场「AI 耳机」赛道了。
8 月 18 日,上海,韶音正式推出旗下首款 AI 耳机 OpenFit 2 AI,我爱音频网受邀参加发布会并进行现场报道。
相比此前的 OpenFit 2,新品品名多出的「AI」两个字母,几乎已经点明了这次新品最大的变化。在成熟的开放式耳机硬件基础上,OpenFit 2 AI 接入千问大模型,新增录音转写、AI 多维会议总结、翻译等生产力功能,韶音也将它定位为一款「耳边生产力」「声产力」工具。

从型号来看,OpenFit 2 AI 很像一次常规的「小改款」。但专门为这样一款产品召开新品发布会,足以说明韶音对这两个字母的重视——这次「小改」,对韶音来说其实并不小。对整个耳机行业来说,同样如此。
过去几年,录音、转写、翻译、会议纪要乃至 AI 问答,已经陆续出现在不同的耳机产品上。科大讯飞更早围绕会议和办公场景推出了多代产品,各类大模型耳机、翻译耳机也早已进入市场。AI 进入耳机,已经不是新鲜事物。
这一阶段的新型 AI 耳戴终端,即 AWS(AI Wearable Stereo,AI 穿戴立体声),是在传统无线耳机听音、通话的基础上,进一步将记录、翻译、信息处理与智能交互等 AI 能力融入日常佩戴。

但韶音的加入,还是让这件事变得有些不同。
从骨传导到 OWS,韶音过去十多年的核心竞争力一直围绕佩戴、声学和产品形态展开。当这样一家已经在「耳机」上建立起强品牌认知的头部厂商,也正式把 AI 写进产品名称,「AI 耳机」似乎正在跨过一个新的节点。
It really seems to be happening now.
更有意思的是,当越来越多成熟玩家开始认真回答「AI 耳机应该怎么做」,它们给出的答案,并没有越来越接近。
恰恰相反,路线开始分叉了——
韶音、科大讯飞向左,Anker 向右。
而这个岔路口,叫做「先入场,还是先筑底」。向左,先上快车道;向右,先走技术长坡。

韶音、科大讯飞向左:先把 AI 耳机做出来
先看「左转」的玩家们。
OpenFit 2 AI 给出的答案其实很直观:耳机原本负责听歌、通话,现在开始进一步负责「记录」。

除了耳机本体,充电盒和手机 Shokz App 都可以快速启动录音,录音结束后,声音还会继续进入下一道流程——转成文字、整理重点、生成摘要、思维导图,再由 AI 从一场会议中提取结论和待办。翻译也被做成了面对面交流、同传等不同模式。
换句话说,AI 带来的首先不是一套新的声学体验,而是一组过去很少见于主流耳机的办公效率能力。
但其实,这条思路并不陌生,科大讯飞已经沿着这条路走了很多年。

科大讯飞很早就已将录音、转写、通话记录等这些原本需要手机、录音笔乃至电脑共同完成的工作,一步步收进耳机及配套软件里。早在 2020 年推出的初代 iFLYBUDS,就已经支持多种通话场景的录音转写,还在多人沟通中自动区分讲话人。
到了今年 5 月,未来智能又推出 viaim 讯飞智能体耳机 Pro、Air,开始强调的不再只是「帮你记下一场会」,而是让 AI 持续承接一个项目里的多次会议、沟通和文档,在更长的上下文里理解信息、生成结果,耳机也由此开始接入今年 AI 最前沿的「Agent」潮流。

现在,韶音也走到了这里。
两家公司出发的位置其实完全不同。科大讯飞长期积累的是语音识别、转写、翻译和办公 AI,耳机更像是这些能力贴近用户的一块硬件入口;韶音首先是一家耳机公司,过去更擅长解决佩戴、声学、运动场景和产品形态的问题。但到了 OpenFit 2 AI,两条路径开始在同一个地方交汇。
过去消费者主要关心音质、佩戴、降噪和通话,现在又多了一层:能不能记录一次沟通、自动生成纪要,甚至把声音进一步整理成可继续使用的信息。
这种范式就是「先入场」。

不等底层硬件重新发明,而是利用已经成熟的蓝牙音频平台,把复杂且变化最快的 AI 能力更多交给手机和云端,先从已经被验证的用户需求切进去。
录音有人需要,转写有人需要,翻译有人需要,开完会以后自动整理纪要,同样有人需要。

这并不是厂商凭空想象出来的需求。韶音中国区 CEO 杨云此前在接受媒体采访时提到,OpenFit 2 AI 的录音转写正是来自用户反馈——如果一副耳机也能完成录音,就可以少带一个设备。
对于 AI 耳机最终应该长成什么样,韶音自己同样没有给出标准答案。但相比先定义终局,它选择先从已经出现的用户需求出发,把能够解决具体场景痛点的能力做成产品。
先推出,先满足需求,先拿到真实市场反馈,再继续迭代。轻、快,而且足够灵活。
这是「向左」。
Anker 向右:先把底座做厚
再看「右转」。
如果只看产品名称,Anker 甚至不像是在做一副「AI 耳机」。

5 月 21 日,纽约 Anker Day 上,Anker 发布 Liberty 5 Pro 和 Liberty 5 Pro Max,我爱音频网进行现场报道。和韶音直接把「AI」写进产品名不同,两款新品延续的仍然是 Liberty 系列的旗舰命名,产品本身首先仍是一副围绕通话、降噪和音质展开的旗舰耳机。
但打开耳机,似乎又处处少不了 AI 的影子。

作为整场发布会的重点之一,Liberty 5 Pro 系列首发搭载了 Thus A1 AI 音频芯片,采用存算一体架构,将过去受功耗和算力限制、难以放进耳机本地运行的神经网络模型进一步搬到端侧。在特定环境降噪任务中,官方给出的 AI 运算性能最高约为上代旗舰的 150 倍。
但 Anker 拿这些新增算力首先做的,还是一些非常「耳机」的事情。

比如通话。传统通话降噪更多是在复杂声音里判断什么是噪声,再想办法滤除;Thus A1 的新算力,则被用于神经网络直接识别和提取佩戴者的人声。
再比如降噪、音质和交互。主动降噪依赖端侧计算实时处理环境噪声,AI Sound Enhancement 用于改善蓝牙传输造成的音质损失,基础语音指令也可以直接在耳机端完成,无需手机和云端响应。
但通话还是通话,降噪还是降噪,听歌也还是听歌。
甚至从一个普通消费者的视角来看,使用 Liberty 5 Pro 时,未必需要意识到这里到底运行了多少神经网络、拥有多少 AI 算力。
不同的是,完成这些事情的方式,开始越来越多地由 AI 驱动。
这也很能说明 Anker 选择的方向。
相比在成熟硬件上迅速增加一批新的 AI 应用,Anker 选择先往底层走,把 AI 放进拾音、降噪、人声分离、声音和交互这些一副耳机本来就在做的核心链路。

当然,Liberty 5 Pro Max 同样加入了 AI 随身记、录音转写和翻译等能力。也就是说,Anker 并没有放弃那些消费者能够直接看到、直接使用的 AI 应用,只是它真正下重注的地方,还是更靠底层。
但相比韶音、讯飞的「快速入场快车道」,Anker 这条「技术长坡」路线更重,兑现周期也更长。
新的 AI 芯片和端侧模型,需要芯片、算法、声学和整机共同适配;更多端侧计算,也意味着算力、功耗、续航、体积和成本之间更加严苛的工程取舍。
不过,相应的,今天真正复杂的语义理解、长文本摘要、翻译乃至大模型 Agent,却依然没有完全住进耳机。

Liberty 5 Pro Max 可以从耳机和充电盒发起录音,但后续的转写、摘要等生产力处理仍然需要 App 和外部算力参与;实时翻译同样没有完全脱离网络。
换句话说,Anker 花了更重的代价,把 AI 深深做进耳机原本的音频链路,但到了今天消费者最容易感知的录音、总结、翻译这些 AI 应用,它仍然没有完全绕开手机和云端。
端侧 AI 当然是非常明确的长期发展方向,对于耳机而言,更强的本地算力可以带来更低的延迟、更好的隐私、更实时的音频处理,而且也可以随着算力继续增长释放出更大的空间。
只是,至少在现阶段,这些更重的底层投入,还没有完全转化成容易被普通消费者感知的新产品体验。
相比韶音直接推出 OpenFit 2 AI,并专门召开新品发布会切入市场,Anker 的选择也明显更加保守。AI 被继续放在 Liberty 原有的旗舰体系里,成为芯片、通话、降噪、AI Note-Taker 等一系列能力的一部分,而没有首先以一个独立的「AI 耳机」产品定义推向市场。
这并不意味着「向右」就是错误。
它更像是在押一个更长周期的问题:当端侧算力继续提升,当模型进一步压缩,当更多任务真正可以脱离手机和云端,一副耳机最终能够独立完成多少 AI 工作?
相比先进入市场,再在用户反馈里不断调整,Anker 选择的是先把底层能力做厚,再等待新的能力逐渐长出来。
这是「向右」。
从技术基座看,三种产品,为什么走成两条路?
如果继续往硬件下面看,「向左」为什么能够更轻、更快,「向右」为什么会变得更重,也会更加直观。
科大讯飞和韶音的共同点,是都没有为了这一代 AI 应用重新搭建整套耳机计算架构。耳机端首先负责拾音、降噪、录音、存储和蓝牙连接,复杂、更新速度又很快的翻译、转写、摘要和大模型服务,则更多交给手机、App 和云端。
Anker 则在蓝牙音频平台之外,又加入 Thus A1 存算一体 AI 芯片,为人声分离、主动降噪、声音增强和离线语音等任务提供专门的端侧 AI 算力。
三种产品,底层方案因此呈现出非常直观的差异:

从底层方案也可以看到,两条路线的差异并不只停留在产品功能:韶音、讯飞更多依赖成熟音频平台与外部算力,换取更快的落地和迭代;Anker 则增加专门的端侧 AI 算力,以更复杂的软硬件投入换取更多本地处理能力。
以上技术信息由我爱音频网结合公开资料及产品方案,拆解分析整理得出。
路线分叉,但「AI 耳机」确已成势
向左还是向右,现在显然还没有标准答案。
但路线分叉本身,恰恰说明「AI 耳机」已经越来越值得被当成一个真正的赛道来讨论。
此前所谓「AI 耳机」尴尬的地方,不是没人做,而是很难判断它究竟是不是一个独立的新品类。产品不少,AI 功能也不少,但在很多时候,它仍然更像传统耳机旁边外挂的一套 AI 服务,很难让消费者感受到一种足够清晰的新产品逻辑。
但现在,情况开始有所不同。
科大讯飞已经持续迭代多年;韶音正式把「AI」写进产品名,为此单独开一场发布会;另一边,Anker 没有高举「AI 耳机」的标签,却愿意花数年时间和资源,把面向音频 AI 的芯片真正做进旗舰耳机。
这些动作背后,已经不只是「要不要给耳机接一个大模型」。
一个新品类真正启动的信号,未必是所有厂商终于找到了同一个答案。但当越来越多有规模的玩家愿意投入资源,并开始押注不同路线,真正的竞争,可能已经开始了。

所以,今天讨论「左与右」,重点并不在于哪一种路线更正确,而是意识到——「AI 耳机」已经跨过了一个品类节点,从「要不要做」,走到了「应该怎么做」。
无论最终从哪一边走过去,一个新的增量窗口已经开始显现。
这样看来,未来的耳机市场会逐渐形成两个越来越清晰的品类:一边仍然是围绕音质、降噪、佩戴、续航和通话持续竞争的「传统耳机」;另一边,则是将 AI 作为核心产品定义、拥有独立应用和技术体系的「AI 耳机」。
而真正的问题,才刚刚开始。

AI 耳机最先应该解决哪些真实需求?云端大模型和端侧算力应该如何分工?当录音、翻译和总结逐渐成为基础能力,下一个能够真正拉开产品差距的应用又会是什么?当耳机开始拥有更多本地算力,芯片、模型、声学、算法和终端品牌之间,谁又会掌握下一代 AI 耳机更大的产品定义权?
现在,没有哪一条路线已经给出了终局答案。
也正因为如此,这些问题,正值得在 2026 世界 AI 耳机大会上被摆到同一张桌上讨论。

2026 年 12 月 3 日,由我爱音频网主办的 2026 世界 AI 耳机大会将在中国深圳科兴科学园 B 栋 4 单元会议中心举行。
从 AI 应用到端侧算力,从声学、麦克风和芯片,到大模型、Agent 与整机产品,当越来越多玩家开始从不同方向进入同一个赛道,AI 耳机的下一阶段,也不会只有一种答案。
路线已经分叉,而这场关于「AI 耳机究竟应该怎么做」的竞争,才刚刚开始。









