ElevenLabs 与 Banner Health 合作,用 AI 语音智能体接听患者来电
ElevenLabs 与 Banner Health 达成合作,用 AI 语音智能体接听患者来电,首批覆盖初级保健预约场景。患者可全天候致电,ElevenAgents 直接在 Banner 的电子病历中完成预约、改期或取消;需要人工时,通话会连同必要上下文转接给 Banner 团队成员。
ElevenLabs 与 Banner Health 达成合作,用 AI 语音智能体接听患者来电,首批覆盖初级保健预约场景。患者可全天候致电,ElevenAgents 直接在 Banner 的电子病历中完成预约、改期或取消;需要人工时,通话会连同必要上下文转接给 Banner 团队成员。
Apple 将于 10 月 13 日举办以智能家居为主题的“Welcome home”发布会,据报道首款智能屏“HomePad”将登场,配备 6 英寸方形屏幕,可接 HomePod mini 式音箱或壁挂使用,主要靠 Siri AI 交互。
Voice Arena 发布 Monsoon ASR 语料库,目前已覆盖 50 种语言、100,000 小时数据,其中多为长尾语言,计划 2027 年底扩展到 1,000 种语言。
荷兰Eevi、美国Aristotle与印度YoLearn.ai接连完成Pre-seed至种子轮融资,均把"语音优先"放于产品核心。波士顿大学一项随机实验显示,语音模式下学生对话密度约为文字模式的1.8倍、提问次数约2.4倍,但五周内两种模式的学习掌握程度无显著差异,且语音成本约为文字的2.8倍。
ElevenLabs 在班加罗尔峰会上与印度一个邦政府签署首份 MOU,试点语音 AI。过去一年印度的 1 亿多次 ElevenAgents 对话中,超 70% 使用 Hindi、Kannada、Tamil 和 Telugu 四种语言。本次峰会聚集 500 多位企业领导者、开发者和合作伙伴。
a16z 的 Angela Strange 与 Valon 的 Andrew Wang、Linda Du 对谈,讨论如何重建仍依赖互联网前系统的 13 万亿美元抵押贷款市场基础设施。
ElevenLabs 宣布获得 FedRAMP 20x Class A 认证,该认证覆盖 ElevenAgents 及 Text to Speech、Speech to Text API,需在 Zero Retention Mode 与美国数据驻留下运行。
NVIDIA CEO Jensen Huang 将于 11 月 11 日出席 ElevenLabs Summit NYC,与 ElevenLabs 的 Mati 就 AI 的未来展开对谈。NVIDIA 自 ElevenLabs 创立初期便与其合作,ElevenLabs 称这一合作是其持续推动语音与音频 AI 能力的重要部分。
Genspark 已选择 Soniox 作为其语音转文字供应商。Soniox 提供覆盖 60+ 种语言的母语级准确率、超低延迟,并在人名、数字和 ID 上具备较强精度。语音正成为 Genspark 用户交互的关键部分,涵盖语音驱动的 AI、会议记录和自主电话呼叫。
NVIDIA 与 Meta 团队合作提升了 Muse Realtime Avatar 的模型效率,让虚拟形象在实时对话时能够跟上节奏。Meta 在 Connect 大会上发布 Muse Realtime Avatar,这项实时化身技术将 Muse Realtime Voice 转化为可表达、可交互的虚拟形象,并为 Muse 带来实时对话等全新交互方式。
iRTE2026 实时智能大会将于 10 月 23 日至 24 日在北京悠唐皇冠假日酒店举行,并设置“企业级客服智能体专场”,邀请声网、冠客科技、美团、阿里、MiniMax 等企业探讨客服智能体从“能对话”迈向“能办事、能转化、能增长”。
Fish Audio 与 @covaldev 在旧金山重启 Voice AI Builder Dinner,活动定于 9 月 22 日,面向创始人及产品负责人。参与者将围绕医疗、客户支持等对可靠性要求极高的场景,交流构建语音 AI 过程中最难的部分。
语音识别领域的竞争正在升温,Google、Meta 和 Microsoft 正通过发布新的强力模型争夺头名位置。DeepLearning.AI 在 The Batch 中解读了这一趋势对 AI 开发者的意义,指出在生成式文本模型占据话题中心的当下,语音识别正迎来属于自己的时刻。
Fish Audio CEO @rissa_cao 拆解了团队如何标注与评估情感语音数据中的细微差别,让模型在对话推进过程中保留语气和表达方式的变化。其核心观点是,有表现力的语音不只是情绪本身,更是在恰当的时刻给出恰当的情绪。
Fish Audio 本月在东京品川、惠比寿和虎之门 Hills 上线通勤场景广告,乘客可能在通勤途中看到。该消息由 Fish Audio 官方账号发布,并附带视频。
Latent.Space 与 @realbasilchatha 合作推出新的 Forward Deployed Engineering 播客栏目。
Mistral 宣布与 HUMAIN 达成战略合作,覆盖 AI 基础设施、先进模型开发以及在沙特及周边地区的 AI 解决方案部署。双方将共同开发本地化前沿 AI 模型,初期聚焦网络安全、语音,以及在阿拉伯语上表现强劲的模型。
Fish Audio 成立一年即达到 $21M ARR、8M 用户,并完成 $52M 种子轮融资。团队称当初被普遍认为入局语音 AI 太晚,但结果证明并非如此,目前正招募 GTM 与企业销售岗位。
MiniMax 官方发文称 H3 开源一周内已在 Hugging Face 衍生出接近 300 个模型,ComfyUI 版本下载量近 700 万。社区把约 60B 参数、BF16 下需约 120GB 内存的 H3 压缩到 42.5GB 以在消费级显卡本地推理,Redis 作者 antirez 还为其编写了面向 Apple Silicon 的原生引擎 h3.c。
Bland 完成 1 亿美元 C 轮融资,将用于继续训练其语音模型,以应对高风险、长达 45 分钟的关键企业电话。其称语音 AI 的真正图灵测试不在两分钟客服通话,而在能否撑起 45 分钟的高风险企业级对话。
播客「牛油果烤面包」第151期与前 iOS 工程师 Shihang 一起聊 WWDC26,逐项点评 macOS Golden Gate、Liquid Glass、Spotlight、Apple Intelligence、Siri AI、App Intents、Shortcuts、Safari、照片、iCloud 以及儿童账号与屏幕使用时间等更新,并讨论了 AI 使用场景。