跳到正文

#语音

今日 0 条
10月9日周五
  1. ElevenLabs(@elevenlabsio)AI 评估 · 19/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs 与 Banner Health 合作,用 AI 语音智能体接听患者来电

    ElevenLabs 与 Banner Health 达成合作,用 AI 语音智能体接听患者来电,首批覆盖初级保健预约场景。患者可全天候致电,ElevenAgents 直接在 Banner 的电子病历中完成预约、改期或取消;需要人工时,通话会连同必要上下文转接给 Banner 团队成员。

  2. 国际大厂AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Apple 10 月 13 日“Welcome home”发布会前瞻:首款智能屏 HomePad 领衔

    Apple 将于 10 月 13 日举办以智能家居为主题的“Welcome home”发布会,据报道首款智能屏“HomePad”将登场,配备 6 英寸方形屏幕,可接 HomePod mini 式音箱或壁挂使用,主要靠 Siri AI 交互。

  3. AI Breakfast(@AiBreakfast)AI 评估 · 52/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Voice Arena 发布覆盖 50 种语言的 Monsoon ASR 语料库

    Voice Arena 发布 Monsoon ASR 语料库,目前已覆盖 50 种语言、100,000 小时数据,其中多为长尾语言,计划 2027 年底扩展到 1,000 种语言。

10月8日周四
  1. 多知AI 评估 · 33/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    三家语音优先教育AI公司接连融资,AI开始"开口教学"?

    荷兰Eevi、美国Aristotle与印度YoLearn.ai接连完成Pre-seed至种子轮融资,均把"语音优先"放于产品核心。波士顿大学一项随机实验显示,语音模式下学生对话密度约为文字模式的1.8倍、提问次数约2.4倍,但五周内两种模式的学习掌握程度无显著差异,且语音成本约为文字的2.8倍。

10月7日周三
  1. ElevenLabs(@elevenlabsio)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs 与印度一邦政府签署首份 MOU,试点语音 AI

    ElevenLabs 在班加罗尔峰会上与印度一个邦政府签署首份 MOU,试点语音 AI。过去一年印度的 1 亿多次 ElevenAgents 对话中,超 70% 使用 Hindi、Kannada、Tamil 和 Telugu 四种语言。本次峰会聚集 500 多位企业领导者、开发者和合作伙伴。

  2. a16z(@a16z)AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    a16z 对话 Valon:如何用 AI 重建 13 万亿美元抵押贷款市场的基础设施

    a16z 的 Angela Strange 与 Valon 的 Andrew Wang、Linda Du 对谈,讨论如何重建仍依赖互联网前系统的 13 万亿美元抵押贷款市场基础设施。

10月3日周六
  1. ElevenLabs(@elevenlabsio)AI 评估 · 36/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    ElevenLabs 获 FedRAMP 20x Class A 认证,语音 AI 可进入美国政府机构

    ElevenLabs 宣布获得 FedRAMP 20x Class A 认证,该认证覆盖 ElevenAgents 及 Text to Speech、Speech to Text API,需在 Zero Retention Mode 与美国数据驻留下运行。

10月1日周四
  1. ElevenLabs(@elevenlabsio)AI 评估 · 12/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Jensen Huang 将出席 ElevenLabs Summit NYC,与 Mati 对谈 AI 未来

    NVIDIA CEO Jensen Huang 将于 11 月 11 日出席 ElevenLabs Summit NYC,与 ElevenLabs 的 Mati 就 AI 的未来展开对谈。NVIDIA 自 ElevenLabs 创立初期便与其合作,ElevenLabs 称这一合作是其持续推动语音与音频 AI 能力的重要部分。

9月30日周三
  1. Genspark(@genspark_ai)AI 评估 · 18/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Genspark 选择 Soniox 作为其语音转文字供应商

    Genspark 已选择 Soniox 作为其语音转文字供应商。Soniox 提供覆盖 60+ 种语言的母语级准确率、超低延迟,并在人名、数字和 ID 上具备较强精度。语音正成为 Genspark 用户交互的关键部分,涵盖语音驱动的 AI、会议记录和自主电话呼叫。

9月28日周一
  1. NVIDIA AI(@NVIDIAAI)AI 评估 · 47/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    NVIDIA 与 Meta 合作优化 Muse Realtime Avatar 模型效率

    NVIDIA 与 Meta 团队合作提升了 Muse Realtime Avatar 的模型效率,让虚拟形象在实时对话时能够跟上节奏。Meta 在 Connect 大会上发布 Muse Realtime Avatar,这项实时化身技术将 Muse Realtime Voice 转化为可表达、可交互的虚拟形象,并为 Muse 带来实时对话等全新交互方式。

9月21日周一
  1. 甲子光年AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    客服智能体走到“上岗”前夜,企业还要跨过几道门槛?|iRTE2026 企业级客服智能体专场

    iRTE2026 实时智能大会将于 10 月 23 日至 24 日在北京悠唐皇冠假日酒店举行,并设置“企业级客服智能体专场”,邀请声网、冠客科技、美团、阿里、MiniMax 等企业探讨客服智能体从“能对话”迈向“能办事、能转化、能增长”。

9月18日周五
  1. Fish Audio(@FishAudio)AI 评估 · 5/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fish Audio 与 Coval 在旧金山重启 Voice AI Builder Dinner,9 月 22 日举办

    Fish Audio 与 @covaldev 在旧金山重启 Voice AI Builder Dinner,活动定于 9 月 22 日,面向创始人及产品负责人。参与者将围绕医疗、客户支持等对可靠性要求极高的场景,交流构建语音 AI 过程中最难的部分。

9月16日周三
  1. DeepLearning.AI(@DeepLearningAI)AI 评估 · 16/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Google、Meta、Microsoft 竞逐语音识别头名,The Batch 解读对 AI 开发的影响

    语音识别领域的竞争正在升温,Google、Meta 和 Microsoft 正通过发布新的强力模型争夺头名位置。DeepLearning.AI 在 The Batch 中解读了这一趋势对 AI 开发者的意义,指出在生成式文本模型占据话题中心的当下,语音识别正迎来属于自己的时刻。

9月11日周五
  1. Fish Audio(@FishAudio)AI 评估 · 13/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fish Audio CEO 拆解情感语音模型的数据标注与评估方法

    Fish Audio CEO @rissa_cao 拆解了团队如何标注与评估情感语音数据中的细微差别,让模型在对话推进过程中保留语气和表达方式的变化。其核心观点是,有表现力的语音不只是情绪本身,更是在恰当的时刻给出恰当的情绪。

9月10日周四
  1. Fish Audio(@FishAudio)AI 评估 · 15/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fish Audio 广告本月登陆东京品川、惠比寿与虎之门 Hills

    Fish Audio 本月在东京品川、惠比寿和虎之门 Hills 上线通勤场景广告,乘客可能在通勤途中看到。该消息由 Fish Audio 官方账号发布,并附带视频。

8月26日周三
  1. Latent.Space(@latentspacepod)AI 评估 · 23/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Latent.Space 推出 Forward Deployed Engineering 播客,首期聚焦企业级语音智能体

    Latent.Space 与 @realbasilchatha 合作推出新的 Forward Deployed Engineering 播客栏目。

8月25日周二
  1. Mistral AI(@MistralAI)AI 评估 · 29/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Mistral 与 HUMAIN 达成战略合作,共建沙特本地化前沿 AI 模型

    Mistral 宣布与 HUMAIN 达成战略合作,覆盖 AI 基础设施、先进模型开发以及在沙特及周边地区的 AI 解决方案部署。双方将共同开发本地化前沿 AI 模型,初期聚焦网络安全、语音,以及在阿拉伯语上表现强劲的模型。

8月18日周二
  1. Fish Audio(@FishAudio)AI 评估 · 40/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    Fish Audio 一周年:ARR 达 $21M、8M 用户,并完成 $52M 种子轮

    Fish Audio 成立一年即达到 $21M ARR、8M 用户,并完成 $52M 种子轮融资。团队称当初被普遍认为入局语音 AI 太晚,但结果证明并非如此,目前正招募 GTM 与企业销售岗位。

8月12日周三
  1. MiniMax 稀宇科技AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    MiniMax H3 开源一周衍生近 300 个模型

    MiniMax 官方发文称 H3 开源一周内已在 Hugging Face 衍生出接近 300 个模型,ComfyUI 版本下载量近 700 万。社区把约 60B 参数、BF16 下需约 120GB 内存的 H3 压缩到 42.5GB 以在消费级显卡本地推理,Redis 作者 antirez 还为其编写了面向 Apple Silicon 的原生引擎 h3.c。

6月23日周二
  1. AI Breakfast(@AiBreakfast)AI 评估 · 25/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    语音 AI 的真正图灵测试:能否撑住 45 分钟高风险企业通话,Bland 完成 1 亿美元 C 轮融资

    Bland 完成 1 亿美元 C 轮融资,将用于继续训练其语音模型,以应对高风险、长达 45 分钟的关键企业电话。其称语音 AI 的真正图灵测试不在两分钟客服通话,而在能否撑起 45 分钟的高风险企业级对话。

6月15日周一
  1. 牛油果烤面包AI 评估 · 22/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。

    播客唠 WWDC26:Apple Intelligence、Siri AI 与 Liquid Glass

    播客「牛油果烤面包」第151期与前 iOS 工程师 Shihang 一起聊 WWDC26,逐项点评 macOS Golden Gate、Liquid Glass、Spotlight、Apple Intelligence、Siri AI、App Intents、Shortcuts、Safari、照片、iCloud 以及儿童账号与屏幕使用时间等更新,并讨论了 AI 使用场景。