Fish Audio(@FishAudio)· Fish Audio (@FishAudio)·· 12 天前AI 评估 · 37/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。
Fish Audio ASR 模型升级:区分说话人、识别情绪并标注 [laughter] 等情绪线索
Today, we're ending boring transcripts. Fish Audio’s ASR model now: → Identifies different speakers ...
AI 导读
Fish Audio 的 ASR 模型现可区分不同说话人、识别说话人情绪,并在转录文本中标注 [laughter]、[surprised] 等情绪线索。该模型支持 83 种语言,官方称其为目前最准确的 STT 模型。
来源:Fish Audio(@FishAudio) · x.com