Paul Couvert(@itsPaulAi)· Paul Couvert (@itsPaulAi)·· 14 天前AI 评估 · 64/100分数表示内容值得关注的程度,依据实质份量、信息增量、证据强度、读者相关性和可用性,按内容类型加权。显示分数为两次独立评分的平均值。AI 判断可能有误,评分不代表事实已被核实,也不同于热点榜的讨论热度。
腾讯开源音频模型 Nano Banana 及更快的 flash 版本
Friendly reminder that we now have Nano Banana for audio And it's fully open source (models and dem...
AI 导读
作者提醒,现在有了音频版的 Nano Banana,模型和 demo 均已开源在 GitHub 与 Hugging Face 上,可实现秒级克隆声音、像编辑文本一样编辑音频、改变音色音调与情绪、去除口音、增强或分离人声,甚至加入咳嗽和笑声等效果。腾讯还发布了更快更小的 flash 变体。
来源:Paul Couvert(@itsPaulAi) · x.com