微软开源前沿语音 AI 家族 VibeVoice:支持 60 分钟长音频识别、90 分钟多说话人生成,GitHub 星标迅速突破 27.7K 微软开源了名为 VibeVoice 的前沿语音 AI 模型家族,覆盖 ASR(自动语音识别) 和 TTS(文本转语音) 等核心方向。根据 GitHub 仓库介绍,VibeVoice 被定义为一个包含 ... AIGC资讯AI工具推荐# ASR模型# TTS模型# VibeVoice 4个月前01190
清华大学与 OpenBMB 联合发布 UltraEval-Audio 开源音频模型评测框架 v1.1.0 人工智能音频领域迎来全新研究工具。由 清华大学 NLP 实验室、OpenBMB 以及 面壁智能(ModelBest) 联合研发的 UltraEval-Audio 框架现已正式开源。该框架为音频模型... AIGC资讯AI工具推荐# AI语音评测# OpenBMB# TTS模型 7个月前02360
通义百聆全面升级 | Fun-CosyVoice3 与 Fun-ASR 打造AI语音合成与识别新体验 在人工智能语音领域,通义百聆再次带来了重磅更新。本次发布中,阿里正式推出了 Fun-CosyVoice3 系列语音合成模型 与 Fun-ASR 系列语音识别模型 的全面升级,覆盖从语音克隆、情绪控... AIGC资讯AI工具推荐# AI语音合成# AI语音识别# ASR模型 8个月前02900
Qwen3-TTS语音合成模型解析:49种音色、10种语言与9种方言 在AI语音应用加速落地的今天,“更像真人、更稳定、更容易切换角色”的语音合成(TTS)正在成为教育内容生产、直播配音、智能客服与多语言出海产品的重要能力。近期,阿里巴巴推出 Qwen3-TTS,主... AIGC资讯AI工具推荐# Qwen3-TTS# TTS模型# 多角色语音 8个月前02530
超小的TTS模型Kitten TTS:参数仅1500万,适合各种设备部署 Kitten TTS是一款开源的轻量级文本转语音模型,其参数量仅为1500万,体积小于25MB,非常适合在各种设备上进行部署。该模型不仅支持无GPU运行,还能够在普通的CPU上实现高质量语音合成... AIGC资讯AI工具推荐# Kitten TTS# TTS模型# 开源TTS模型 12个月前01980