微软开源前沿语音 AI 家族 VibeVoice:支持 60 分钟长音频识别、90 分钟多说话人生成,GitHub 星标迅速突破 27.7K 微软开源了名为 VibeVoice 的前沿语音 AI 模型家族,覆盖 ASR(自动语音识别) 和 TTS(文本转语音) 等核心方向。根据 GitHub 仓库介绍,VibeVoice 被定义为一个包含 ... AIGC资讯AI工具推荐# ASR模型# TTS模型# VibeVoice 4个月前01180
阿里通义开源语音交互大模型 Fun-Audio-Chat-8B 实现超低延迟与情绪感知语音理解 阿里巴巴通义实验室正式开源新一代端到端语音交互大模型——Fun-Audio-Chat-8B,为语音AI应用赋能更加自然、流畅的语音交互体验。该模型专注于提升实时语音理解与回应的速度,同时具备先进的... AIGC资讯大模型# Fun-Audio-Chat-8B# 低延迟语音理解# 开源语音模型 7个月前03520
Maya1 开源语音模型发布:实时生成富有情感的语音,仅需单张 GPU 即可运行 Maya1:全新开源语音模型,开启实时富有表现力的文本转语音时代 AI 语音生成技术再迎新突破。Maya Research 团队近日发布了全新的开源文本转语音模型 Maya1。该模型拥有 30... AIGC资讯大模型# AI语音# Maya1# TTS 9个月前01930