阿里通义开源语音交互大模型 Fun-Audio-Chat-8B 实现超低延迟与情绪感知语音理解 阿里巴巴通义实验室正式开源新一代端到端语音交互大模型——Fun-Audio-Chat-8B,为语音AI应用赋能更加自然、流畅的语音交互体验。该模型专注于提升实时语音理解与回应的速度,同时具备先进的... AIGC资讯大模型# Fun-Audio-Chat-8B# 低延迟语音理解# 开源语音模型 7个月前03540
阿里通义 Qwen3-VL 系列新增 2B 与 32B 模型尺寸:视觉语言理解扩展至手机端 阿里通义千问 推出的视觉语言模型系列 Qwen3‑VL 再添新成员——新增 2 B 和 32 B 两种参数规模,进一步扩大了其在视觉语言理解任务中的应用范围。新的模型尺寸让手机端等资源受限设备也能... AIGC资讯大模型# 2B 模型# Qwen3-VL# 多模态模型 10个月前03190
阿里通义Qwen3-Omni全模态大模型登顶Hugging Face全球第一,7款模型包揽前十 阿里通义团队的最新成果引起了全球关注——他们的7款模型在Hugging Face全球开源模型榜单中表现卓越,尤其是Qwen3-Omni,作为一款全模态大模型,凭借其强大的音视频处理能力以及稳定的文... AIGC资讯AI工具推荐# Hugging Face# Qwen3-Omni# 全模态大模型 10个月前02860