Midjourney推出HD视频模式,专为专业人士打造高品质影像 Midjourney推出全新HD视频模式,提升专业视频生成质量 Midjourney近日推出了全新的HD视频模式,为专业用户提供了更高清、更高质量的视频生成工具。与传统的SD模式相比,HD模式... AIGC资讯AI工具推荐# AI视频生成# Midjourney HD视频模式# 视频清晰度提升 1年前02580
混元图像3.0图生图模型上线元宝:一句话就能p图 混元图像3.0模型补上了重要一块能力版图——支持图生图了。 1月26日,腾讯混元发布混元图像3.0图生图(HunyuanImage 3.0-Instruct)模型,支持图片编辑与多图融合,并在「元宝... AIGC资讯AI免费工具# AI图像编辑# HunyuanImage 3.0-Instruct# 图片生成模型 6个月前02570
美团首款 AI IDE 产品 CatPaw 开启公测 美团正式推出首款 AI IDE 产品 CatPaw(下文统一称为“CatPaw”),并开启公开测试。CatPaw 以 Agent & 人协作为核心,通过智能 Agent 驱动编程,结合代码... AIGC资讯AI工具推荐# AI IDE 公测# CatPaw AI IDE# LongCat 模型 8个月前02570
国产 AI 模型 Kimi K2 成功接入 Perplexity:与 GPT-5.1 同步上线,迈出国际化关键一步 国产大模型在全球舞台上迎来新的里程碑——Kimi K2 Thinking 模型正式接入全球知名 AI 搜索应用 Perplexity,成为目前唯一接入该平台的国产 AI 模型。这一举动不仅展示了国... AIGC资讯AI工具推荐# AI 搜索应用# Kimi K2# Kimi K2 Thinking 9个月前02570
百度 PaddleOCR-VL 模型登顶全球 OCR 榜,连续五日领跑 Huggingface 趋势榜 百度飞桨团队发布的 PaddleOCR-VL 模型在全球 OCR(光学字符识别)领域掀起了巨大的波澜。凭借其强大的性能、广泛的语言支持和文档语义重建能力,PaddleOCR-VL 在 OmniDo... AIGC资讯AI工具推荐# OCR技术# PaddleOCR-VL# 光学字符识别 9个月前02570
中国科大与字节跳动发布 MoGA 长视频生成模型:一分钟多镜头短片一键生成,助力全球AI竞赛 在全球 AI 竞争日益激烈的背景下,中国科学技术大学与字节跳动联合发布了具有突破性意义的 MoGA 长视频生成模型。这一端到端的生成模型采用了 MoGA 算法,能够在分钟级别内生成高质量的视频内容... AIGC资讯大模型# AI 视频生成# MoGA# 中国科学技术大学 9个月前02570
美图RoboNeo上线首月MAU破百万:吴欣鸿提出‘AI原生组织’理念,推动创新与效率并行 美图公司推出的AI应用——RoboNeo,自上线以来迅速走红,上线首月MAU突破百万,并成功进入多个国家的应用商店榜单前10名。这一成绩的背后,不仅是技术创新的成果,更是美图在组织结构与工作方式上... AIGC资讯AI工具推荐# AI创新工作室# AI原生组织# AI应用 10个月前02570
Adobe 正版全家桶可用 PS AI(创成式填充) 关于 PS填充功能购买 随着人工智能的迅速发展,对于创作而言,我们必须借助各种工具来实现创意的展现,比如PS的创造性填充等等。然而,这些功能通常需要购买正版会员才能享受。 但是,购买正版会员有时候也会... AI工具推荐# adobe# adobe正版 1年前02570
汇总10个优质MCP资源网站!值得收藏! 什么是 MCP? MCP(全称 The Model Context Protocol,模型上下文协议)是由 Anthropic 于 2024 年 11 月提出并开源的开放协议。MCP 能够实现大模... Mcp# MCP Server# MCP Servers# MCP协议 1年前02570
Kimi开源视觉语言模型双星:30亿参数轻量架构,多模态推理能力全面超越GPT-4o 1 小时前 0 10 编辑 Kimi-VL与Kimi-VL-Thinking:轻量化架构下的多模态推理新标杆 2025年4月,Kimi团队开源了视觉语言模型Kimi-VL及其推理增强版Kimi-VL... 大模型 1年前02570
超实用的免费 AI 工具网站!很赞! 一个爱代码的设计师在运营,不定时分享干货、学习方法、效率工具和AIGC趋势发展。个人网站:tomda.top 01. UIED在线免费AI工具箱 UIED是一个免费的在线工具集,包括ai工具箱免费但不... DeepSeek# deepseek# deepseek学习# deepseek本地部署 1年前02570
Vidu 推出 AI 一键生成 MV 功能,打造分钟级智能“虚拟制片厂”体验 一、Vidu 发布全新 AI MV 生成系统:开启智能视频创作新时代 AI 视频创作平台 Vidu 正式上线了全新的 AI 一键生成 MV 功能,标志着视频制作进入“分钟级自动生成”阶段。用户... AIGC资讯AI工具推荐# AI MV生成# AI多智能体系统# AI自动剪辑 7个月前02560
阿里万相2.6发布:支持“角色扮演”与多分镜控制,视频生成时长突破15秒上限 阿里巴巴正式发布 万相2.6 版本,这一全新升级的视频生成模型在功能、性能和创作自由度上均实现了显著提升。新版本引入了 “角色扮演”、多分镜控制、音画同步 等关键功能,单次视频生成时长更是提升至 ... AIGC资讯AI工具推荐# AI视频生成# 万相视频模型# 多分镜控制 8个月前02560
谷歌推出 Gemini 3 Deep Think 模式:推理能力大幅增强,复杂问题处理表现显著提升 谷歌正式发布 Gemini 3 Deep Think 模式,这是一次面向复杂推理任务的关键功能升级,为人工智能在数学、科学计算、符号推理、逻辑分析等领域带来了更强的处理能力。相比常规模式,Deep... AIGC资讯AI工具推荐# AI推理能力# ARC-AGI-2# Gemini 3 8个月前02560
2025 最佳 AI 代码编辑器推荐 人工智能正逐步改变代码编写、调试与管理的方式。如今主流代码编辑器均内置 AI 工具,可提供上下文感知的代码建议、实时调试辅助与协作功能,让编码更快速、简单且精准。无论你是编程初学者还是资深开发者... 大模型 11个月前02560
探索蓝心大模型BlueLM全方位AI开发者的高效利器 蓝心大模型BlueLM是由Vivo开发的一个领先的人工智能模型平台,专为开发者提供全面的服务和支持。此平台以其强大的语言理解和生成能力,支持多种编程语言和开发环境,以及丰富的模型库和开发工具,成为了A... 大模型# AI开发# 开发工具# 开发教程 1年前02560
美团重磅开源 6B 图像生成模型 LongCat-Image 美团 LongCat 团队正式开源了 LongCat-Image ——一款仅 6B 参数规模但性能对标大模型的新一代图像生成模型。尽管体量小巧,但其 图像编辑能力与 中文文字生成能力均达到了当前开... AIGC资讯AI工具推荐# 6B 图像生成模型# AI 图像编辑# Diffusion 模型 8个月前02550
Comfy Cloud公测开启!浏览器直连Stable Diffusion云端生成,AI图像创作进入“零门槛”时代 AI图像生成领域迎来新一轮普及热潮——Comfy Cloud正式开启公测。这一平台让用户无需高端显卡、无需安装复杂依赖,只需打开浏览器即可秒启Stable Diffusion创作。它不仅让AI绘画... AIGC资讯AI工具推荐# AI图像生成# AI绘画# Comfy Cloud 9个月前02550
SoulX-Podcast语音模型震撼发布:90分钟无中断播客生成,AI语音技术再升级 SoulX-Podcast语音模型的发布标志着AI语音技术在播客创作领域的一次重大突破。该模型通过其高保真音质、出色稳定性以及多语言支持,为播客内容创作者提供了前所未有的技术支持,带来了更加流畅和... AIGC资讯大模型# AI语音生成# SoulX-Podcast# 双语播客 9个月前02550
阿里通义千问开源Qwen-Image:突破性文生图模型助力图像生成与编辑 阿里通义千问近日开源了全新的文生图模型——Qwen-Image。该模型在文本渲染和图像编辑领域展现了巨大的技术突破,特别是在生成宫崎骏风格动漫场景和中文对联书法效果等方面,表现尤为出色。Qwen... 大模型# Qwen-Image# 图像生成# 图像编辑 1年前02550
OpenAI发布ChatGPT Agent:AI助理自主浏览、购物、做PPT,提升工作效率 OpenAI近日正式推出了ChatGPT Agent,标志着人工智能技术在任务执行上的重大飞跃。从简单的对话助手到现在能够自主完成复杂任务,ChatGPT Agent使得AI不仅能够回答问题,还能... 大模型# ChatGPT Agent# OpenAI# 人工智能 1年前02550
支付宝推出国内首个“AI打赏”服务,推动AI开发者收款便捷化 随着人工智能的飞速发展,AI开发者正面临着越来越多的商业化机会和挑战。为了支持这一发展趋势,支付宝最近宣布推出国内首个“AI打赏”服务,旨在为AI开发者提供便捷的收款解决方案。通过这一创新举措,开发者... 大模型# AI 开发者# AI 打赏# 支付宝 1年前02550
悟道·天鹰Aquila大语言模型 悟道·天鹰Aquila大语言模型是由智源研究院开发的一系列先进的人工智能模型,专注于提供强大的语言理解和生成能力。近期,智源研究院宣布悟道·天鹰Aquila系列全面升级到Aquila2,并新增了340... 大模型# Aquila2# 代码生成# 大语言模型 1年前02550
阿里Mobile-Agent-v3发布:GUI自动化领域迎来跨时代突破,开源多模态虚拟层GUI-Owl 阿里Mobile-Agent-v3横空出世!GUI自动化领域迎来跨时代突破 阿里巴巴发布了第三代GUI智能体框架——Mobile-Agent-v3,并推出了开源的多模态跨平台GUI虚拟层模型G... AIGC资讯AI工具推荐# GUI自动化# Mobile-Agent-v3# 多模态感知 12个月前02540
腾讯发布混元3D世界模型1.0,AI重塑虚拟世界未来 在2025世界人工智能大会上,腾讯震撼发布了其最新的混元3D世界模型1.0,并宣布该模型全面开源。该模型具备高精度的360°场景生成和可交互漫游功能,为3D内容创作、游戏开发、虚拟现实(VR)以及... AI工具推荐大模型# 3D世界模型# 可交互漫游# 混元3D 1年前02540
DeepSeek助力论文写作:10条实用指令全面解析 一、标题 指令:提供研究的核心内容、关键词和创新点。 示例: “我是【XX专业】学生,想研究[XX领域],请推荐5个创新且可行的论文选题,要求结合近3年研究热点,并附上每个选题的研究意义和可能的创新点... DeepSeek# deepseek# deepseek学习# deepseek本地部署 1年前02540
TapNow:面向企业与创作者的 AI视觉创作引擎,快速生成专业级视觉内容 TapNow 是一款面向企业和创作者的 AI视觉创作引擎,适用于电商广告、电影级短片与实验艺术创作,帮助用户高效生成专业级视觉内容。立即了解 TapNow 的核心能力与应用场景。链接:https... AIGC资讯AI工具推荐# +AI创作工具# AI广告制作# AI视觉创作 5个月前02530
Qwen3-TTS语音合成模型解析:49种音色、10种语言与9种方言 在AI语音应用加速落地的今天,“更像真人、更稳定、更容易切换角色”的语音合成(TTS)正在成为教育内容生产、直播配音、智能客服与多语言出海产品的重要能力。近期,阿里巴巴推出 Qwen3-TTS,主... AIGC资讯AI工具推荐# Qwen3-TTS# TTS模型# 多角色语音 8个月前02530
Z-Image-Turbo-Fun-Controlnet-Union 提升图像生成控制力与兼容性 Z-Image-Turbo-Fun-Controlnet-Union 模型 强化图像生成中的可控性与效率 阿里通义实验室推出的 Z-Image-Turbo-Fun-Controlnet-Uni... AIGC资讯AI工具推荐# ControlNet# Z-Image-Turbo-Fun-Controlnet-Union# 图像生成 8个月前02530
月之暗面推出 Kimi Linear 架构:长上下文处理速度大幅提升 月之暗面(Moonshot AI)**发布的新一代长上下文架构 Kimi Linear 正式登场。在超长输入与实时推理场景中,Kimi Linear 通过 KDA(Kimi Delta Atten... AIGC资讯大模型# KDA# Kimi Delta Attention# Kimi Linear 9个月前02530
中国电信开源TeleChat3国产千亿MoE大模型:全栈自研,支持思考模式,实力对标国际顶尖 中国电信人工智能研究院(TeleAI)正式宣布开源 星辰语义大模型TeleChat3系列,这是一款基于全国产算力体系训练的 千亿参数细粒度MoE(Mixture of Experts)模型,在性能... AIGC资讯AI工具推荐# MoE模型# TeleChat3# Thinking模式 7个月前02520
微软 Copilot 升级 GPT-5.2,AI工作流进入专家级智能办公新时代 微软正式宣布将最新的 GPT-5.2 模型 接入其全系 Copilot 助手 产品中,为用户带来更高效、更精准的智能办公体验。此次升级标志着 Copilot 迈入 深度逻辑推理与复杂任务处理的新阶... AIGC资讯AI工具推荐# AI 办公自动化# GPT 模型# GPT-5.2 7个月前02520
阿里推出全模态大模型 Qwen3-Omni-Flash:支持实时流式输出与 119 种语言交互的多场景 AI 能力解析 阿里正式发布 Qwen3-Omni-Flash,这是一款面向多模态智能交互的全场景大模型。根据官方介绍 ,Qwen3-Omni-Flash 支持文本、语音、图像等多种输入方式,并具备实时流式输出能... AIGC资讯大模型# 119种语言支持# AI直播助手# Qwen3-Omni-Flash 8个月前02520
阿里通义千问 Qwen3-Max 正式上线“深度思考”模式:万亿参数模型重塑AI推理能力 阿里巴巴旗下的 通义千问团队 正式发布新一代旗舰语言模型 Qwen3-Max,并同步上线“深度思考(Thinking)”模式。这一版本在参数规模、推理能力、编程性能等方面实现全面升级,标志着中国大... AIGC资讯大模型# Qwen3-Max# 万亿参数模型# 深度思考模式 9个月前02520
OpenAI 发布 ChatGPT Atlas 浏览器:AI Agent 模式开启智能浏览新时代 OpenAI 正式发布全新浏览器 ChatGPT Atlas,这款产品标志着 ChatGPT 从聊天助手迈向全面互联网操作平台。Atlas 将 AI 融入浏览体验的每个角落:无论是网页阅读、数据分... AIGC资讯AI工具推荐# Agent 模式# AI浏览器# ChatGPT Atlas 10个月前02520
苹果FS-DFM模型发布:AI长文本写作效率提升128倍,打破生成瓶颈 苹果公司与俄亥俄州立大学的研究团队联合发布了全新的FS-DFM模型,这项技术革新在AI长文本生成领域展现了巨大潜力。通过这一模型,仅需8轮迭代便可生成高质量的文本,相比于传统模型需要千轮迭代的生成过程... AIGC资讯大模型# AI长文本生成# FS-DFM# 写作效率 10个月前02520
京东自研「京点点AI文案」全新上线,3秒快速生成高效文案,全面提升营销效率 随着数字营销的不断发展,商家在内容创作上面临的挑战也日益增加。如何在短时间内高效生成优质文案,并精准吸引目标用户,成为了商家成功营销的关键。京东近日推出了全新自研的**「京点点AI文案」**工具... AIGC资讯AI工具推荐# AI文案创作# 京东文案工具# 京点点AI文案 11个月前02520
紫东太初 紫东太初是由中国科学院自动化研究所和武汉人工智能研究院联合推出的新一代多模态大模型,凭借其强大的功能和广泛的应用场景,成为人工智能领域的焦点。本文将为您详细介绍紫东太初的功能、官网访问方法以及常见问题... 大模型# 中科院大模型# 多模态大模型# 官网访问 1年前02520
腾讯混元3D Studio 1.2 开启公测:新增笔刷交互与八视图生成,提升3D建模精度 一、腾讯混元3D Studio 1.2 正式公测,3D生成能力全面升级 腾讯正式发布 混元3D Studio 1.2 并开启公测。本次版本升级围绕“可控性、结构准确性与视觉质量”三大核心方向... AIGC资讯AI工具推荐# 3D生成工具# AI 3D建模# 八视图生成 7个月前02510
Mugen3D——AI驱动的3D建模新突破,仅凭一张图片生成逼真三维世界 一、Mugen3D简介:AI建模进入高保真时代 Mugen3D 是一款基于人工智能与3D高斯溅射(3D Gaussian Splatting)技术的全新建模工具。它能够仅凭一张普通图片,生成具... AIGC资讯AI工具推荐# 3D建模工具# 3D高斯溅射# AI三维模型 7个月前02510
MiniMax M2.1开源模型发布:100亿参数编码AI登顶多语言SOTA,性能超越Gemini3Pro与Claude 4.5 近日,MiniMax M2.1开源编码大模型正式发布,凭借100亿激活参数,在多语言编程和真实工程任务中表现出色,全面超越闭源模型如谷歌Gemini3Pro、Anthropic Claude 4... AIGC资讯AI工具推荐# Go AI开发# Java AI模型# JavaScript代码生成 7个月前02510
字节跳动发布 Seed Prover1.5:推动形式化数学推理的新进展 在人工智能与数学领域的融合日益深入的今天,字节跳动Seed团队再度带来了重要突破——全新版本的Seed Prover1.5正式发布。这一版本在形式化数学推理与自动定理证明方向取得了显著进展,为AI... AIGC资讯大模型# Agentic Prover# Seed Prover# 人工智能 7个月前02510
月之暗面推出开源AI代理开发框架Kosong1异步编排与插件化设计赋能开发者更高自由度 月之暗面推出Kosong框架:开源AI代理的全新解决方案 月之暗面(MoonshotAI)近日推出了其备受期待的开源AI代理开发框架——Kosong。该框架为开发者提供了更高效、灵活的AI应用... AIGC资讯AI工具推荐# AI工具# AI框架# Python开发 9个月前02510
微软发布首款自家研发AI模型MAI-Voice-1和MAI-1-preview,与OpenAI竞争 微软推出首款自主研发AI模型MAI-Voice-1与MAI-1-preview,强力挑战OpenAI 在全球人工智能技术激烈竞争的背景下,微软再次展现其技术创新能力,推出了两款自家研发的AI模... AIGC资讯AI工具推荐# Copilot Daily# MAI-1-preview# MAI-Voice-1 11个月前02510
国产AI炸场!Seko一键生成爆火短视频,创作变得轻松无比 国产AI大模型Seko:一分钟创作爆火短视频,解锁视频创作新体验 你能想象吗?仅凭一个创意想法,就能快速生成最近爆火的短片?这正是商汤科技旗下的国产AI大模型Seko所带来的创新——只需简单的... AIGC资讯AI工具推荐# AI视频创作# Seko# 一键生成短视频 1年前02510
左医医疗大语言模型!医疗健康领域的AI语言处理革新 在医疗健康领域,高效、精准的语言处理技术对于提升服务质量至关重要。左医医疗大语言模型,由北京左医科技有限公司开发,专注于医疗健康领域,通过先进的AI技术提供高质量的医疗语言处理服务,为医疗工作者提供了... 大模型# 北京左医科技# 医疗AI# 左医医疗大语言模型 1年前02510
美图奇想大模型!AI视觉技术推动创意产业效率与质量提升 美图奇想大模型是一个专注于美学与创意表现的AI视觉技术平台,通过人工智能技术为用户提供多样化的图像和视频效果生成服务,助力各行各业提升创意工作的效率与质量。本文将详细介绍其功能、特点以及在多个行业中的... 大模型# AI视觉技术# 创意产业优化# 图像生成 1年前02510
飞书多维表格!提升团队协作与决策精准度的高效应用 在当今数字化办公环境中,协作和数据管理成为提高工作效率和精准决策的关键因素。飞书多维表格作为一款新一代的效率应用,结合了在线表格、数据管理与分析、高项目管理软件效协作和可视化功能,业务决策是什么意... AIGC资讯AI工具推荐# 企业管理系统# 数据分析工具# 数据可视化 9个月前02500
在线生成风格化字符图案工具:轻松将图像转为字符艺术 在线生成风格化图案工具是一款功能强大的图像转字符艺术工具,用户只需上传图像,便可将其转化为具有风格化效果的字符图案。该工具提供了三种不同的配色风格,支持字符、颜色、颗粒度等多种设置,帮助用户创造出... AIGC资讯AI工具推荐# 图像转字符# 图像转艺术# 在线生成字符图案工具 12个月前02500
腾讯混元T1与DeepSeek V3最新版发布:智能技术再升级,秒级响应引领AI未来 腾讯科技近日正式发布了混元T1正式版和DeepSeek V3最新版,这标志着其在深度学习和人工智能领域取得了新的突破。新版本的推出在速度和性能上进行了全面优化,能够实现秒级响应,显著提升了用户体验,适... 大模型# DeepSeek V3# 人工智能# 智能技术支持 1年前02500
DeepSeek高性能AI模型,专业面向数学、编程与逻辑推理 在人工智能技术的浪潮中,DeepSeek凭借其强大的模型性能和多领域应用能力,赢得了广泛关注。作为一款开源的大型语言模型,DeepSeek不仅在数学、编程和逻辑推理等专业领域表现出色,还通过丰富的AP... 大模型 1年前02500
通义千问开源Qwen3-Coder:顶尖AI编程大模型,助力智能编程技术突破 阿里云近日宣布其最新的AI编程大模型Qwen3-Coder全面开源。这一模型在代码生成和智能Agent能力上达到了顶尖水平,为智能编程技术带来了新的突破。作为继承了先进MoE架构和强大上下文处理能... AI工具推荐大模型# AI编程大模型# MoE架构# Qwen3-Coder 1年前02490
影视级TTS神器——IndexTTS2!零样本克隆+情绪控制 在语音合成技术领域,IndexTTS2的发布标志着一场革命性的突破。这款文本转语音(TTS)模型不仅具备了传统TTS技术所无法比拟的强大功能,还在零样本语音克隆、情绪控制等方面取得了显著进展。无论是在... AI工具推荐大模型# IndexTTS2# TTS技术# 情绪控制 1年前02490
腾讯混元T1-Vision技术升级|深度图文理解标杆|多模态AI助手「元宝」专业评测 功能体验通道:hunyuan.tencent.com 讯研究院携Hunyuan T1-Vision大模型推出革命性多模态AI工具「元宝」,其视觉语义解析系统采用动态关联注意力机制,实现跨模态信息耦合度... 大模型# 多模态AI助手# 腾讯混元T1 1年前02490
新一代多模态AI DeepEyesV2:智能工具助力超越更大模型的突破 随着多模态AI技术的不断发展,DeepEyesV2 作为一款最新的多模态AI模型,凭借其卓越的图像理解、代码执行与网络搜索能力,正逐渐在AI领域引起广泛关注。由一支研究团队推出,DeepEyesV... AIGC资讯大模型# AI模型# DeepEyesV2# 图像理解 9个月前02480
告别文字乱码!全新文生图模型Qwen-Image来咯 我们很高兴开源 Qwen-Image,一个20B的MMDiT模型。这是通义千问系列中首个图像生成基础模型,其在复杂文本渲染和精确图像编辑方面取得了显著进展。 Qwen-Image的主要特性包括: ... 大模型 1年前02480
腾讯混元Hunyuan3D-PolyGen:首个美术级3D生成大模型,提升建模效率超70% 在3D建模领域,传统生成算法面临着布线质量差、面数过高以及后期编辑困难等挑战。为了解决这些问题,腾讯混元3D团队推出了业界首个美术级3D生成大模型——Hunyuan3D-PolyGen。这一创新模型结... AI工具推荐大模型 1年前02480
隐形AI桌面助手Glass:开源智能记录,提升工作与生活效率 在智能助手不断发展的今天,Glass 作为一款开源的AI桌面助手,带来了前所未有的工作效率提升。这款由 Pickle团队 开发的工具,专为 macOS 系统设计,轻量且快速运行于后台,几乎不占用系统资... AI工具推荐 1年前02480
美团推出 SOTA 级虚拟人视频生成模型 LongCat-Video-Avatar 美团 LongCat 团队近日推出了 SOTA 级虚拟人视频生成模型 LongCat-Video-Avatar,该模型在长视频生成领域表现优异,尤其是在动作拟真、长视频稳定性和身份一致性方面,展现... AIGC资讯大模型# Cross-Chunk Latent Stitching# LongCat-Video# 美团 LongCat-Video-Avatar 8个月前02470
阶跃发布端到端语音大模型Step-Audio2mini,超越多款开源模型 阶跃星辰发布Step-Audio2mini:革命性的端到端语音大模型 阶跃星辰近日发布了其最新的端到端语音大模型——Step-Audio2mini,这款模型在多个国际基准测试中取得了SOTA... AIGC资讯AI工具推荐# Step-Audio2mini# 语音大模型# 语音识别 11个月前02470