腾讯混元开源Hunyuan-GameCraft:高动态交互式游戏视频生成框架 腾讯混元推出Hunyuan-GameCraft:游戏视频生成框架 腾讯混元团队推出的 Hunyuan-GameCraft 是一款基于 HunyuanVideo底模 的 高动态交互式游戏视频生成... AIGC资讯AI工具推荐# Hunyuan-GameCraft# 动态交互视频# 游戏视频生成 12个月前03620
Belin Doc强大的免费AI文档翻译工具 Belin Doc 是一款 免费的AI文档翻译工具,无需注册或登录即可使用,支持多种主流大语言模型(如 Claude、GPT 等)。此工具设计简便,旨在提供快捷、精准的文档翻译服务,并注重用户隐私... AI工具推荐# Belin Doc# Claude翻译# GPT翻译 12个月前02820
官方否认DeepSeek-R2模型8月发布计划,性能优化仍在进行中 DeepSeek-R2模型发布计划被否认 关于 DeepSeek-R2模型 的8月发布计划,官方已经进行了明确的否认。此前有传言称,DeepSeek-R2 模型将于 8月15日至30日 之间发... AIGC资讯AI工具推荐# DeepSeek-R2# DeepSeek模型# 代码生成 12个月前02610
腾讯混元发布52B参数Large-Vision模型:支持任意分辨率全场景输入的多模态理解模型 腾讯混元Large-Vision:全新多模态理解突破 腾讯混元团队近日发布了 Large-Vision,这是一款采用 MoE(Mixture of Experts) 架构的全新 多模态理解模型... AIGC资讯AI工具推荐# 52B参数模型# Large-Vision# MoE架构 12个月前02790
昆仑万维开源Skywork UniPic 2.0:轻量化统一多模态生成与编辑模型 Skywork UniPic 2.0正式开源 昆仑万维集团在 SkyWork AI技术发布周 正式宣布开源Skywork UniPic 2.0,该模型融合了轻量化生成与编辑模块以及多模态理解联... AIGC资讯AI工具推荐# Flow-GRPO# SD3.5-Medium# Skywork UniPic 2.0 12个月前02630
B站测试“花生AI”视频创作工具:3分钟成片,多语言实时翻译助力全球创作 B站推出全新AI视频创作工具 B站近日开始测试全新的“花生AI”视频创作工具,该工具主打“3分钟可成片”的高效创作体验,旨在降低视频制作门槛,让更多用户能够快速完成创作并分享。 用户可通过... AIGC资讯AI工具推荐# Matrix-3D# Mesh渲染# 全景视频 12个月前03450
Matrix-3D:单张图像生成3D世界的新突破 昆仑万维近日开源了Matrix-3D大模型,这是一个能够由单张图像生成360°可漫游全景视频的AI系统。与以往依赖多视角采集的3D重建方法不同,Matrix-3D仅需一张输入图片,即可生成轨迹一致... AIGC资讯AI工具推荐# Matrix-3D# Mesh渲染# 全景视频 12个月前03460
字节跳动发布全球首个基于DiT大模型的视频字幕无痕擦除方案 助力短剧出海与跨境电商 全球首发的DiT大模型字幕擦除技术 字节跳动近日推出了全球首个基于 DiT(Diffusion Transformer)大模型 的视频字幕无痕擦除方案,在视频后期处理和跨语言内容分发领域实现了... 大模型 12个月前01230
360智脑Light-IF系列模型正式发布 360智脑Light-IF系列模型正式发布 360智脑近期推出了全新的Light-IF系列模型,该系列以“预览-自检式推理+信息熵控制”框架为核心,针对当前大语言模型在复杂任务中常见的“懒惰推... 大模型# 360智脑# Light-IF# 信息熵控制 12个月前01880
高德全面接入通义大模型 推出首个地图AI原生Agent 阿里巴巴集团高德地图与通义实验室联合发布全球首个AI原生地图,推出全新的智能体“小高老师”。该智能体实现了全链路语音交互与复杂任务推理导航,为用户提供更加智能和便捷的导航体验。 小高老师智能体... AIGC资讯大模型# AI原生地图# GPT-5# POI推理 12个月前03170
阿里达摩院开源三项具身智能核心技术:推动机器人智能化发展 阿里达摩院在世界机器人大会上宣布开源三项自研核心技术:VLA模型RynnVLA-001-7B、世界理解模型RynnEC以及机器人上下文协议RynnRCP。这一举措旨在推动数据、模型与机器人本体的兼... 大模型# RynnEC# RynnRCP# RynnVLA-001-7B 12个月前01840
智谱GLM-4.5V开源发布:全球100B级最佳视觉推理模型 智谱公司宣布推出并开源了全球100B级效果最佳的视觉推理模型——GLM-4.5V。该模型是智谱在通向通用人工智能(AGI)道路上的又一重要探索性成果。GLM-4.5V总参数达到106B,并在41个... 大模型# GLM-4.5V# GLM-4.5V GitHub# 开源视觉推理 12个月前01630
超小的TTS模型Kitten TTS:参数仅1500万,适合各种设备部署 Kitten TTS是一款开源的轻量级文本转语音模型,其参数量仅为1500万,体积小于25MB,非常适合在各种设备上进行部署。该模型不仅支持无GPU运行,还能够在普通的CPU上实现高质量语音合成... AIGC资讯AI工具推荐# Kitten TTS# TTS模型# 开源TTS模型 12个月前01990
苹果宣布GPT-5将入驻iOS 26:ChatGPT-5集成提升智能体验 苹果公司近日宣布,ChatGPT-5将集成至即将发布的iOS 26系统中。这一更新将显著提升Apple智能设备的性能,并带来一系列全新功能,包括实时翻译和内容搜索优化等。用户无需OpenAI账户即... AIGC资讯AI工具推荐# ChatGPT-5# iOS 26# iOS智能助手 12个月前02690
Windows 11 Copilot应用免费接入GPT-5:更宽松的使用限制,提升智能体验 微软宣布,Windows 11和Windows 10中的Copilot应用现已全面支持GPT-5智能模式,用户无需更新即可启用该功能。与ChatGPT相比,Copilot的使用限制更加宽松,进一步... AIGC资讯AI工具推荐# ChatGPT替代# Copilot应用# GPT-5智能模式 12个月前03020
Open AI重磅发布GPT-5提示词指南:解锁AI编程与多模态新境界 Open AI正式发布了其最新的GPT-5模型,并推出了官方的提示词指南,为开发者和用户提供了一整套优化策略。这些策略帮助用户充分挖掘GPT-5的潜力,在复杂任务、编程和多模态交互方面取得更高的效... AIGC资讯AI工具推荐# AI编程# GPT-5# Open AI 12个月前01740
昆仑万维发布SkyReels-A3模型:根据语音生成口型同步的数字人视频 昆仑万维集团正式发布了基于DiT视频扩散模型的SkyReels-A3,该模型通过音频驱动数字人创作,能够将静态图像或视频中的人物根据语音内容进行动态表演,包括开口说话和唱歌。SkyReels-A3... AIGC资讯AI工具推荐# AI视频创作# SkyReels-A3# 口型同步 12个月前01960
在线生成风格化字符图案工具:轻松将图像转为字符艺术 在线生成风格化图案工具是一款功能强大的图像转字符艺术工具,用户只需上传图像,便可将其转化为具有风格化效果的字符图案。该工具提供了三种不同的配色风格,支持字符、颜色、颗粒度等多种设置,帮助用户创造出... AIGC资讯AI工具推荐# 图像转字符# 图像转艺术# 在线生成字符图案工具 12个月前02500
HiPixel:macOS 原生 AI 图像高清化工具 HiPixel 是一款专为 macOS 用户打造的 AI 图像超分辨率处理工具。这款应用程序使用 SwiftUI 构建,并集成了强大的 Upscayl AI 模型,可以帮助用户将低分辨率的图像提升... AIGC资讯AI工具推荐# AI 图像超分辨率# HiPixel# macOS AI 图像工具 12个月前02070
阿里云通义千问 Qwen Code 宣布每日免费运行 2000 次! 阿里云近日宣布,旗下的AI编程智能体 Qwen Code现已提供每日2000次免费运行权限,并且无需 Token 限制。此举为中国大陆用户提供了更加灵活且高效的AI编程支持,让开发者能够利用AI智... AIGC资讯AI工具推荐# AI编程工具# AI编程智能体# GitHub AI工具 12个月前02330
微软推出AI浏览器功能:Edge浏览器Copilot模式开启智能浏览体验 微软近期在其Edge浏览器中推出了一个新的实验性功能——Copilot模式,标志着Edge浏览器从传统的网页浏览器,逐步转变为一款智能AI原生浏览器。该功能通过集成人工智能技术,能够为用户提供更加智能... AIGC资讯AI工具推荐# AI浏览器# Copilot模式# Edge浏览器功能 12个月前02870
10个AI写作工具推荐!提升写作效率与创意的智能助手 随着人工智能技术的迅速发展,AI写作工具已成为提升创作效率和文本质量的重要工具。从学术论文到广告文案、小说创作,再到SEO内容生成,AI写作工具为不同需求的用户提供了便利。本文将为您推荐几款功能强大的... AI工具推荐大模型# +AI写作工具# AI写作助手# AI文案生成 1年前01470
百度将推全新推理模型与文心5.0大模型:AI性能与用户体验双升级 百度宣布计划在2025年8月底前推出全新的推理模型,并同步发布升级版文心5.0大模型。这一举措旨在应对不断加剧的AI市场竞争,同时进一步提升用户体验与产品性能。 核心亮点 ? 全新推理模型... AIGC资讯AI工具推荐# AI中文大模型# 中文语义理解# 多模态AI生成 1年前02830
Cursor CLI版本正式发布:终端环境下的高效AI编程工具 Cursor近日正式发布CLI版本,为开发者带来一种全新的命令行AI编程体验。这款工具的推出,意味着在没有图形界面的环境中,例如远程Linux服务器、Docker容器或云端开发平台,开发者也能流畅... AIGC资讯AI工具推荐# AI自动化脚本生成# Cursor CLI# 命令行AI编程工具 1年前03110
刚刚,GPT-5正式发布!人人免费可用 北京时间凌晨 1 点,OpenAI 正式发布全新旗舰模型 GPT-5 —— 迄今为止最智能、最快速、最实用的 AI 系统。它首次引入 内置思维能力,将“专家级智能”普及到每一位用户手中。 颠覆... AIGC资讯AI工具推荐# ChatGPT# GPT-5 1年前02420
国产AI炸场!Seko一键生成爆火短视频,创作变得轻松无比 国产AI大模型Seko:一分钟创作爆火短视频,解锁视频创作新体验 你能想象吗?仅凭一个创意想法,就能快速生成最近爆火的短片?这正是商汤科技旗下的国产AI大模型Seko所带来的创新——只需简单的... AIGC资讯AI工具推荐# AI视频创作# Seko# 一键生成短视频 1年前02510
FlowSpeech:全球首个书面语转口语的TTS,提升语音合成自然性 FlowSpeech:全球首个书面语转口语的TTS,打造更自然的语音体验 FlowSpeech是一款创新的AI文本转语音(TTS)工具,突破了传统TTS技术的局限,能够将书面文字自然流畅地转化... AIGC资讯大模型# FlowSpeech# TTS工具# 上下文感知 1年前02920
腾讯重磅开源WeKnora:解锁复杂文档智能解析,知识管理进入AI新时代 腾讯开源WeKnora,重塑文档理解与知识管理 腾讯近日正式开源了WeKnora,一款基于大语言模型的文档理解与检索工具。WeKnora能够智能解析多种格式的文档(如PDF、Word、图片等... 大模型# WeKnora# 多模态文档解析# 文档理解工具 1年前02230
MiniCPM-V4.0开源发布:堪称“手机上的GPT-4V”,轻量级多模态大模型 MiniCPM-V4.0开源发布:移动设备上的GPT-4V,轻量级多模态大模型 MiniCPM-V4.0作为一款轻量级多模态大模型,凭借卓越的性能和优化设计,在图像、视频理解和多轮对话等任务中... AIGC资讯大模型# GPT-4V# MiniCPM-V4.0# 图像视频理解 1年前03070
Cursor 1.4正式发布:加速大型代码库自动化,提升异步长程任务处理能力 Cursor 1.4版本正式发布,聚焦异步长程任务,加速大型代码库自动化进程 Cursor 1.4版本的发布标志着其在AI驱动开发工具领域的进一步领先。该版本通过增强异步任务和长程任务处理能力... AI工具推荐大模型# AI编码工具# Cursor 1.4# 大型代码库优化 1年前01780
Midjourney推出HD视频模式,专为专业人士打造高品质影像 Midjourney推出全新HD视频模式,提升专业视频生成质量 Midjourney近日推出了全新的HD视频模式,为专业用户提供了更高清、更高质量的视频生成工具。与传统的SD模式相比,HD模式... AIGC资讯AI工具推荐# AI视频生成# Midjourney HD视频模式# 视频清晰度提升 1年前02600
MiniMax推出Speech 2.5语音生成模型,提升多语种表现力与音色复刻 MiniMax Speech 2.5语音生成模型上线:多语种表现力更强 MiniMax发布了新一代Speech 2.5语音生成模型,该模型在多语种表现力、音色复刻和语种覆盖范围等方面实现了显著... AIGC资讯大模型# MiniMax语音生成模型# Speech 2.5# 多语种语音生成 1年前02840
小红书发布开源多模态大模型dots.vlm1,NaViT视觉编码器领跑行业 小红书发布开源多模态大模型dots.vlm1,NaViT视觉编码器引领行业发展 小红书Hi Lab近日发布了全新的开源多模态大模型dots.vlm1,该模型结合了NaViT视觉编码器和Deep... AIGC资讯大模型# dots.vlm1# NaViT视觉编码器# 多模态评测 1年前01870
阿里发布Qwen3-4B模型:小巧强劲,手机也能跑 AI! 阿里发布Qwen3-4B系列模型:小型语言模型突破,移动端AI应用迎来新纪元 阿里巴巴通义千问团队近日发布了全新的Qwen3-4B系列模型,该模型在小型语言模型领域取得了显著突破,为移动端AI... AIGC资讯大模型# Qwen3-4B模型# 小型语言模型# 移动端AI应用 1年前02100
百度智能云推出全球首批AI数字员工,助力企业生产力升级 百度智能云发布全球首批AI数字员工,赋能企业核心业务 在百度智能云AI Day开放日活动中,百度推出了全球首批AI数字员工。这些数字员工依托百度的AI全栈能力,涵盖多个核心业务职能,包括营销经... 大模型# AI数字员工# 企业生产力# 全球首批数字员工 1年前02220
Claude Opus 4.1:编程能力提升至74.5%,数据分析与安全性更强 Claude Opus 4.1重磅升级,编程能力达到74.5%新高 随着人工智能的不断发展,各大AI系统在各个领域中的表现也在不断提高。近日,Claude Opus 4.1发布了重要升级,特别... AI工具推荐大模型# AI编程能力# Claude Opus 4.1# 安全性提升 1年前02060
OpenAI推出开源GPT-oss-120b与GPT-oss-20b:突破性大模型,支持商用与灵活部署 OpenAI再次推出开源模型,发布了两款突破性的GPT-oss系列大模型,即GPT-oss-120b和GPT-oss-20b,为AI领域带来了巨大的创新和发展潜力。这两款模型不仅在性能上与现有... 大模型开源项目# GPT-oss# GPT-oss-120b# GPT-oss-20b 1年前01730
北京团队发布全球首个人形机器人3D视觉系统,突破性多传感器融合技术 近日,北京人形机器人创新中心宣布推出全球首个人形机器人Humanoid Occupancy视觉感知系统,这一技术突破标志着在机器人感知能力方面的重大进展。通过引入语义占用表征技术,该系统能够精准建... 大模型 1年前01480
智谱推出Zread.ai:基于GLM-4.5的开发效率工具,提升代码理解与文档生成 智谱公司近日推出了全新的开发效率工具——Zread.ai,该工具基于最新的GLM-4.5大语言模型,旨在帮助开发者更高效地理解代码结构、生成技术文档,并提升团队协作效率。作为一款集成了先进AI技术... 大模型# GLM-4.5# Zread.ai# 代码理解 1年前01720
阿里通义千问开源Qwen-Image:突破性文生图模型助力图像生成与编辑 阿里通义千问近日开源了全新的文生图模型——Qwen-Image。该模型在文本渲染和图像编辑领域展现了巨大的技术突破,特别是在生成宫崎骏风格动漫场景和中文对联书法效果等方面,表现尤为出色。Qwen... 大模型# Qwen-Image# 图像生成# 图像编辑 1年前02550
腾讯AI工作台ima推出新功能:AI播客生成与文件夹导入等实用工具 腾讯旗下的AI知识管理工具ima近日推出了多项新功能,旨在进一步提升用户的知识获取和管理体验。全新功能包括AI播客生成、文件夹一键导入、Xmind脑图导入及知识库内容置顶等,全面优化了用户在日常工... 大模型# AI工作台# AI播客生成# ima 1年前02150
小米开源声音理解大模型 MiDashengLM-7B 音频理解是构建全场景智能生态的关键领域,在智能座舱、家居交互等场景均有广泛应用,是小米“人车家全生态”战略的核心技术组件。2024 年,小米发布的 Xiaomi Dasheng(https://git... 大模型 1年前02750
告别文字乱码!全新文生图模型Qwen-Image来咯 我们很高兴开源 Qwen-Image,一个20B的MMDiT模型。这是通义千问系列中首个图像生成基础模型,其在复杂文本渲染和精确图像编辑方面取得了显著进展。 Qwen-Image的主要特性包括: ... 大模型 1年前02480
昆仑万维开源推理大模型MindLink:创新推理框架与卓越多轮对话体验 昆仑万维近日发布并开源了最新的推理大模型——Skywork MindLink。该模型凭借创新的推理框架和独特的设计理念,在多个领域中展现了出色的推理能力,尤其在多轮对话和复杂任务处理方面,取得了显... 大模型# AI推理框架# Skywork MindLink# 推理大模型 1年前04200
腾讯混元发布0.5B、1.8B、4B、7B模型:适用于低功耗设备与长文处理 腾讯混元团队近期开源并发布了四款小尺寸的AI模型,分别为0.5B、1.8B、4B和7B版本。这些模型为开发者和企业提供了高效、低功耗的解决方案,适用于消费级显卡、边缘设备以及多种低功耗场景。通过这... 大模型# 低功耗AI# 小尺寸AI模型# 微调AI模型 1年前02360
Qwen3-Coder-Flash:高效AI编程模型新突破,支持多平台与超长上下文 在快速发展的AI编程领域,通义千问最新发布的Qwen3-Coder-Flash模型引发了广泛关注。作为Qwen3-Coder系列的新成员,它在功能性能、使用体验和开发者适配上,都展现出令人满意的表... 大模型# AI编程模型# Qwen3-Coder-Flash# 编程AI 1年前02060
Kimi K2 高速版发布:输出速度提升至每秒40 Tokens Kimi K2 高速版的发布标志着该款产品在性能上的一次重要飞跃。在保持与原版相同参数的基础上,Kimi K2 高速版的输出速度实现了显著提升,从每秒10 Tokens提升至每秒40 Tokens... 大模型# Kimi K2 高速版# 输出速度提升 1年前01480
Ollama桌面客户端发布:图形化界面、多模态识别与本地AI体验 Ollama近日发布了其全新的桌面客户端,为用户带来了更加直观和便捷的交互体验。与传统的命令行界面相比,Ollama桌面客户端不仅简化了操作流程,还增加了多模态识别和文档拖拽功能,极大地提升了用户... AI工具推荐大模型# Ollama# 图形化界面# 多模态识别 1年前02260
GPT-5即将发布!揭秘GPT-5-Auto与GPT-5-Reasoning模型亮点 随着人工智能技术的不断进步,OpenAI正在为下一代AI模型的发布做好准备。根据最新的发现,OpenAI目前可能正在测试其最新的两个模型——GPT-5-Auto和GPT-5-Reasoning,这... 大模型# GPT-5# GPT-5-Auto# GPT-5-Reasoning 1年前02290
阿里开源WebAgent项目WebShaper:GAIA评测超越Claude4与Sonnet,开启AI智能体新时代 近日,阿里云通义实验室发布了其自主研发的WebAgent项目,该项目的两大核心模型WebSailor和WebShaper在多个评测中表现出色,尤其是在复杂网络任务处理和多步推理能力上,超越了诸多业... AI工具推荐大模型# AI智能体# WebAgent# WebSailor 1年前02080
6.9k星星,实时交互的语音、视频、数字人 AI Agent 在人工智能快速发展的当下,实时交互的智能应用需求日益增长,而 TEN 的出现,为这一领域带来了全新的可能。这款已收获 6.9k 星星的开源生态系统,专注于创建、定制和部署具有多模态能力的实时对话式... 大模型开源项目# 开源项目# 数字人 1年前01870
豆包App视觉推理能力升级:深度思考模式助力图片分析与精准定位 豆包App在视觉推理领域实现了重大的功能升级,推出了全新的深度思考模式,使得其图片分析功能更加智能、精准。这个更新不仅提高了图片搜索的准确性,还能够帮助用户对图片中的细节进行更精细的处理和分析,带... AI工具推荐大模型# 图片分析# 深度思考模式# 视觉推理 1年前01740
上海AI实验室开源发布“书生”科学多模态大模型Intern-S1 上海AI实验室最近发布了其最新的科学多模态大模型——Intern-S1,这款模型旨在提升科学研究的深度和广度,特别是在化学、材料、地球科学等领域展现了极为出色的性能。Intern-S1是一个跨模态... 大模型# Intern-S1# 上海AI实验室# 开源AI模型 1年前02020
智谱AI发布GLM-4.5:全球首个原生融合推理、编码、智能体能力的开源模型 在2025年,智谱AI推出了其最新的旗舰模型——GLM-4.5。这一开源模型创新性地实现了推理、编码和智能体能力的原生融合,标志着AI技术的重大突破。GLM-4.5不仅在推理、代码生成和智能体应用... 大模型# GLM-4.5# 开源AI模型# 推理与编码 1年前01910
腾讯发布混元3D世界模型1.0,AI重塑虚拟世界未来 在2025世界人工智能大会上,腾讯震撼发布了其最新的混元3D世界模型1.0,并宣布该模型全面开源。该模型具备高精度的360°场景生成和可交互漫游功能,为3D内容创作、游戏开发、虚拟现实(VR)以及... AI工具推荐大模型# 3D世界模型# 可交互漫游# 混元3D 1年前02560
四连发!通义万相重磅开源 第四发更新来了 通义万相2.2正式开源! 具体如下 开源文生视频Wan2.2-T2V-A14B 图生视频Wan2.2-I2V-A14B 统一视频生成Wan2.2-TI2V-5B 文生视频模型和图生... AI工具推荐大模型# AI模型# AI视频工具# AI视频生成 1年前02790
B站成AI内容生态第一平台,月活跃AI用户超1.4亿 在2025年,B站(哔哩哔哩)展示了其强大的AI内容生态,成为了AI内容传播的重要平台。根据最新数据显示,B站月活跃AI用户超过1.4亿,这一数据表明,AI内容正在成为B站内容生态的重要组成部分... AI工具推荐# AI内容# AI创作# B站 1年前02060
阿里巴巴开源WebSailor AI Agent,打破信息检索壁垒 在人工智能领域,信息检索的效率和智能化程度是许多应用场景中的关键因素。为了解决这一难题,阿里巴巴通义实验室推出了WebSailor,一个开源AI智能体框架,旨在通过增强学习和复杂任务生成技术,提升信息... 大模型# WebSailor# 开源AI# 强化学习 1年前02620
金山办公发布WPS AI 3.0灵犀版本,开启智能办公新时代 在2025AI生产力论坛上,金山办公正式发布了WPS AI 3.0版本——WPS灵犀。这一版本标志着办公AI的重大升级,将传统办公工具转变为智能助理,推动了办公效率的飞跃。通过原生Office智能... AI工具推荐大模型# WPS AI 3.0# WPS灵犀# 智能办公 1年前02390
Runway推出全新视频编辑模型Aleph,视频创作体验 在视频创作领域,AI技术的快速进步正在不断改变创作者的工作方式。Runway公司最新推出的视频编辑模型Aleph,被誉为“视频领域的Kontext模型”,标志着视频编辑的一个全新时代。通过Alep... AI工具推荐大模型# AI视频工具# Aleph# Runway 1年前02300