DeepSeek V3.1正式发布:长文档分析与代码理解能力大幅提升,R2发布仍需等待 DeepSeek V3.1正式发布:长文档分析、代码理解能力大幅增强,R2仍需等待 近日,DeepSeek发布了其全新的V3.1版本,带来了多项重要的功能提升,尤其在上下文长度、推理任务的处理... AIGC资讯AI工具推荐# AI长文档分析# deepseek# V3.1发布 12个月前03120
ToonComposer:AI 技术助力动漫制作,自动上色与动画生成效率提升70% 在动漫制作流程中,绘制与上色一直是最耗时的环节。如今,基于生成式 AI 的创新工具 ToonComposer 为创作者带来了全新的解决方案。只需提供 一张草图和一帧彩色图像,系统即可自动生成完整的... AIGC资讯大模型# AI生成卡通视频# ToonComposer# 动漫制作AI 12个月前05790
Qwen 发布全能图像编辑模型 Qwen-Image-Edit:角色一致性、风格迁移、文字编辑全面升级 今天凌晨,Qwen 正式发布 Qwen-Image-Edit —— 这是 Qwen-Image 的图像编辑版本。新模型基于 200 亿参数的 Qwen-Image 模型 进一步训练,将其独特的 文... AIGC资讯AI工具推荐# Qwen-Image-Edit# Qwen全能图像编辑# 图像编辑模型 12个月前03180
10 款热门AI视频工具推荐!强烈推荐! 一个爱代码的设计师在运营,不定时分享干货、学习方法、效率工具和AIGC趋势发展。个人网站:tomda.top AI 生成视频领域可谓热闹非凡,各类工具如雨后春笋般不断涌现。今天,Tomda 用心梳理了... AI工具推荐大模型# AI视频创作# AI视频工具# AI视频生成 12个月前09450
港大、哈工大与浙大联合发布OmniPart:可解耦3D建模技术提升创意设计灵活性 OmniPart:可解耦3D建模新技术 香港大学、哈尔滨工业大学与浙江大学联合推出了 OmniPart 技术,这一成果为 3D建模领域 带来了重要突破。OmniPart能够实现 3D模型部件的... AIGC资讯AI工具推荐# 3D建模# OmniPart# 体素丢弃 12个月前02970
阿里开源WebWatcher:多模态深度研究智能体,突破AI研究新边界 阿里推出WebWatcher:多模态深度研究智能体 阿里巴巴自然语言处理团队正式推出了 WebWatcher,这是一个 开源的多模态深度研究智能体。该智能体旨在突破现有闭源系统和开源Agent... AIGC资讯AI工具推荐# AI智能助手# WebWatcher# 多模态智能体 12个月前02210
腾讯发布AudioGenie:多模态AI音频生成,一键打造电影级音效 AudioGenie横空出世:重新定义AI音频生成 腾讯正式发布 AudioGenie,这是一款具备 多模态音频生成能力 的AI工具,能够根据 视频、文本、图像 等多模态输入,一键生成 电影级... AIGC资讯AI工具推荐# AI音频生成# 多模态音频# 无训练框架 12个月前02420
香港大学推出OpenCUA框架!个性化电脑智能助手,提升工作效率 香港大学开源OpenCUA框架:打造个性化智能助手 香港大学联合多家机构开源了 OpenCUA 框架,旨在帮助开发者构建个性化的 计算机使用智能体(CUA),提升用户工作效率。该框架通过提供丰... AIGC资讯AI工具推荐# CUA框架# OpenCUA# 智能助手开发 12个月前03410
Meta开源DINOv3:无需人工标注的AI视觉模型,颠覆图像识别技术 Meta发布DINOv3:自监督学习的AI视觉突破 Meta AI 最近开源了 DINOv3,这是新一代的通用 图像识别模型,基于 自监督学习,无需人工标注即可实现卓越的性能,标志着AI视觉技... AIGC资讯AI免费工具# DINOv3# Meta AI# 图像识别 12个月前04120
腾讯云推出CloudBase AI CLI:减少80%编码量,提升开发效率 腾讯云发布CloudBase AI CLI:提升开发效率,减少编码量 腾讯云推出了 CloudBase AI CLI,一款深度集成云开发平台的 AI命令行工具。该工具旨在为开发者提供更高效、便... AIGC资讯AI工具推荐# AI命令行工具# AI开发# CloudBase AI CLI 12个月前02450
昆仑万维推出Mureka V7.5和MoE-TTS语音模型:提升中文歌曲创作与语音合成质量 昆仑万维推出Mureka V7.5与MoE-TTS语音模型:AI音乐与语音合成的新突破 2025年8月15日,昆仑万维集团 在 SkyWork AI技术发布周 上发布了 Mureka V7.5... AIGC资讯AI工具推荐# AI音乐创作# MoE-TTS# Mureka V7.5 12个月前03070
快手可灵2.1内测:首尾帧功能提升视频创作体验,优化转场与生成效率 快手可灵2.1模型发布:提升视频创作体验 快手推出了 可灵2.1模型,新增了 首尾帧功能,显著提升了视频生成的效果与流畅度。该模型在动态表现、语义理解和生成效率等方面都有明显的提升,尤其是在 ... AIGC资讯AI工具推荐# 快手可灵2.1# 文本响应# 视频创作 12个月前02660
昆仑万维发布Skywork Deep Research Agent v2:提升多模态信息处理与浏览器智能分析 昆仑万维发布Skywork Deep Research Agent v2:提升信息处理与用户体验 昆仑万维发布了 Skywork Deep Research Agent v2,该版本显著增强了... AI工具推荐大模型# Skywork Deep Research Agent# 信息处理# 多模态智能体 12个月前01460
谷歌为Slides和Vids引入全新AI图像编辑功能,轻松替换与扩展图片背景 谷歌推出基于Gemini的AI图像编辑功能:优化背景替换与扩展 谷歌近日推出了基于 Gemini 技术的两项新 AI图像编辑功能,专为 Google Slides 和 Vids 设计。这些功能... 大模型# Gemini技术# Google Slides# Google Vids 12个月前02070
智元机器人发布Genie Envisioner开源平台:全新机器人操控技术路径 智元机器人发布Genie Envisioner平台:开创机器人操控新模式 智元机器人于上海发布了 Genie Envisioner(GE) 平台,这一平台通过整合 未来帧预测、策略学习 与 仿... AIGC资讯大模型# Genie Envisioner# GE平台# 智元机器人 12个月前02590
Kimi推出全球版PPT生成功能,依托K2驱动提升AI办公效率 Kimi K2模型即将推出全球版PPT生成功能 Kimi K2模型 以其强大的性能和开源特性,在人工智能领域取得了显著成就。作为Kimi的最新成果,K2模型不仅在多个AI任务中表现出色,还将推... AIGC资讯大模型# 1万亿参数模型# AI办公工具# Kimi K2 12个月前03000
字节跳动开源M3-Agent-Control:基于Qwen 3 32B训练的高性能AI模型 字节跳动发布M3-Agent-Control:高性能AI模型 字节跳动最新推出的 M3-Agent-Control 模型,基于 Qwen 3 32B 训练,拥有 328亿参数,采用 BF16张... 大模型开源项目# BF16张量类型# M3-Agent-Control# Qwen 3 32B 12个月前01980
超越FLUX Kontext!Nano-Banana模型在图像编辑领域展现强大角色还原与场景重构能力 Nano-Banana:超越FLUX Kontext的图像编辑新突破 Nano-Banana 模型在图像编辑领域表现出色,特别是在 角色还原、场景重构 和 图像融合 等关键技术上,超越了 FL... AIGC资讯AI工具推荐# FLUX Kontext# Nano-Banana# 图像编辑 12个月前02410
腾讯混元开源Hunyuan-GameCraft:高动态交互式游戏视频生成框架 腾讯混元推出Hunyuan-GameCraft:游戏视频生成框架 腾讯混元团队推出的 Hunyuan-GameCraft 是一款基于 HunyuanVideo底模 的 高动态交互式游戏视频生成... AIGC资讯AI工具推荐# Hunyuan-GameCraft# 动态交互视频# 游戏视频生成 12个月前03610
官方否认DeepSeek-R2模型8月发布计划,性能优化仍在进行中 DeepSeek-R2模型发布计划被否认 关于 DeepSeek-R2模型 的8月发布计划,官方已经进行了明确的否认。此前有传言称,DeepSeek-R2 模型将于 8月15日至30日 之间发... AIGC资讯AI工具推荐# DeepSeek-R2# DeepSeek模型# 代码生成 12个月前02600
腾讯混元发布52B参数Large-Vision模型:支持任意分辨率全场景输入的多模态理解模型 腾讯混元Large-Vision:全新多模态理解突破 腾讯混元团队近日发布了 Large-Vision,这是一款采用 MoE(Mixture of Experts) 架构的全新 多模态理解模型... AIGC资讯AI工具推荐# 52B参数模型# Large-Vision# MoE架构 12个月前02790
昆仑万维开源Skywork UniPic 2.0:轻量化统一多模态生成与编辑模型 Skywork UniPic 2.0正式开源 昆仑万维集团在 SkyWork AI技术发布周 正式宣布开源Skywork UniPic 2.0,该模型融合了轻量化生成与编辑模块以及多模态理解联... AIGC资讯AI工具推荐# Flow-GRPO# SD3.5-Medium# Skywork UniPic 2.0 12个月前02610
Matrix-3D:单张图像生成3D世界的新突破 昆仑万维近日开源了Matrix-3D大模型,这是一个能够由单张图像生成360°可漫游全景视频的AI系统。与以往依赖多视角采集的3D重建方法不同,Matrix-3D仅需一张输入图片,即可生成轨迹一致... AIGC资讯AI工具推荐# Matrix-3D# Mesh渲染# 全景视频 12个月前03450
字节跳动发布全球首个基于DiT大模型的视频字幕无痕擦除方案 助力短剧出海与跨境电商 全球首发的DiT大模型字幕擦除技术 字节跳动近日推出了全球首个基于 DiT(Diffusion Transformer)大模型 的视频字幕无痕擦除方案,在视频后期处理和跨语言内容分发领域实现了... 大模型 12个月前01230
360智脑Light-IF系列模型正式发布 360智脑Light-IF系列模型正式发布 360智脑近期推出了全新的Light-IF系列模型,该系列以“预览-自检式推理+信息熵控制”框架为核心,针对当前大语言模型在复杂任务中常见的“懒惰推... 大模型# 360智脑# Light-IF# 信息熵控制 12个月前01870
高德全面接入通义大模型 推出首个地图AI原生Agent 阿里巴巴集团高德地图与通义实验室联合发布全球首个AI原生地图,推出全新的智能体“小高老师”。该智能体实现了全链路语音交互与复杂任务推理导航,为用户提供更加智能和便捷的导航体验。 小高老师智能体... AIGC资讯大模型# AI原生地图# GPT-5# POI推理 12个月前03160
阿里达摩院开源三项具身智能核心技术:推动机器人智能化发展 阿里达摩院在世界机器人大会上宣布开源三项自研核心技术:VLA模型RynnVLA-001-7B、世界理解模型RynnEC以及机器人上下文协议RynnRCP。这一举措旨在推动数据、模型与机器人本体的兼... 大模型# RynnEC# RynnRCP# RynnVLA-001-7B 12个月前01840
智谱GLM-4.5V开源发布:全球100B级最佳视觉推理模型 智谱公司宣布推出并开源了全球100B级效果最佳的视觉推理模型——GLM-4.5V。该模型是智谱在通向通用人工智能(AGI)道路上的又一重要探索性成果。GLM-4.5V总参数达到106B,并在41个... 大模型# GLM-4.5V# GLM-4.5V GitHub# 开源视觉推理 12个月前01600
超小的TTS模型Kitten TTS:参数仅1500万,适合各种设备部署 Kitten TTS是一款开源的轻量级文本转语音模型,其参数量仅为1500万,体积小于25MB,非常适合在各种设备上进行部署。该模型不仅支持无GPU运行,还能够在普通的CPU上实现高质量语音合成... AIGC资讯AI工具推荐# Kitten TTS# TTS模型# 开源TTS模型 12个月前01980
苹果宣布GPT-5将入驻iOS 26:ChatGPT-5集成提升智能体验 苹果公司近日宣布,ChatGPT-5将集成至即将发布的iOS 26系统中。这一更新将显著提升Apple智能设备的性能,并带来一系列全新功能,包括实时翻译和内容搜索优化等。用户无需OpenAI账户即... AIGC资讯AI工具推荐# ChatGPT-5# iOS 26# iOS智能助手 12个月前02690
Windows 11 Copilot应用免费接入GPT-5:更宽松的使用限制,提升智能体验 微软宣布,Windows 11和Windows 10中的Copilot应用现已全面支持GPT-5智能模式,用户无需更新即可启用该功能。与ChatGPT相比,Copilot的使用限制更加宽松,进一步... AIGC资讯AI工具推荐# ChatGPT替代# Copilot应用# GPT-5智能模式 12个月前03020
Open AI重磅发布GPT-5提示词指南:解锁AI编程与多模态新境界 Open AI正式发布了其最新的GPT-5模型,并推出了官方的提示词指南,为开发者和用户提供了一整套优化策略。这些策略帮助用户充分挖掘GPT-5的潜力,在复杂任务、编程和多模态交互方面取得更高的效... AIGC资讯AI工具推荐# AI编程# GPT-5# Open AI 12个月前01730
昆仑万维发布SkyReels-A3模型:根据语音生成口型同步的数字人视频 昆仑万维集团正式发布了基于DiT视频扩散模型的SkyReels-A3,该模型通过音频驱动数字人创作,能够将静态图像或视频中的人物根据语音内容进行动态表演,包括开口说话和唱歌。SkyReels-A3... AIGC资讯AI工具推荐# AI视频创作# SkyReels-A3# 口型同步 12个月前01950
在线生成风格化字符图案工具:轻松将图像转为字符艺术 在线生成风格化图案工具是一款功能强大的图像转字符艺术工具,用户只需上传图像,便可将其转化为具有风格化效果的字符图案。该工具提供了三种不同的配色风格,支持字符、颜色、颗粒度等多种设置,帮助用户创造出... AIGC资讯AI工具推荐# 图像转字符# 图像转艺术# 在线生成字符图案工具 12个月前02500
HiPixel:macOS 原生 AI 图像高清化工具 HiPixel 是一款专为 macOS 用户打造的 AI 图像超分辨率处理工具。这款应用程序使用 SwiftUI 构建,并集成了强大的 Upscayl AI 模型,可以帮助用户将低分辨率的图像提升... AIGC资讯AI工具推荐# AI 图像超分辨率# HiPixel# macOS AI 图像工具 12个月前02050
阿里云通义千问 Qwen Code 宣布每日免费运行 2000 次! 阿里云近日宣布,旗下的AI编程智能体 Qwen Code现已提供每日2000次免费运行权限,并且无需 Token 限制。此举为中国大陆用户提供了更加灵活且高效的AI编程支持,让开发者能够利用AI智... AIGC资讯AI工具推荐# AI编程工具# AI编程智能体# GitHub AI工具 12个月前02330
微软推出AI浏览器功能:Edge浏览器Copilot模式开启智能浏览体验 微软近期在其Edge浏览器中推出了一个新的实验性功能——Copilot模式,标志着Edge浏览器从传统的网页浏览器,逐步转变为一款智能AI原生浏览器。该功能通过集成人工智能技术,能够为用户提供更加智能... AIGC资讯AI工具推荐# AI浏览器# Copilot模式# Edge浏览器功能 12个月前02870
10个AI写作工具推荐!提升写作效率与创意的智能助手 随着人工智能技术的迅速发展,AI写作工具已成为提升创作效率和文本质量的重要工具。从学术论文到广告文案、小说创作,再到SEO内容生成,AI写作工具为不同需求的用户提供了便利。本文将为您推荐几款功能强大的... AI工具推荐大模型# +AI写作工具# AI写作助手# AI文案生成 12个月前01470
百度将推全新推理模型与文心5.0大模型:AI性能与用户体验双升级 百度宣布计划在2025年8月底前推出全新的推理模型,并同步发布升级版文心5.0大模型。这一举措旨在应对不断加剧的AI市场竞争,同时进一步提升用户体验与产品性能。 核心亮点 ? 全新推理模型... AIGC资讯AI工具推荐# AI中文大模型# 中文语义理解# 多模态AI生成 1年前02820
Cursor CLI版本正式发布:终端环境下的高效AI编程工具 Cursor近日正式发布CLI版本,为开发者带来一种全新的命令行AI编程体验。这款工具的推出,意味着在没有图形界面的环境中,例如远程Linux服务器、Docker容器或云端开发平台,开发者也能流畅... AIGC资讯AI工具推荐# AI自动化脚本生成# Cursor CLI# 命令行AI编程工具 1年前03110
刚刚,GPT-5正式发布!人人免费可用 北京时间凌晨 1 点,OpenAI 正式发布全新旗舰模型 GPT-5 —— 迄今为止最智能、最快速、最实用的 AI 系统。它首次引入 内置思维能力,将“专家级智能”普及到每一位用户手中。 颠覆... AIGC资讯AI工具推荐# ChatGPT# GPT-5 1年前02400
国产AI炸场!Seko一键生成爆火短视频,创作变得轻松无比 国产AI大模型Seko:一分钟创作爆火短视频,解锁视频创作新体验 你能想象吗?仅凭一个创意想法,就能快速生成最近爆火的短片?这正是商汤科技旗下的国产AI大模型Seko所带来的创新——只需简单的... AIGC资讯AI工具推荐# AI视频创作# Seko# 一键生成短视频 1年前02500
FlowSpeech:全球首个书面语转口语的TTS,提升语音合成自然性 FlowSpeech:全球首个书面语转口语的TTS,打造更自然的语音体验 FlowSpeech是一款创新的AI文本转语音(TTS)工具,突破了传统TTS技术的局限,能够将书面文字自然流畅地转化... AIGC资讯大模型# FlowSpeech# TTS工具# 上下文感知 1年前02900
腾讯重磅开源WeKnora:解锁复杂文档智能解析,知识管理进入AI新时代 腾讯开源WeKnora,重塑文档理解与知识管理 腾讯近日正式开源了WeKnora,一款基于大语言模型的文档理解与检索工具。WeKnora能够智能解析多种格式的文档(如PDF、Word、图片等... 大模型# WeKnora# 多模态文档解析# 文档理解工具 1年前02210
MiniCPM-V4.0开源发布:堪称“手机上的GPT-4V”,轻量级多模态大模型 MiniCPM-V4.0开源发布:移动设备上的GPT-4V,轻量级多模态大模型 MiniCPM-V4.0作为一款轻量级多模态大模型,凭借卓越的性能和优化设计,在图像、视频理解和多轮对话等任务中... AIGC资讯大模型# GPT-4V# MiniCPM-V4.0# 图像视频理解 1年前03060
Cursor 1.4正式发布:加速大型代码库自动化,提升异步长程任务处理能力 Cursor 1.4版本正式发布,聚焦异步长程任务,加速大型代码库自动化进程 Cursor 1.4版本的发布标志着其在AI驱动开发工具领域的进一步领先。该版本通过增强异步任务和长程任务处理能力... AI工具推荐大模型# AI编码工具# Cursor 1.4# 大型代码库优化 1年前01780
Midjourney推出HD视频模式,专为专业人士打造高品质影像 Midjourney推出全新HD视频模式,提升专业视频生成质量 Midjourney近日推出了全新的HD视频模式,为专业用户提供了更高清、更高质量的视频生成工具。与传统的SD模式相比,HD模式... AIGC资讯AI工具推荐# AI视频生成# Midjourney HD视频模式# 视频清晰度提升 1年前02570
MiniMax推出Speech 2.5语音生成模型,提升多语种表现力与音色复刻 MiniMax Speech 2.5语音生成模型上线:多语种表现力更强 MiniMax发布了新一代Speech 2.5语音生成模型,该模型在多语种表现力、音色复刻和语种覆盖范围等方面实现了显著... AIGC资讯大模型# MiniMax语音生成模型# Speech 2.5# 多语种语音生成 1年前02830
小红书发布开源多模态大模型dots.vlm1,NaViT视觉编码器领跑行业 小红书发布开源多模态大模型dots.vlm1,NaViT视觉编码器引领行业发展 小红书Hi Lab近日发布了全新的开源多模态大模型dots.vlm1,该模型结合了NaViT视觉编码器和Deep... AIGC资讯大模型# dots.vlm1# NaViT视觉编码器# 多模态评测 1年前01870
阿里发布Qwen3-4B模型:小巧强劲,手机也能跑 AI! 阿里发布Qwen3-4B系列模型:小型语言模型突破,移动端AI应用迎来新纪元 阿里巴巴通义千问团队近日发布了全新的Qwen3-4B系列模型,该模型在小型语言模型领域取得了显著突破,为移动端AI... AIGC资讯大模型# Qwen3-4B模型# 小型语言模型# 移动端AI应用 1年前02100
百度智能云推出全球首批AI数字员工,助力企业生产力升级 百度智能云发布全球首批AI数字员工,赋能企业核心业务 在百度智能云AI Day开放日活动中,百度推出了全球首批AI数字员工。这些数字员工依托百度的AI全栈能力,涵盖多个核心业务职能,包括营销经... 大模型# AI数字员工# 企业生产力# 全球首批数字员工 1年前02210
Claude Opus 4.1:编程能力提升至74.5%,数据分析与安全性更强 Claude Opus 4.1重磅升级,编程能力达到74.5%新高 随着人工智能的不断发展,各大AI系统在各个领域中的表现也在不断提高。近日,Claude Opus 4.1发布了重要升级,特别... AI工具推荐大模型# AI编程能力# Claude Opus 4.1# 安全性提升 1年前02060
OpenAI推出开源GPT-oss-120b与GPT-oss-20b:突破性大模型,支持商用与灵活部署 OpenAI再次推出开源模型,发布了两款突破性的GPT-oss系列大模型,即GPT-oss-120b和GPT-oss-20b,为AI领域带来了巨大的创新和发展潜力。这两款模型不仅在性能上与现有... 大模型开源项目# GPT-oss# GPT-oss-120b# GPT-oss-20b 1年前01730
北京团队发布全球首个人形机器人3D视觉系统,突破性多传感器融合技术 近日,北京人形机器人创新中心宣布推出全球首个人形机器人Humanoid Occupancy视觉感知系统,这一技术突破标志着在机器人感知能力方面的重大进展。通过引入语义占用表征技术,该系统能够精准建... 大模型 1年前01460
智谱推出Zread.ai:基于GLM-4.5的开发效率工具,提升代码理解与文档生成 智谱公司近日推出了全新的开发效率工具——Zread.ai,该工具基于最新的GLM-4.5大语言模型,旨在帮助开发者更高效地理解代码结构、生成技术文档,并提升团队协作效率。作为一款集成了先进AI技术... 大模型# GLM-4.5# Zread.ai# 代码理解 1年前01720
阿里通义千问开源Qwen-Image:突破性文生图模型助力图像生成与编辑 阿里通义千问近日开源了全新的文生图模型——Qwen-Image。该模型在文本渲染和图像编辑领域展现了巨大的技术突破,特别是在生成宫崎骏风格动漫场景和中文对联书法效果等方面,表现尤为出色。Qwen... 大模型# Qwen-Image# 图像生成# 图像编辑 1年前02550
腾讯AI工作台ima推出新功能:AI播客生成与文件夹导入等实用工具 腾讯旗下的AI知识管理工具ima近日推出了多项新功能,旨在进一步提升用户的知识获取和管理体验。全新功能包括AI播客生成、文件夹一键导入、Xmind脑图导入及知识库内容置顶等,全面优化了用户在日常工... 大模型# AI工作台# AI播客生成# ima 1年前02150
小米开源声音理解大模型 MiDashengLM-7B 音频理解是构建全场景智能生态的关键领域,在智能座舱、家居交互等场景均有广泛应用,是小米“人车家全生态”战略的核心技术组件。2024 年,小米发布的 Xiaomi Dasheng(https://git... 大模型 1年前02750
告别文字乱码!全新文生图模型Qwen-Image来咯 我们很高兴开源 Qwen-Image,一个20B的MMDiT模型。这是通义千问系列中首个图像生成基础模型,其在复杂文本渲染和精确图像编辑方面取得了显著进展。 Qwen-Image的主要特性包括: ... 大模型 1年前02480
昆仑万维开源推理大模型MindLink:创新推理框架与卓越多轮对话体验 昆仑万维近日发布并开源了最新的推理大模型——Skywork MindLink。该模型凭借创新的推理框架和独特的设计理念,在多个领域中展现了出色的推理能力,尤其在多轮对话和复杂任务处理方面,取得了显... 大模型# AI推理框架# Skywork MindLink# 推理大模型 1年前04200