被 Nano-banana 霸屏了!这款 “最强 AI 生图神器” 凭什么火?看一眼出图就懂了! 点击蓝字关注我? 一个爱代码的设计师在运营,不定时分享干货、学习方法、效率工具和AIGC趋势发展。个人网站:tomda.top 最近刷遍各大社交平台的 AI 手办模型(上一篇文章),是不是让你... AIGC资讯AI工具推荐# Nano-Banana 11个月前01790
京东重磅开源JoyAgent-JDGenie!GAIA准确率75.15%领跑多智能体系统 在人工智能领域,多智能体系统的协作能力一直是一个备受关注的研究方向。京东近日开源了JoyAgent-JDGenie框架,并在GAIA基准测试中以75.15%的准确率位居领先,展示了其强大的多智能体... 大模型# GAIA基准测试# JoyAgent-JDGenie# 京东开源框架 1年前01790
国产大模型“第一股”或将花落上海|MiniMax通过港交所上市聆讯 近日,国产大模型公司 MiniMax 宣布已通过 港交所上市聆讯,有望成为首家登陆资本市场的国产大模型企业。这一消息不仅标志着大模型企业在资本市场迈出重要一步,也引发业内对于 大语言模型与多模态生... AIGC资讯大模型# AI上市# AI企业融资# AI商业化 8个月前01780
月之暗面发布Kimi-Dev-72B开源模型,打破编程基准记录! 月之暗面发布Kimi-Dev-72B开源模型,打破编程基准记录,现已在Hugging Face和GitHub提供下载 月之暗面(MoonshotAI)再次引领了开源AI技术的前沿,推出了全新开源编程模... 大模型# GitHub# Hugging Face# Kimi-Dev-72B 1年前01780
苹果发布 UniGen 1.5|多模态 AI 模型实现图像理解、生成与编辑三合一 苹果最近发布了其最新的多模态 AI 模型 UniGen 1.5,在图像处理领域实现了重大的突破。UniGen 1.5 将 图像理解、生成与编辑功能 集成于一体,并通过创新的“编辑指令对齐”技术,显... AIGC资讯大模型# AI 图像处理# UniGen 1.5# 创意设计 8个月前01770
华为与浙大 DeepSeek-R1-Safe 深度解析:AI 安全与性能平衡的突破性实践 在 AI 技术狂飙突进的当下,"安全增强必损性能" 已成为行业公认的两难困境 —— 传统大模型为提升有害信息防御能力,往往需牺牲 15%-30% 的通用推理性能,这种取舍严重制约了 AI 在金融... AIGC资讯大模型# deepseek# 华为 11个月前01770
IBM发布Granite-Docling-258M:开源企业级文档AI模型,提升文档转换精度 IBM推出Granite-Docling-258M:高效文档AI模型提升文档转换精度 随着文档处理需求的不断增加,如何高效、准确地将文档内容转化为机器可读的格式成为许多行业的重要任务。为了解决... 大模型# Granite-Docling-258M# IBM# 开源文档AI模型 11个月前01770
科大讯飞推出星火 X1.5 大模型,全国产算力助力AI技术升级,性能接近GPT-5水平 科大讯飞正式发布了全新一代星火 X1.5 大模型,标志着中国AI产业在国产算力与智能算法融合方面迈出了关键一步。星火 X1.5在多语言处理、计算效率与模型精度上实现全面提升,不仅性能对标国际主流模... AIGC资讯AI工具推荐# AI大模型# 人工智能技术# 国产算力 9个月前01760
豆包App视觉推理能力升级:深度思考模式助力图片分析与精准定位 豆包App在视觉推理领域实现了重大的功能升级,推出了全新的深度思考模式,使得其图片分析功能更加智能、精准。这个更新不仅提高了图片搜索的准确性,还能够帮助用户对图片中的细节进行更精细的处理和分析,带... AI工具推荐大模型# 图片分析# 深度思考模式# 视觉推理 1年前01760
通义千问Qwen推出机器翻译模型Qwen-MT:支持92种语言,低延迟、高可控性 通义千问(Qwen)正式发布了其全新的机器翻译模型——Qwen-MT,该模型基于 Qwen 3 架构开发,旨在提供快速、精确且低成本的多语言翻译服务。Qwen-MT 支持 92种语言互译,覆盖全球... 大模型# 92种语言# Qwen-MT# 低延迟翻译 1年前01760
稀宇科技推出视频生成模型Hailuo02,降门槛提升创作质量,支持复杂场景 稀宇科技推出视频生成模型Hailuo02,降门槛提升创作质量 稀宇科技自豪地推出了其全新的视频生成模型Hailuo02,这一创新性模型基于Noise-aware Compute Redistribut... 大模型 1年前01760
昆仑万维 AI 音乐平台 Mureka 上线 Agent Studio 功能,让音乐创作触手可及 作为昆仑万维 “算力基础设施 — 大模型算法 —AI 应用” 全产业链布局的重要一环,其旗下 AI 音乐创作平台 Mureka 近日正式推出「Agent Studio」功能,进一步降低音乐创作门槛... 大模型 11个月前01750
Open AI重磅发布GPT-5提示词指南:解锁AI编程与多模态新境界 Open AI正式发布了其最新的GPT-5模型,并推出了官方的提示词指南,为开发者和用户提供了一整套优化策略。这些策略帮助用户充分挖掘GPT-5的潜力,在复杂任务、编程和多模态交互方面取得更高的效... AIGC资讯AI工具推荐# AI编程# GPT-5# Open AI 12个月前01750
月之暗面发布Kimi K2!万亿参数开源大模型,推动通用智能发展 在人工智能领域,月之暗面的最新发布——Kimi K2大语言模型,无疑是一次重磅的技术突破。这款模型的参数规模达到1万亿,结合创新的混合专家架构,展现了强大的计算能力与智能体执行能力。最令人瞩目的是,K... AI工具推荐大模型 1年前01750
英伟达发布 PersonaPlex-7B-v1:重塑实时语音交互的“全双工”AI 对话模型 英伟达(NVIDIA)研究团队近日正式发布了全新的语音对语音对话模型 PersonaPlex-7B-v1。该模型以全双工(Full-Duplex)语音交互为核心设计目标,通过端到端 Transfo... AIGC资讯大模型# NVIDIA PersonaPlex# Transformer 语音模型# 全双工语音交互 7个月前01740
OpenAI推出开源GPT-oss-120b与GPT-oss-20b:突破性大模型,支持商用与灵活部署 OpenAI再次推出开源模型,发布了两款突破性的GPT-oss系列大模型,即GPT-oss-120b和GPT-oss-20b,为AI领域带来了巨大的创新和发展潜力。这两款模型不仅在性能上与现有... 大模型开源项目# GPT-oss# GPT-oss-120b# GPT-oss-20b 1年前01740
智谱推出Zread.ai:基于GLM-4.5的开发效率工具,提升代码理解与文档生成 智谱公司近日推出了全新的开发效率工具——Zread.ai,该工具基于最新的GLM-4.5大语言模型,旨在帮助开发者更高效地理解代码结构、生成技术文档,并提升团队协作效率。作为一款集成了先进AI技术... 大模型# GLM-4.5# Zread.ai# 代码理解 1年前01740
开源版多邻国!WordPecker:AI语音对话+个性化词汇,3倍速学语言 随着语言学习工具的不断发展,WordPecker脱颖而出,成为基于人工智能的创新语言学习平台。借助**LLM(大语言模型)和TTS(文本转语音)**技术,WordPecker不仅提供了个性化的词汇... 大模型# AI语言学习工具# OpenAI语音Agent# WordPecker 1年前01740
百度发布文心ERNIE-5.0-0110:数学能力全球第二,多领域智能全面升级 一、文心ERNIE-5.0-0110正式发布:多模态与推理能力全面提升 百度正式推出全新大语言模型 ERNIE-5.0-0110,该版本在多项国际权威评测中表现卓越,尤其在数学推理与计算能力方... AIGC资讯AI工具推荐# ERNIE-5.0-0110# GPT-5.2-High# 数学能力全球第二 7个月前01730
夸克”深度搜索”新品解析:AI智能检索技术带来更精准的搜索体验 为什么"深度搜索"与众不同? 关键技术突破 语义理解层: 采用深度神经网络对用户query进行多维度解析 支持复杂长句、隐含意图的精准识别 实现上下文关联理解 知识图谱构建: 整合超过10亿级别的实体... 大模型# AI检索技术# 智能搜索# 深度搜索 1年前01720
Adobe Firefly平台重磅升级!整合OpenAI与Google技术,开启智能创意新时代 Adobe发布全新Firefly AI平台 打造创意设计新范式 全球创意软件巨头Adobe近日正式推出新一代Firefly平台,通过深度整合OpenAI和Google的先进AI模型,为Creative... 大模型# +生成式AI# Adobe Firefly# Google AI 1年前01690
Midjourney Niji 7全面升级——AI动漫创作进入高质量时代,风格迁移与提示词理解双提升 一、Midjourney Niji 7:动漫AI创作的又一里程碑 AI绘画领域正快速发展,而在动漫与插画风格生成方面,Midjourney 一直处于领先地位。全新的 Niji 7 模型,是Mi... AIGC资讯大模型# AI动漫# AI绘画# AI艺术创作 7个月前01680
Kimi Playground上线!AI技术进化为智能助理,提升开发效率 随着人工智能(AI)技术的持续进步,AI在各个领域的应用已经不仅仅局限于传统的对话助手。近期,月之暗面Kimi开放平台发布了Kimi Playground,这标志着AI技术的一个重要进化——从单纯... 大模型# AI技术# Kimi Playground# 工具调用 1年前01680
PS正式官宣接入Nano Banana,网友:谁能想到巨头也会 “追着香蕉跑” Adobe 和谷歌这波联动,直接把 AI 修图的期待值拉满! 官方确认,谷歌全新图像 AI 技术 “Nano Banana”(正式名Gemini 2.5 Flash Image),即将作为可选工具登陆... AI工具推荐大模型# Nano-Banana# pbotoshop 11个月前01670
八斗智能基于大规模预训练的语义理解AI服务,提升文本处理效率 在当今信息爆炸的时代,高效、准确的文本处理成为各行业的关键需求。八斗智能通过大规模神经网络语义理解模型,凭借其领先的预训练技术和多行业知识库迁移学习,为企业在处理大规模文本数据时提供了强有力的支持。 ... 大模型# 信息抽取# 八斗智能# 大规模预训练 1年前01670
Hugging Face发布SmolLM3:新一代小参数模型,双模式推理突破 Hugging Face近期发布了其最新的小型开源模型——SmolLM3,该模型具有30亿参数,在性能上超越了同类开源模型如Llama-3.2-3B和Qwen2.5-3B。SmolLM3不仅支持多语言... 大模型 1年前01660
阿里通义 Qwen3-ASR-Toolkit!开源音视频转录工具新选择 阿里通义 Qwen3-ASR-Toolkit:开源音视频转录工具新选择 阿里通义 Qwen 团队近期推出的 Qwen3-ASR-Toolkit,是一款基于 Python 命令行开发的开源音视频... AI工具推荐大模型 11个月前01650
8 个 ChatGPT 思考提示!让 AI 成为求职中的「深度思考伙伴」,避免决策盲区 在求职过程中,我们常陷入 “思路单一”“忽略风险”“犹豫不前” 的困境 —— 比如只盯着 “大厂光环” 忽略适配性,简历优化只关注内容却没考虑 HR 视角,拿到 offer 却纠结到错过截止日期... AI工具推荐大模型# ChatGPT# ChatGPT Agent# ChatGPT-5 11个月前01640
智谱GLM-4.5V开源发布:全球100B级最佳视觉推理模型 智谱公司宣布推出并开源了全球100B级效果最佳的视觉推理模型——GLM-4.5V。该模型是智谱在通向通用人工智能(AGI)道路上的又一重要探索性成果。GLM-4.5V总参数达到106B,并在41个... 大模型# GLM-4.5V# GLM-4.5V GitHub# 开源视觉推理 12个月前01640
美团AI编程工具“NoCode”即将上线,对话式开发对标Lovable,助力非程序员应用构建 美团正加速推进AI战略布局,旗下AI编程工具“NoCode”即将上线,定位于“Vibe Coding”赛道,通过对话式交互实现应用构建,面向非程序员用户,致力于让每个人都能用自然语言轻松开发、部署和修... 大模型# AI工具# AI编程工具# Code Agent 1年前01640
昆仑万维开源Matrix-Game|构建交互式虚拟世界|行业首发10B+空间大模型 [项目主页直达:https://matrix-game-homepage.github.io] 中国AI技术研发迎来重要节点——昆仑万维集团正式宣布开源Matrix-Game大模型体系,标志着全球首个... 大模型# Matrix-Game开源# 空间智能大模型# 虚拟世界构建 1年前01640
GPT-4.1系列发布:编程性能提升21%、支持百万级上下文,三大版本满足不同场景需求 全面升级的GPT-4.1系列模型 OpenAI最新发布了GPT-4.1系列,包含三个不同定位的版本:全功能的GPT-4.1旗舰版、轻量级的GPT-4.1 mini和高效经济的GPT-4.1 nano... 大模型# AI编程工具# GPT-4.1# OpenAI新模型 1年前01640
谷歌发布Gemini CLI:开源AI编程助手来袭,免费挑战Cursor! 谷歌放大招!Gemini CLI开源发布,免费提供AI编程助手挑战Cursor 在AI开发工具日益激烈竞争的背景下,谷歌再度出手,正式开源发布了全新的Gemini CLI。作为一款面向开发者的强大AI... 大模型# Gemini 1年前01630
刚刚,DeepSeek R1 发布更新! > DeepSeek 官方刚刚发布通知:R1 模型已完成小范围版本升级。 > 目前已在官方网站、APP 及小程序(开启深度求索)开启测试体验。 > 由于官方模型卡尚未更新,本次升级的... 大模型# deepseek# DeepSeek V3# DeepSeek-R1 1年前01630
腾讯混元SRPO技术!提升AI生成图像真实感,解决人物皮肤质感问题 腾讯混元SRPO技术:提升AI图像质量与真实感 在人工智能图像生成领域,如何让生成的图像更加真实且细腻,尤其是在人物皮肤质感的呈现上,一直是技术发展的难题。为了应对这一挑战,腾讯混元团队与香港... AI工具推荐大模型# AI图像生成# Direct-Align策略# Flux模型 11个月前01620
阿里开源MNN TaoAvatar!手机上的3D数字人应用新纪元! 阿里巴巴集团开源发布MNN TaoAvatar,将高保真3D虚拟形象和实时交互能力引入移动设备,为直播、虚拟社交、AR应用开创无限可能。 ? 核心亮点 ✨ 真3D虚拟角色 实时生成与驱动 手机上流畅运... 大模型# 阿里巴巴 1年前01620
微软宣布VS Code转型开源AI编辑器,Copilot Chat扩展开源对抗Cursor与Windsurf 在2025年Build大会上,微软重磅宣布:Visual Studio Code(VS Code)将转型为全球首款开源AI编辑器,并将GitHub Copilot Chat扩展完全开源。这一举措不仅彰... 大模型 1年前01620
百度发布“绘想”平台与MuseSteamer:AI生成视频,一张图片即可制作专业级大片! 百度近日发布了其最新的AI平台——“绘想”,并推出了其新产品MuseSteamer。这一平台依托于生成式AI与多模态技术,提供了一个全面的视频生成解决方案,特别适用于搜索、广告等多个场景。更为重要的是... 大模型# +AI生成视频# MuseSteamer# 百度绘想 1年前01610
腾讯混元上线游戏视觉生成平台,AI助力美术设计师高效创作 作为一名游戏美术设计师,我对腾讯混元游戏视觉生成平台的上线感到非常兴奋。这一平台依托混元大模型打造,将AI技术深度融合进游戏美术创作流程,极大提升了内容生产的效率和创意空间。 官方网址:? https... 大模型# AI美术# 游戏美术设计# 游戏视觉生成 1年前01610
千问太快了!阿里领先谷歌推出AI购物功能 1月15日,千问App正式宣布全面接入淘宝、支付宝、淘宝闪购、飞猪、高德等阿里生态业务,并在全球首次实现点外卖、买东西、订机票等AI购物功能。 这一动作标志着千问App已经超越了传统意义上的“聊天机器... AIGC资讯大模型 7个月前01600
Nano Banana首款官方应用,谷歌Mixboard全新AI画板工具来了! 谷歌 Mixboard:AI 驱动的创意设计工具新选择 谷歌近期推出的 Mixboard,是一款聚焦 “情绪板创建” 的实验性 AI 工具。不同于传统设计工具对专业技能的高要求,它以 “降低创... AI工具推荐大模型# Google Nano Banana 11个月前01600
首个完全开源支持物理渲染纹理的3D生成模型 随着人工智能技术的不断演进,3D 内容生成开始进入更广泛的应用场景。2025 年 6 月,腾讯正式对外开源 混元3D 2.1 大模型,为游戏、美术、电影、电商等行业带来了更高质量的 3D 创作体验。本... 大模型 1年前01580
Kling 2.6 发布:原生音频加入、10秒1080P输出,AI视频全面迈入有声时代 Kling 2.6 发布:原生音频加入、10秒1080P输出,AI视频全面迈入有声时代 随着 AIGC 视频技术不断进步,AI 视频创作从静态走向动态,再从无声迈向“可听”。在 Omni 生态周的首个... AIGC资讯AI工具推荐# 1080P视频生成# AI双语对白# AI歌唱视频 8个月前01570
来了!腾讯混元3D世界模型正式发布并开源 今天,在2025世界人工智能大会腾讯论坛上,腾讯正式发布混元3D世界模型 1.0,并全面开源。 这是业界首个开源可沉浸漫游、可交互、可仿真的世界生成模型,为游戏开发、VR、数字内容创作等领域带来了... AI工具推荐大模型# 3D世界生成# 开源# 混元3D世界模型 1年前01570
百度飞桨PaddleOCR 3.0开源发布,OCR精度提升13%支持多场景文档解析 百度飞桨团队正式发布PaddleOCR 3.0,带来全新一代的文字识别与文档解析能力。新版本在OCR精度、多语种与手写体识别、文档结构解析等方面实现重大突破,并新增对国产硬件的支持,进一步推动AI文档... 大模型# AI开源工具# AI文档处理# OCR开源 1年前01560
Photoshop Beta扩展生成填充功能!加入nano banana Photoshop作为全球最受欢迎的图像编辑软件之一,随着生成填充功能的扩展,进一步增强了其创作的灵活性和精准度。通过引入Google的Gemini 2.5 Flash Image(Nano Ba... AIGC资讯AI工具推荐# Adobe Firefly# AI图像模型# FLUX.1 Kontex 10个月前01550
Wan2.5-Preview发布:AI视觉生成技术实现多模态输入与电影级视频同步生成 随着人工智能技术的不断发展,AI视觉生成领域迎来了重要的突破。Wan2.5-Preview的发布标志着AI视觉生成技术迈向了一个全新的阶段。该版本不仅提升了图像和视频生成能力,还实现了多模态输入... AI工具推荐大模型# AI视觉生成# Wan2.5-Preview# 图像生成 11个月前01550
火山引擎AI云原生服务全面升级!豆包大模型1.6 & Seedance1.0pro震撼发布! 在FORCE原动力大会上,火山引擎重磅推出豆包大模型1.6和Seedance1.0pro视频生成模型,开启AI云原生全栈服务新时代! ? 豆包大模型1.6:性能升级,价格更亲民 ? 统一定价模式 价格... 大模型# 豆包大模型 1年前01550
Qwen VLo:从“看懂”世界到“描绘”世界 多模态大模型的演进正在不断突破我们对技术边界的认知。从最初的 Qwen-VL 到如今的 Qwen2.5 -VL,我们在提升模型对图像内容的理解能力方面取得了一些进展。今天,我们正式推出 Qwen VL... AI工具推荐大模型 1年前01530
中科院推出类脑大模型 SpikingBrain:以 2% 数据实现百倍速度突破 在人工智能模型持续迭代发展的当下,长文本处理效率与数据利用效能一直是行业内亟待攻克的难题。近期,中国科学院自动化研究所的李国齐、徐波团队成功推出全球首款大规模类脑脉冲大模型 SpikingBrai... AIGC资讯大模型# 大模型 11个月前01510
DeepSite V2携手DeepSeek-R1-0528模型,实现零代码生成3D网页动画 在 ima Open Day 活动上,腾讯正式发布了全新升级的 ima 2.0 版本。此次升级使 ima 从一个简单的搜索问答工具,变成了一个能够理解复杂任务并自动拆解执行的智能伙伴。新增的 ‘任... AIGC资讯大模型# AI要点# ima 2.0# 任务模式 10个月前01500
昆仑万维发布Skywork Deep Research Agent v2:提升多模态信息处理与浏览器智能分析 昆仑万维发布Skywork Deep Research Agent v2:提升信息处理与用户体验 昆仑万维发布了 Skywork Deep Research Agent v2,该版本显著增强了... AI工具推荐大模型# Skywork Deep Research Agent# 信息处理# 多模态智能体 12个月前01490
北京团队发布全球首个人形机器人3D视觉系统,突破性多传感器融合技术 近日,北京人形机器人创新中心宣布推出全球首个人形机器人Humanoid Occupancy视觉感知系统,这一技术突破标志着在机器人感知能力方面的重大进展。通过引入语义占用表征技术,该系统能够精准建... 大模型 1年前01490
Kimi K2 高速版发布:输出速度提升至每秒40 Tokens Kimi K2 高速版的发布标志着该款产品在性能上的一次重要飞跃。在保持与原版相同参数的基础上,Kimi K2 高速版的输出速度实现了显著提升,从每秒10 Tokens提升至每秒40 Tokens... 大模型# Kimi K2 高速版# 输出速度提升 1年前01490
Gemini 3学生身份验证,免费使用一年!详细教程 点击蓝字关注我👆 一个爱代码的设计师在运营,不定时分享干货、学习方法、效率工具和AIGC趋势发展。个人网站:tomda.top 今天,弄一篇详细的白嫖Gemini 3 Pro 学生优惠教程。 成功解锁... AIGC资讯大模型# Gemini 8个月前01480
10个AI写作工具推荐!提升写作效率与创意的智能助手 随着人工智能技术的迅速发展,AI写作工具已成为提升创作效率和文本质量的重要工具。从学术论文到广告文案、小说创作,再到SEO内容生成,AI写作工具为不同需求的用户提供了便利。本文将为您推荐几款功能强大的... AI工具推荐大模型# +AI写作工具# AI写作助手# AI文案生成 1年前01480
Qwen-TTS模型发布:方言语音合成新突破。 近日,我们通过 Qwen API 更新了 Qwen-TTS ( qwen-tts-latest or qwen-tts-2025-05-22 ) 的最新版本。此次,Qwen-TTS 新增支持生成三种中... 大模型 1年前01470
千问APP接入万相 Wan2.5:视频生成能力全面升级 随着 AIGC 视频生成技术的快速发展,越来越多的创作工具开始加入高阶视频模型,提升用户的内容生产体验。近日,千问APP正式接入万相 Wan2.5 模型,其视频创作能力迎来全面升级,不仅支持音视频... AIGC资讯AI工具推荐 8个月前01460
南洋理工与上海AI Lab发布PhysX-3D:为AI生成3D模型注入“物理灵魂” 在当前的AI生成3D模型领域,虽然模型的视觉表现令人惊艳,但却缺乏真实的物理属性,导致模型在动态交互和真实感表现上存在明显的不足。为了解决这一问题,南洋理工大学与上海AI Lab联合推出了Phys... 大模型 1年前01450
Qwen 家族再上新! Qwen3 Embedding 是基于 Qwen3 基础模型训练的文本嵌入模型系列,能够将离散的、高维的符号(如文字、图片、声音等)转化为低维、连续的数字向量(Vector)的转化技术。通过捕捉不同数... 大模型 1年前01450