生数Vidu Q3上线华为云:打造“为剧而生”的多模态视频生成方案 近日,生数科技新一代多模态视频生成大模型 Vidu Q3 正式上线华为云 MaaS 模型即服务。该模型主打文生视频、图生视频一体化成片能力,支持 16 秒声画同步生成、1080P 高清画质、多镜头叙事... AIGC资讯# 1080P视频生成# AI视频生成# Vidu Q3 1个月前0480
字节跳动开源 Lance 3B:一个模型同时完成图像、视频理解、生成与编辑 最近,字节跳动智能创作团队开源了 Lance,一个轻量级原生统一多模态大模型。这款模型最吸引人的地方,不是参数规模有多夸张,而是它试图用一个统一框架同时完成图像和视频的理解、生成与编辑任务。根据 ... AIGC资讯# Lance# Lance 3B# 原生统一多模态模型 2个月前01210
腾讯发布 OpenSearch-VL:开源多模态深度搜索 Agent,让 AI 学会边看边搜边推理 最近,腾讯混元联合 UCLA、香港中文大学、香港大学等机构发布了 OpenSearch-VL。 从论文标题来看,OpenSearch-VL 的定位很明确:它不是单一模型,也不只是一个搜索工具,而是一套... AIGC资讯# AI Agent# OpenSearch-VL# 多模态大模型 3个月前0930
DeepSeek开启识图模式灰度测试:多模态视觉理解能力落地,AI看图问答体验升级 DeepSeek近期开始灰度测试全新的“识图模式”,在移动端和网页版中新增图片理解入口。用户可通过该模式上传图片,让DeepSeek进行画面描述、内容识别、截图分析和视觉问答。这意味着DeepSeek... AIGC资讯# AI看图# AI识图# deepseek 3个月前01300
商汤发布 SenseNova U1:原生理解生成统一模型开源,告别拼接式多模态AI 商汤科技正式发布并开源 日日新 SenseNova U1 系列原生理解生成统一模型。该模型基于商汤自主研发的 NEO-unify 架构,在单一模型架构中统一多模态理解、推理与生成能力,目标是让AI不再... AIGC资讯# NEO-unify# SenseNova U1# SenseNova U1 Lite 3个月前0890
月之暗面 Kimi K3 或于第三季度发布:2.5万亿参数与百万字上下文成最大看点 月之暗面下一代大模型 Kimi K3 近期传出新进展。根据多家媒体与行业信息源报道,Kimi K3 预计将在今年第三季度发布,参数规模有望达到 2.5万亿,上下文长度标准或提升至约 100万字。如... AIGC资讯# 2.5万亿参数# Agent大模型# AI大模型 3个月前03290
通义实验室开源Fun-CineForge:影视级AI配音模型支持多人对话与精准口型同步 随着生成式 AI 持续深入音视频内容生产,AI配音正从基础语音合成逐步走向更复杂、更专业的影视级应用场景。尤其在影视内容、短剧制作、动画配音、国际化译制和多角色对白处理中,传统 AI配音方案往往会遇到... AIGC资讯开源项目# AI配音# Fun-CineForge# 口型同步 5个月前02100
腾讯混元图像 3.0 正式开源:800 亿参数图生图模型助力 AI 图像创作 随着生成式 AI 在图像创作和编辑领域的持续发展,图生图模型正成为提升创作效率的重要工具。近日,腾讯混元团队正式开源混元图像 3.0 图生图模型。该模型在参数规模、模型架构和实际编辑能力等方面均实现明... AIGC资讯AI工具推荐# AI图像创作# AI图像编辑# 图生图模型 6个月前01230
智谱AI携手华为开源GLM-Image:国产算力驱动多模态SOTA模型全链路落地 一、智谱AI联合华为开源GLM-Image,国产多模态AI迎来新突破 近日,智谱AI(Zhipu AI) 与 华为(Huawei) 联合宣布开源最新多模态大模型 GLM-Image。该模型在性... AIGC资讯AI工具推荐# GLM-Image# 华为# 国产AI芯片 7个月前01830
智源研究院推出Emu3.5:全球最强多模态世界模型,精准预测“下一秒”世界状态 随着人工智能技术的不断进步,AI领域的创新步伐也在加速。近日,北京智源人工智能研究院(BAAI)推出的Emu3.5多模态大模型引起了业内的广泛关注。这一突破性技术不仅能够处理图像、文本和视频等多模... AIGC资讯AI工具推荐# Emu3.5# 世界模拟器# 人工智能技术 8个月前01950
小米开源7B多模态大模型MiMo-VL,推出智能AI管家Miloco 小米近日正式在 Hugging Face 与 GitHub 平台同步开源了其最新的 7B参数多模态大模型——“Xiaomi-MiMo-VL-Miloco-7B-GGUF”,并基于该模型推出智能家居... AIGC资讯大模型# AI智能家居# Miloco# MiMo-VL 9个月前03410
支付宝发布UI-UG:全新多模态大模型实现UI理解与生成的完美融合 在移动互联网时代,用户界面(UI)不仅是用户与数字世界的连接桥梁,更直接影响到用户体验和业务转化效果。随着AI技术的发展,越来越多的学术与产业界开始关注如何提升UI设计与开发的效率。为了进一步推进... AIGC资讯AI工具推荐# UI-UG# UI理解与生成# UI自动化 10个月前02890
上海 AI 实验室开源 InternVL3.5:2410 亿参数多模态大模型,性能超越 GPT-5,重新定义开源 AI 边界 2025 年 8 月 31 日,上海人工智能实验室(OpenGVLab)正式开源书生・万象 InternVL3.5,以2410 亿参数旗舰模型 + 九种尺寸矩阵的全量级布局,首次实现开源多模态大模... AIGC资讯AI工具推荐# InternVL3.5# 上海AI实验室# 多模态大模型 11个月前02300
MiniCPM-V4.0开源发布:堪称“手机上的GPT-4V”,轻量级多模态大模型 MiniCPM-V4.0开源发布:移动设备上的GPT-4V,轻量级多模态大模型 MiniCPM-V4.0作为一款轻量级多模态大模型,凭借卓越的性能和优化设计,在图像、视频理解和多轮对话等任务中... AIGC资讯大模型# GPT-4V# MiniCPM-V4.0# 图像视频理解 1年前03050
小米开源多模态大模型MiMo-VL-7B参数超越巨型模型,引领视觉推理新突破 小米正式开源多模态大模型Xiaomi MiMo-VL-7B,凭借仅7B参数量,在各类多模态任务(包括图片、视频和语言推理)上实现出色表现,甚至超越阿里Qwen-2.5-VL-72B等参数体量达其十倍的... 大模型# AI创新# AI模型开源# GUI操作AI 1年前03620
紫东太初 紫东太初是由中国科学院自动化研究所和武汉人工智能研究院联合推出的新一代多模态大模型,凭借其强大的功能和广泛的应用场景,成为人工智能领域的焦点。本文将为您详细介绍紫东太初的功能、官网访问方法以及常见问题... 大模型# 中科院大模型# 多模态大模型# 官网访问 1年前02510