Meta开源DINOv3:无需人工标注的AI视觉模型,颠覆图像识别技术
Meta发布DINOv3:自监督学习的AI视觉突破 Meta AI 最近开源了 DINOv3,这是新一代的通用 图像识别模型,基于 自监督学习,无需人工标注即可实现卓越的性能,标志着AI视觉技...
腾讯云推出CloudBase AI CLI:减少80%编码量,提升开发效率
腾讯云发布CloudBase AI CLI:提升开发效率,减少编码量 腾讯云推出了 CloudBase AI CLI,一款深度集成云开发平台的 AI命令行工具。该工具旨在为开发者提供更高效、便...
昆仑万维推出Mureka V7.5和MoE-TTS语音模型:提升中文歌曲创作与语音合成质量
昆仑万维推出Mureka V7.5与MoE-TTS语音模型:AI音乐与语音合成的新突破 2025年8月15日,昆仑万维集团 在 SkyWork AI技术发布周 上发布了 Mureka V7.5...
快手可灵2.1内测:首尾帧功能提升视频创作体验,优化转场与生成效率
快手可灵2.1模型发布:提升视频创作体验 快手推出了 可灵2.1模型,新增了 首尾帧功能,显著提升了视频生成的效果与流畅度。该模型在动态表现、语义理解和生成效率等方面都有明显的提升,尤其是在 ...
昆仑万维发布Skywork Deep Research Agent v2:提升多模态信息处理与浏览器智能分析
昆仑万维发布Skywork Deep Research Agent v2:提升信息处理与用户体验 昆仑万维发布了 Skywork Deep Research Agent v2,该版本显著增强了...
谷歌为Slides和Vids引入全新AI图像编辑功能,轻松替换与扩展图片背景
谷歌推出基于Gemini的AI图像编辑功能:优化背景替换与扩展 谷歌近日推出了基于 Gemini 技术的两项新 AI图像编辑功能,专为 Google Slides 和 Vids 设计。这些功能...
智元机器人发布Genie Envisioner开源平台:全新机器人操控技术路径
智元机器人发布Genie Envisioner平台:开创机器人操控新模式 智元机器人于上海发布了 Genie Envisioner(GE) 平台,这一平台通过整合 未来帧预测、策略学习 与 仿...
Kimi推出全球版PPT生成功能,依托K2驱动提升AI办公效率
Kimi K2模型即将推出全球版PPT生成功能 Kimi K2模型 以其强大的性能和开源特性,在人工智能领域取得了显著成就。作为Kimi的最新成果,K2模型不仅在多个AI任务中表现出色,还将推...
字节跳动开源M3-Agent-Control:基于Qwen 3 32B训练的高性能AI模型
字节跳动发布M3-Agent-Control:高性能AI模型 字节跳动最新推出的 M3-Agent-Control 模型,基于 Qwen 3 32B 训练,拥有 328亿参数,采用 BF16张...
超越FLUX Kontext!Nano-Banana模型在图像编辑领域展现强大角色还原与场景重构能力
Nano-Banana:超越FLUX Kontext的图像编辑新突破 Nano-Banana 模型在图像编辑领域表现出色,特别是在 角色还原、场景重构 和 图像融合 等关键技术上,超越了 FL...