支付宝发布UI-UG:全新多模态大模型实现UI理解与生成的完美融合
在移动互联网时代,用户界面(UI)不仅是用户与数字世界的连接桥梁,更直接影响到用户体验和业务转化效果。随着AI技术的发展,越来越多的学术与产业界开始关注如何提升UI设计与开发的效率。为了进一步推进...
DeepSeek V3.2-Exp发布:全新Sparse Attention技术提升效率,API降价50%
DeepSeek团队近日发布了其最新的模型版本——DeepSeek V3.2-Exp,这一版本引入了创新的注意力机制——DeepSeek Sparse Attention (DSA)。该技术在大幅...
阿里通义Qwen3-Omni全模态大模型登顶Hugging Face全球第一,7款模型包揽前十
阿里通义团队的最新成果引起了全球关注——他们的7款模型在Hugging Face全球开源模型榜单中表现卓越,尤其是Qwen3-Omni,作为一款全模态大模型,凭借其强大的音视频处理能力以及稳定的文...
全新开源高性能AI思考模型 Ring-flash-2.0!超越传统性能的计算与推理能力
蚂蚁百灵团队最新发布的开源AI模型 Ring-flash-2.0,是一款高性能的思考模型,在多个基准测试中展现出了强大的计算和推理能力。该模型在资源效率和计算能力方面表现出色,创新的两阶段强化学习训练...
VideoFrom3D 框架:无需昂贵 3D 数据集,生成逼真 3D 场景视频的新方案
在 3D 场景视频生成领域,传统技术长期受限于 “依赖昂贵配对 3D 数据集”“稀疏视角重建难”“动态场景易漂移” 等痛点。近期推出的 VideoFrom3D 框架通过融合图像与视频扩散模型,实现...
苹果推出 Manzano 图像模型:兼具图像理解与生成能力,文本任务表现优异
在图像 AI 领域,苹果公司近期推出的全新 Manzano 图像模型引发行业关注。该模型打破了当前开源图像模型 “要么侧重理解、要么侧重生成” 的局限,实现了图像理解与生成双重能力的高效融合,为图...
快手发布KAT系列代码大模型:KAT-Dev-32B与KAT-Coder,提升编程效率与代码智能
快手发布KAT系列大模型,代码能力表现出 快手旗下Kwaipilot团队近日推出了两款在代码智能领域表现突出的新模型——KAT-Dev-32B和KAT-Coder。这两款模型旨在满足不同用...
腾讯放大招!混元图像 3.0 开源了!
Hi, 朋友们。 混元图像3.0,真的来了——开源,免费开放使用。 正式介绍一下:混元图像3.0(HunyuanImage 3.0),是首个工业级原生多模态生图模型,参数规模80B,也是目前测...
Photoshop Beta扩展生成填充功能!加入nano banana
Photoshop作为全球最受欢迎的图像编辑软件之一,随着生成填充功能的扩展,进一步增强了其创作的灵活性和精准度。通过引入Google的Gemini 2.5 Flash Image(Nano Ba...
OpenAI发布GPT-5基准测试:AI模型在多个行业逐渐逼近人类专家
OpenAI最近发布了新基准测试GDPval,这一测试旨在评估AI模型在多个行业和44种职业中的表现。根据最新的测试结果,GPT-5和Claude Opus4.1在部分任务中已经能够接近人类行业专...