DeepSeek开启识图模式灰度测试:多模态视觉理解能力落地,AI看图问答体验升级 DeepSeek近期开始灰度测试全新的“识图模式”,在移动端和网页版中新增图片理解入口。用户可通过该模式上传图片,让DeepSeek进行画面描述、内容识别、截图分析和视觉问答。这意味着DeepSeek... AIGC资讯# AI看图# AI识图# deepseek 3个月前01300
LLaVA-OneVision-1.5:全面开源的多模态模型 AI多模态领域再迎重磅开源项目。由 EvolvingLMMs-Lab 团队推出的 LLaVA-OneVision-1.5 模型正式发布,凭借卓越的图像与文本理解能力,在多项基准测试中表现优异,性能... AIGC资讯大模型# AI视频理解# LLaVA-OneVision-1.5# Qwen2.5-VL 10个月前02110
火山引擎发布豆包大模型1.6-vision:视觉理解能力重大突破,携“Viking长期记忆”功能引领智能化转型 火山引擎今日正式发布了其最新人工智能产品 —— 豆包大模型1.6-vision。这一版本的亮相,标志着视觉理解能力取得了新的里程碑式突破,也为AI技术在产业中的落地应用提供了更强支撑。 1. ... AIGC资讯AI工具推荐# 1.6-vision# 图像识别# 火山引擎 10个月前02710
百度Qianfan-VL开源发布:昆仑芯助力多模态AI的新突破 在小说创作的过程中,很多作者都会遇到写作瓶颈、文风不一致或者内容扩展困难等问题。为了帮助写作者们克服这些挑战,蛙蛙写作应运而生。这款AI小说写作助手为作者们提供了全面的润色、改写和扩写功能,帮助你提升... AIGC资讯AI工具推荐# Qianfan-VL# 图像识别# 多模态AI 10个月前01820
Meta开源DINOv3:无需人工标注的AI视觉模型,颠覆图像识别技术 Meta发布DINOv3:自监督学习的AI视觉突破 Meta AI 最近开源了 DINOv3,这是新一代的通用 图像识别模型,基于 自监督学习,无需人工标注即可实现卓越的性能,标志着AI视觉技... AIGC资讯AI免费工具# DINOv3# Meta AI# 图像识别 12个月前04070