腾讯混元大模型团队宣布,混元图像2.0将在5月16日发布,这是腾讯在AI视觉领域的重要突破,以‘更智能、更开放、更中国’为核心理念。
腾讯混元大模型实验室正式宣布,混元图像2.0将于5月16日全场景开放商用。新版本集成了NeRF-Pro动态建模框架,在中文语境下文本到图像生成准确率提升至94.3%,场景分割精度达SAM水平(mIoU 89.6),参数规模扩展至180亿可训练单元。
✦ 关键技术创新
? 动态表征学习
- 支持7680×4320分辨率无损扩展
- 中文OCR识别错误率降至1.2%
- 跨模态对齐误差控制<3μm(像素级)
? 计算架构升级
▸ 采用Diffusion-Transformer Hybrid架构
▸ 推理速度优化至单卡A100处理32FPS
▸ 模型蒸馏压缩比突破21:1(精度损失<1.8%)
? 本土化增强
- 内置300万级中文文化元素素材库
- 支持书法/国画/戏曲等专项生成模式
- 民族文化场景生成准确度92.7%
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...
