阿里巴巴发布QwenLong-L1-32B:首个强化学习训练长文本推理大模型,性能直逼Claude-3.7 阿里巴巴近日正式发布全球首个通过强化学习训练的长文本推理模型——QwenLong-L1-32B,专为复杂的长上下文推理与问答场景设计。该模型采用创新的GRPO和DAPO强化学习算法,在长文本推理准确性... 大模型# AI创新# AI推理# AI模型开源 1年前02590
通义实验室发布 Qwen3.6-Plus:聚焦 Agentic Coding 与百万级上下文,提升 AI 编程稳定性 通义实验室正式推出 Qwen3.6-Plus。从官方博客来看,Qwen 团队对它的定位非常明确:这不是一次普通的小版本升级,而是一次围绕 Real World Agents 的能力强化。官方明确写到... AIGC资讯AI工具推荐# Agentic Coding# AI编程# Coding Agent 4个月前01190
智谱 AI 正式开源 GLM-5.2 模型:主打 1M 无损上下文与长程代码任务 智谱 AI 正式开源新一代大模型 GLM-5.2。作为面向长程任务和代码生成场景打造的旗舰模型,GLM-5.2 的重点能力集中在 1M 无损上下文、长程代码任务执行、复杂工程理解、思考档位控制和多端应... AIGC资讯# 1M上下文# 1M无损上下文# AI大模型 1个月前0530
Kimi K3正式发布:2.8万亿参数、100万Token上下文,完整模型权重即将开放 2026年7月17日,月之暗面正式推出新一代旗舰模型 Kimi K3。 Kimi K3总参数规模达到 2.8万亿,基于Kimi混合线性注意力机制 **Kimi Delta Attention(KDA... AIGC资讯# 100万Token# 2.8万亿参数# 3万亿级模型 3周前0520