阿里巴巴发布QwenLong-L1-32B:首个强化学习训练长文本推理大模型,性能直逼Claude-3.7 阿里巴巴近日正式发布全球首个通过强化学习训练的长文本推理模型——QwenLong-L1-32B,专为复杂的长上下文推理与问答场景设计。该模型采用创新的GRPO和DAPO强化学习算法,在长文本推理准确性... 大模型# AI创新# AI推理# AI模型开源 1年前02580
硅基流动DeepSeek-R1推理模型API升级,支持128K上下文长度与灵活控制 硅基流动宣布其推理模型API全面升级,最大上下文长度提升至128K,极大增强了模型的推理深度与输出完整性。此次升级还引入了独立控制思维链与回复内容长度的功能,为开发者带来更高的灵活性和精准调控能力。 ... 大模型# 128K上下文# AI开发者工具# AI推理 1年前03010