Qwen3-Coder-Next 发布,面向智能体编程与本地开发
Qwen 团队推出开源权重语言模型 Qwen3-Coder-Next,面向编程智能体与本地开发。该模型基于 Qwen3-Next-80B-A3B-Base 构建,采用混合注意力与 MoE 架构,并通过可执行编程任务、环境交互和强化学习进行智能体训练。
文章将模型的训练配方与基准表现放在一起,呈现小激活参数规模下的编程智能体效率取舍,也交代了其训练侧重点。
Qwen 团队推出开源权重语言模型 Qwen3-Coder-Next,面向编程智能体与本地开发。该模型基于 Qwen3-Next-80B-A3B-Base 构建,采用混合注意力与 MoE 架构,并通过可执行编程任务、环境交互和强化学习进行智能体训练。
文章将模型的训练配方与基准表现放在一起,呈现小激活参数规模下的编程智能体效率取舍,也交代了其训练侧重点。
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开放权重大语言模型,采用 Apache 2.0 许可。官方称,它们在推理任务上优于规模相近的开放模型,具备较强工具使用能力,并针对消费级硬件上的高效部署进行了优化。
gpt-oss-120b 和 gpt-oss-20b 采用 Apache 2.0 许可,并强调推理、工具使用与消费级硬件部署,可从这些维度了解其定位。
月之暗面发布并开源 Kimi K2,这是一个拥有 32 billion 激活参数、1 trillion 总参数的 MoE 模型,提供 Kimi-K2-Base 和 Kimi-K2-Instruct 两个版本。
Kimi K2 同时公布了模型规模、MuonClip 稳定训练方案和智能体数据构建流程,呈现了从预训练到工具使用能力的技术路径。