IBM 发布 Granite 4.2:首个专注于推理的大规模语言模型家族
IBM 的 Granite 团队发布了 Granite 4.2,这是首个专注于推理的大规模语言模型家族。该系列包括三种不同大小的模型(3B、8B 和 30B),每个模型都经过从零开始的预训练,并通过五阶段策略扩展上下文窗口至512K令牌。这些模型还接受了链式思维和代理轨迹数据的监督微调,以及多阶段强化学习管道的后训练。其中,8B 和 70B 模型在真实沙盒环境中进行代理强化学习,学会使用工具、编辑和运行代码等操作。所有 Granite 4.2 模型都支持原生工具调用,并且可以通过 OpenAI 兼容端点发出工具调用。这些模型具有思考/非思考模式切换功能,在处理需要更多推理的任务时可以启用思考模式,而在处理简单问题时则使用低功耗的非思考模式。所有 Granite 4.2 模型均在 Apache 2.0 许可下发布,并支持 SGLang 环境。
