IBM正式推出Granite 4.2语言模型系列,覆盖3B、8B和30B三种参数规模。这批模型在约15万亿token上完成训练,上下文窗口最高支持512,000 token,适合处理长文档和复杂代码场景。

内置代理能力来自“代理强化学习”

打开网易新闻 查看精彩图片

较大的模型采用了“agentic RL”训练方式,让模型自行学习工具调用代码执行。这意味着模型不只是生成文本,还能在训练过程中掌握与外部工具交互的能力,为后续构建自动化代理应用提供基础。

Apache 2.0协议开放权重

所有Granite 4.2模型均以Apache 2.0许可证发布。开发者可以自由下载权重、进行微调或商用部署,无需担心授权限制。这一选择延续了IBM开源模型生态中的布局,也降低了企业接入门槛。

从参数规模看,3B适合轻量部署和边缘设备,8B在性能与资源消耗之间取得平衡,30B则面向需要更强推理能力的任务。结合长上下文窗口,这批模型可以覆盖从快速响应到深度分析的不同需求。