IBM正式发布Granite 4.2系列语言模型,覆盖3B、8B、30B三种参数规模。据IBM介绍,这些模型从零开始训练,训练数据量约为15万亿个token上下文窗口最高支持512,000个token

思考与非思考模式可切换

打开网易新闻 查看精彩图片

系列模型可以在“思考”和“非思考”两种模式之间切换,以便针对不同任务控制计算量。IBM表示,其中一种“低努力”模式能够在处理简单查询时节省计算资源。

8B和30B版本还经过了IBM所称的“智能体强化学习”训练。在这一训练过程中,模型学习使用工具、编写并运行代码,以及在真实沙盒环境中搜索网页。所有模型均支持OpenAI格式的工具调用,并可在vLLM或SGLang上运行。

语音模型同步更新

一同发布的还有Granite Speech 5.0 Turbo CTC模型。该语音模型仅有4.7亿参数,IBM称其在Open ASR Leaderboard上的速度是此前领先模型的两倍,能够在一秒内转录三小时的音频。

所有模型均采用Apache 2.0许可发布,用户可以在Hugging Face、Ollama、GitHub等平台获取。