IBM正式发布Granite 4.2系列语言模型,覆盖3B、8B、30B三种参数规模。据IBM介绍,这些模型从零开始训练,训练数据量约为15万亿个token,上下文窗口最高支持512,000个token。
思考与非思考模式可切换
打开网易新闻 查看精彩图片
该系列模型可以在“思考”和“非思考”两种模式之间切换,以便针对不同任务控制计算量。IBM表示,其中一种“低努力”模式能够在处理简单查询时节省计算资源。
8B和30B版本还经过了IBM所称的“智能体强化学习”训练。在这一训练过程中,模型学习使用工具、编写并运行代码,以及在真实沙盒环境中搜索网页。所有模型均支持OpenAI格式的工具调用,并可在vLLM或SGLang上运行。
语音模型同步更新
一同发布的还有Granite Speech 5.0 Turbo CTC模型。该语音模型仅有4.7亿参数,IBM称其在Open ASR Leaderboard上的速度是此前领先模型的两倍,能够在一秒内转录三小时的音频。
所有模型均采用Apache 2.0许可发布,用户可以在Hugging Face、Ollama、GitHub等平台获取。
热门跟贴