Coolkid mascot CoolkidLab Build in Public. Level up together.
首頁新手教學免費工具AI 新聞GitHub 精選陪跑服務關於

AI 重點新聞 · Hugging Face

IBM推出Granite 4.2推理模型系列,Apache 2.0開源

Hugging Face
原始來源
2026-08-25
發布
2026-08-26
最後確認
2026-08-28
適用版本
Granite 4.2
閱讀

發生了什麼

IBM發布了Granite模型家族最新一代Granite 4.2,這是IBM首次推出主打推理能力的Granite系列,提供3B、8B、30B三種參數規模。每個模型都能在回答前產生一段思考過程,並可在思考模式與非思考模式之間切換,另外還有一種低強度思考模式,只在簡單問題上花少量的推理預算。三種規模全部採Apache 2.0授權,可免費商用。

背景:從很會聽話到很會推理

原文提到,先前的Granite系列已經是不錯的指令遵循型助手,而Granite 4.2新增的重點是明確的推理能力。訓練方式是先用約15兆個token從零開始預訓練,並透過五階段策略把上下文長度延伸到512K token,再用思維鏈、推理與代理任務相關的資料做監督式微調,最後經過多階段強化學習。其中8B與30B這兩個較大的模型,額外經過代理強化學習,讓模型學會在真實沙盒環境中呼叫工具、寫程式與操作終端機。所有模型都支援原生工具呼叫,能接上vLLM等常見的AI服務框架。

為什麼重要

對需要串接AI模型做內部工具的團隊來說,Granite 4.2提供了免費、可商用、且原生支援工具呼叫的選項,不用完全依賴付費API。對一般讀者來說,這也是開源AI模型持續往會思考、會用工具方向發展的一個例子——愈來愈多開源模型不再只是聊天機器人,而是能實際執行多步驟任務的代理。不過模型好不好用終究要看實際場景表現,IBM官方公布的數據還需要更多獨立測試驗證。

筆者看法

IBM這次把訓練細節(資料配比、品質控管流程、去重方式)寫得相當透明,對想了解大型模型怎麼訓練出來的人是不錯的參考。至於實際推理能力好不好,官方公布的數據只是第一步,我會等社群拿它跟其他同量級開源模型實際比較後,再判斷值不值得優先選用。

原文出處:Hugging Face(原始來源日期 2026-08-25)

本文由 Lab 的 AI Agent 依原始報導起草、本人審稿後發布; 事實以「原始來源」為準,「筆者看法」為本站觀點。

← 回 AI 重點新聞列表

⚠ 本站所有內容僅供教育與研究用途,不構成投資建議,不保證任何獲利。投資有風險,使用者須自行判斷並承擔結果。
TAO 道 · Hikari Zen YouTube ↗
音樂透過 YouTube 播放
♪ TAO 道 · Hikari Zen — Japanese Zen Music(YouTube)