IBM Granite 4.2: модели с рассуждениями в размерах 3B, 8B и 30B
IBM выпустила Granite 4.2 — семейство плотных моделей с рассуждениями в трёх размерах: 3, 8 и 30 млрд параметров. Модели обучены с нуля на ~15 трлн токенов, держат контекст до 512 тыс. токенов и распространяются по лицензии Apache 2.0.

IBM выпустила Granite 4.2 — первое в линейке семейство плотных моделей с рассуждениями. Размеров три: 3, 8 и 30 млрд параметров. Все модели обучены с нуля, распространяются по лицензии Apache 2.0 и лежат в коллекции IBM на Hugging Face.
Что нового
Прошлые версии Granite были ассистентами, которые хорошо следуют инструкциям. В 4.2 модель может сначала рассуждать, а потом отвечать. Рассуждения включаются и выключаются, а для простых вопросов есть облегчённый режим с коротким бюджетом на размышления. Вызывать инструменты умеют все три модели, вызовы идут в формате OpenAI function calling.
Модели на 8 и 30 млрд параметров прошли ещё и агентное обучение с подкреплением: правили и запускали код, работали в терминале и искали в интернете внутри реальных изолированных сред.
Как обучали
Предобучение шло на ~15 трлн токенов в пять фаз. Последняя фаза расширила контекст до 512 тыс. токенов. Затем модели дообучили на ~7,2 млн примеров, это около 100 млрд токенов. Почти треть набора — агентные траектории, и 69% из них — задачи по разработке ПО, собранные в разных обвязках: OpenHands, SWE-agent, Codex, Gemini CLI и других. Качество примеров проверяли модели-судьи GPT-OSS-120B и Gemma 4.
Дальше шла цепочка этапов обучения с подкреплением на асинхронном GRPO: математика, код, наука, следование инструкциям, вызов инструментов, затем агентный блок для 8B и 30B. Модель на 30 млрд параметров получила ещё одну фазу дообучения, сфокусированную на агентном программировании.
Как запустить
Granite 4.2 работает через OpenAI-совместимый эндпоинт, например в vLLM, и поддерживается в SGLang. Размеры от 3 до 30 млрд параметров позволяют развернуть модели на собственном оборудовании, если данные нельзя отдавать во внешнее облако.
TL;DR
Главное
Granite 4.2 добавляет в линейку IBM явные рассуждения и агентные навыки, оставаясь в размерах, которые можно развернуть на своём оборудовании.
Ключевые факты
- /Три размера: 3, 8 и 30 млрд параметров, плотная архитектура без смеси экспертов.
- /Предобучение с нуля на ~15 трлн токенов, контекст расширен до 512 тыс. токенов.
- /Режим рассуждений можно включать и выключать, для простых вопросов есть облегчённый режим.
- /Модели 8B и 30B дополнительно обучены агентной работе: код, терминал, веб-поиск.
- /Лицензия Apache 2.0.
Инсайт
69% агентной части обучающих данных — задачи по разработке ПО, собранные в чужих агентных обвязках, от OpenHands до Codex и Gemini CLI.



