Детали:
IBM 25 августа объявила о двух свежих релизах Granite. Granite Speech 5.0 — два английских speech-recognition-моделя по 470M параметров. В официальном материале IBM заявлена скорость более 12 600 RTFx на NVIDIA H200: это свыше 3,5 часа аудио за секунду при batch-инференсе. Доступны TurboCTC и non-commercial варианты.
Granite 4.2 — dense decoder-only reasoning-семья в размерах 3B, 8B и 30B. По описанию IBM, модели предобучались примерно на 15T токенов, получили контекст до 512K, thinking/non-thinking режимы и native tool calling. 8B и 30B дополнительно обучались работать с инструментами внутри sandboxed environments через многоэтапный reinforcement-learning pipeline. Все модели опубликованы под Apache 2.0.
Где деньги:
Speech 5.0 удешевляет расшифровку колл-центров, встреч, интервью и потоковых архивов: при такой скорости узким местом становятся не GPU, а загрузка данных, хранение и проверка качества. Granite 4.2 интересна компаниям, которым нужны локальные reasoning-агенты без обязательной отправки данных в закрытый API.
Практический бизнес — вертикальные решения поверх открытых весов: голосовые архивы с поиском, внутренние агенты с инструментами, автоматизация поддержки и compliance-workflows. Конкуренция будет не только за benchmark, но и за качество интеграции, безопасность и стоимость инференса.
Вердикт:
Главный сигнал релиза — открытые модели начинают закрывать сразу два слоя AI-продукта: мгновенное превращение голоса в данные и агентное рассуждение поверх этих данных. Заявленные скорости и качество нужно проверять на своих датасетах, но Apache 2.0 и публичные материалы делают Granite 4.2 особенно интересной базой для локальных корпоративных экспериментов.
Источники:
IBM Granite Speech 5.0 — официальный материал
IBM Granite 4.2 — технический разбор
AI От веб-кодинга к вайб-кодингу 🔥
26 авг 2026 10:02
Комментариев пока нет.