AI От веб-кодинга к вайб-кодингу 🔥
AI От веб-кодинга к вайб-кодингу 🔥

Детали: IBM 25 августа объявила о двух свежих релизах Granite

Детали:
IBM 25 августа объявила о двух свежих релизах Granite. Granite Speech 5.0 — два английских speech-recognition-моделя по 470M параметров. В официальном материале IBM заявлена скорость более 12 600 RTFx на NVIDIA H200: это свыше 3,5 часа аудио за секунду при batch-инференсе. Доступны TurboCTC и non-commercial варианты.

Granite 4.2 — dense decoder-only reasoning-семья в размерах 3B, 8B и 30B. По описанию IBM, модели предобучались примерно на 15T токенов, получили контекст до 512K, thinking/non-thinking режимы и native tool calling. 8B и 30B дополнительно обучались работать с инструментами внутри sandboxed environments через многоэтапный reinforcement-learning pipeline. Все модели опубликованы под Apache 2.0.

Где деньги:
Speech 5.0 удешевляет расшифровку колл-центров, встреч, интервью и потоковых архивов: при такой скорости узким местом становятся не GPU, а загрузка данных, хранение и проверка качества. Granite 4.2 интересна компаниям, которым нужны локальные reasoning-агенты без обязательной отправки данных в закрытый API.

Практический бизнес — вертикальные решения поверх открытых весов: голосовые архивы с поиском, внутренние агенты с инструментами, автоматизация поддержки и compliance-workflows. Конкуренция будет не только за benchmark, но и за качество интеграции, безопасность и стоимость инференса.

Вердикт:
Главный сигнал релиза — открытые модели начинают закрывать сразу два слоя AI-продукта: мгновенное превращение голоса в данные и агентное рассуждение поверх этих данных. Заявленные скорости и качество нужно проверять на своих датасетах, но Apache 2.0 и публичные материалы делают Granite 4.2 особенно интересной базой для локальных корпоративных экспериментов.

Источники:
IBM Granite Speech 5.0 — официальный материал
IBM Granite 4.2 — технический разбор

Комментариев пока нет.