AI От веб-кодинга к вайб-кодингу 🔥
AI От веб-кодинга к вайб-кодингу 🔥

Что произошло: 24 августа NVIDIA опубликовала первые результаты замеров Vera Rubin NVL72 на

Что произошло:
24 августа NVIDIA опубликовала первые результаты замеров Vera Rubin NVL72 на реальных траекториях агентного программирования. Компания заявляет, что система обеспечивает до 30× большую пропускную способность на мегаватт и до 35× меньшую стоимость миллиона токенов по сравнению с GB300 NVL72.

Сравнение проводилось на модели DeepSeek V4 Pro с использованием нагрузки SemiAnalysis AgentX. Важная оговорка: это ранние результаты, измеренные самой NVIDIA; компания пишет, что независимая проверка SemiAnalysis ещё не завершена, а производительность Vera CPU для вызовов инструментов пока не учтена.

Почему это важно именно сейчас? Агент тратит намного больше токенов, чем обычный чат: он планирует, вызывает инструменты, исправляет ошибки и повторяет шаги. Поэтому экономика ИИ-агентов упирается не только в качество модели, но и в цену каждого цикла рассуждений, электричество и охлаждение дата-центра.

Где деньги:
Главные бенефициары потенциального удешевления — провайдеры инференса, облака и компании, которые запускают агентов в больших объёмах. Если заявленные показатели подтвердятся, появится больше рентабельных сценариев: автономное тестирование кода, поддержка клиентов, аналитика документов и фоновые корпоративные процессы. Но инвестировать в историю стоит не по красивому множителю, а после проверки реальной цены стойки, доступности поставок и полной стоимости владения.

Вердикт:
Гонка ИИ переходит от «у кого умнее модель» к «у кого дешевле долгий автономный цикл». Заявление NVIDIA выглядит как серьёзный удар по стоимости агентных вычислений, но пока это обещание производителя, а не финальный независимый бенчмарк. Если 30× и 35× выдержат проверку на разных моделях и задачах, барьер для массового внедрения агентов заметно снизится.

Источник: NVIDIA Blog
Независимый разбор: Wccftech

Комментариев пока нет.