AiManual - База знаний по ИИ
AiManual - База знаний по ИИ

DeepSeek V4 Flash на Colibri: тест производительности на GPU от 128 ГБ VRAM

DeepSeek V4 Flash на Colibri: тест производительности на GPU от 128 ГБ VRAM

DeepSeek V4 Flash на платформе Colibri с GPU от 128 ГБ VRAM достигает скорости префилла до 2300 токенов/с на контекстах 200k+ токенов и задержки первого токена 4–7 секунд. Модель обходит Sonnet 5 по скорости обработки длинных промптов и стабильно держит контекст в агентных сессиях. Читайте разбор с цифрами, сравнением и сценариями использования.

Читать статью →

Подписаться на канал

Комментариев пока нет.