DeepSeek V4 Flash на Colibri: тест производительности на GPU от 128 ГБ VRAM
DeepSeek V4 Flash на платформе Colibri с GPU от 128 ГБ VRAM достигает скорости префилла до 2300 токенов/с на контекстах 200k+ токенов и задержки первого токена 4–7 секунд. Модель обходит Sonnet 5 по скорости обработки длинных промптов и стабильно держит контекст в агентных сессиях. Читайте разбор с цифрами, сравнением и сценариями использования.
Читать статью →
Подписаться на канал
AiManual - База знаний по ИИ
6 авг 2026 09:20
Комментариев пока нет.