API VEGA
deepseek

DeepSeek: DeepSeek V4.1 Flash (batch)

deepseek/deepseek-v4.1-flash:batch
Контекст
1 048 576
Вход токены
14,16 ₽/M
Выход токены
42,48 ₽/M
Кэш чтение
0,38 ₽/M
описание

DeepSeek V4.1 Flash — это разреженная модель семейства mixture-of-experts от DeepSeek, и первая, построенная на архитектуре Causal Encoder-Decoder (CED) компании. Она активирует 8B параметров при вводе и 16B при выводе из основной сети на 552B параметров — асимметричное распределение, которое поддерживает низкий объём вычислений на токен относительно общего размера модели. Понимание изображений является неотъемлемой частью архитектуры: визуальные и текстовые вложения обучаются совместно с самого начала предобучения, а не добавляются после, как в более раннем экспериментальном варианте V4 Flash Vision Exp.

Подходит для задач, связанных с программированием, работы в терминале и использования компьютера, а также для задач с длительным горизонтом планирования, которые должны выполняться до конца через множество шагов, и для анализа с длинным контекстом. Сжатое KV-кэширование сокращает объём памяти для кэша примерно до четверти от предыдущего поколения Flash, значительно снижая затраты на рабочие нагрузки агентного типа. DeepSeek позиционирует её как экономичный уровень семейства V4.1 и сообщает, что она превосходит V4 Pro по производительности, скорости и времени выполнения задач.

модальности
+
интеграция

Как использовать через API

bash
# Запрос к API VEGA через deepseek/deepseek-v4.1-flash:batch
curl https://api.vega.chat/api/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $VEGA_API_KEY" \
  -d '{
    "model": "deepseek/deepseek-v4.1-flash:batch",
    "messages": [
      {  "role": "user", "content": "Hello!"  }
    ]
  }'