qwen
Qwen

Qwen: Qwen3 VL 8B Thinking

qwen/qwen3-vl-8b-thinking
Контекст
256 000
Вход токены
14,4 ₽/M
Выход токены
167,97 ₽/M
описание

Qwen3-VL-8B-Thinking — это оптимизированный для рассуждений вариант мультимодальной модели Qwen3-VL-8B, разработанный для продвинутого визуального и текстового рассуждения над сложными сценами, документами и временными последовательностями. Он интегрирует улучшенное мультимодальное согласование и обработку длинного контекста (нативный 256K, расширяемый до 1M токенов) для задач, таких как научный визуальный анализ, причинно-следственное выводы и математическое рассуждение над изображениями или видеовводами.

По сравнению с изданием Instruct, версия Thinking вводит более глубокую визуально-языковую фузию и продуманные пути рассуждения, которые повышают производительность в задачах длительной логической цепочки, решении задач STEM и многошаговом понимании видео. Она достигает более сильного временного привязывания благодаря Interleaved-MRoPE и встраиваниям, учитывающим временные метки, при этом сохраняет надёжный OCR, многоязычное понимание и генерацию текста на уровне крупных LLM, работающих только с текстом.

модальности
+
интеграция

Как использовать через API

bash
# Запрос к API VEGA через qwen/qwen3-vl-8b-thinking
curl https://api.vega.chat/api/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $VEGA_API_KEY" \
  -d '{
    "model": "qwen/qwen3-vl-8b-thinking",
    "messages": [
      {  "role": "user", "content": "Hello!"  }
    ]
  }'