API VEGA
nvidia

NVIDIA: Llama Nemotron Rerank VL 1B V2 (free)

Free
nvidia/llama-nemotron-rerank-vl-1b-v2:free
Контекст
10 240
описание

Llama Nemotron Rerank VL 1B V2 — это мультимодальная модель реранкинга с 1,7 млрд параметров от NVIDIA. Она оценивает релевантность изображений документов и текста по отношению к пользовательским запросам и предназначена для пайплайнов vision RAG, работающих с диаграммами, таблицами, инфографикой и мультимедийными документами. Модель функционирует как кросс-энкодер, который принимает текстовые запросы в паре с изображениями, текстом или комбинированными документами на входе, обеспечивая примерно 6–7% улучшение показателя recall по сравнению с базовыми подходами, основанными только на эмбеддингах, в бенчмарках визуального поиска по документам.

модальности
+
интеграция

Как использовать через API

bash
# Запрос к API VEGA через nvidia/llama-nemotron-rerank-vl-1b-v2:free
curl https://api.vega.chat/api/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $VEGA_API_KEY" \
  -d '{
    "model": "nvidia/llama-nemotron-rerank-vl-1b-v2:free",
    "messages": [
      {  "role": "user", "content": "Hello!"  }
    ]
  }'