inception

Inception: Mercury 2

inception/mercury-2
Контекст
128 000
Вход токены
30,76 ₽/M
Выход токены
92,29 ₽/M
Кэш чтение
3,08 ₽/M
описание

Mercury 2 — это чрезвычайно быстрая LLM для рассуждений и первая LLM с диффузионным рассуждением (dLLM). Вместо последовательной генерации токенов Mercury 2 генерирует и уточняет несколько токенов параллельно, достигая более 1 000 токенов в секунду на стандартных GPU. Mercury 2 работает более чем в 5 раз быстрее, чем ведущие LLM, оптимизированные по скорости, такие как Claude 4.5 Haiku и GPT 5 Mini, при значительно меньших затратах. Mercury 2 поддерживает настраиваемые уровни рассуждений, контекст объёмом 128 К, нативное использование инструментов и вывод JSON, согласованный со схемой. Создана для рабочих процессов программирования, где задержка накапливается, для реального времени голосового поиска и циклов агентов. Совместима с API OpenAI. Подробнее читайте в блоге (откроется в новой вкладке).

модальности
интеграция

Как использовать через API

bash
# Запрос к API VEGA через inception/mercury-2
curl https://api.vega.chat/api/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $VEGA_API_KEY" \
  -d '{
    "model": "inception/mercury-2",
    "messages": [
      {  "role": "user", "content": "Hello!"  }
    ]
  }'