Gemini 2.5 Flash-Lite — это облегчённая модель рассуждения из семейства Gemini 2.5, оптимизированная для ультранизкой задержки и экономичности. Она обеспечивает повышенную пропускную способность, более быструю генерацию токенов и лучшую производительность по общим бенчмаркам по сравнению с предыдущими моделями Flash. По умолчанию «мышление» (т. е. многошаговое рассуждение) отключено, чтобы отдать приоритет скорости, но разработчики могут включить его через параметр Reasoning API (opens in new tab), чтобы избирательно обменять стоимость на интеллект.
# Запрос к API VEGA через google/gemini-2.5-flash-lite-preview-09-2025
curl https://api.vega.chat/api/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $VEGA_API_KEY" \
-d '{
"model": "google/gemini-2.5-flash-lite-preview-09-2025",
"messages": [
{ "role": "user", "content": "Hello!" }
]
}'