NVIDIA Nemotron 3 Embed 1B — это открытая модель эмбеддингов текста от NVIDIA, оптимизированная для высокопроизводительной обработки с низкой задержкой. Она подходит для корпоративного поиска, RAG (генерации, дополненной поиском), поиска кода и рабочих процессов агентов, сохраняя более 95% точности 8-миллиардной модели при меньшем размере развертывания.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.embeddings.create(
model="nvidia/nemotron-3-embed-1b:free",
input="Текст для векторизации",
)
print(resp.data[0].embedding[:8])modelstringобязательныйinputstring | string[]обязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegerГенерация медиа (аудио/изображения) тарифицируется по фактической стоимости провайдера — итоговая цена хода видна в чате сразу после ответа.