Встраивающая модель Llama Nemotron Embed VL 1B V2 оптимизирована для извлечения информации при ответе на мультимодальные вопросы. Модель может встраивать «документы» в виде изображений, текста или комбинации изображений и текста. Документы могут быть извлечены при поступлении запроса пользователя в текстовой форме. Модель поддерживает изображения, содержащие текст, таблицы, диаграммы и инфографику.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.embeddings.create(
model="nvidia/llama-nemotron-embed-vl-1b-v2:free",
input="Текст для векторизации",
)
print(resp.data[0].embedding[:8])modelstringобязательныйinputstring | string[]обязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegerГенерация медиа (аудио/изображения) тарифицируется по фактической стоимости провайдера — итоговая цена хода видна в чате сразу после ответа.