NVIDIA Nemotron™ 3 Nano Omni — это открытая мультимодальная модель с 30 миллиардами параметров (30B-A3B), разработанная для функционирования в качестве суб-агента восприятия и контекста в корпоративных агентских системах. Она принимает текстовые, графические, видео- и аудиовходы и выдает текстовый вывод, позволяя агентам воспринимать и анализировать различные модальности в рамках одного цикла инференса. Созданная на гибридной архитектуре Transformer-Mamba с использованием MoE, слоев Conv3D для видео и технологии Efficient Video Sampling (EVS), она обеспечивает примерно в 2 раза более высокую пропускную способность и в 2,5 раза меньшие вычислительные затраты для анализа видео по сравнению с раздельными конвейерами обработки изображений и речи. Модель поддерживает контекст длиной до 300 тыс. токенов и бюджет рассуждений в 16 384 токена, с возможностью расширенного анализа посредством функции reasoning.enabled на OpenRouter.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegertoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean