NVIDIA Nemotron 3 Ultra — это открытая модель для рассуждений и оркестрации, разработанная NVIDIA, с 55 миллиардами активных параметров из 550 миллиардов (MoE). Она построена на гибридной архитектуре Transformer-Mamba с использованием смеси экспертов, поддерживает текстовый ввод и вывод с размером контекстного окна до 1 миллиона токенов. Модель подходит для длительных рабочих процессов с агентами, включая оркестрацию агентов, кодирование агентов, глубокие исследования и сложные корпоративные задачи. Она особенно сильна в многоэтапных рассуждениях и планировании, с высокопроизводительным инференсом, разработанным для конвейеров агентов с большим объемом. Nemotron 3 Ultra является частью семейства открытых моделей NVIDIA Nemotron для агентного ИИ.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nvidia/nemotron-3-ultra-550b-a55b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectreasoning_effortstringinclude_reasoningboolean