NVIDIA Nemotron 3 Ultra — это открытая модель для рассуждений и оркестрации от NVIDIA, имеющая 55 миллиардов активных параметров из 550 миллиардов общих (MoE). Построенная на гибридной архитектуре Mixture-of-Experts (MoE), сочетающей Transformer и Mamba, она поддерживает ввод и вывод текста с длиной контекстного окна до 1 миллиона токенов. Модель подходит для длительных рабочих процессов агентов, включая оркестрацию агентов, кодовых агентов, глубокие исследования и сложные корпоративные задачи. Она особенно сильна в многоэтапных рассуждениях и планировании, с высокопроизводительным выводом, разработанным для конвейеров агентов с большим объемом. Она является частью семейства открытых моделей NVIDIA Nemotron для агнентского ИИ.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nvidia/nemotron-3-ultra-550b-a55b:free",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegertoolsarraytool_choicestring | objectreasoningobjectreasoning_effortstringinclude_reasoningboolean