NVIDIA Nemotron 3 Super — это гибридная открытая модель MoE с 120 миллиардами параметров, активирующая всего 12 миллиардов параметров для максимальной вычислительной эффективности и точности в сложных многоагентных приложениях. Построенная на гибридной архитектуре Mamba-Transformer Mixture-of-Experts с многоточечным предсказанием (MTP), она обеспечивает генерацию токенов более чем на 50% быстрее по сравнению с ведущими открытыми моделями. Модель оснащена контекстным окном в 1 миллион токенов для обеспечения долгосрочной когерентности агентов, междокументных рассуждений и многошагового планирования задач. Latent MoE позволяет вызывать 4 эксперта при стоимости инференса всего одного, повышая интеллект и обобщающую способность. Обучение RL в многосредовой среде с более чем 10 средами обеспечивает лидирующую точность на бенчмарках, включая AIME 2025, TerminalBench и SWE-Bench Verified. Полностью открытая модель с весами, наборами данных и рецептами под лицензией NVIDIA Open License, Nemotron 3 Super позволяет легко настраивать и безопасно развертывать ее где угодно — от рабочей станции до облака.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nvidia/nemotron-3-super-120b-a12b:free",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberseedintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectreasoning_effortstringinclude_reasoningboolean