Hermes 4 — это крупномасштабная модель рассуждений, построенная на основе Meta-Llama-3.1-405B и выпущенная Nous Research. Она представляет гибридный режим рассуждений, в котором модель может выбирать между внутренним обдумыванием с использованием <think>...</think> следов или прямым ответом, предлагая гибкость между скоростью и глубиной. Пользователи могут контролировать поведение рассуждений с помощью булева значения `reasoning` `enabled`. [Узнайте больше в нашей документации](https://openrouter.ai/docs/use-cases/reasoning-tokens#enable-reasoning-with-default-config) Модель прошла обучение инструкциям с расширенным корпусом данных после обучения (~60B токенов), делая акцент на следах рассуждений, что улучшает производительность в математике, коде, STEM и логических рассуждениях, сохраняя при этом широкую полезность в качестве ассистента. Она также поддерживает структурированные выходные данные, включая режим JSON, соответствие схеме, вызовы функций и использование инструментов. Hermes 4 обучена для управляемости, снижения частоты отказов и соответствия нейтральному, управляемому пользователем поведению.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nousresearch/hermes-4-405b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerfrequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberresponse_formatobjectreasoningobjectinclude_reasoningboolean