Hermes 4 70B — это гибридная модель рассуждений от Nous Research, построенная на базе Meta-Llama-3.1-70B. Она представляет тот же гибридный режим, что и более крупная версия 405B, позволяя модели либо отвечать напрямую, либо генерировать явные трассировки рассуждений <think>...</think> перед ответом. Пользователи могут управлять поведением рассуждений с помощью булева значения `reasoning` `enabled`. [Узнайте больше в нашей документации](https://openrouter.ai/docs/use-cases/reasoning-tokens#enable-reasoning-with-default-config) Этот вариант 70B обучен на расширенном посттренировочном корпусе (~60B токенов) с упором на проверенные данные рассуждений, что привело к улучшениям в математике, программировании, STEM, логике и структурированных выходных данных, сохраняя при этом общую производительность ассистента. Он поддерживает режим JSON, соблюдение схем, вызов функций и использование инструментов, а также разработан для большей управляемости с уменьшенным уровнем отказов.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="nousresearch/hermes-4-70b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerfrequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberresponse_formatobjectreasoningobjectinclude_reasoningboolean