Qwen3-Next-80B-A3B-Thinking — это чат-модель в линейке Qwen3-Next, ориентированная на рассуждения, которая по умолчанию выводит структурированные «мыслительные» следы. Она разработана для сложных многошаговых задач; математических доказательств, синтеза/отладки кода, логики и агентного планирования, и демонстрирует высокие результаты в оценках знаний, рассуждений, кодирования, соответствия и многоязычности. По сравнению с предыдущими вариантами Qwen3, она делает упор на стабильность при длинных цепочках рассуждений и эффективное масштабирование во время вывода, а также настроена на выполнение сложных инструкций, уменьшая при этом повторяющееся или нерелевантное поведение. Модель подходит для агентских фреймворков и использования инструментов (вызов функций), рабочих процессов с интенсивным использованием поиска и стандартизированных бенчмарков, где требуются пошаговые решения. Она поддерживает длинные, подробные завершения и использует методы, ориентированные на пропускную способность (например, предсказание нескольких токенов) для более быстрой генерации. Обратите внимание, что она работает только в режиме размышлений.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-next-80b-a3b-thinking",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectlogprobsbooleantop_logprobsintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean