Qwen3-235B-A22B-Thinking-2507 — это высокопроизводительная открытая модель Mixture-of-Experts (MoE), оптимизированная для сложных задач рассуждений. Она задействует 22 млрд из своих 235 млрд параметров за прямой проход и нативно поддерживает до 262 144 токенов контекста. Этот вариант, ориентированный исключительно на рассуждения ("thinking-only"), улучшает структурированные логические рассуждения, математику, науку и генерацию длинных текстов, демонстрируя высокие результаты на бенчмарках AIME, SuperGPQA, LiveCodeBench и MMLU-Redux. Модель использует специальный режим рассуждений (</think>) и предназначена для вывода большого количества токенов (до 81 920) в сложных предметных областях. Модель прошла настройку на основе инструкций и превосходно справляется с пошаговыми рассуждениями, использованием инструментов, агентными рабочими процессами и многоязычными задачами. Эта версия представляет собой наиболее мощный открытый вариант в серии Qwen3-235B, превосходя многие закрытые модели в сценариях структурированных рассуждений.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-235b-a22b-thinking-2507",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectlogprobsbooleantop_logprobsintegerresponse_formatobjecttoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean