Qwen3-Coder-30B-A3B-Instruct — это модель Mixture-of-Experts (MoE) с 30,5 миллиардами параметров и 128 экспертами (8 активных на прямой проход), разработанная для продвинутой генерации кода, понимания репозиториев в большом масштабе и использования агентами инструментов. Созданная на архитектуре Qwen3, она поддерживает исходную длину контекста в 256 тысяч токенов (с возможностью расширения до 1 миллиона с помощью Yarn) и показывает высокие результаты в задачах, связанных с вызовами функций, использованием браузера и структурированным автодополнением кода. Эта модель оптимизирована для следования инструкциям без «режима размышления» и хорошо интегрируется с форматами использования инструментов, совместимыми с OpenAI.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-coder-30b-a3b-instruct",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogprobsbooleantop_logprobsintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | object