Qwen3, последнее поколение в серии больших языковых моделей Qwen, использует плотную архитектуру и архитектуру Mixture-of-Experts (MoE) для достижения превосходных результатов в рассуждениях, поддержке нескольких языков и выполнении продвинутых задач агентов. Его уникальная способность плавно переключаться между режимом мышления для сложных рассуждений и немыслительным режимом для эффективного диалога обеспечивает универсальную, высококачественную производительность. Значительно превосходя предыдущие модели, такие как QwQ и Qwen2.5, Qwen3 демонстрирует превосходные возможности в области математики, программирования, здравого смысла, творческого письма и интерактивного диалога. Вариант Qwen3-30B-A3B включает 30,5 миллиарда параметров (3,3 миллиарда активированных), 48 слоев, 128 экспертов (8 активированных на задачу) и поддерживает контекст до 131K токенов с YaRN, устанавливая новый стандарт среди моделей с открытым исходным кодом.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-30b-a3b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectresponse_formatobjecttoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean