Qwen3-Max — это обновленный выпуск, основанный на серии Qwen3, предлагающий существенные улучшения в логическом мышлении, следовании инструкциям, многоязычной поддержке и охвате редких знаний по сравнению с версией от января 2025 года. Он обеспечивает более высокую точность в задачах по математике, кодированию, логике и естественным наукам, более надежно следует сложным инструкциям на китайском и английском языках, снижает галлюцинации и генерирует более качественные ответы для вопросов с открытым концом, письма и общения. Модель поддерживает более 100 языков с улучшенным переводом и здравым смыслом, а также оптимизирована для генерации с помощью поиска (RAG) и вызова инструментов, хотя и не включает выделенного режима «мышления».
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-max",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerstopstring | string[]frequency_penaltynumberpresence_penaltynumberseedintegerlogprobsbooleantop_logprobsintegerresponse_formatobjectЦена зависит от длины промпта (пороги: 32K, 128K токенов). Считается по числу токенов во входном запросе.
structured_outputsbooleantoolsarraytool_choicestring | object