Qwen3-VL-30B-A3B-Thinking — это мультимодальная модель, объединяющая мощные возможности генерации текста с пониманием визуальной информации в изображениях и видео. Её вариант Thinking улучшает выполнение задач в области STEM, математики и сложных задач. Она превосходно разбирается в восприятии реальных/синтетических категорий, пространственном соотнесении 2D/3D и понимании длинных визуальных фрагментов, демонстрируя конкурентоспособные результаты на мультимодальных бенчмарках. Для использования в качестве агента она обрабатывает многократные инструкции по нескольким изображениям, синхронизацию по временной шкале видео, автоматизацию GUI и визуальное кодирование от набросков до отлаженных пользовательских интерфейсов. Производительность в текстовой части соответствует флагманским моделям Qwen3, что делает её подходящей для Document AI, OCR, помощи с пользовательским интерфейсом, пространственных задач и исследований в области агентов.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-vl-30b-a3b-thinking",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerstopstring | string[]frequency_penaltynumberpresence_penaltynumberseedintegerlogprobsbooleantop_logprobsintegerresponse_formatstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean