Qwen3-VL-30B-A3B-Instruct — это мультимодальная модель, объединяющая мощные возможности генерации текста с пониманием визуальной информации из изображений и видео. Её вариант Instruct оптимизирован для следования инструкциям в общих мультимодальных задачах. Она превосходно справляется с восприятием реальных/синтетических объектов, пространственным соотнесением 2D/3D и пониманием длинных визуальных последовательностей, показывая конкурентоспособные результаты на мультимодальных бенчмарках. Для использования в качестве агента модель обрабатывает многократные обращения с несколькими изображениями, выравнивание видео по временной шкале, автоматизацию GUI и создание кода по эскизам с отладкой пользовательского интерфейса. Производительность в текстовых задачах сопоставима с флагманскими моделями Qwen3, что делает её подходящей для документоориентированных AI, OCR, помощи с GUI, пространственных задач и исследований в области агентов.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="qwen/qwen3-vl-30b-a3b-instruct",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectlogprobsbooleantop_logprobsintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | object