Gemini 3 Flash Preview — это высокоскоростная, высокоэффективная модель для решения задач, разработанная для рабочих процессов агентов, многооборотного чата и помощи в написании кода. Она обеспечивает производительность, близкую к уровню Pro, в области рассуждений и использования инструментов, при значительно меньшей задержке по сравнению с более крупными вариантами Gemini, что делает ее хорошо подходящей для интерактивной разработки, длительных циклов работы агентов и совместных задач по написанию кода. По сравнению с Gemini 2.5 Flash, она обеспечивает широкие улучшения качества в области рассуждений, мультимодального понимания и надежности. Модель поддерживает контекстное окно размером 1 миллион токенов и мультимодальные входные данные, включая текст, изображения, аудио, видео и PDF-файлы, с текстовым выводом. К ее возможностям относятся настраиваемые рассуждения с уровнями мышления (минимальный, низкий, средний, высокий), структурированный вывод, использование инструментов и автоматическое кэширование контекста. Gemini 3 Flash Preview оптимизирована для пользователей, которым требуется надежное использование рассуждений и поведение агентов без затрат или задержек, связанных с полномасштабными передовыми моделями.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="google/gemini-3-flash-preview:batch",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberstopstring | string[]seedintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectreasoning_effortstringinclude_reasoningboolean