Gemini 3 Flash Preview — это высокоскоростная, высокоценностная модель мышления, предназначенная для рабочих процессов с агентами, многоходовых чатов и помощи в написании кода. Она демонстрирует производительность, близкую к уровню Pro, в области рассуждений и использования инструментов, при значительно более низкой задержке, чем у более крупных вариантов Gemini, что делает ее хорошо подходящей для интерактивной разработки, длительных циклов работы с агентами и совместной работы над кодом. По сравнению с Gemini 2.5 Flash, она обеспечивает широкие улучшения качества в области рассуждений, мультимодального понимания и надежности. Модель поддерживает контекстное окно размером 1 миллион токенов и мультимодальные входы, включая текст, изображения, аудио, видео и PDF-файлы, с текстовым выводом. Она включает конфигурируемые уровни рассуждений (минимальный, низкий, средний, высокий), структурированный вывод, использование инструментов и автоматическое кэширование контекста. Gemini 3 Flash Preview оптимизирована для пользователей, которым требуются сильные рассуждения и поведение агентов без затрат или задержек, характерных для полномасштабных передовых моделей.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="google/gemini-3-flash-preview",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumberstopstring | string[]seedintegerresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectreasoning_effortinclude_reasoningboolean