MiniMax-M3 — это мультимодальная фундаментальная модель от MiniMax. Она поддерживает ввод текста, изображений и видео с выводом текста, контекстное окно размером 1 миллион токенов и подходит для задач с длительным горизонтом, связанных с агентами, программированием и использованием инструментов. Модель построена на основе MiniMax Sparse Attention (MSA), которая заменяет полное внимание выбором KV-блоков для снижения вычислительных затрат на токен при работе с длинным контекстом — примерно в 20 раз дешевле предыдущего поколения при 1 миллионе токенов, с существенно ускоренной предварительной обработкой и декодированием при сохранении качества в большинстве задач. Обученная как нативная мультимодальная модель на чередующихся данных и настроенная для многоходовой, приближенной к реальному производству коллаборации через интерактивную систему симуляции пользователей, модель ориентирована на выполнение продолжительных, многошаговых задач, а не на однократное выполнение.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="minimax/minimax-m3:batch",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberlogit_biasobjectresponse_formatstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean