Muse Image — это агентная модель генерации изображений от Meta, которая создает и редактирует изображения по текстовому описанию и эталонным изображениям. В отличие от однопроходных моделей изображений, она сначала рассуждает, а затем рендерит, разбивая многокомпонентные запросы и уточняя свои выходные данные в цепочке рассуждений, а также использует веб-поиск для обеспечения фактической точности в запросах, требующих знаний. Модель поддерживает генерацию изображений по тексту, таргетированное редактирование изображений, композицию из нескольких изображений, управление на основе эталонных изображений для согласованности стиля и объекта в серии, а также точное рендеринг текста внутри сгенерированных изображений. Итеративное редактирование работает путем передачи предыдущего выходного изображения с новой инструкцией.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.images.generate(
model="meta/muse-image",
prompt="Акварельный лис в снежном лесу",
n=1,
)
print(resp.data[0].b64_json[:32])modelstringобязательныйpromptstringобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegerrepetition_penaltynumberГенерация медиа (аудио/изображения) тарифицируется по фактической стоимости провайдера — итоговая цена хода видна в чате сразу после ответа.