Llama Guard 4 — это предварительно обученная мультимодальная модель, основанная на Llama 4 Scout, дообученная для классификации безопасности контента. Подобно предыдущим версиям, она может использоваться для классификации контента как во входных данных LLM (классификация промптов), так и в ответах LLM (классификация ответов). Она действует как LLM, генерируя в своем выводе текст, указывающий, является ли данный промпт или ответ безопасным или небезопасным, а если небезопасным, то также перечисляет нарушенные категории контента. Llama Guard 4 была согласована для защиты от стандартизированной таксономии угроз MLCommons и разработана для поддержки мультимодальных возможностей Llama 4. В частности, она сочетает в себе функции предыдущих моделей Llama Guard, обеспечивая модерацию контента на английском и нескольких поддерживаемых языках, а также улучшенные возможности для обработки смешанных текстово-графических промптов, включая несколько изображений. Кроме того, Llama Guard 4 интегрирована в Llama Moderations API, расширяя надежную классификацию безопасности для текста и изображений.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="meta-llama/llama-guard-4-12b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectresponse_formatobject