Virtuoso-Large — это флагманская многоцелевая LLM от Arcee с 72 миллиардами параметров, настроенная для решения задач междисциплинарного рассуждения, творческого письма и корпоративных QA. В отличие от многих своих аналогов с 70 миллиардами параметров, она сохраняет контекст длиной 128 тыс., унаследованный от Qwen 2.5, что позволяет ей полностью обрабатывать книги, кодовые базы или финансовую отчетность. Обучение включало дистилляцию DeepSeek R1, многоэпоховую supervised fine-tuning и финальный этап выравнивания DPO/RLHF, что обеспечило высокую производительность на тестах BIG-Bench-Hard, GSM-8K и long-context Needle-In-Haystack. Предприятия используют Virtuoso-Large в качестве "запасного" модуля в конвейерах Conductor, когда другие SLM сигнализируют о низкой уверенности. Несмотря на свой размер, агрессивные оптимизации KV-кэша позволяют поддерживать задержку первого токена в пределах нескольких секунд на узлах с 8× H100, делая ее практичным и мощным решением производственного уровня.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="arcee-ai/virtuoso-large",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberlogit_biasobjecttoolsarraytool_choicestring | object