По сравнению с GLM-4.5, это поколение предлагает несколько ключевых улучшений: Увеличенное контекстное окно: Контекстное окно было расширено со 128 тысяч до 200 тысяч токенов, что позволяет модели выполнять более сложные агентные задачи. Превосходная производительность в кодировании: Модель демонстрирует более высокие результаты в кодовых бенчмарках и лучшую производительность в реальных приложениях, таких как Claude Code, Cline, Roo Code и Kilo Code, включая улучшенное создание визуально отполированных фронтенд-страниц. Продвинутое рассуждение: GLM-4.6 демонстрирует явное улучшение производительности в рассуждениях и поддерживает использование инструментов во время инференса, что приводит к повышению общей производительности. Более способные агенты: GLM-4.6 показывает более высокую производительность в использовании инструментов и агентных системах, основанных на поиске, и более эффективно интегрируется в агентные фреймворки. Улучшенное письмо: Лучше соответствует человеческим предпочтениям в стиле и читаемости, а также более естественно ведет себя в сценариях ролевых игр.
from openai import OpenAI
client = OpenAI(
base_url="https://infergate.ru/api/v1",
api_key="sk-•••",
)
resp = client.chat.completions.create(
model="z-ai/glm-4.6",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)modelstringобязательныйmessagesarrayобязательныйtemperaturenumbermax_tokensintegertop_pnumbertop_kintegermin_pnumberstopstring | string[]frequency_penaltynumberpresence_penaltynumberrepetition_penaltynumberseedintegerlogit_biasobjectresponse_formatobjectstructured_outputsbooleantoolsarraytool_choicestring | objectreasoningobjectinclude_reasoningboolean