К каталогу моделей

zhipu

GLM 4.1V Thinking Flash

GLM 4.1V Thinking Flash. Разработчик: zhipu.

API ID
zhipu/glm-4.1v-thinking-flash

Цена

Цена пока не опубликована

Без опубликованного тарифа стоимость запроса неизвестна.

О модели

GLM 4.1V Thinking Flash. Разработчик: zhipu. Входные данные: текст, изображения. Результат: текст. Назначение: текстовый диалог, понимание изображений. Контекстное окно: 64 000 токенов.

Релиз
Дата не указана

Характеристики

Тип модели
Текст
Вход
Текст, Изображения
Выход
Текст
Контекстное окно
64 000 токенов
Максимальный ответ
8 192 токенов
Операции в каталоге
Текстовый диалог, Понимание изображений
Подтверждённые возможности
Понимание изображений

Подключение

Пример подключения доступен. Запуск этой модели пока недоступен. Ключ храните в переменной окружения на своём сервере. REQUEST_ID — уникальный идентификатор запроса. При повторе сохраняйте его и тело запроса.

import json
import os
from urllib.request import Request, urlopen

request = Request(
    "https://api.kvantora.ai/v1/chat/completions",
    data="{\n  \"model\": \"zhipu/glm-4.1v-thinking-flash\",\n  \"messages\": [\n    {\n      \"role\": \"user\",\n      \"content\": \"Объясни задачу кратко.\"\n    }\n  ],\n  \"max_tokens\": 256\n}".encode("utf-8"),
    headers={
        "Authorization": "Bearer " + os.environ["KVANTORA_API_KEY"],
        "Content-Type": "application/json",
        "Idempotency-Key": os.environ["REQUEST_ID"],
    },
    method="POST",
)
with urlopen(request) as response:
    print(json.load(response))
Документация APIСоздать API-ключ