zhipu
GLM 4.1V Thinking Flash
GLM 4.1V Thinking Flash. Разработчик: zhipu.
zhipu/glm-4.1v-thinking-flashЦена
Цена пока не опубликована
Без опубликованного тарифа стоимость запроса неизвестна.
О модели
GLM 4.1V Thinking Flash. Разработчик: zhipu. Входные данные: текст, изображения. Результат: текст. Назначение: текстовый диалог, понимание изображений. Контекстное окно: 64 000 токенов.
- Релиз
- Дата не указана
Характеристики
- Тип модели
- Текст
- Вход
- Текст, Изображения
- Выход
- Текст
- Контекстное окно
- 64 000 токенов
- Максимальный ответ
- 8 192 токенов
- Операции в каталоге
- Текстовый диалог, Понимание изображений
- Подтверждённые возможности
- Понимание изображений
Подключение
Пример подключения доступен. Запуск этой модели пока недоступен. Ключ храните в переменной окружения на своём сервере. REQUEST_ID — уникальный идентификатор запроса. При повторе сохраняйте его и тело запроса.
import json
import os
from urllib.request import Request, urlopen
request = Request(
"https://api.kvantora.ai/v1/chat/completions",
data="{\n \"model\": \"zhipu/glm-4.1v-thinking-flash\",\n \"messages\": [\n {\n \"role\": \"user\",\n \"content\": \"Объясни задачу кратко.\"\n }\n ],\n \"max_tokens\": 256\n}".encode("utf-8"),
headers={
"Authorization": "Bearer " + os.environ["KVANTORA_API_KEY"],
"Content-Type": "application/json",
"Idempotency-Key": os.environ["REQUEST_ID"],
},
method="POST",
)
with urlopen(request) as response:
print(json.load(response))