MWS в 2026 году: GLM-5.3 в GPT Model Hub
MWS в 2026 году: GLM-5.3 в GPT Model Hub
Выборочная проверка GPT Model Hub: 10 сентября 2026 года. Тарифы других услуг MWS в рамках этого дополнения полностью не перепроверялись.
4 сентября — GLM-5.3 в российском облаке
В новостях MWS от 4 сентября опубликован анонс GLM-5.3. По заявлению провайдера, вычисления выполняются в инфраструктуре MWS Cloud в России, без передачи запросов и обрабатываемых данных за пределы страны.
Это утверждение о размещении сервиса, а не независимый аудит обработки данных. Оно не определяет автоматически сроки хранения запросов, доступ сотрудников, условия использования данных для обучения или соответствие конкретной системы требованиям законодательства.
Готовность, контекст и стоимость
На дату проверки каталог моделей указывает glm-5.3 как General Availability с контекстом 200 тысяч токенов. По определению MWS, контекст включает запрос и ответ, а не только входной prompt.
Тарифная таблица, обновлённая 7 сентября, содержит:
| Модель | Вход, ₽ за 1 млн токенов с НДС 22% | Выход, ₽ за 1 млн токенов с НДС 22% | Отпускная единица |
|---|---|---|---|
glm-5.3 | 178,12 | 746,64 | 100 токенов |
glm-5.2 | 178,12 | 746,64 | 100 токенов |
MWS описывает накопление отпускной единицы и хранение остатка в течение 24 часов. Это не следует пересказывать как обязательное округление каждого запроса вверх до 100 токенов.
Эти условия относятся к API MWS, не к подписке Z.ai Coding Plan и не к модели GLM-5.3-Flash. Дата обновления документации не выдаётся за дату вступления нового тарифа в силу.
Что проверить перед использованием
В отдельном проекте с лимитом расходов проверить потоковую выдачу, вызовы инструментов, формат ошибок, тайм-ауты, работу с длинным контекстом и точность учёта входных/выходных токенов. Совместимость конкретного SDK и агентского клиента нужно подтвердить запросами, а не названием модели.
Для сравнительного теста использовать одинаковые задачи и считать не только цену миллиона токенов, но и стоимость успешного результата, повторные попытки, задержку первого токена и полное время ответа. Для кода и документов с секретами нужны предварительное обезличивание, минимальные IAM-права, отключение небезопасных debug-логов и согласованные условия обработки данных.
Влияние на категорию
MWS остаётся в «Кандидатах на тест». Новая модель расширяет AI-предложение, но не подтверждает надёжность Compute, дисков, сети, поддержки или восстановления. Собственный API-тест в этом материале не заявлен.
