Usage Stats ZCode: как отслеживать токены, сессии и квоту GLM-5.2
Usage Stats показывает, как именно используется ZCode. Раздел состоит из двух вкладок: App Usage — для локальных сессий ZCode, и Coding Plan — для квоты и использования удалённого Coding Plan Z.ai / BigModel.

App Usage
App Usage читает локальные записи сессий ZCode на текущем устройстве. Используйте её, чтобы оценить недавний объём работы внутри ZCode.
Здесь видно:
- Использование токенов, сессии, сообщения и активные дни.
- Текущий streak, самый длинный streak и пиковый час.
- Ежедневный тренд токенов, тепловую карту активности и рейтинг использования моделей.
Переключателем диапазонов в правом верхнем углу можно сравнить All Time, Last 30 Days и Last 7 Days.

График ежедневного тренда токенов поддерживает детали при наведении для каждого дня, включая разбивку токенов по моделям. Используйте его, чтобы замечать скачки использования и понимать, какие модели больше всего «весили» в конкретную дату.

График использования моделей суммирует общее число токенов за выбранный период и ранжирует каждую модель по её доле — так проще определить основные модели и сравнить распределение использования.
Coding Plan
Coding Plan читает удалённую статистику Coding Plan Z.ai / BigModel. Используйте её для проверки квоты, использования моделей и вызовов инструментов. Ниже на скриншоте в качестве примера показан Z.ai - Coding Plan; BigModel - Coding Plan поддерживается в том же представлении с аналогичной разбивкой квоты и использования.

Здесь отображается:
- Статус квоты: пул промптов на 5 часов, недельная квота и месячная квота MCP.
- Потребление токенов по моделям вроде GLM-5.2 и GLM-5-Turbo.
- Вызовы инструментов: Network Search MCP, Web Reader MCP и др.
При раскрытии деталей квоты ZCode также показывает текущую разбивку контекстного окна, доли использования сообщений и инструментов, а также остаток квоты для пулов 5-часового, недельного и инструментальных вызовов.
Заметка практика: Разделение на App Usage (локально) и Coding Plan (удалённо) — удобно для бюджетирования: первое показывает, где уходят токены вашей команды по моделям и дням, второе — сколько ещё осталось в оплачиваемом пуле. На практике два приёма. Во-первых, по графику разбивки по моделям легко заметить, что дорогая GLM-5.2 тянет 70% токенов там, где хватило бы GLM-5-Turbo (черновики, генерация тестовых данных) — наведитесь на пик дня и пересмотрите роутинг моделей в задачах. Во-вторых, отслеживайте пул «5 часов» в Coding Plan при пиковых нагрузках: именно он «заканчивается» первым, и аккуратный
/compactиз команд ZCode снижает расход контекстного окна в длинных сессиях, продлевая лимит, — куда эффективнее, чем переплачивать за увеличение квоты.
Локализованный гайд по официальной документации ZCode. Оригинал на английском.