2 хв читання

GLM-5.3: безкоштовний доступ і реальні ліміти

GLM-5.3Z.AIAI-агенты

Z.AI представила GLM-5.3 для програмування й агентних завдань, а десктопний застосунок обіцяє безкоштовний доступ до кінця жовтня. Проте одна велика задача на практиці вичерпала денний ліміт старшої моделі у три мільйони токенів. Це розділяє рекламний баланс і реально доступний бюджет.

Що випустила Z.AI і де приховані ліміти

Я б не ототожнював реліз GLM-5.3 з однією промоакцією: Z.AI позиціонує модель як старшу систему для програмування та агентних завдань. В офіційній документації Z.AI акцентує розробку ПЗ, роботу в терміналі та багатокрокові дії агента. GLM-5.3-Flash описано окремо як легшу, швидшу й мультимодальну версію.

В описі десктопного застосунку Z.AI заявлено встановлення в один клік на Windows і Mac, контекст у 1 млн токенів та повний доступ до GLM-5.3 до кінця жовтня. Картка й внутрішня система балів на цей період не потрібні. Легкі операції застосунок обробляє локально, щоб без потреби не витрачати хмарний бюджет.

Але безкоштовний доступ не означає бездонний контекст. У моєму запуску одна велика задача вичерпала доступні старшій GLM-5.3 денні 3 млн токенів. Залишок, судячи з розподілу лімітів, призначався для Flash, хоча швидкість генерації справді була високою.

Промо влаштовано не надто прозоро. У дописі спільноти йдеться про можливість знову отримати 300 млн токенів, але видача має обмежену щоденну квоту та працює за принципом черги. В обговоренні від 3 вересня 2026 року вікно отримання бонусу також трактували як одноденне, тому номінальний обсяг акції та фактичний ліміт конкретної моделі не можна складати в одну цифру.

Для коротких агентних сесій такий режим виглядає щедрим. Тривала автономна задача може зупинитися посередині, навіть якщо інтерфейс і далі показує великий загальний залишок.

Агент для термінала: сценарій реальний, доказів мало

GLM-5.3 справді орієнтована на термінальні операції, однак у зібраних матеріалах немає підтвердженого виробничого кейсу Z.AI з автономною діагностикою серверів. Є офіційні заяви про поліпшення реальних агентних задач і сторонні огляди результатів у Terminal-Bench 3.0 та CyberGym, але без окремих цифр у вихідних даних.

Відгук про безвідмовну роботу агента, який обходив сервер і шукав причину збою, стосувався не старшої GLM-5.3, а попередньої версії, пов’язаної в обговоренні з Flash. Я б не переносив цей досвід на нову модель автоматично.

Насамперед я б перевіряв межі прав у shell, захист від руйнівних команд, збереження стану й здатність пояснити діагноз до внесення змін. Швидкість і безкоштовні токени полегшують експеримент, але надійність серверного агента починається там, де закінчується гарний бенчмарк.

Раніше ми розбирали, як розгорнути автономного ШІ-агента на VPS, налаштувати його безперервну роботу та захистити інфраструктуру. Це доповнює обговорення серверних агентів і практичних обмежень під час розподілу доступу до моделей.