Пт, 28 Сер
Творці «Воллеса і Громіта» випустять ляльковий мультсеріал за Pokémon для Disney+ Кіно/Серіали 28.08.2026 21:56
Стартувала відкрита бета Call of Duty: Modern Warfare 4 — із сюжетною кампанією та версією для Nintendo Switch 2 Ігри 28.08.2026 21:46
У Minecraft перенесли Лордран із Dark Souls: із босами, душами, прокачуванням і кооперативом Ігри 28.08.2026 21:15
Z.ai виклала у відкритий доступ ваги нейромережі GLM-5.3 для програмування та ШІ-агентів Нейромережі 28.08.2026 20:37
Дизайнер створив «цифровий камуфляж», що приховує людину від алгоритмів комп’ютерного зору НейромережіТехнології 28.08.2026 20:29
iPhone 17 Pro скинули зі стратосфери з висоти 30,6 км: смартфон вижив і встановив рекорд Гіннесса ГаджетиТехнології 28.08.2026 20:23
Замінники цукру пов’язали з прискореним старінням мозку: результати 8-річного дослідження за участю 12 000 осіб Наука 28.08.2026 20:13
Microsoft запропонувала Голлівуду пакет прав на екранізацію своїх культових ігор за $300 млн ІгриКіно/Серіали 28.08.2026 20:12
Porsche поверне бензинові двигуни до компактного класу: наступник кросовера Macan з’явиться у 2028 році Автомобілі 28.08.2026 20:01
Ціни на відеокарти знову зростають: постачання скорочується на 20%, а пам’ять дорожчає через бум ШІ IT-бізнес 28.08.2026 19:51
Android 17 приховає відвідувані сайти від операторів і заблокує сканування домашньої мережі Софт 28.08.2026 18:35

Z.ai виклала у відкритий доступ ваги нейромережі GLM-5.3 для програмування та ШІ-агентів

Max Ivanov · 28.08.2026 20:37 · 3 хвилини читання

Китайська лабораторія Z.ai опублікувала повні ваги флагманської моделі GLM-5.3 на платформі Hugging Face. Нейромережа орієнтована на складні завдання програмування, автоматизацію термінала та керування автономними ШІ-агентами, демонструючи результати на рівні провідних закритих комерційних систем.

Повний реліз на 756 ГБ та підтримувані фреймворки

На відміну від представленої раніше полегшеної мультимодальної версії GLM-5.3-Flash (архітектура MoE на 320 млрд параметрів із 18 млрд активних), розробники відкрили саме повнорозмірну флагманську модель.

Як випливає з репозиторію на Hugging Face, сумарний обсяг файлів ваг у форматі Safetensors становить близько 756 ГБ. Модель оптимізовано для локального та серверного розгортання через ключові відкриті рушії:

  • vLLM та SGLang для високошвидкісного інференсу;
  • Transformers та KTransformers;
  • фреймворки Unsloth та TokenSpeed;
  • спеціалізовані стеки для апаратних прискорювачів Huawei Ascend NPU.

Стрибок у кодингу та агентних бенчмарках

Базова архітектура моделі залишилася попередньою (як у GLM-5.2), однак інженери Z.ai застосували масштабний етап post-training із акцентом на довгострокове планування (long-horizon reasoning) і виконання завдань в ізольованих програмних середовищах.

За інформацією з офіційного блогу Z.ai, модель показала істотний відрив від попередниці у стандартизованих тестах:

  • Terminal Bench 2.1: результат зріс до 88,2 бала проти 81,0 у GLM-5.2 (для порівняння, у пропрієтарної GPT-5.6 Sol — 88,8);
  • Terminal Bench 3.0: стрибок з 4,6 до 28,3 бала;
  • DeepSWE v1.1: зростання з 46,2 до 66,9 бала;
  • AutomationBench: покращення з 26,2 до 48,2 бала.

У власному синтетичному бенчмарку генерації коду Z.ai Code Bench точність зросла в середньому на 50%.

Несподівані навички у кібербезпеці та затримка релізу

Початковий анонс GLM-5.3 відбувся ще 14 серпня, однак викладення ваг відклали на два тижні. Причиною стало неконтрольоване зростання здібностей моделі в сфері аналізу вразливостей.

У тестах CyberGym модель набрала 84,5 бала, а в ExploitBench — 54,4 (проти 24,4 у версії 5.2), подвоївши ефективність у сценаріях експлуатації прогалин безпеки. Додатковий час розробники витратили на тестування захисних механізмів і вирівнювання (safety alignment), щоб знизити ризики нецільового використання ШІ.

Статус ліцензії

Ваги моделі поширюються за принципом open-weights: розробники та компанії можуть вільно завантажувати файли й запускати їх на власних потужностях, однак проєкт захищений пропрієтарною ліцензією GLM-5.3, а не класичними пермісивними ліцензіями MIT чи Apache 2.0. Для більшості локальних ентузиастів практичнішою залишається версія Flash, тоді як повнорозмірна 756-гігабайтна модель орієнтована на корпоративні серверні кластери.

Подобається ВсеЗависло?

Додайте нас до улюблених джерел Google, щоб частіше бачити наші новини.

Поділитися

Залишити коментар