DEV Community

Cover image for «нейросеть глка» - это GLM? Индекс Artificial Analysis: GLM-5.2 - лучшая открытая
Promptra Team for Promptra

Posted on

«нейросеть глка» - это GLM? Индекс Artificial Analysis: GLM-5.2 - лучшая открытая

«Глка» - не отдельная нейросеть и не свежий стартап. Так на слух записывают GLM - семейство моделей китайской Zhipu AI, и запрос «нейросеть глка» набирают люди, которые слышали о ней краем уха. Отвечаю сразу: иишка, которую ты ищешь, - это GLM-5.2. По состоянию на 19 июля 2026 это сильнейшая модель с открытыми весами: 51 балл в независимом Intelligence Index v4.1 от Artificial Analysis, первое место среди open-weights и четвёртое среди всех моделей мира.

Все цифры ниже - на 19 июля 2026: официальный блог Z.ai, карточка модели на Hugging Face, прайс Z.ai и методология Artificial Analysis. Лидерборды пересчитывают еженедельно, так что дата тут не для красоты.

Официальные тарифы Z.ai указаны в долларах. Рабочих путей два: один из 16 сторонних хостов с иностранной оплатой или provod.ai (российский OpenRouter), где GLM-5.2 живёт в одном чате с DeepSeek и Kimi с единого рублёвого баланса, без VPN и без наценки к ценам провайдеров. К доступу вернёмся ближе к концу.

«Нейросеть глка» - что это на самом деле?

Коротко: «глка» - это GLM, General Language Model от Zhipu AI, работающей под брендом Z.ai. Компания - выходец из Университета Цинхуа, линейку двуязычных моделей ведёт с 2021 года. Актуальная версия - GLM-5.2: анонсирована 13 июня 2026 на всех тарифах GLM Coding Plan, а API и открытые веса под лицензией MIT выкатили 16 июня, по официальному блогу Z.ai.

Откуда берётся «глка»: GLM читается «джи-эл-эм», но в русскоязычных пересказах на слух выходит что-то вроде «гл». Паттерн устойчивый: так же рождаются «дееспик», «квэн» и «клоод» (полный словарик - ближе к концу).

Темп линейки впечатляет и тревожит одновременно. По данным cryptobriefing, GLM-5.2 - четвёртый крупный релиз семейства примерно за четыре месяца: GLM-5 с техотчётом «from Vibe Coding to Agentic Engineering» и индексом AA 50, потом GLM-5.1 с контекстом 200K, теперь GLM-5.2 с миллионом токенов и 51 баллом.

Почему GLM-5.2 - лучшая открытая модель июля 2026?

Коротко: Intelligence Index v4.1 от Artificial Analysis - композит из девяти независимых оценок, и GLM-5.2 набрала в нём 51 балл. Среди моделей с открытыми весами это первый результат; выше стоят только три закрытых флагмана. Данные - по artificialanalysis.ai и aiweekly.co на середину июля 2026.

В индекс входят девять замеров: GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience и AA-LCR.

Модель Индекс AA v4.1 Веса
Claude Fable 5 60 закрытые
Claude Opus 4.8 56 закрытые
GPT-5.5 55 закрытые
GLM-5.2 51 открытые, MIT
MiniMax-M3 44 открытые
DeepSeek V4 Pro 44 открытые
Kimi K2.6 43 Modified MIT

Разрыв с ближайшими открытыми - 44 и 43 - приличная дистанция по меркам индекса. Гонку за сверхинтеллект в общем зачёте пока возглавляют закрытые лаборатории - Anthropic, OpenAI, Google Демиса Хассабиса, - но веса, которые можно скачать и запустить у себя, в верхушке таблицы открыты только у GLM-5.2.

По данным aiweekly.co, рост против прошлой версии: Humanity's Last Exam +12 пунктов до 40%, SciCode +7 до 50%, CritPt +16 до 21%; по GDPval-AA v2 модель набрала 1524 - уровень GPT-5.5 с его 1514. Лидерборд перепишут через месяц, но срез на середину июля 2026 выглядит именно так.

Индекс Artificial Analysis v4.1: GLM-5.2 = 51 балл, первая среди открытых моделей

Что умеет GLM-5.2: кодинг и миллион токенов контекста

Коротко: два рабочих козыря - агентный кодинг и контекст в миллион токенов. По вендорской таблице с карточки Hugging Face: SWE-bench Pro 62.1 против 58.6 у GPT-5.5, Terminal-Bench 2.1 - 81.0 против 63.5 у GLM-5.1, FrontierSWE 74.4 против 72.6 у GPT-5.5. Это цифры самого вендора - независимую сводку ты видел выше.

Архитектура - mixture-of-experts: 753B суммарных параметров по карточке Hugging Face (Artificial Analysis указывает 744B, источники расходятся), около 40B активных на токен. Контекст - 1 000 000 токенов против 200K у GLM-5.1, выход - до 131 072 токена. За экономию отвечает IndexShare: общий индексер на каждые четыре слоя разреженного внимания режет FLOPs на токен в 2.9 раза на контексте 1M, а MTP-слой добавляет 20% к длине спекулятивного декодирования.

У длинного мышления есть счёт: цепочка рассуждений у GLM-5.2 длинная, из примерно 43k выходных токенов на задачу индекса AA около 37k уходит на reasoning. Зато математика даётся: AIME 2026 - 99.2 по вендорской карточке, олимпиадный «хомиворк» она щёлкает.

Для агентов важнее другое: из коробки модель совместима с Claude Code, Cline, OpenCode, Roo Code, Goose, Crush, OpenClaw и Kilo Code, а у Z.ai есть Anthropic-совместимый эндпоинт (api.z.ai/api/anthropic) - переключение агента сводится к смене base URL и ключа.

Сколько стоит GLM-5.2 и где её взять?

Коротко: официальный API Z.ai - $1.40 за миллион входных и $4.40 за миллион выходных токенов, кэшированный вход - $0.26, по прайсу Z.ai на июль 2026. Подписка GLM Coding Plan - $18, $72 или $160 в месяц. Плюс 16 сторонних API-провайдеров с разбросом цен до 4.1 раза.

По данным Artificial Analysis, модель обслуживают DeepInfra, Together AI, Fireworks, Baseten, Nebius, CoreWeave, Databricks и другие. Минимальный blended-тариф у DeepInfra в FP4 - $0.61 за миллион токенов; быстрее всех в их замере - Together AI, 476 токенов в секунду. Есть в списке и «небиус» - Nebius Аркадия Воложа.

Самохост - отдельная история. Лицензия MIT без региональных ограничений разрешает скачивание, файнтюн, self-host и коммерцию; веса лежат на Hugging Face и ModelScope в формате safetensors - в поиске их называют и «сафетннсор». Но полный BF16 весит примерно 1.51 ТБ и просит железа класса 8×H100-80GB. Сценарий «докальная нейросеть без инета» реален только в ужатых квантах: 2-битный GGUF от Unsloth запускается на Mac с 256 ГБ памяти со скоростью 3-9 токенов в секунду - медленно для рабочего агента. За месяц веса скачали с Hugging Face больше 536 тысяч раз.

Способ Цена Кому подходит
Официальный API Z.ai $1.40 / $4.40 за 1M; Coding Plan $18-160/мес есть зарубежная карта
Сторонние провайдеры (16 штук) blended от $0.61/1M у DeepInfra выбор по скорости и цене, биллинг за рубежом
Self-host по MIT веса бесплатно; железо от ~8×H100 или Mac 256 ГБ с GGUF полный контроль, исследования
Агрегатор provod.ai те же тарифы провайдеров, в рублях, без наценки Россия: карта РФ, СБП, счёт, документы

Данные - Artificial Analysis и прайс Z.ai, июль 2026. Соседка по гонке, «квэн» Qwen3.7 Max, по данным siliconreport на 3 июля 2026, стоит $2.50/$7.50 за миллион и открытых весов не имеет - в этой компании она наблюдатель.

Весь агентный стек на GLM-5.2 заводится из России сменой двух строк: ключ и base_url на единый API provod.ai - он совместим и с OpenAI SDK (/v1/chat/completions), и с Anthropic (/v1/messages), так что Claude Code и Cline подхватывают его без переписывания кода. Один ключ вместо пяти, один баланс на чат и прод, оплата в рублях; виден каждый токен, а юрлицам выдают договор и закрывающие.

Чего GLM-5.2 не решает?

Коротко: это текстовая модель без зрения с дорогой привычкой подолгу «думать», и даже она уступает трём закрытым флагманам в общем зачёте. Бенчмарк - не твой продакшн.

Картинки, скриншоты и computer-use - мимо неё: модель text-only. Запросы вида «минджорень» и «перерисовка изображений» относятся к другому классу моделей.

Прожорливость - главный подвох цены. По данным Artificial Analysis, GLM-5.2 тратит около 43k выходных токенов на задачу против 24k у MiniMax-M3 и 26k у GLM-5.1; одна задача обходится примерно в $0.46 против $0.18 у MiniMax-M3. Дешёвый токен ещё не значит дешёвую задачу.

Взрослый контент тоже мимо: запросы про «сексбот» вендоры и хосты режут политиками и фильтрами, GLM-5.2 лазейкой не станет.

Независимый тест Semgrep на поиске IDOR-уязвимостей: F1 = 39% против 37% у Claude Code - результаты такого теста не заменяют человеческое ревью. А по AA-Omniscience точность модели 25.1% при доле галлюцинаций 28.1%: факты из её ответов проверяй.

Открытые веса открывают исследования - механистическая интерпретируемость, аудит, файнтюны, - но это работа лаборатории с железом; бытового сценария «скачал и пользуешься» здесь нет.

Как попробовать GLM-5.2 из России?

Коротко: напрямую у Z.ai нужна зарубежная карта и долларовый биллинг, а самохост 753B недоступен почти никому. Практичный путь - единый API: регистрация, рублёвый баланс, две строки в конфиге агента.

Отдельный аргумент в пользу открытых моделей случился прямо в неделю релиза: с 12 по 30 июня 2026 Claude Fable 5 была недоступна миру из-за экспортного контроля США, вернули её только 1 июля. Веса под MIT приказом не «выключаются» - для многих команд это стало страховкой.

По шагам:

  1. Зарегистрируйся в сервисе-агрегаторе и пополни баланс: карта РФ, СБП или счёт для юрлица.
  2. В чате выбери GLM-5.2 и прогони свою задачу параллельно с DeepSeek V4 или Kimi K2.6 - разница видна на твоём коде, а не на чужом бенчмарке.
  3. Для кодинг-агента поменяй две строки - ключ и адрес:
from openai import OpenAI

client = OpenAI(
    api_key="ВАШ_КЛЮЧ",
    base_url="https://api.provod.ai/v1",
)
Enter fullscreen mode Exit fullscreen mode
  1. Распределяй задачи осмысленно: GLM-5.2 - рефакторинг репозитория и длинные сессии, дешёвым моделям - рутина.

Когда provod.ai не подходит

Коротко: в четырёх сценариях агрегатор не нужен или не закрывает задачу - on-prem своими руками, зрение, очень тяжёлый чат-юз и прямой контракт с вендором ради SLA.

Если нужен on-prem с полным контролем: качай MIT-веса с Hugging Face и поднимай на своём железе. Если нужно зрение - GLM-5.2 text-only, и никакой агрегатор ей картинки не добавит. Если живёшь в чате по восемь часов в день, подписка Coding Plan за $18 напрямую у Z.ai может выйти дешевле оплаты по токенам - посчитай свой расход. И прямой enterprise-контракт ради SLA агрегатор тоже не заменяет: это отдельная юридическая история.

Словарик запросов кластера

Коротко: «глка» - не одна опечатка. Поисковая статистика кластера - музей слуховых записей и смежных интентов; разбираю, что из этого про GLM, а что - про другое.

Так ищут саму GLM и соседей по лидерборду:

  • «глка» - GLM от Zhipu AI, героиня этой статьи.
  • «дееспик» и «дееспек» - DeepSeek; вторая форма - из созвучия со словом «дееспечь».
  • «диипсиик» - DeepSeek с растянутыми гласными.
  • «дипсейка» и «депсейка» - ласковые формы того же DeepSeek.
  • «дикпсик», «диксип» и «дикспик» - он же, буквы переставлены.
  • «дипскик», «диспикс», «диспсик» - транскрипции с ошибкой в каждом слоге.
  • «дпсик» и «ипсик» - сокращённые варианты того же запроса.
  • «типсик» - ещё одна слуховая запись DeepSeek.
  • «квэн» - Qwen; у актуальной Qwen3.7 Max открытых весов нет.
  • «клоод» и «клот» - Claude, две опечатки одного флагмана Anthropic.
  • «джипитта» - GPT, семейство OpenAI.
  • «крея» - Krea, генерация картинок и видео.
  • «хайло» - Hailuo, видеомодель MiniMax.
  • «щедеврум» - Shedevrum, приложение для генерации изображений.
  • «гиначат» - GigaChat от Сбера, как его слышат.

Имена, которые привозят в кластер:

  • «волож» - Аркадий Волож, основатель Nebius; ищут и акции, и хостинг открытых моделей.
  • «менша» - Артур Менша, глава Mistral AI; европейские открытые модели.
  • «демис» и «хассабис» - Демис Хассабис из Google; запросы про гонку фронтир-моделей.
  • «норвуд» - Тилли Норвуд, сгенерированная «ИИ-актриса» из новостей.
  • «джейд» - генерация изображений в чужом художественном стиле; этика таких запросов спорная.
  • «зубков» - видеоэффект «на палец».
  • «кадинский» - так слышат фамилию Кандинского; стиль в генерации картинок.
  • «гайдук» - треки исполнителя; нейросеть тут нужна для кавера.

Музыка и «скачать песню» - спам-интенты кластера:

  • «ахас» - ИИ-кавер на группу АХАС.
  • «бобибом» и «бобомуз» - музыкальные запросы без однозначного сервиса.
  • «вокзал» - песня «Вокзал на двое».
  • «гандон» - песня «Человек-гандон».
  • «гармонист» - «Тракторист и гармонист».
  • «камал» и «крымский» - треки, ищут ИИ-каверы.
  • «лингангули» - трек Тохи.
  • «музппрайм» - кто поёт трек в музсервисе.
  • «нейрома» - «нейро май», песенный запрос.
  • «омур» и «совера» - ремиксы и треки.
  • «панч» - обложка для трека.
  • «родня» - песня «Родня».
  • «своб» и «сказочник» - песенные запросы.
  • «шлягер» - текст песни GLM-5.2 напишет, спеть - нет.
  • «фруктовые» - «фруктовые истории», музыкально-видео запрос.

Картинки, видео и дизайн - то, чего GLM-5.2 не умеет:

  • «астрологическая» - генераторы гороскопов.
  • «бармен» - вирусный ролик, где нейросеть «наливает».
  • «бонусным» - фотосессии с «бонусным бесплатным» периодом.
  • «буктрейлер» - трейлеры к книгам.
  • «видеозаставку» и «видеопереход» - монтажные задачи.
  • «китаяночки» - рисование портретов.
  • «королевской» - «королевская фотография», фильтры.
  • «обучалка» - обучалки с инфографикой; текст поможет, картинки - мимо.
  • «отработка» - доводка изображений после генерации.
  • «премку» - взлом платной версии видеосервиса; пиратский интент.
  • «сменщик» - «сменщик одежды» на фото.
  • «стример» - виртуальные ведущие.
  • «террасы» - дизайн террасы с визуализацией.
  • «тюль» - генератор логотипов.
  • «фотомастер» и «фоторум» - онлайн-обработка фото.
  • «эльфийки» - аниме-картинки.
  • «своп» - фейс-своп; у приличных вендоров он ограничен правилами.
  • «финном» - чат с персонажем Финном, сервисы класса character.ai.

Совсем из других вселенных:

  • «доставщик» - роботы-доставщики еды; железо, не LLM.
  • «фиджитал» - phygital-ритейл, формат магазинов.
  • «лифтвеб» - сервис с таким именем; к GLM не относится.
  • «нейрохам» и «максик» - мемные слова из чатов; продукта за ними нет.
  • «крок» и «марг» - неоднозначные запросы; чаще про картинки.
  • «ураган» - видео и картинки стихии.
  • «царица» - персонаж для генерации изображений.
  • «хутер» - мемный запрос; однозначного сервиса нет.
  • «маджонг» - игра; ИИ-соперник или раскладка.
  • «декомбин» - отзывы о сервисе с похожим названием.
  • «гострайтер» - ИИ-гострайтер текстов; это GLM-5.2 умеет, но факты проверяй.
  • «спервой» - спам про «бесплатную пробу» сомнительных нейронок; к GLM отношения нет.

provod.ai — отдельное пространство для задач компании

Рабочие запросы, доступы и расходы не должны жить в личных аккаунтах сотрудников: корпоративное пространство объединяет команду и помогает сохранять управляемый контур использования AI.

В одном каталоге — актуальные модели для текста и медиа: GPT от OpenAI, Claude от Anthropic, Gemini от Google, Grok от xAI, DeepSeek, Qwen, GLM, Kimi и MiniMax; для изображений — Nano Banana 2 Pro и GPT Image; для видео — последние версии Seedance, Kling, Veo и Google Omni. Также доступны модели для reasoning, поиска, документов, эмбеддингов, музыки и аудио.

Компания получает единый тарифный принцип: цены 1:1 с официальными поставщиками и нулевая собственная наценка provod.ai.

Создайте рабочее пространство команды: форма регистрации · цены на модели · защита данных по 152-ФЗ · политика обработки данных

FAQ

Коротко: пять вопросов после таблиц - расшифровка, сравнение с флагманами, локальный запуск, учёба и цена в рублях.

«Нейросеть глка» - это GLM?
Да. «Глка» - слуховая запись аббревиатуры GLM, General Language Model от Zhipu AI (бренд Z.ai). Актуальная версия - GLM-5.2; именно её имеют в виду, когда говорят о сильнейшей открытой модели июля 2026.

GLM-5.2 лучше ChatGPT и Claude?
В общем зачёте индекса AA - нет: 51 против 55 у GPT-5.5, 56 у Opus 4.8 и 60 у Fable 5. Зато веса открыты под MIT, официальный API стоит $1.40 за миллион входных и $4.40 за миллион выходных токенов, а по Terminal-Bench она подобралась к Opus 4.8 вплотную. И зрения у неё нет.

Можно ли запустить GLM-5.2 локально и бесплатно?
Лицензия разрешает, железо - вряд ли. Полный BF16 тянет 1.51 ТБ и требует порядка восьми H100-80GB. Двухбитный GGUF от Unsloth встаёт на Mac с 256 ГБ памяти, но выдаёт 3-9 токенов в секунду. Дешевле взять API: blended-тарифы начинаются от $0.61 за миллион у DeepInfra, по данным AA на июль 2026.

Поможет ли с учёбой и текстами?
Математику тянет: AIME 2026 - 99.2 по вендорской карточке, так что «хомиворк» ей по силам. Соберёт и библиографический список, но каждую ссылку проверяй руками: галлюцинации - 28.1% по AA-Omniscience. С гуманизацией текста тоже справится - переформулировать она умеет, хотя профиль у неё кодинговый.

Сколько это стоит в рублях?
Официальные тарифы - в долларах: $1.40 за миллион входных и $4.40 за миллион выходных токенов. Условия тарификации и учёта расхода на provod.ai уточняйте у сервиса.

Источники

Куда всё это катится, видно по темпу Zhipu: крупный релиз примерно раз в месяц, контекст вырос с 200K до миллиона за один шаг, а индустрия параллельно готовит тернарные 1.58-bit модели, которые обещают инференс на порядок дешевле. Гонка идёт сразу по двум трекам - кто умнее и кто дешевле, - и GLM-5.2 держится в обоих.

Проверить всё написанное выше можно за один вечер и на собственной задаче. Лидерборд убеждает слабее, чем твой репозиторий, прочитанный целиком в одном миллионном окне.

Один ключ к GLM-5.2 и остальным моделям с рублёвого баланса - provod.ai

Возьми свою задачу и прогони её через GLM-5.2 за пять минут: на provod.ai она доступна в одном чате и через единый API, оплата в рублях с карты РФ, для юрлиц - договор и закрывающие. Без VPN и без наценки: платишь официальный тариф провайдера, только в рублях.

И спорный вопрос напоследок. После двухнедельного «выключения» Fable 5 в июне: держать продакшн на закрытом флагмане за $10/$50 - или переводить агентные задачи на открытую модель, которую нельзя отключить приказом, даже если она на четыре балла ниже в индексе? Что выбрал бы ты?

Top comments (0)