GLM-5.2 - Nowy wiodacy model LLM o otwartych wagach

GLM-5.2 - Nowy wiodacy model LLM o otwartych wagach

GLM-5.2 - Nowy wiodacy model LLM o otwartych wagach

Chinskie laboratorium AI Z.ai udostepnilo GLM-5.2 subskrybentom swojego planu programistycznego 13 czerwca, a nastepnie opublikowalo pelne otwarte wagi na licencji MIT 16 czerwca. Według Artificial Analysis, jednego z najbardziej cenionych niezależnych benchmarków, GLM-5.2 jest teraz nowym wiodącym modelem o otwartych wagach w Intelligence Index.

Co wydalo Z.ai

GLM-5.2 ma ten sam rozmiar co GLM-5.1 - 744B parametrów lacznie z 40B aktywnymi (architektura Mixture of Experts) - ale zdobywa o 11 punktów więcej w Intelligence Index v4.1. To model tylko tekstowy z oknem kontekstu 1M tokenów, wobec 200K w GLM-5.1, wydany na liberalnej licencji MIT.

Gdzie sie plasuje

  • Intelligence Index v4.1 - Zdobywa 51, wyprzedzajac MiniMax-M3 (44), DeepSeek V4 Pro (44) i Kimi K2.6 (43).
  • GDPval-AA v2 - Zdobywa 1524 w tym agentowym benchmarku ze swiata rzeczywistego, przed MiniMax-M3 (1418) i DeepSeek V4 Pro (1328), praktycznie na rowni z GPT-5.5 (1514).
  • Code Arena WebDev - 2. miejsce w tworzeniu front-endu, ustepujac tylko Claude Fable 5 - imponujace jak na model bez wejscia obrazowego.

Najwieksze przyrosty dotyczyly rozumowania naukowego, w tym skok o 16 punktów w CritPt, o 12 punktów w HLE do 40 procent i o 16 punktów w TerminalBench v2.1 do 78 procent.

Kompromis

GLM-5.2 zuzywa dużo tokenów. Wykorzystuje okolo 43k tokenów wyjsciowych na zadanie Intelligence Index, wobec 26k w GLM-5.1 i powyżej MiniMax-M3 (24k) oraz Kimi K2.6 (35k). Mimo to znajduje sie na froncie Pareto inteligencji względem kosztu, przy okolo $0.46 za zadanie - najnizszy koszt za zadanie wsrod modeli na jego poziomie inteligencji. Ceny natywnego API wynosza $1.4 / $0.26 / $4.4 za 1M tokenów wejsciowych / cache / wyjsciowych.

Uruchom go na europejskiej infrastrukturze

Poniewaz GLM-5.2 jest dostarczany na licencji MIT z otwartymi wagami, możesz hostowac go samodzielnie zamiast polegać na API innej firmy. Uruchomienie go na własnym sprzecie utrzymuje prompty i dane w twojej jurysdykcji - realna przewaga dla zespołów z wymogami GDPR lub rezydencji danych. DCXV zapewnia serwery cloud Tier III w UE zbudowane dokladnie do tego rodzaju obciazen. Wdróż serwer cloud w Europie.

Podsumowanie

GLM-5.2 to prawdopodobnie najpotezniejszy tekstowy model LLM o otwartych wagach dostepny dzisiaj. Zamyka znaczna część luki do zamkniętych modeli frontier, jest dostarczany na liberalnej licencji MIT i dostepny u dostawców takich jak DeepInfra, Novita, Nebius, Fireworks i OpenRouter - lub na twojej wlasnej infrastrukturze.

Źródło: Artificial Analysis, Simon Willison

Jak połączyć się z nowym serwerem cloud przez SSH
sshtutorialcloud

Jak połączyć się z nowym serwerem cloud przez SSH

Serwer jest gotowy, a panel pokazuje IP, login i hasło. Oto pierwsze połączenie SSH, cztery najczęstsze błędy i pierwsze dziesięć minut.

Jak połączyć się z serwerem Windows przez pulpit zdalny
rdpwindowstutorialcloud

Jak połączyć się z serwerem Windows przez pulpit zdalny

Masz adres, nazwę użytkownika i hasło. Oto jak zamienić je w pulpit Windows na swoim ekranie - z komputera, Maca albo telefonu, krok po kroku.

Serwer cloud dla Stable Diffusion w Europie: konfiguracja GPU
cloudaigpu

Serwer cloud dla Stable Diffusion w Europie: konfiguracja GPU

Uruchom Stable Diffusion na serwerze cloud w UE zgodnym z RODO. GPU, konfiguracja AUTOMATIC1111 i ComfyUI, przechowywanie modeli i testy generowania obrazów.

Serwer cloud dla hostingu LLM w Europie: przewodnik AI RODO
cloudaigpu

Serwer cloud dla hostingu LLM w Europie: przewodnik AI RODO

Hostuj duze modele jezykowe na serwerze cloud w UE zgodnym z RODO. Wymagania GPU, kwantyzacja, frameworki API i testy wydajności dla Europy.

Uruchom Claude Code, Codex i Grok CLI na własnym serwerze cloud
cloudaivps

Uruchom Claude Code, Codex i Grok CLI na własnym serwerze cloud

Zamień serwer cloud Debian lub Ubuntu w piaskownicę dla agentów AI jak Claude Code, Codex i Grok CLI. Koduj z dowolnego miejsca, nawet z telefonu.