Veiligheid & privacy30 Aug 2026, 13:35

GLM-5.3 vond 2.436 kwetsbaarheden in open-sourcecode

Een open-source AI-model heeft in 269 uiteenlopende softwareprojecten 2.436 beveiligingsfouten aangetroffen, waarvan er 53 inmiddels publiek bekend zijn. Maar al die cijfers komen van de maker zelf en zijn niet onafhankelijk gecontroleerd.

Het Chinese bedrijf Z.ai presenteerde in augustus 2026 het model GLM-5.3. Naast betere codeerkwaliteit claimt het bedrijf iets bijzonders: het model is met een groep beveiligingsteams in China door honderden echte, open-source projecten gegaan en zou daarbij duizenden beveiligingsfouten (kwetsbaarheden) hebben ontdekt. Dat klinkt als goed nieuws, maar het is vooral ook een waarschuwing over hoe snel AI nu zelf kan zoeken naar zwakke plekken in software die wij dagelijks gebruiken.

Illustratie: een vergrootglas boven groene computercode met rode waarschuwingen
Illustratie: redactie (AI-gegenereerd)

Wat heeft GLM-5.3 precies gevonden?

Volgens de aankondiging op de blog van Z.ai vond het model 2.436 kwetsbaarheden in 269 open-source projecten. Die projecten omvatten systeemkernels (zoals de Linux-kernel), besturingssystemen, browsers, infrastructuursoftware en netwerkprotocollen. Van alle bevindingen zijn er 1.097 van gemiddelde tot hoge ernst, verdeeld over 107 als kritiek gekwalificeerde en 990 als hoog gekwalificeerde problemen.

Het opvallendste detail volgens het bedrijf zelf: veel van deze fouten zaten al heel lang in de code. De oudste dateert uit 1981, en gemiddeld had een gevonden fout ruim 26 jaar onopgemerkt in de code gestaan. Z.ai houdt de vondsten bij in een openbaar Security Disclosure Ledger dat je kunt inzien op cvd.z.ai. Daar staat per bevinding welk project het betreft, hoe ernstig het is, of er al een officieel CVE-nummer (een internationaal erkend foutnummer) is toegekend en hoe lang de fout al in het bestand stond. Op dit moment zijn 53 bevindingen openbaar en staan er nog 2.383 onder embargo, wat betekent dat de projecteigenaren eerst de tijd krijgen om de fout te verhelpen voordat die wereldkundig wordt.

Waarom moeten we hier nog voorzichtig mee zijn?

Hier zit precies het kritische punt. Al deze getallen komen van Z.ai zelf. Zowel de Reuters-berichtgeving als de weergave door Channel News Asia meldt uitdrukkelijk dat de resultaten niet onafhankelijk zijn geverifieerd. Er staat dus nergens een onafhankelijke partij die heeft bevestigd dat het model écht 2.436 bruikbare bevindingen heeft geleverd, of dat alle projecten terecht als kwetsbaar zijn aangemerkt.

Daar komt bij dat het vermogen van het model flink afneemt naarmate je verder in de aanvalsketen komt. Op CyberGym, een toets die kijkt of een model kwetsbaarheden kan herkennen en valideren, scoort GLM-5.3 volgens Z.ai 84,5 procent. Dat is hoog. Maar op ExploitBench, waarbij het model die gevonden fout ook daadwerkelijk moet misbruiken, komt het op 54,4 procent, tegenover 78,0 procent voor het gesloten model Mythos van Anthropic. Met andere woorden: het vinden van fouten is indrukwekkend, het misbruiken lukt veel minder goed. Dat verschil is belangrijk, want het bepaalt hoe gevaarlijk zo'n model werkelijk is.

Wat betekent dit voor beheerders en maintainers?

Het belangrijkste gevolg is geldig voor iedereen die open-source software gebruikt: een model dat op grote schaal kwetsbaarheden kan vinden, heeft als het ware een voorsprong genomen op de mensen die hun systemen moeten beveiligen. Z.ai zegt zelf dat de fouten vooral zaten in basiscomponenten die overal worden gebruikt, en dat er echte CVE's zijn toegekend tegen onder meer de Linux-kernel en de browser-engine WebKit. De gemiddelde fout zat ruim 26 jaar in de code, wat betekent dat er vermoedelijk veel vergelijkbare problemen nog niet gevonden zijn.

Voor beheerders is de praktische les: blijf je gebruikte open-source software updaten, houd security-advisories in de gaten en neem een model als hulpmiddel bij het testen van je eigen code, maar vertrouw niet blind op cijfers van één leverancier. Voor maintainers van open-source projecten is het signaal dat door AI-geholpen audits grote aantallen bevindingen in relatief korte tijd kunnen opleveren, en dat het op de juiste manier patchen van al die meldingen nu de echte uitdaging is.

De bekendste kanttekening blijft: Z.ai houdt de modelgewichten momenteel nog vast en belooft ze pas na een veiligheidsbeoordeling openbaar te maken. Daarmee geeft het bedrijf aan dat het zich bewust is van wat zo'n model in verkeerde handen kan doen. Tegelijkertijd is dat precies de reden waarom toezichthouders en beveiligingsonderzoekers de komende maanden goed zullen kijken naar wat er gebeurt zodra de gewichten echt publiek worden.

Wat weten we zéker?

Bevestigd (primair en door Reuters overgenomen):

Nog niet bevestigd:

STELLING VAN DE DAG · HALFWEG HET ARTIKEL, EVEN PAUZE

Binnen vijf jaar levert een AI-agent meer productiecode dan een junior developer — en dat is prima voor het vak.

Elke editie één prikkelende stelling — van AI tot economie. Eén klik, volkomen anoniem.

Eens
Oneens
2.185 stemmen · blijft anoniem✓ Stem bezorgd bij de redactie!
«Dit artikel is geschreven met behulp van AI en vóór publicatie feitelijk gecontroleerd door de menselijke redactie.»

Geschreven door AI · gecontroleerd door mensen

WhatsApp X / Twitter

Gerelateerd