SpaceXAI’s Grok Build AI-codingtool kreeg felle kritiek nadat onderzoekers ontdekten dat deze volledige gebruikersrepositories uploadde naar Google Cloud-opslag. Het lek veroorzaakte bezorgdheid over hoeveel propriëtaire gegevens AI-assistenten kunnen absorberen en bewaren.
Excessieve gegevensbewaring en beveiligingsrisico's
De analyse van Cereblab toonde aan dat de command-line interface (CLI) van Grok Build volledige codebases verpakte en naar de cloud stuurde. Nog verontrustender was dat de tool bestanden opende die hij volgens de instructies moest negeren, en geheimen ophaalde die ontwikkelaars uit de git-geschiedenis hadden verwijderd.
Dat niveau van gegevensverzameling doet concurrenten zoals Claude Code in het niet vallen. Dr. Lukasz Olejnik, een beveiligingsonderzoeker aan het King’s College London, waarschuwde dat een dergelijke verzameling broncode, infrastructuurdiagrammen, kwetsbaarheden en inloggegevens kan blootstellen aan externe servers.
De reactie van SpaceXAI en Elon Musk
SpaceXAI heeft de uploadfunctie uitgeschakeld. Onderzoekers zien nu een disable_codebase_upload: true flag op de servers van Grok, wat bevestigt dat de automatische push niet meer wordt uitgevoerd.
Elon Musk plaatste op X dat alle eerder geüploade gegevens "volledig en onherroepelijk worden verwijderd." Hij drong gebruikers ook aan om SpaceXAI gegevens te laten bewaren voor "het oplossen van bugs" (debugging issues), een verzoek dat velen als tegenstrijdig beschouwen.
Het bedrijf suggereerde de /privacy CLI-opdracht om de bewaartermijn te beheren, maar Cereblab merkte op dat de opdracht alleen de opslag per sessie aan- of uitzet — het stopt niet de systematische uploads van repositories die het schandaal veroorzaakten.
Waarom dit belangrijk is voor ontwikkelaars en ondernemingen
Dit incident waarschuwt ontwikkelaars en ondernemingen dat door AI gestuurde coding agents niet langer eenvoudige autocomplete-tools zijn; ze kunnen zelfstandig code lezen, wijzigen en committen. Wanneer een agent ignore-bestanden omzeilt of verwijderde geheimen tot leven wekt, moet elke claim van "zero data retention" worden bewezen met technische tests, niet met beloftes in de gebruikersinterface (UI).
Voor CTO's en producteigenaren onderstreept het incident de noodzaak voor:
- Onafhankelijke audits van AI-tools op echte codebases.
- Contractuele clausules die gegevensverwerking, bewaartermijnen en verwijderingsgaranties expliciet vastleggen.
- Runtime-beveiligingen die permissies op bestandsniveau afdwingen, vooral voor repositories met inloggegevens of gepatenteerde algoritmen.
Belangrijkste conclusies
- Onbedoelde gegevensafbakening (Unintended Data Scoping): Grok Build uploadde volledige repositories, inclusief beperkte bestanden en verwijderde geheimen, naar Google Cloud.
- Status van mitigatie: SpaceXAI heeft de automatische upload uitgeschakeld en beloofd de reeds verzamelde gegevens te wissen.
- Beveiligingsimplicaties: Het lek benadrukt het gevaar van excessieve gegevensbewaring in AI-coding agents, die propriëtaire logica en inloggegevens kunnen lekken.
De Grok Build-tool van SpaceXAI werd betrapt op het stilletjes uploaden van volledige codebases van gebruikers naar Google Cloud, waarbij propriëtaire bronbestanden en verwijderde geheimen werden blootgesteld.
Wat er is gebeurd
Cereblab herleidde het netwerkverkeer van de Grok Build CLI naar een Google Cloud bucket en ontdekte dat deze automatisch volledige git-repositories verpakte voor upload. Kortom, de assistent haalde gegevens op die hij volgens de instructies moest negeren.
Hoe het lek werd ontdekt
Onderzoekers inspecteerden de payloads en zagen dat de upload-flag standaard was ingeschakeld, zonder globale opt-out. Dr. Lukasz Olejnik waarschuwde dat een dergelijke "excessieve gegevensbewaring" bedrijfslogica, infrastructuurdetails en authenticatietokens kan lekken. Vergeleken met andere AI-codingassistenten — waarbij Claude Code als referentiepunt dient — is het gedrag van Grok Build aanzienlijk invasiever.
De reactie van SpaceXAI
Nadat het rapport openbaar werd gemaakt, bracht SpaceXAI een update uit die een disable_codebase_upload: true flag teruggeeft, waardoor de functie effectief wordt uitgeschakeld. Elon Musk kondigde op X aan dat alle geüploade gegevens "volledig en onherroepelijk worden verwijderd" en herhaalde dat "privacy-instellingen altijd worden gerespecteerd." Hij vroeg gebruikers ook om de gegevens voor het bedrijf te laten bewaren voor "het oplossen van bugs", een verzoek dat velen als tegenstrijdig beschouwen.
Het bedrijf adviseerde de /privacy CLI-opdracht om de bewaartermijn te beheren, maar onderzoekers wezen erop dat deze alleen de opslag per sessie aan- of uitzet en de systematische uploads van repositories niet stopt.
Waarom dit belangrijk is voor ontwikkelaars en ondernemingen
Door AI gestuurde coding agents evolueren van autocomplete naar autonome tools die code kunnen lezen, wijzigen en committen. Wanneer een agent lokale ignore-bestanden kan omzeilen of verwijderde geheimen tot leven kan wekken, moet elke belofte van "zero data retention" worden geverifieerd met technische tests, en niet alleen met UI-instellingen. CTO's en producteigenaren zouden moeten:
- Laat onafhankelijke audits uitvoeren naar het gedrag van AI-tools op echte codebases.
- Onderhandel over duidelijke contracten waarin gegevensverwerking, bewaartermijnen en verwijderingsgaranties worden vastgelegd.
- Implementeer runtime-beveiligingsmaatregelen die permissies op fileniveau afdwingen voor gevoelige repositories.
Het datalek roept ook een bredere vraag op over de afweging tussen het gemak van AI en de veiligheid. SpaceXAI beweert dat de uploadfunctie gebruiksstatistieken verzamelde om het model te verbeteren, en heeft de functie uitgeschakeld met de belofte om bestaande uploads te wissen. Critici merken op dat het oorspronkelijke ontwerp geen transparante opt-out bevatte en dat het privacy-commando na het incident de gegevens die al in de cloud stonden niet met terugwerkende kracht beschermt.
Tegenargument van SpaceXAI
SpaceXAI voert aan dat de uploadfunctie bedoeld was om gebruiksstatistieken te verzamelen voor modelverbetering. Het wijst op het snelle uitschakelen van de functie en de belofte om bestaande uploads te wissen als bewijs van een verantwoordelijke reactie. Critici werpen tegen dat het oorspronkelijke ontwerp geen duidelijke opt-out bood en dat het privacy-commando er niet in slaagt gegevens te beschermen die al in de cloud zijn opgeslagen.
Conclusie
Wanneer een AI-code-assistent stilletjes een volledige repository kan leegtrekken, wordt vertrouwen een technisch vraagstuk in plaats van een marketingkwestie. Organisaties moeten verifieerbare, afdwingbare controles eisen die verborgen data-exfiltratie voorkomen, anders riskeren ze de code die hen een concurrentievoordeel geeft, bloot te stellen.
