OpenAI test een veiligheidssysteem dat misbruik signaleert zonder klantdata te bewaren, een directe uitdaging aan rivaal Anthropic en diens nieuwe bewaarplicht van 30 dagen.
Belangrijkste punten:
- OpenAI lanceert een preview van Private Safety Processing, een tool die misbruikpatronen over samenhangende sessies opspoort zonder prompts of antwoorden op te slaan.
- Anthropic eist van zakelijke klanten bij de krachtigste modellen 30 dagen databehoud, omdat de logs nodig zouden zijn om aanvallen in meerdere stappen te detecteren.
- Een bredere uitrol en een technische whitepaper staan gepland voor september.
Private Safety Processing richt zich op misbruik over meerdere sessies
Het bedrijf maakte woensdag bekend dat de preview live gaat. De dienst wordt gepresenteerd als een uitbreiding op Zero Data Retention: de afspraak dat OpenAI prompts en modeluitvoer niet bewaart zodra een verzoek is afgehandeld. In september moeten een bredere uitrol en een technische whitepaper volgen.
In het nieuwe model blijft klantcontent óf op infrastructuur onder eigen beheer van de klant, óf in opslag bij OpenAI, maar dan versleuteld met sleutels die uitsluitend de klant beheert. Geautomatiseerde tooling scant die content vervolgens op misbruikpatronen over verwante sessies heen. De opzet dekt ook zogenoemd ‘agentic’ gedrag, waarbij een systeem doorwerkt nadat een gebruiker opdracht heeft gegeven om te stoppen. Medewerkers krijgen de inhoud nooit te zien.
Aleah Houze, hoofd productbeleid bij OpenAI, vertelde aan verslaggevers dat risicovol gedrag vaak pas zichtbaar wordt als je meerdere interacties in samenhang bekijkt. Ze schetste het voorbeeld van een gebruiker die in het ene gesprek naar kwetsbaarheden in software zoekt en in een later gesprek vraagt naar remote access tools.
Ook interessant: De verborgen watermark van Claude ondermijnt schrijverschap, zegt Gruber
Anthropic's bewaarplicht zet de concurrenten lijnrecht tegenover elkaar
Anthropic koos in juli nadrukkelijk voor de tegenovergestelde koers en verplicht zakelijke klanten tot 30 dagen databehoud als zij de krachtigste modellen gebruiken, waaronder Fable 5 en Mythos 5.
Het lab erkende dat het beleid impopulair kan zijn en de eigen business kan schaden, maar noemt de logs essentieel om aanvallen te vangen die bewust worden uitgesmeerd over vele losse verzoeken. Menselijke review blijft mogelijk, zij het via een strikt gecontroleerd proces waar slechts een kleine, geautoriseerde groep reviewers toegang toe heeft. Elke sessie wordt vastgelegd in een onvervalsbare log.
Analisten zetten vraagtekens bij timing en bewijs van OpenAI
Brian Levine, uitvoerend directeur van FormerGov, noemde de belofte technisch sterk, omdat misbruikmonitoring en volledige blindheid voor inhoud traditioneel op gespannen voet staan.
Hij wees er tegelijk op dat het harde bewijs pas weken later komt. Jason Andersen van Moor Insights and Strategy leest de aankondigingen deels als strategische positionering vooruitlopend op een mogelijke beursgang.
Flavio Villanustre, chief information security officer bij LexisNexis Risk Solutions Group, ziet in de stap een poging om de strengere regulering die hij verwacht alvast af te zwakken.
De preview vormt het sluitstuk van een week vol veiligheidsboodschappen. Dinsdag meldde OpenAI dat het de schaalvergroting tijdelijk vertraagt en reinforcement learning-training pauzeert, om de onderzoeksomgeving verder te hardenen en intensiever te ‘red-team’en’. Het bedrijf schat bovendien dat de extra monitoring ongeveer 20% van de inference-capaciteit die onder toezicht staat zal opslokken.
Lees ook: Bitcoin kan opnieuw $100.000 aantikken vóór halvering in 2028, zegt Scaramucci





