OpenAI test een veiligheidssysteem dat misbruik signaleert zonder klantdata op te slaan – een directe uitdaging aan rivaal Anthropic, dat net een verplichte bewaartermijn van 30 dagen heeft ingevoerd.
Belangrijkste punten:
- OpenAI geeft een voorproef van Private Safety Processing, een tool die misbruikpatronen over gekoppelde sessies heen opspoort zonder prompts of antwoorden van klanten te bewaren.
- Anthropic eist van zakelijke klanten op zijn krachtigste modellen een bewaartermijn van 30 dagen, en noemt logdata noodzakelijk om meerstapsaanvallen te onderscheppen.
- Een bredere uitrol en een technisch whitepaper staan gepland voor september.
Private Safety Processing richt zich op misbruik over meerdere sessies
Het bedrijf maakte woensdag bekend dat de preview van start gaat. OpenAI presenteert het systeem als een uitbouw van Zero Data Retention, de afspraak waarbij het bedrijf geen prompts of modelantwoorden bewaart zodra een verzoek is afgehandeld. Een ruimere uitrol en een technisch whitepaper worden in september verwacht.
In het nieuwe model blijft klantcontent óf op infrastructuur die de klant zelf beheert, óf in OpenAI-opslag die is versleuteld met sleutels waar alleen de klant toegang toe heeft. Geautomatiseerde tools analyseren die content op misbruikpatronen over gerelateerde sessies heen. Het ontwerp is ook toegesneden op ‘agentisch’ werk, waarbij een systeem kan doorwerken nadat een gebruiker het ogenschijnlijk heeft stopgezet. Menselijke medewerkers krijgen de inhoud niet te zien.
Aleah Houze, hoofd productbeleid bij OpenAI, verklaarde tegenover verslaggevers dat gevaarlijk gedrag vaak pas zichtbaar wordt als je meerdere interacties in samenhang bekijkt. Ze schetste het voorbeeld van een gebruiker die in één gesprek naar softwarekwetsbaarheden zoekt en in een ander gesprek doorvraagt over remote access tools.
Ook interessant: De verborgen watermark van Claude ondermijnt schrijfkunst, zegt Gruber
Bewaarplicht van Anthropic zet de rivalen lijnrecht tegenover elkaar
Anthropic koos in juli bewust voor de tegengestelde koers: zakelijke klanten die de meest geavanceerde modellen – waaronder Fable 5 en Mythos 5 – inzetten, moeten akkoord gaan met een verplichte bewaartermijn van 30 dagen.
Het lab erkende dat dit beleid impopulair kan zijn en commercieel pijn kan doen, maar noemt de logs cruciaal om aanvallen te detecteren die doelbewust over vele afzonderlijke verzoeken worden uitgesmeerd. Handmatige controle blijft mogelijk, al kan dat alleen via een strikt gereguleerd proces waartoe slechts een kleine, vooraf gescreende groep reviewers toegang heeft. Elke sessie wordt vastgelegd in een onvervalsbaar logbestand.
Analisten zetten vraagtekens bij timing en bewijs van OpenAI
Brian Levine, uitvoerend directeur van FormerGov, noemde in zijn reactie de toezegging een stevige technische belofte, juist omdat misbruikmonitoring en volledige datablindheid historisch gezien elkaars tegenpolen zijn.
Hij wees er tegelijk op dat het harde bewijs pas weken later volgt. Jason Andersen van Moor Insights and Strategy las de aankondigingen van deze week mede als strategische positionering in aanloop naar een mogelijke beursgang.
Flavio Villanustre, chief information security officer bij LexisNexis Risk Solutions Group, ziet in de stap een poging om toekomstige, zwaardere regulering alvast af te vlakken.
De preview vormt de afsluiter van een week vol veiligheidsboodschappen. Op dinsdag meldde het bedrijf dat het zijn opschaling heeft vertraagd en tijdelijk is gestopt met reinforcement learning-training, om de onderzoeksomgeving beter te harden en intensiever te ‘red-team’en. OpenAI schat bovendien dat de uitgebreidere monitoring grofweg 20% van de rekencapaciteit voor inferentie onder toezicht zal zetten.
Lees ook: Bitcoin kan weer boven $100.000 komen vóór de halvering van 2028, zegt Scaramucci





