Linux Foundation en NVIDIA lanceren SAFE voor AI-cyberbeveiliging
Tijdens de jaarlijkse Black Hat-conferentie in Las Vegas heeft de Linux Foundation een oproep tot commentaar (Request for Comments) gepubliceerd voor de zogeheten Shared AI Findings Exchange (SAFE). De richtlijnen, opgesteld door de meer dan 120 leden tellende Open Secure AI Alliance, zijn bedoeld om incidenten rondom autonome AI-agenten om te zetten in collectieve bescherming voor de gehele IT-sector.
Aan het initiatief werken vooraanstaande technologie- en beveiligingsbedrijven mee, waaronder NVIDIA, Cisco, CrowdStrike, Hugging Face en Red Hat. Het SAFE-kader richt zich op het vertrouwelijk verzamelen en analyseren van AI-veiligheidsincidenten en 'near misses', het informeren van gedupeerden en het identificeren van terugkerende beveiligingsfouten. Op basis hiervan wil de alliantie operationele aanbevelingen publiceren die systeemrisico's moeten verkleinen.
Beveiliging van de volledige AI-stack
Volgens de initiatiefnemers vraagt het beveiligen van AI-agenten om meer dan traditionele kwetsbaarheidsscans, omdat agenten bestaan uit complexe systemen van identiteitscontroles, guardrails, logboeken en runtimes. Alliantieleden dragen daarom op verschillende niveaus open-source tools en hulpmiddelen bij om de volledige AI-beveiligingsketen te versterken.
NVIDIA levert onder meer de NVIDIA Labs Object-Oriented Agent (NOOA) voor het testen en auditen van agentgedrag, het OpenShell-runtimekader voor toegangsbeperkingen, en de Garak-scanner voor het opsporen van kwetsbaarheden zoals prompt injection. Daarnaast publiceert het bedrijf cryptografisch ondertekende 'agent skills' en beveiligingsmodellen binnen de Nemotron-familie.
Brede bijdragen uit de IT-industrie
Ook andere alliantieleden lanceren nieuwe open-source middelen binnen het ecosysteem:
Identiteit en Toegangsbeheer: Okta ontwikkelt referentie-implementaties voor het Cross App Access (XAA)-protocol op basis van OpenShell. Palo Alto Networks draagt Agent Guard en Agent Watch uit het Idira-platform bij, terwijl Red Hat het project asago heeft opgericht om governance-regels (zoals NIST en de EU AI Act) direct te koppelen aan de acties van agenten.
Orchestratie en Harnesses: Nieuw lid Amazon deelt Strands Agents en de autorisatietaal Cedar. Microsoft stelt onder meer PyRIT (voor geautomatiseerde red teaming) en Assert beschikbaar, terwijl Cloudflare, Capital One, Visa en Wiz hun eigen analyse-harnesses openstellen.
Beveiligingsmodellen en Detectie: Cisco brengt het DefenseClaw-beheerplatform op OpenShell en kleine taalmodellen (Project CodeGuard) uit. CrowdStrike gebruikt een gefine-tuned NVIDIA Nemotron Nano-model om de efficiëntie van SOC-teams te verhogen, en Mistral publiceert het multimodale veiligheidsmodel Shieldstral. Uber stelt onderdelen van zijn Agentic AI Detection and Response (ADR)-systeem beschikbaar, dat dagelijks meer dan 200.000 agent-sessies analyseert.
Resilience en Herstel: LangChain voegt herstelopties toe aan zijn kaders zodat onderbroken agenten veilig kunnen hervatten, terwijl Veeam via het Kanister-framework zorgt voor de bescherming en het herstel van Kubernetes-data en vectordatabases.
Met de publicatie van de SAFE-richtlijnen en de uitbreiding van het open-source instrumentarium wil de Open Secure AI Alliance de verdedigers van digitale infrastructuren op gelijke snelheid brengen met de ontwikkelingen rondom agentische AI.