Techgiganten delen open-source tools voor agentic AI-beveiliging
De Linux Foundation en de Open Secure AI Alliance — een consortium van inmiddels meer dan 120 organisaties — hebben op 4 augustus 2026 de zogeheten Shared AI Findings Exchange (SAFE) richtlijnen aangekondigd. Met dit voorstel voor een Request for Comments (RFC) wil de Alliantie incidenten en kwetsbaarheden rondom autonome AI-agents op een vertrouwelijke en gestructureerde manier delen. Zo moeten beveiligingsincidenten snel worden omgezet in collectieve bescherming voor het gehele ecosysteem.
Aan het initiatief werken grote technologie- en cybersecuritybedrijven mee, waaronder NVIDIA, Cisco, CrowdStrike, Hugging Face en Red Hat. De richtlijnen omvatten afspraken over het anoniem verzamelen en analyseren van AI-incidenten en 'near misses', het informeren van betrokkenen en het publiceren van operationele aanbevelingen om systeemeigen risico's te verminderen.
Verder kijken dan alleen kwetsbaarheidsscans
Volgens de initiatiefnemers vereist het beveiligen van zogeheten agentic AI een bredere aanpak dan traditionele beveiliging. Omdat een AI-agent niet alleen uit een model bestaat, maar ook uit identiteitscontroles, harnesses (sturingslagen), guardrails en logboeken, moeten alle lagen van de AI-beveiligingsstack worden afgedekt.
Om deze lagen open en controleerbaar te maken, stellen verschillende alliantieleden open-source middelen en modellen beschikbaar:
Infrastructuur en sturing (NVIDIA): NVIDIA levert onder meer het NVIDIA OpenShell-framework om de acties van AI-agents op runtime-niveau te beperken, evenals hulpmiddelen als NeMo Guardrails en de LLM-scanner Garak.
Identiteit en toegang (Okta, Palo Alto Networks, Red Hat): Bedrijven werken aan open protocollen en tools. Zo richt het door Red Hat gestarte project asago zich op het rechtstreeks vertalen van governance-eisen (zoals uit de EU AI Act of NIST) naar de bevoegdheden van agents.
Orchestratie en sturingslagen (Amazon, Microsoft, Cloudflare, Wiz): Amazon introduceert met Cedar een autorisatietaal voor agents en sluit zich aan bij de alliantie. Microsoft deelt tools zoals PyRIT voor geautomatiseerde 'red teaming' en RAMPART voor herhaalbare beveiligingstests. Wiz draagt met Atlas bij aan autonome kwetsbaarheidsanalyse.
Gespecialiseerde AI-modellen (Cisco, CrowdStrike, Mistral): Cisco brengt met Antares kleine taalmodellen uit voor beveiliging, terwijl Mistral zijn Shieldstral-veiligheidsmodel als open-weights beschikbaar stelt onder een Apache 2.0-licentie. CrowdStrike stemt Nemotron-modellen af op beveiligingsanalyses binnen het eigen platform.
Zichtbaarheid en herstelvermogen
Naast detectie en preventie richt de alliantie zich op de vraag wat een agent precies heeft gedaan en waarom. Bedrijven als Perplexity (Numbat) en Uber (ADR) stellen technologieën beschikbaar die de gehele keten van agent-acties — van prompt tot tool-call — in kaart brengen en bewaken. Uber zet dit reeds op grote schaal in voor het monitoren van honderdduizenden agent-sessies per dag.
Tot slot voegen partijen als LangChain en Veeam functionaliteiten toe om de continuïteit te waarborgen. Hierdoor kunnen AI-agents na een onderbreking of fout veilig terugvallen op alternatieve modellen of herstellen vanaf een opgeslagen status, zonder dat kritieke data verloren gaat of de omgeving in gevaar komt.