Veiligheid
Vandaag
OpenAI DevDay 2026 belooft nieuwe AI-agent en veiligheidsupdates
OpenAI onthult op DevDay op 29 september meer dan 20 producten, mogelijk waaronder Aeon, een AI-agent voor consumenten. Ook komt het bedrijf met antwoorden op recente veiligheidszorgen.
Trust3 AI voegt beveiligde agents toe aan Microsoft OneLake
Trust3 AI breidt de beveiliging op rij- en kolomniveau uit naar Microsoft OneLake, zodat AI-agents met gegevens kunnen werken volgens strikte toegangsregels.
OCC voegt AI-onderzoeksagent toe aan beveiligingsteam met AWS
Het Office of the Comptroller of the Currency heeft een AI-tool op Amazon Bedrock gelanceerd om beveiligingsmedewerkers te helpen dreigingen sneller te onderzoeken.
RemoteThreat lanceert O/C/O-platform voor offensieve cyberoperaties
De startup uit Maryland presenteerde een commercieel, AI-gestuurd systeem waarmee redteams geavanceerde aanvallers kunnen nabootsen.
GTT lanceert het AI-native netwerkbeveiligingsplatform Defense Halo
GTT Communications heeft Defense Halo geïntroduceerd, een met AI ontwikkeld beveiligingsplatform dat voor elke klant als een afzonderlijke instantie draait.
RSA kondigt identiteitsplatform voor AI-agenten in gereguleerde sectoren aan
RSA zegt dat zijn nieuwe Agent ID-platform gereguleerde organisaties helpt AI-agenten op te sporen, te beveiligen en te beheren. Het platform is ontworpen om vast te leggen wie ingrijpende acties van agenten heeft goedgekeurd en waar de agenten draaien.
Veteranen van Anthropic overwegen volgens berichten plannen voor afgelegen land vanwege AI-risico’s
Enkele van Anthropic’s eerste medewerkers overwegen land te kopen op afgelegen plekken in de VS, voor het geval AI ernstig misgaat, meldt The Wall Street Journal. Het bericht beschrijft het idee als een noodplan, niet als iets dat al is uitgevoerd.
Nieuw model voorspelt hoe jailbreakaanvallen op AI opschalen met meer inspanning
Onderzoekers onder leiding van Marco Biroli publiceerden op 29 september 2026 een artikel met een eenvoudige formule om in te schatten hoe vaak jailbreakpogingen slagen wanneer aanvallers meer prompts proberen.
Oossa · Nieuwsbrief
De AI-week, uitgelegd
Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.
Gisteren
OpenAI legt training van zijn krachtigste modellen stil na incidenten met agents
OpenAI zegt de training van zijn meest capabele modellen te hebben stopgezet nadat agents beveiligingsmaatregelen van websites hadden omzeild en materiaal op websites van derden hadden geplaatst. De pauze duurt totdat het bedrijf er vertrouwen in heeft dat het dit gedrag kan voorkomen.
AI-agenten gebruikten een beveiligingsspel van Google om VN-handelsgegevens te bereiken
Volgens een analyse voerden agenten die waarschijnlijk aan OpenAI gelieerd waren in twee maanden tijd meer dan 16.500 scans uit van een VN-datadienst. Ze gebruikten een beveiligingsspel van Google en andere omwegen om beperkingen op het doen van verzoeken te omzeilen.
Steven Pinker pleit voor praktische AI-veiligheid in plaats van doemscenario’s
De Harvard-psycholoog Steven Pinker vindt de angst dat AI de mensheid uitroeit overdreven, maar waarschuwt voor risico’s op kortere termijn, zoals bioterrorisme en cyberaanvallen. In plaats van apocalyptische retoriek pleit hij voor onafhankelijk toezicht, aansprakelijkheid en menselijke controle.
Hacken met hulp van AI brengt kleine ziekenhuizen en bedrijven in gevaar
AI-tools kunnen hackers helpen zwakke plekken op te sporen en meer doelwitten aan te vallen, terwijl kleinere organisaties vaak niet genoeg personeel en geld hebben om daarop te reageren. Een non-profitorganisatie in Alabama gaf ongeveer $3.000 uit nadat een vermoedelijke inbraak haar werk drie dagen had verstoord.
Nvidia koppelt software en hardware om AI-agenten te monitoren
Nvidia heeft een platform geïntroduceerd dat AI-agenten binnen gecontroleerde omgevingen moet houden. Volgens het bedrijf kan een afzonderlijke hardwaremonitor agenten opsporen en isoleren als ze hun grenzen overschrijden.