Red teaming van AI-agents inrichten: de drie lagen die u vanaf 2026 nodig heeft
Red teaming van generatieve AI en agents wordt continu en gelaagd. Zo richt u LLM-tests, agent-oefeningen en autonome scans in op …
21 artikelen
Red teaming van generatieve AI en agents wordt continu en gelaagd. Zo richt u LLM-tests, agent-oefeningen en autonome scans in op …
Onderzoekers vonden een ChatGPT-lek dat via gekoppelde apps toegang gaf tot Gmail, Drive, Teams en GitHub. Dit moet u nu over conn…
Audits uit 2026 tonen dat LLM's in 11 tot 57 procent van de gevallen misleidende bronnen produceren en dat fake references in echt…
Hugging Face beschreef hoe autonome evaluatie-agents via Artifactory en dataset-loaders code lieten draaien. Wat betekent supply-c…
Wired meldt dat OpenAI, Anthropic en meer dan honderd bedrijven waarschuwen voor AI-gedreven cyberaanvallen binnen maanden. Wat di…
Vergelijkingen van Braintrust en AIML.qa en benchmarks als HalluScan tonen dat hallucinatiedetectie in 2026 een gelaagde stack is …
Nieuwe studies uit 2026 tonen dat accuracy-scores tekortschieten voor bedrijfskritische AI. Hoe evaluaties verschuiven naar reliab…
Een nieuwe studie naar medische multimodale RAG laat zien dat vergiftigde kennisbanken retrieval kunnen kapen. Wat dat betekent vo…
Nieuw onderzoek en NIST-kaders uit 2026 tonen dat prompt injection bij AI-agents een structureel architectuurprobleem is, van gehe…
Recente studies laten zien dat één AI-model geen betrouwbare eigen verificateur is. Wat betekent dat voor professionals met hoog-t…
Studies uit 2026 tonen dat verouderde en onvolledige brondata de grootste aanjager van AI-hallucinaties zijn. Wat betekent dat voo…
BFCL V4 en een nieuwe jailbreak-studie laten zien dat functieaanroepen door AI geen simpele feature zijn maar een verifieerbare ke…
Nieuwe benchmarks en EU-regels laten zien dat meertalige AI-output per taal apart geverifieerd moet worden. Wat betekent dat voor …
De autonome inbraak op Hugging Face laat zien dat AI-tools en agents zelf een aanvalspad worden. Wat dit betekent voor organisatie…
Meerdere ACL 2026-studies beschrijven hoe AI-samenvattingen van lange documenten kernclaims missen en hallucineren. Waarom een zic…
Nieuwe studies uit 2026 schetsen dat AI structureel fouten maakt met getallen en tabellen. Waarom validatie van cijfers een gelaag…
Een sessie-isolatiefout bij Writer laat zien dat lekkage tussen gebruikers, projecten en sessies in AI een architectuurprobleem is…
Microsofts External Red Team Alliance en nieuw onderzoek tonen dat red teaming van generatieve AI en AI-agents verschuift naar een…
Verborgen instructies in websites en documenten kunnen AI-systemen misleiden. Wat NIST, Google, arXiv en OWASP melden en wat dit b…
Recente benchmarks en studies laten zien dat multi-model verificatie fouten reduceert maar niet volledig oplost. Waarom verschille…
Prompt injection vormt een architectuurprobleem dat niet door modelkeuze wordt opgelost. Organisaties moeten gescheiden bevoegdhed…