Naar de inhoud

AI veilig inzetten: Wat het mag zien, en wat het mag doen.

AI veilig inzetten betekent vooraf vastleggen wat een AI-systeem mag zien, wat het zelf mag doen en wat altijd op een mens wacht. Goudbeek in Almere bouwt AI-agents en chatbots volgens die regels, en legt AI die je al draait langs dezelfde zes punten.

Het grootste risico in een AI-systeem is niet het model. Het is wat je het laat bereiken, en wat je het laat doen zonder dat iemand meekijkt. Elke build hier begint bij die twee vragen, en de antwoorden staan op papier voordat er een regel live gaat.

Onderdeel van elke build

Zes dingen die vastliggen voordat er iets draait.

01

Minimale toegang als standaard

Het krijgt de documenten en systemen die de klus nodig heeft, en niets daarbuiten. Toegang gaat per bron in plaats van per systeem, dus een chatbot die vragen over bezorging beantwoordt heeft geen route naar je salarisadministratie.

02

Een grens tussen opstellen en uitvoeren

Lezen, zoeken en concepten schrijven kosten weinig als het misgaat. Versturen, betalen, verwijderen en gegevens wijzigen kunnen veel kosten. Alles met gevolgen zit achter een goedkeuring tot jij besluit dat het anders mag.

03

Elk antwoord draagt zijn bron

Als het uit jouw materiaal antwoordt, zegt het welk document en welke passage het gebruikte. Een antwoord dat niemand kan herleiden is een antwoord dat niemand kan controleren, en dat je niet kunt verdedigen tegenover een klant.

04

Het mag zeggen dat het het niet weet

Een systeem dat altijd iets produceert, produceert vroeg of laat met droge ogen iets verkeerds. Deze zijn gebouwd om aan de rand van hun kennis te weigeren en over te dragen, en dat is precies het gedrag dat mensen daar willen.

05

Externe tekst blijft onvertrouwd

Alles wat van buiten binnenkomt — een klantmail, een webpagina, een geüploade pdf — behandelen we als data, nooit als instructie. Een taalmodel kan dat onderscheid niet waterdicht maken, dus beperken we wat zulke tekst kan aanrichten: het systeem kan alleen bij wat de klus nodig heeft, en alles met gevolgen wacht standaard op een mens.

06

Er is een registratie

Wat er gevraagd is, wat het gelezen heeft, wat het gedaan heeft en wie het goedkeurde. Niet voor de folder: zo zoek je uit wat er werkelijk gebeurde op de dag dat iets er vreemd uitziet.

Vragen over AI veilig inzetten

Eerlijke antwoorden, ook over wat we niet beloven.

Kan een AI-agent voor de gek gehouden worden?

Ja, ook een AI-agent kan voor de gek gehouden worden. Geen enkel AI-systeem is immuun, en wie beweert dat zijn systeem dat wel is, heeft iets te verkopen. De nuttige vraag is wat het kan bereiken op de dag dat het wél voor de gek gehouden wordt. Daarom krijgt het alleen toegang tot de bronnen die de klus nodig heeft, en zit alles met gevolgen — versturen, betalen, verwijderen, gegevens wijzigen — standaard achter een goedkeuring door een mens.

Is Goudbeek SOC 2- of ISO 27001-gecertificeerd?

Nee, Goudbeek zelf heeft geen SOC 2- of ISO 27001-certificering. De SOC 2-, ISO 27001- en PCI DSS-keurmerken op de hostingpagina horen bij het platform eronder. Ze zeggen dat de infrastructuur onafhankelijk geaudit is. Ze zeggen niets over de vraag of jouw AI-agent zelfstandig een mail mag versturen. Dat deel is van ons: het toegangsmodel, de goedkeuringsgrens en de registratie, vastgelegd voordat de bouw begint.

Wanneer regel je de beveiliging van een AI-systeem?

De beveiliging van een AI-systeem regelen we bij de intake, niet aan het eind. Toegang, goedkeuringen en logging liggen vast voordat er gebouwd wordt, want ze er achteraf aan vastplakken betekent het systeem eromheen opnieuw bouwen. Als een build toegang zou vragen waar we ons niet prettig bij voelen, is dat een gesprek vóór de offerte, niet erna. Wat vastligt, staat op papier, en jij kunt het blijven aanpassen. Dat geldt voor elk van onze AI-oplossingen voor bedrijven.

Tot welke gegevens krijgt de AI toegang?

De AI krijgt alleen toegang tot de documenten en systemen die de klus nodig heeft, en niets daarbuiten. Toegang gaat per bron in plaats van per systeem: een chatbot die vragen over bezorging beantwoordt, heeft geen route naar je salarisadministratie. Welke bronnen dat zijn, beslissen we samen vóór de bouw en leggen we vast in de afspraak.

Hoe ga je om met prompt injection?

Tegen prompt injection behandelen we alles wat van buiten het systeem binnenkomt — een klantmail, een opgehaalde webpagina, een geüploade pdf — als data, nooit als instructie. Helemaal uitsluiten dat een model zo'n tekst toch als opdracht leest, kan niemand. Daarom krijgt het systeem ook minimale toegang en een goedkeuring op acties met gevolgen: een geslaagde injectie bereikt dan veel minder dan hij anders zou doen.

Kun je terugzien wat de AI deed en waarom?

Ja, je kunt terugzien wat de AI deed en waarom. Wat er gevraagd is, wat het gelezen heeft, wat het gedaan heeft en wie het goedkeurde, wordt vastgelegd. Antwoorden uit je eigen materiaal noemen het document en de passage waar ze vandaan komen. Een antwoord dat niemand kan herleiden, kan niemand controleren — en kun je niet verdedigen tegenover een klant op de dag dat hij het betwist.

Wat is een AI-securityreview?

Een AI-securityreview is een review van een AI-agent, chatbot of automatisering die al draait — ongeacht of iemand anders hem bouwde of je hem zelf in elkaar zette. We leggen jouw opzet langs dezelfde zes punten waarmee wij bouwen, en leveren terug wat het kan bereiken, wat het zonder mens kan doen, waar de antwoorden vandaan komen, wat er wordt vastgelegd, en een geordende lijst met wat je als eerste verandert.

Is de review een pentest of een certificering?

Nee, de AI-securityreview is geen penetratietest en geen certificering tegen een norm — we zijn geen auditor en gaan ons ook niet zo voordoen. Het is een engineering-review door degene die deze systemen bouwt, opgeschreven zodat je er iets mee kunt. Hij is bedoeld voor teams die al AI draaien die echte data raakt, en waar nog nooit iemand deze vragen hardop over heeft gesteld.

De grens

Opgeschreven voordat het gebouwd wordt.

Wat een systeem mag bereiken, wat het zelf mag doen en wat altijd op een mens wacht, besluiten we eerst en zetten we op papier; daarna kun jij het blijven aanpassen.

Vraag een review aan
Als dienst

Een review van de AI die je al hebt.

De zes hierboven zijn hoe wij bouwen. Het is ook een checklist waar je een bestaand systeem langs kunt leggen — eentje die iemand anders bouwde, of die je zelf in elkaar hebt gezet. Dat is de review: we lopen jouw opzet langs dezelfde vragen en leveren terug wat het kan bereiken, wat het ongezien kan doen, wat er wordt vastgelegd, en wat we als eerste zouden veranderen.

Wat je krijgt

  • Een kaart van wat het systeem kan bereiken — elke documentenbron, elk systeem en elke sleutel die het heeft, en welke daarvan de klus echt nodig heeft.
  • De lijst met acties die het zonder mens kan uitvoeren, gesplitst in de acties die daar prima zitten en de acties die dat niet doen.
  • Waar de antwoorden vandaan komen, en of iemand er eentje zou kunnen herleiden als een klant hem betwist.
  • Wat er wordt vastgelegd tijdens het draaien, en of dat genoeg zou zijn om na een incident uit te zoeken wat er gebeurde.
  • Een geordende lijst met wijzigingen: wat je deze week oplost, wat vóór het groeit, en wat prima is zoals het is.

Voor wie

Teams die al een AI-agent, chatbot of automatisering draaien die echte data raakt, en waar nog nooit iemand deze vragen hardop over heeft gesteld.

Wat het niet is

Het is geen penetratietest en het is geen certificering tegen een norm — we zijn geen auditor en gaan ons ook niet zo voordoen. Het is een engineering-review door degene die deze systemen bouwt, opgeschreven zodat je er iets mee kunt.

Vraag een review aan
Waar het draait

De vloer eronder.

De punten hierboven gaan over het systeem dat wij bouwen. De grond waar het op staat — overal HTTPS, altijd DDoS-bescherming, een onafhankelijk geaudit platform — is de hostingkant, en die heeft zijn eigen pagina.

Bekijk het platform
Verder lezen

Drie stukken over dezelfde vraag.

Uit de kennisbank: wat een agent mag doen, wat de AI-verordening vraagt van een bedrijf met één chatbot, en prompt injection zonder de hype. Wil je zien hoe die regels in een werkend systeem zitten, lees dan over AI-agents voor klantenservice en chatbots die antwoorden uit je eigen data.

AI-security

Prompt injection, uitgelegd zonder de hype

De aanval is oud nieuws in een nieuw jasje: er komt tekst van buiten binnen en het systeem kan instructie niet van inhoud onderscheiden. Wat telt is wat het bereikt zodra het lukt.

4 min lezen

AI-security

Benieuwd wat die van jou zou mogen?

Beschrijf de klus en de systemen die het zou raken. Je krijgt een eerlijk beeld van wat het zou mogen bereiken, wat achter een mens hoort te blijven, en of het überhaupt de moeite waard is om te bouwen.

Begin het gesprek