// ORVYN — AI-AGENTBEVEILIGING · BESLOTEN PREVIEW

Wij proberen je AI-agent te breken. Voordat iemand anders het doet.

Orvyn is een door mensen geleide securitytest voor AI-agents die met klanten praten en tools, data of geheugen gebruiken. We spreken af wat getest mag worden, onze reviewers en bots pushen de agent zoals een aanvaller dat zou doen, en jij krijgt duidelijk bewijs en oplossingen.

// WAT WE CONTROLEREN

Elk pad dat een aanvaller zou proberen.

Een Orvyn-review is geen scanner. Onze reviewers en bots praten met je agent zoals een aanvaller dat zou doen. Dit zijn de acht routes die we altijd proberen, in gewone taal.

  1. 01

    De agent zijn regels laten vergeten

    Kan iemand de agent overtuigen om zijn instructies te negeren?

  2. 02

    Verborgen instructies in content

    Volgt de agent tekst die verstopt zit in e-mails, pagina's of bestanden die hij leest?

  3. 03

    Gegevens van anderen lekken

    Kan de agent verleid worden om gegevens te delen die van iemand anders zijn?

  4. 04

    Gevaarlijke acties via tools

    Kan de agent worden gepusht tot terugbetalingen, verwijderingen of e-mails die hij nooit mag doen?

  5. 05

    Meer doen dan de gebruiker mag

    Doet de agent dingen waar deze gebruiker geen recht op heeft?

  6. 06

    Valse herinneringen planten

    Kan iemand een onwaarheid opslaan die de agent later vertrouwt?

  7. 07

    Bereik via gekoppelde systemen

    Wat kan de agent aanraken via zijn integraties, en wat gebeurt er als dat misbruikt wordt?

  8. 08

    Standhouden onder druk

    Blijft de agent binnen jouw zakelijke en veiligheidsregels als iemand hard pusht?

Wat Orvyn controleert

Orvyn controleert een AI-agent binnen een afgesproken testomgeving. We kijken naar de instructies, tools, rechten, het geheugen, opgehaalde content, gekoppelde systemen en de gegevens die de agent kan bereiken.

Voor de start spreken we af welke risicovolle situaties we proberen. Denk aan verkeerde instructies, onveilig toolgebruik, het omzeilen van rechten, geheugenproblemen en datalekken. De precieze dekking hangt af van de toegang en veiligheidsgrenzen die we samen afspreken.

Hoe de besloten preview werkt

Eerst brengen we in kaart wat de agent kan zien en doen. Daarna proberen we de afgesproken aanvalsscenario's en bewaren we het bruikbare spoor: de instructie, context, toolaanroepen, goedkeuringsstatus, betrokken gegevens en het resultaat.

We markeren elk resultaat als gereproduceerd, geblokkeerd, mogelijk maar niet bewezen, of niet getest. De dekkingsregistratie benoemt de agentversie, rollen, gekoppelde tools, gegevensklassen, scenario's, uitgesloten acties, omgeving en het testvenster, zodat een niet-geteste route nooit als gedekt wordt gepresenteerd.

Een bevinding bevat de status van de menselijke beoordeling, voorwaarden, een geredigeerde prompt of request, tooltrace of response, waargenomen resultaat, verwachte controle, bedrijfsimpact en herstelcriteria. Een hertest is alleen inbegrepen als dit in het schriftelijke previewvoorstel staat; deze slaagt alleen voor de exacte route en verwachte controle die daarin zijn beschreven. De besloten preview is geen certificering of blijvende veiligheidsgarantie.

Wanneer je Orvyn gebruikt

Gebruik Orvyn voordat een agent live gaat, na het toevoegen van een nieuwe tool, voordat je meer toegang geeft en voordat je gevoelige gegevens koppelt. Het is ook nuttig na een incident of een grote wijziging aan prompts, retrieval, geheugen of modellen.

Hetzelfde model kan weinig risico opleveren in een chatvenster en veel risico zodra het code kan wijzigen, terugbetalingen kan uitvoeren, klantgegevens kan aanpassen of infrastructuur kan beheren. Test opnieuw wanneer die mogelijkheden veranderen.

Veelgestelde vragen

Wat is Orvyn?

Orvyn is Loki's beveiligingsassessment voor AI-agents in besloten preview. Het controleert of een agent binnen de afgesproken grenzen blijft wanneer mensen, content of gekoppelde tools de agent van koers proberen te brengen.

Hoe verschilt dit van een gewone pentest?

Een gewone pentest richt zich op code, accounts, endpoints en infrastructuur. Orvyn controleert daarnaast de instructies, tools, het geheugen, opgehaalde content, de rechten en goedkeuringsstappen van de agent.

Welke AI-agentomgevingen kunnen jullie controleren?

De preview kan aangepaste AI-workflows, RAG-systemen, MCP-servers en -clients, API's die tools aanroepen, browseragents, computer-use-agents en multi-agentsystemen omvatten. Ondersteuning hangt af van de omgeving, beschikbare traces, testomgeving en afgesproken grenzen.

Kunnen jullie een live agent veilig testen?

We spreken de veiligheidsgrenzen af voordat we testen. Risicovolle acties, echte klantgegevens en kwetsbare workflows sluiten we uit of verplaatsen we naar een veilige testomgeving. We leggen vast wat we wel hebben getest en wat buiten de scope bleef.

Wat ontvangen we?

Je ontvangt een agentkaart, de geteste scenario's, beschikbare bewijssporen, de betrokken tools of gegevens, het bedrijfsrisico, praktische oplossingen, stappen voor een hertest en duidelijke labels voor geblokkeerde of niet-geteste routes.

Hoe beginnen we?

Plan een gesprek over de besloten preview. We bekijken eerst de agent, toegang, toestemming, testomgeving, veiligheidsgrenzen en de beslissingen die je moet nemen. Daarna bevestigen we of we een nuttig assessment kunnen afbakenen.

Wat omvat de vanafprijs van €500 per maand?

Orvyn is alleen op uitnodiging en heeft geen universeel vast pakket. Het schriftelijke previewvoorstel bevestigt de agent en omgeving, scenario's, rollen, tools, toegang, uitsluitingen, bewijs, oplevering, looptijd, facturatie en of een hertest is inbegrepen. Een boeking koopt, verlengt of autoriseert geen werk.