Prompt Injection-aanval

Prompt Injection-aanval

Een webpagina kan uw AI-assistent vertellen geheimen te lekken.

Wat is Prompt Injection-aanval?

Een AI-assistent kan uw instructies niet vertellen, afgezien van de instructies die hij vindt in de inhoud die hij leest. Tekst die verborgen is op een webpagina, een document of een e-mail wordt behandeld als een opdracht en de assistent voert deze uit met uw toegang. Je vraagt een assistent om een gedeeld artikel samen te vatten, kijkt hoe verborgen instructies sessiereferenties verzamelen en deze naar de server van een aanvaller sturen, opent vervolgens de pagina en vindt het geïnjecteerde blok. U roteert het openbaar gemaakte wachtwoord en dient het incidentrapport in.

Wat je leert in Prompt Injection-aanval

Prompt Injection-aanval — Trainingsstappen

  1. Introductie

    Uw team heeft onlangs OpenClaw geïmplementeerd, een AI-assistent die op internet kan surfen, terminalopdrachten kan uitvoeren en kan helpen met dagelijkse taken. In deze training ervaar je hoe aanvallers verborgen kwaadaardige instructies in webinhoud kunnen insluiten om AI-assistenten te manipuleren om schadelijke acties uit te voeren - een techniek die 'prompt injection' wordt genoemd.

  2. Een Telegrambericht ontvangen

    Je telefoon zoemt met een nieuw Telegrambericht van je collega Marcus. Hij deelt een artikel over AI-beveiligingstrends die hij interessant vond.

  3. Het artikel openen

    Je klikt op de link om het artikel te bekijken dat Marcus heeft gedeeld. De pagina wordt geladen in de browser van uw telefoon.

  4. Te lang om te lezen

    Het artikel ziet er legitiem uit: professionele lay-out, gedetailleerde inhoud over AI-beveiligingstrends. Maar terwijl je er doorheen bladert, besef je dat het behoorlijk lang is. Je hebt weinig tijd en een deadline nadert. Het hele artikel lezen is op dit moment niet praktisch, maar u wilt mogelijk nuttige informatie niet missen. Dan herinner je je: OpenClaw kan helpen! De nieuwe AI-assistent van uw team kan webinhoud snel voor u samenvatten.

  5. OpenClaw om hulp gevraagd

    Het artikel is momenteel te lang om te lezen. Je hebt het druk met een deadline. U besluit OpenClaw, uw AI-assistent, te vragen het artikel snel voor u samen te vatten. Dit lijkt een onschuldig, tijdbesparend verzoek – precies waarvoor AI-assistenten zijn ontworpen.

  6. OpenClaw geeft toegang tot het artikel

    OpenClaw erkent uw verzoek en begint toegang te krijgen tot de artikel-URL om de inhoud ervan te lezen. Achter de schermen haalt OpenClaw de webpagina op en parseert de tekst ervan, inclusief eventuele verborgen inhoud die mogelijk in de pagina is ingesloten.

  7. Er lijkt iets mis te zijn

    Wacht - heb je gemerkt wat OpenClaw net zei? In plaats van het artikel simpelweg samen te vatten, werd er melding gemaakt van het uitvoeren van 'diagnostische opdrachten' en het bieden van 'meer context'. Je hebt nooit om diagnostiek gevraagd. U vroeg alleen om een samenvatting. Waarom zou een AI-assistent terminalopdrachten moeten uitvoeren om een artikel samen te vatten? Dit is het eerste waarschuwingssignaal dat er iets niet klopt.

  8. De aanval ontvouwt zich

    Er gebeurt iets onverwachts. In plaats van het artikel alleen maar samen te vatten, begint OpenClaw met het uitvoeren van terminalopdrachten. Het artikel bevatte verborgen kwaadaardige instructies die bedoeld waren om AI-assistenten te misleiden. Deze instructies geven OpenClaw nu de opdracht om toegang te krijgen tot gevoelige bestanden op uw systeem - en deze naar de server van een aanvaller te sturen.

  9. Inloggegevens gestolen

    Dit kan niet gebeuren. Uw inloggegevens zijn zojuist gestolen en naar de server van een aanvaller gestuurd. Kijk naar de terminaluitvoer: uw API-tokens, wachtwoorden en gevoelige gegevens zijn zojuist geëxfiltreerd via dat curl-commando. De aanvaller beschikt nu over: Je OpenAI-, Anthropic-, AWS- en GitHub API-sleutels Je e-mailadres en VPN-wachtwoorden van je bedrijf Toegangsgegevens voor interne systemen Allemaal omdat je een AI-assistent hebt gevraagd een artikel samen te vatten. Een ogenschijnlijk onschuldig verzoek heeft zojuist uw volledige digitale identiteit in gevaar gebracht.

  10. De aanval begrijpen

    Je moet precies begrijpen hoe dit gebeurde. Het artikel dat Marcus deelde bevatte verborgen kwaadaardige instructies die volledig onzichtbaar voor je waren, maar perfect leesbaar door OpenClaw. Veelgebruikte verbergtechnieken die aanvallers gebruiken: Witte tekst op een witte achtergrond HTML-opmerkingen met instructies Niet op het scherm geplaatste elementen Tekst zonder lettergrootte of zonder dekking Laten we dat artikel eens bekijken en zien waar de aanval precies verborgen zat.

Dekking van beveiligingsframeworks

OWASP LLM Top 10

  • LLM01:2026 Prompt Injection
  • LLM01:2025 Prompt Injection

CWE

  • CWE-1427 Improper Neutralization of Input Used for LLM Prompting
  • CWE-807 Reliance on Untrusted Inputs in a Security Decision

CIS Controls

  • CIS 16 Application Software Security

NIST CSF

  • PR.AT-02 Individuals in specialized roles are provided with awareness and training so that they possess the knowledge and skills to perform relevant tasks with cybersecurity risks in mind
  • PR.PS Platform Security