AI-denial-of-service-aanval
Een gelekte API-sleutel kan uw AI-budget in een middag uitgeven.
Wat is AI-denial-of-service-aanval?
Elke aanroep naar een groot model kost rekenkracht, dus een onbeschermd AI-eindpunt is een uitgavenrekening met een API ervoor. Aanvallers hoeven de service niet uit te schakelen, maar alleen om deze bezig te houden. Je vindt een API-sleutel in een openbare commit en hamert op het eindpunt met dure aanwijzingen, en neemt vervolgens de plaats van de verdediger in: lees de budgetwaarschuwing, zie hoe de kosten en latentie stijgen, traceer de verzoeken via de consolelogboeken, trek de sleutel in en stel tarieflimieten, tokenlimieten en bestedingsdrempels in.
Wat je leert in AI-denial-of-service-aanval
- Identificeer de bronuitputtingsvectoren die specifiek zijn voor AI-API's, waaronder contextvenster-misbruik, recursieve generatie en gelijktijdige verzoekoverbelasting
- Traceer het kostenescalatiepad van gemanipuleerde prompts via rekenverbruik naar de cloudrekening
- Pas snelheidsbeperking, invoervalidatie en uitvoertokenlimieten toe op AI-service-eindpunten om onbegrensd verbruik te voorkomen
- Evalueer budgetcontroles, bestedingswaarschuwingen en automatische beperkingsmechanismen die AI-servicekosten beheersen tijdens aanvalsscenario's
- Maak onderscheid tussen legitieme patronen van hoog AI-verbruik en vijandige bronuitputtingspogingen met behulp van monitoring en anomaliedetectie
AI-denial-of-service-aanval — Trainingsstappen
-
De scan instellen
Bob opent zijn dashboard voor het scannen van inloggegevens – een tool die openbare codeopslagplaatsen controleert op openbaar gemaakte API-sleutels, tokens en cloudgeheimen. Hij staat op het punt zich te richten op de openbare GitHub-organisatie van CypherPeak Technologies.
-
Het scannen uitvoeren
Bob voert de GitHub-organisatie-URL van CypherPeak in de scanner in en start een inloggegevensonderzoek door al hun openbare repository's.
-
Een kritische bevinding
De scanner analyseerde 847 repositories en 12.403 recente commits. Van de zes gevonden geheimen valt er één op: een productie-OpenAI API-sleutel die is onthuld in een configuratiebestand dat slechts enkele minuten geleden is vastgelegd voor het AI-gatewayproject van CypherPeak.
-
Het onderzoeken van de verbintenis
Bob klikt door naar de broncommit om de blootgestelde inloggegevens in de oorspronkelijke context te onderzoeken. De GitHub commit diff toont het volledige configuratiebestand met de API-sleutel in platte tekst.
-
De blootgestelde API-sleutel
De commit diff onthult een productie-API-sleutel die rechtstreeks in een Python-configuratiebestand is gecodeerd. Deze sleutel biedt volledige toegang tot de AI-platform-API van CypherPeak, zonder dat er tariefbeperkingen of budgetbeperkingen aan verbonden zijn.
-
De aanval voorbereiden
Bob opent een terminal om te testen of de gestolen API-sleutel nog actief is. Als de sleutel werkt en er geen snelheidslimiet is, kan hij een denial-of-wallet-aanval lanceren om het volledige AI-budget van CypherPeak leeg te zuigen.
-
Het testen van de gestolen sleutel
Bob stuurt een eenvoudig API-verzoek met behulp van de gestolen sleutel om te verifiëren dat deze werkt. Een succesvol antwoord zonder headers met een snelheidslimiet bevestigt dat de sleutel kan worden misbruikt.
-
De sleutelwerken
De API reageert succesvol. Het antwoord bevestigt dat de sleutel geldig is – en cruciaal is dat de velden rate_limit en budget_cap beide null zijn. Er zit geen enkele beveiliging op deze sleutel.
-
Het lanceren van de aanval
De sleutel werkt en heeft geen beveiliging. Bob lanceert een geautomatiseerd aanvalsscript dat honderden zorgvuldig vervaardigde recursieve uitbreidingsprompts (elk ontworpen om de maximale 32.768 tokens per verzoek te gebruiken) over 50 gelijktijdige threads verzendt.
-
Aanval in uitvoering
The attack script initializes 50 concurrent worker threads, each sending recursive expansion prompts at maximum token output. Within seconds, the cost rate hits $12.40 per minute – over $700 per hour.
Dekking van beveiligingsframeworks
OWASP LLM Top 10
- LLM06:2026 Unbounded Consumption
- LLM10:2025 Unbounded Consumption
CWE
- CWE-770 Allocation of Resources Without Limits or Throttling
CIS Controls
- CIS 16 Application Software Security
NIST CSF
- PR.AT-02 Individuals in specialized roles are provided with awareness and training so that they possess the knowledge and skills to perform relevant tasks with cybersecurity risks in mind
- PR.PS Platform Security