Back to AI TrendsSecurity Risk

Anthropic tester Claude mod virkelighedens cyberangreb: Er AI en sikkerhedsrisiko?

Anthropic Blog July 30, 2026
Anthropic tester Claude mod virkelighedens cyberangreb: Er AI en sikkerhedsrisiko?

Anthropic har gennemført dybdegående evalueringer af deres Claude-modeller mod tre reelle cybersikkerhedshændelser for at kortlægge risikoen for AI-assisteret hacking. For IT-direktører understreger dette behovet for robuste 'guardrails', da AI viser tegn på at kunne hjælpe angribere med rekognosering og sårbarhedsanalyse.

Key Intelligence

  • Anthropic har testet Claude mod tre konkrete, historiske cyberangreb for at måle modellens 'offensive' evner.
  • Modellerne viser evne til at assistere med komplekse opgaver som rekognosering og udnyttelse af sårbarheder i software.
  • Resultaterne viser, at AI-modeller kan forkorte tiden fra opdagelse af en sårbarhed til selve angrebet.
  • Sikkerhedsevalueringerne afslører, at nuværende sikkerhedsfiltre (guardrails) fanger mange, men ikke alle, ondsindede prompts.
  • Anthropic opfordrer til branchestandarder for 'cybersecurity benchmarks' for at forhindre, at AI bliver et værktøj for statsstøttede hackere.
  • Det viser sig, at AI'ens evne til at forstå kontekst i kodebaser er dens største styrke og potentielt største trussel i cyberkrig.
  • Virksomheder bør opdatere deres trusselsmodeller til at inkludere AI-accelererede angrebsmønstre.