AI-funksjoner som ikke lekker.

Modellen brytes i et sikret miljø først, så tettes hullene. For alle som har koblet en språkmodell til noe som betyr noe.

SLIK GÅR DET FOR SEG

  1. Kartlegging

    Gratis. Hva modellen er koblet til, og hva den kan nå.

  2. Angrep

    Vektorene kjøres mot ditt oppsett. Alt som slipper gjennom dokumenteres. Har modellen en kunnskapsbase å slå opp i, prøver jeg også å få den til å hente ut noe derfra som ikke var ment for den som spør.

  3. Forsvar

    Guardrails i koden rundt modellen, ikke i instruksjonene til den. Trenger du en kunnskapsbase modellen kan slå opp i (RAG), setter studioet den opp, med grensene på plass fra første dag.

  4. Rapport og gjentest

    Funnene skriftlig, og de samme angrepene på nytt etterpå.

DETTE INNGÅR

Åtte ting følger med. Og du får det skriftlig.

EKSEMPEL

Kartlegging av angrepsflate

Prompt injection-testing

Systemprompt og datalekkasje

Verktøy- og API-misbruk

Guardrails i koden

Logging av avviste forsøk

Retest og verifikasjon

Rapport og styresammendrag