Trova le falle del tuo LLM
prima che un attaccante lo faccia.
Valutazione offensiva sistematica di sistemi IA — OWASP LLM Top 10, prompt engineering avversariale e audit dell'infrastruttura. Evidenza riproducibile, classificazione AI-VRM e piano di remediation prioritizzato.
Dalla ricognizione alla classificazione del rischio
Ogni fase produce evidenza. Ogni evidenza alimenta la successiva — niente rework, niente assunzioni.
Mappare la superficie del modello
Endpoint, system prompt, plugin, RAG e flusso dati — documentati prima del primo test.
surface_map.jsonTestare le dieci categorie
Prompt injection, output handling, data poisoning, model DoS — copertura sistematica e riproducibile.
findings.md · 10/10Verificare lo stack che sostiene il modello
Gateway, model serving, vector DB, segreti e isolamento — dove vive la maggior parte delle falle critiche.
stack_audit.logTradurre i risultati in decisioni
Severità, sfruttabilità e impatto sul business in una matrice che prioritizza cosa correggere per primo.
risk_matrix.csvOWASP LLM Top 10 — testato, documentato, prioritizzato
Ogni categoria è esercitata con tecniche reali osservate negli incidenti 2025–26, con PoC riproducibile e classificazione di rischio AI-VRM.
Prompt Injection
Attacchi diretti e indiretti che manipolano il comportamento, aggirano i guardrail o innescano azioni non volute.
Gestione Insicura dell'Output
Falle di validazione che portano a XSS, SSRF, esecuzione di codice o escalation in sistemi downstream.
Avvelenamento del Training
Manipolazione di dati di pre-training, fine-tuning o embedding per introdurre bias o backdoor.
Denial of Service del Modello
Operazioni intensive che degradano le prestazioni, gonfiano i costi o interrompono il servizio.
Supply Chain
Modelli pre-addestrati, dataset, plugin ed estensioni di terze parti che introducono vulnerabilità.
Divulgazione di Dati Sensibili
Esposizione di PII, segreti o system prompt tramite risposte o canali laterali.
Design Insicuro dei Plugin
Integrazioni di strumenti che consentono azioni non autorizzate o esecuzione di codice.
Agenzia Eccessiva
Sistemi con permessi o autonomia oltre lo scope previsto — sfruttabili per azioni arbitrarie.
Eccessiva Dipendenza
Fiducia negli output del LLM senza validazione — disinformazione, vulnerabilità, decisioni errate.
Furto di Modello
Estrazione, replicazione o esfiltrazione non autorizzata di modelli proprietari e pesi.
Cosa ricevi alla fine
Niente report generici. Ogni deliverable è indirizzato al pubblico giusto — dal board all'ingegnere.
Riepilogo per il board
Analisi di impatto sul business, principali rischi ed esposizione finanziaria — in 2 pagine, linguaggio C-suite.
board_summary.pdfRisultati con PoC
Ogni vulnerabilità con proof-of-concept riproducibile, log request/response e classificazione CVSS+AI-VRM.
findings_full.mdMatrice AI-VRM
Severità × sfruttabilità × impatto, con priorità P0/P1/P2 e SLA suggerito per categoria.
risk_matrix.csvPiano 30/60/90
Azioni concrete per ogni finding, con owner, sforzo e finestra. Include un workshop di readout con il tuo team.
remediation_plan.xlsxTesta i tuoi sistemi IA prima degli attaccanti
Pianifica un pentest IA/LLM e ottieni una visione completa della tua superficie d'attacco — dalla prompt injection al furto del modello.
Richiedi pentest IA