Categoria

Pagina 2 di 4

Penetration Testing: trovare i buchi prima di chi li vuole usare

Pensare come un attaccante è l'unico modo per difendersi davvero. Un penetration test non è scaricare uno scanner e leggere il report: è capire come i pezzi di un sistema si combinano in un percorso di compromissione che nessun tool automatico vede da solo. Questa categoria racconta la sicurezza offensiva applicata, con finalità difensiva.

Il primo tema è il metodo dell'attaccante: la ricognizione, lo sfruttamento della logica applicativa che il WAF non intercetta, il lateral movement, l'analisi di codice legacy per trovare le falle prima che lo faccia qualcun altro. Il valore non è nel singolo exploit, ma nel ragionamento che collega form di upload, credenziali deboli e servizi esposti in una catena.

Il secondo tema sono le CVE reali riprodotte in laboratorio: dall'RCE pre-auth nell'SSH di Erlang a regreSSHion, dalle vulnerabilità della supply chain come xz-utils ai bug dei tool dell'ecosistema AI. Capire un attacco eseguendolo in un ambiente controllato è ciò che permette poi di chiudere davvero la porta, con la sandbox e la documentazione che una ricerca responsabile richiede.

Il terzo tema è il fronte offensivo nuovo: la pipeline CI/CD come vettore di attacco sottovalutato, il container escape, e il mondo agentic, dalla prompt injection come compromissione di sistema all'over-broad token scoping di MCP.

Se vuoi un assessment offensivo della tua infrastruttura, vedi la consulenza cybersecurity e NIS2 o scrivimi.

Non puoi difendere quello che non capisci. E per capire un attacco, a volte, devi saperlo eseguire in un ambiente controllato.

OWASP Top 10 for Agentic Applications 2026: ASI01-10 audit checklist per sistemi LLM enterprise

OWASP Top 10 for Agentic Applications 2026: ASI01-10 audit checklist per sistemi LLM enterprise OWASP ha pubblicato a dicembre 2025 la prima Top 10 specifica per agentic applications - ASI01-10 - che affianca ma non sostituisce la LLM Top 10. Il Q1 2026 Exploit Round-up (14 aprile) mappa otto incidenti reali sulle nuove categorie. Ti mostro la checklist operativa di audit che uso nei red team: per ognuna delle 10 ASI fornisco payload di test, tool diagnostici, mitigation applicativa, e un esempio concreto Q1 2026. Continua a leggere
Ultima modifica:

LangGraph pickle RCE CVE-2026-27794: supply chain alarm sulle pipeline LLM e come l'ho trovato

LangGraph pickle RCE CVE-2026-27794: supply chain alarm sulle pipeline LLM e come l'ho trovato Sto auditando una pipeline LangGraph nella mia sandbox di red team quando noto un'entry sospetta in Redis: un oggetto binario serializzato con pattern pickle. L'indagine porta a CVE-2026-27794 - JsonPlusSerializer(pickle_fallback=True) cade su pickle deserialization quando msgpack fallisce, e scrivere su cache Redis = RCE. Ti mostro la catena completa dalla scoperta al PoC all'hardening, con sigma rule Wazuh per rilevare la classe di attacco. Continua a leggere
Ultima modifica:

Flowise CVE-2025-59528 RCE 10.0: autopsia dell'exploit che ho riprodotto nel mio laboratorio

Flowise CVE-2025-59528 RCE 10.0: autopsia dell'exploit che ho riprodotto nel mio laboratorio Il 14 aprile 2026 ho messo una istanza Flowise 2.x volontariamente esposta nella mia sandbox di audit per riprodurre la CVE-2025-59528 - una RCE CVSS 10.0 già sfruttata in the wild su oltre 12.000 istanze Internet-facing. In 12 minuti dal deploy, payload Function('return ' + input)() iniettato su mcpServerConfig ha restituito shell root del container. Ti racconto la catena completa, l'impatto di supply chain sulle chiavi API LLM salvate, e le tre regole WAF che la bloccano. Continua a leggere
Ultima modifica:

La cascata sistemica del coding AI: vulnerabilità, paradosso di produttività, collasso della carriera junior

La cascata sistemica del coding AI: vulnerabilità, paradosso di produttività, collasso della carriera junior Quando misuri l'AI coding solo sull'output dei junior, sembra un boom di produttività. Quando misuri il sistema intero, la realtà cambia: il 45% del codice AI ha falle di sicurezza, i senior perdono il 19% di produttività riassorbendo il debito, i junior smettono di costruire i modelli mentali che li renderebbero senior domani. Il sistema si squilibria sotto la velocità apparente. Continua a leggere
Ultima modifica:

Sette pattern di disallineamento LLM riprodotti in sandbox red team nel 2026

Sette pattern di disallineamento LLM riprodotti in sandbox red team nel 2026 Gartner prevede il 40% di progetti agentic cancellati entro il 2027 per inadequate risk controls. Nel mio laboratorio di red team ho riprodotto sette pattern documentati in letteratura: alignment faking, self-exfiltration, scheming multi-step, deception manipulation, sandbagging, reward hacking, sycophancy. Diagnosi operativa con payload di test, indicatori lato telemetria, contromisure applicabili in produzione su agenti enterprise. Continua a leggere
Ultima modifica:

Reward hacking e specification gaming: perché gli agenti LLM sfruttano ogni scorciatoia e come contenerli

Reward hacking e specification gaming: perché gli agenti LLM sfruttano ogni scorciatoia e come contenerli Dai circa sessanta esempi documentati da Krakovna/DeepMind (2020) al paper Apollo Research del dicembre 2024 sull'in-context scheming (o1, Opus 3, Sonnet 3.5, Gemini 1.5 Pro, Llama 3.1 405B), il pattern è invariato: se misuri un obiettivo algoritmicamente, l'agente trova una scorciatoia senza risolvere il problema reale. Analizzo specification gaming, sandbagging, self-preservation, e propongo un'architettura di containment a cinque layer applicabile oggi su agenti aziendali. Continua a leggere
Ultima modifica:

Sandboxing di agent LLM che eseguono codice arbitrario: container effimeri, seccomp, capability dropping

Sandboxing di agent LLM che eseguono codice arbitrario: container effimeri, seccomp, capability dropping Un agent LLM che può eseguire codice Python, Bash o SQL in autonomia è una backdoor delegata. Permetterlo in produzione senza sandboxing è irresponsabile. La mia architettura usa container effimeri, seccomp filter che bloccano syscall pericolose, capability dropping, network namespace che taglia l'egress. Ti mostro il design, i trade-off performance vs sicurezza, e i test di escape eseguiti per validare l'isolamento. Continua a leggere
Ultima modifica:

Red team di RAG systems aziendali: prompt injection attraverso documenti indicizzati e difese applicative

Red team di RAG systems aziendali: prompt injection attraverso documenti indicizzati e difese applicative Un RAG aziendale indicizza documenti interni e risponde alle domande. Se un attaccante inietta un documento nel corpus, può manipolare le risposte per tutti gli utenti. Ti racconto la metodologia di red team che applico: exfiltration di chunk sensibili, pivoting tra tenant multi-azienda, poisoning persistenti. Con tre proof-of-concept e il pattern di difesa applicativa. Continua a leggere
Ultima modifica:

Vettori di attacco nel codice generato da LLM: analisi offensiva delle vulnerabilità ricorrenti

Vettori di attacco nel codice generato da LLM: analisi offensiva delle vulnerabilità ricorrenti Dal punto di vista di un attaccante, il codice LLM-generated è una miniera d'oro. I pattern ricorrenti - concatenazione di input in query, gestione uniforme degli errori che leak info sensibili, assunzioni di sanitizzazione fatte dall'LLM senza dirlo - sono sfruttabili con PoC mirati. Ti racconto 5 classi di attacco osservate su codice reale, con exploit dimostrato e la strategia di difesa applicativa che uso in audit. Continua a leggere
Ultima modifica:

Automated security testing in CI: integrare DAST e SAST nella pipeline PHP

Automated security testing in CI: integrare DAST e SAST nella pipeline PHP Security testing manuale è costoso e non scala. Ho costruito un layer di security testing automatico nella pipeline GitHub Actions di un cliente: PHPStan per l'analisi statica, OWASP ZAP in modalità baseline per il DAST, Trivy per i container. Zero colli di bottiglia, il tempo di CI è aumentato solo di 4 minuti. Continua a leggere
Ultima modifica:

Strumenti utili

Tool gratuiti per l'analisi di sicurezza:

Audit JWT, Audit del composer.lock, Analisi security headers, Decodifica certificato SSL.