4.11 — Quiz della Sicurezza 📊
Associa ogni problema alla sua contromisura.
Problemi
- A. L’IA inizia a rispondere a un cliente aggressivo… con insulti.
- B. L’IA sta per offrire un rimborso di 500 € a un cliente.
- C. Vuoi sapere quanto ti è costata questa IA questa settimana.
- D. Un PDF inviato da un « cliente » contiene un’istruzione nascosta che ordina all’agente di esfiltrare il tuo database clienti.
- E. L’agente riprova una connessione fallita, ancora e ancora, tutta la notte.
Poi:
F. In uno scenario Make/n8n che invia email ai clienti, dove metti il punto HITL?
G. Il tuo agente ha bisogno solo di leggere una tabella Airtable. Quale principio si applica ai suoi permessi?
H. Vero o falso: con un agente no-code, non hai alcuna traccia di ciò che ha fatto.
👉 Mostra le risposte
- A → Guardrail : filtra il tono / blocca gli output tossici prima dell’invio.
- B → Human-in-the-Loop : l’IA blocca il rimborso e aspetta il tuo clic « Approva ».
- C → Osservabilità : il cruscotto delle tracce per contare i token spesi.
- D → Iniezione indiretta : guardrail sui contenuti in entrata + privilegio minimo (l’agente non può esportare il database) + spezzare la triade letale.
- E → Stopping rule : tetto di iterazioni + rilevamento di non-progresso.
- F → Subito prima dell’azione sensibile/irreversibile (l’invio dell’email), tramite un passo di approvazione che mette in pausa lo scenario.
- G → Il privilegio minimo : accesso in sola lettura, senza diritto di cancellare né esportare.
- H → Falso. Make/n8n conservano uno storico delle esecuzioni e Airtable uno storico delle modifiche — un primo livello di tracce nativo.
📝 La mia nota
Una formazioneBaxIA