Proteggere gli agenti Claude dalla prompt injection significa decidere in anticipo che cosa l'agente può fare, non soltanto che cosa gli si chiede. Servono tre elementi: permessi minimi su ogni connettore, un confine netto tra istruzioni e dati, un'approvazione umana prima di ogni invio, pagamento o cancellazione. Un buon prompt da solo non basta, perché oggi nessuno sa eliminare questo rischio.
La prompt injection è un attacco in cui istruzioni malevole vengono inserite in contenuti esterni che Claude legge durante un compito legittimo. È la definizione che Anthropic usa nella sua guida a Cowork. Il contenuto può essere il corpo di un'email in arrivo, una pagina web o il testo di un file caricato. L'obiettivo dell'attaccante è far eseguire a Claude le proprie istruzioni al posto delle Sue.
In questa guida un agente è Claude collegato ai sistemi aziendali tramite connettori. I connettori sono le integrazioni che permettono a Claude di accedere alle Sue applicazioni, recuperare dati e compiere azioni al loro interno. Per un quadro generale su cosa fa un agente in produzione può partire dalla guida su che cosa sono gli agenti AI in un'azienda reale.
La guida è pensata per una piccola impresa che collega Claude alla posta, a un CRM come Zoho CRM, ai file e al web. Mostra da dove entra l'attacco, quali impostazioni esistono davvero nei piani Claude e come costruire una checklist basata sul privilegio minimo.
