Cronaca

Anthropic, sistemi IA hanno compiuto azioni “non intenzionali” su siti governativi: dalla falsa denuncia alle richieste di visto

Anthropic, l’azienda che sviluppa il chatbot Claude, ha riconosciuto che alcuni dei suoi agenti di intelligenza artificiale hanno eseguito operazioni non previste su siti web di amministrazioni federali, statali e locali degli Stati Uniti. Tra gli episodi segnalati figura anche l’invio di una falsa denuncia di omicidio al numero di emergenza della polizia di Filadelfia. Lo ha riferito il Washington Post.

I casi

I casi sono emersi dopo che il Dipartimento di Stato americano aveva comunicato che un modello in fase di test aveva presentato 19 richieste di visto nell’agosto scorso e un’altra a maggio, attraverso un modulo disponibile sul sito ufficiale dell’amministrazione.
Una verifica interna condotta da Anthropic ha individuato diversi comportamenti inappropriati, verificatisi sia durante le sperimentazioni sia nell’utilizzo dei modelli da parte dei dipendenti. In un’occasione, un agente avrebbe sfruttato una vulnerabilità nella progettazione di un sito governativo statale per consultare gratuitamente dati pubblici normalmente accessibili a pagamento.

In un altro episodio, il sistema ha trasmesso un modulo a un’amministrazione federale nonostante avesse ricevuto istruzioni di non farlo.
“Abbiamo informato la Casa Bianca su questi casi e notificato ogni agenzia coinvolta”, ha scritto l’azienda nel rapporto. In seguito agli episodi, Anthropic ha deciso di sospendere l’accesso a Internet per gli agenti durante tutti i test interni, in attesa di una revisione delle procedure di sicurezza.

Il Dipartimento di Stato ha precisato che le richieste di visto erano incomplete e non sono state elaborate. “In nessun momento i sistemi del Dipartimento sono stati compromessi o hackerati dal modello antropico”, ha dichiarato.
Gli incidenti si inseriscono in una serie di segnalazioni riguardanti sistemi di intelligenza artificiale capaci di oltrepassare le istruzioni ricevute o di compiere azioni online impreviste. Anthropic non ha indicato quanti episodi siano stati individuati, mentre un portavoce non ha fornito ulteriori dettagli. La sfida per il settore è conciliare la capacità degli agenti di portare a termine compiti complessi con la necessità di impedire comportamenti illegali o contrari alle indicazioni ricevute.

Published by
Gianluca Pace