AI, OpenAI e Anthropic indagano su decine di migliaia di incidenti (Axios)
pubblicato:Fa scalpore un report dell’agenzia Axios che rivela che i colossi dell’intelligenza artificiale come OpenAI e Anthropic starebbero in realtà già indagando su decine di migliaia di incidenti, molti di più di quelli segnalati finora al mercato.
Si ripropone così l’interrogativo sulla capacità effettiva dei grandi gruppi dell’AI di controllare i propri agenti. Gli incidenti coinvolgono casi di superamento delle barriere imposte, di creazione di piattaforme di discussione, di fuga dalle sandbox (i luoghi controllati dove dovrebbero rimanere segregati), ma anche attacchi informatici a siti web, self-prompting (l’auto imposizione di istruzioni), il superamento delle barriere di vigilanza.
Una parte degli incidenti è normale conseguenza delle attività di ricerca dirette proprio sulla sicurezza degli agenti e anche il CEO di OpenAI Sam Altman ha confermato una fase di monitoraggio esteso sull’uso dell’accesso al web da parte degli agenti di intelligenza artificiale.