10%
La stima del 10% di possibili “esiti catastrofici” riaccende il dibattito sulla sicurezza dell’intelligenza artificiale
Le sue preoccupazioni trovano conferma nelle parole di Evan Hubinger, responsabile dei team che valutano i rischi in Anthropic. Hubinger spiega che tra gli esperti è discussa apertamente la possibilità che futuri sistemi non allineati possano generare conseguenze molto gravi. In particolare, ricorda che alcuni ricercatori stimano circa un 10% di probabilità che modelli avanzati e non controllati possano portare a esiti catastrofici, una formula tecnica che indica danni potenzialmente su larga scala.
Durante la stesura dell’articolo, ho chiesto a un sistema di intelligenza artificiale di spiegarmi quale fosse, secondo lui, il significato dell’espressione “esiti catastrofici” usata dagli esperti. La risposta è stata che, nel linguaggio della sicurezza dell’AI, il termine non indica l’estinzione o il collasso totale dell’umanità, ma fa riferimento a eventi molto gravi che possono manifestarsi in forme diverse. L’AI ha elencato i principali scenari discussi nella comunità di ricerca:
Perdita di controllo operativo — sistemi che prendono decisioni non previste.
Impatti economici massicci — destabilizzazione di settori o mercati.
Manipolazione informativa su larga scala — influenza di opinioni, processi democratici o mercati.
Compromissione di infrastrutture critiche — energia, sanità, logistica.
Uso improprio da parte di attori ostili — attacchi informatici, biologia sintetica, automazione militare.
La vicenda mostra come il confronto sui limiti e sui rischi dell’intelligenza artificiale non provenga soltanto da osservatori esterni, ma coinvolga direttamente chi lavora alla progettazione di queste tecnologie. E conferma che, mentre l’AI avanza a ritmo accelerato, la discussione sulla sua sicurezza rimane una delle questioni più urgenti del settore.
Skynet è più vicina?
Commenti
0 interventi
Nessun commento ancora