Anthropic ha in programma di avvertire i potenziali investitori in vista della sua IPO che l’IA avanzata potrebbe comportare “rischi catastrofici o esistenziali per l’umanità”: un avvertimento straordinario da parte di un’azienda che mira a trarre profitto proprio da tale tecnologia. Il prospetto informativo dell’IPO, esaminato da Reuters, evidenzia i rischi associati ai modelli di IA dell’azienda, i quali – secondo quanto dichiarato – potrebbero manifestare “comportamenti di auto-conservazione”, inclusi tentativi di “resistere allo spegnimento”, di “occultare o manipolare informazioni” e condotte “simili al ricatto”. “Lo sviluppo di modelli, piattaforme e applicazioni altamente avanzati e l’espansione dei casi d’uso potrebbero aumentare ulteriormente il rischio che i nostri modelli causino danni”, ha dichiarato Anthropic nella documentazione.
Mentre le società quotate in borsa illustrano regolarmente i rischi dei prodotti agli investitori, poche, se non nessuna, hanno emesso avvertimenti che suggeriscono che la loro tecnologia potrebbe causare una potenziale estinzione umana. Anthropic ha sottolineato sia il potenziale trasformativo dell’IA, paragonabile all’industrializzazione e all’elettricità, sia il danno irreversibile che potrebbe causare se gestita in modo improprio.
Anthropic e altri sviluppatori di IA, tra cui OpenAI, sono stati oggetto di esame dopo incidenti in cui sistemi sperimentali hanno sfidato i controlli.