Questo sito utilizza cookies tecnici (propri e di terze parti) come anche cookie di profilazione (di terze parti) sia per proprie necessità funzionali, sia per inviarti messaggi pubblicitari in linea con tue preferenze. Per saperne di più o per negare il consenso all'uso dei cookie di profilazione clicca qui. Scorrendo questa pagina, cliccando su un link o proseguendo la navigazione in altra maniera, acconsenti all'uso dei cookie Ok, accetto

 2026  settembre 30 Mercoledì calendario

Anthropic ammette i rischi «esistenziali» dei suoi modelli

L’ad di Anthropic, Dario Amodei, lo aveva già detto. Ma ora è scritto nero su bianco: l’azienda del chatbot Claude afferma che la sua tecnologia di intelligenza artificiale potrebbe comportare per l’umanità «rischi esistenziali». Una locuzione minacciosa ma garbata che, tradotta in maniera più brutale, equivale a una minaccia globale capace di provocare l’estinzione della specie umana o di danneggiare in modo irreversibile il futuro prospero della civiltà. La formula è contenuta nel prospetto confidenziale preparato per la quotazione a Wall Street, depositato a giugno alla Sec (l’autorità di controllo sulla Borsa americana) e visionato ora da Reuters e Wall Street Journal.
La parte principale del prospetto è lunga 261 pagine e ben 80 sono dedicate ai fattori di rischio: quasi un terzo del documento quindi, contro appena 48 pagine utilizzate per descrivere l’attività dell’azienda. Non riguardano tutte scenari da fine del mondo, ma Anthropic contempla esplicitamente la possibilità che modelli sempre più autonomi sviluppino comportamenti orientati all’autoconservazione, provino a evitare lo spegnimento, nascondano o manipolino informazioni oppure assumano condotte assimilabili al ricatto. C’è poi un altro problema menzionato: «La possibile consapevolezza del modello dei nostri tentativi di valutarlo limita significativamente la capacità di verificarne la sicurezza», scrive la società. In sostanza, un sistema abbastanza sofisticato potrebbe comportarsi meglio proprio perché sa di essere sotto esame.
Anthropic ammette inoltre che capacità inattese possono emergere durante l’addestramento e diventare evidenti soltanto dopo la diffusione del modello. Una frenata nello sviluppo non sembra però probabile: viene spiegato ai futuri investitori che i ricavi dipendono dall’arrivo continuo di modelli più potenti e che una cadenza serrata di nuove versioni è necessaria per restare rilevanti nel settore. L’Ipo potrebbe assegnare all’azienda di Amodei un valore di oltre 2.000 miliardi di dollari, superando il recente record di SpaceX (1.770 miliardi).
Il tema si intreccia con un altro allarme arrivato proprio in queste ore. Lunedì oltre venti ricercatori di primissimo piano – tra cui i responsabili scientifici e della ricerca di OpenAI, Microsoft, Meta e Anthropic, oltre a due dei «padrini dell’AI», ovvero Yoshua Bengio e il Nobel Geoffrey Hinton – hanno pubblicato un lavoro dedicato alla possibilità che l’automazione della ricerca sull’AI inneschi una «esplosione di intelligenza». Il meccanismo che descrivono è quello di sistemi capaci di svolgere una quota crescente della ricerca sull’AI che contribuiscono a creare sistemi migliori. Che a loro volta accelerano ulteriormente la ricerca. Un circolo vizioso in cui, scrivono, «l’umanità potrebbe perdere il controllo su sistemi di AI sovrumani».