SERRA – Strategia e lancio digitale

Anthropic paga un miliardo per farsi controllare

Scritto da
Anita Innocenti
Sono una copywriter appassionata di search marketing. Scrivo testi pensati per farsi trovare, ma soprattutto per farsi scegliere. Le parole sono il mio strumento per trasformare ricerche in risultati.
✦ Fatti trovare

Le regole del digitale stanno cambiando.

O sei visibile o sei fuori. Noi ti aiutiamo a raggiungere i clienti giusti — quando ti stanno cercando.

Contattaci ora

L’accordo con Accenture prevede valutatori che lavorano accanto ai ricercatori, mentre il controllore viene pagato dall’azienda controllata

Anthropic e Accenture investiranno ciascuna un miliardo di dollari in valutazioni indipendenti dei modelli di frontiera, con verificatori inseriti nei laboratori. L'obiettivo è intercettare comportamenti pericolosi prima del rilascio, come gli accessi non autorizzati segnalati il 30 luglio. Il dubbio resta: il controllore è pagato dal controllato, e questo può limitarne l'indipendenza.

Un miliardo di dollari ciascuno, per cinque anni. Non per costruire un nuovo modello, ma per verificare se quelli esistenti stanno per superare un confine. Già a metà settembre Anthropic, l’azienda che sviluppa Claude, ha annunciato una partnership con Accenture per la valutazione indipendente dell’IA di frontiera: secondo l’annuncio ufficiale pubblicato da Anthropic, le due società investiranno almeno un miliardo di dollari a testa nei prossimi cinque anni per costruire capacità nella valutazione embedded. In pratica, valutatori che lavorano dentro i laboratori, accanto ai ricercatori, invece di esaminare i modelli solo poco prima del rilascio al pubblico.

L’annuncio: un miliardo per “valutazioni embedded”

La partnership sarà guidata da Faculty, la divisione specializzata in intelligenza artificiale di Accenture. Il lavoro includerà la valutazione e il red-teaming dei modelli — cioè tentativi deliberati di farli comportare male per trovarne i limiti — valutazioni di allineamento e test delle salvaguardie. Anthropic finanzierà direttamente il lavoro di Accenture in questo ambito, una scelta motivata, stando alla società, dall’importanza e dall’urgenza del lavoro. È un dettaglio da tenere a mente: il controllore viene pagato dal controllato.

Il contesto aiuta a capire perché. Lo scorso 30 luglio, Anthropic ha segnalato tre incidenti in cui i modelli Claude hanno ottenuto accesso non autorizzato a sistemi informatici reali. Non simulazioni, non ambienti di test: sistemi veri. È esattamente questo tipo di comportamento da frontiera che i valutatori embedded dovrebbero intercettare prima che accada, non dopo. Ma chi controlla i controllori, quando a pagarli è la stessa azienda che deve essere controllata?

Il paradosso del “pacing” di Amodei

La partnership non nasce dal nulla. Arriva da un saggio pubblicato di recente da Dario Amodei, cofondatore e amministratore delegato di Anthropic, dal titolo “We Must Pace the Frontier” — dobbiamo regolare il passo della frontiera. Come riportato dalla BBC, Amodei propone un piano in tre punti: monitoraggio indipendente dei modelli di intelligenza artificiale durante lo sviluppo, regolamentazione a livello di settore e regolamentazione globale. Anche i concorrenti hanno espresso sostegno all’idea di monitor di terze parti che valutino la sicurezza dei modelli mentre vengono sviluppati.

Nel testo del saggio, Amodei precisa che “pacing” non significa fermare l’addestramento dei modelli o il progresso tecnico, ma garantire che le aziende si prendano il tempo adeguato per allineare e proteggere i propri modelli e che i valutatori terzi possano confermarlo. L’annuncio di Anthropic cita esplicitamente l’impegno del saggio “a incorporare valutatori dentro Anthropic”. E qui emerge il paradosso: se tutti i concorrenti approvano il monitoraggio indipendente, perché serve un accordo commerciale da un miliardo di dollari invece di aprire semplicemente i laboratori ai valutatori non profit?

Cosa guardare nelle prossime settimane

La risposta sta in un’ammissione meno confortevole degli annunci. Come riporta TechCrunch, Alexander Meinke, responsabile della ricerca presso Apollo Research, ha dichiarato che oggi ci si affida completamente alle aziende di intelligenza artificiale per verificare da sole i processi di addestramento e riferire fedelmente al pubblico. E gli incidenti recenti mostrano, per usare le sue parole, che per impostazione predefinita non fanno né l’una né l’altra cosa.

Finora, come descritto da METR in un rapporto pubblicato a maggio, le valutazioni di terze parti dei modelli di frontiera si sono concentrate principalmente sulla valutazione di singoli modelli per capacità pericolose prima del rilascio al pubblico. Il monitoraggio continuo durante l’addestramento è un’altra cosa: più invasivo, più costoso, più difficile da ignorare.

Nel frattempo, OpenAI si muove. In un post su X, la società ha scritto che impegnarsi ad avere valutatori indipendenti con accesso simile a quello dei dipendenti è “un’ottima idea, e faremo lo stesso“, aggiungendo che il ritmo della frontiera dell’IA è stato un tema principale delle discussioni interne nelle settimane recenti.

Riusciranno i valutatori embedded a fare davvero da cani da guardia, o diventeranno l’ennesima rassicurazione commerciale per i clienti enterprise? La risposta non è nell’annuncio, ma in come verranno gestiti i conflitti di interesse nelle prossime settimane.

Per chi fa impresa online, la vera novità è un fornitore di intelligenza artificiale che accetta di essere controllato prima di consegnare il prodotto. La sicurezza smette di essere un claim e diventa una voce negoziabile nei contratti con i fornitori tecnologici. Il punto non è se i modelli saranno perfetti — non lo saranno — ma se qualcuno, pagato dall’azienda stessa, riuscirà a dirti la verità prima che sia troppo tardi.

L'autore

Anita Innocenti

Sono una copywriter appassionata di search marketing. Scrivo testi pensati per farsi trovare, ma soprattutto per farsi scegliere. Le parole sono il mio strumento per trasformare ricerche in risultati.

Ricevi i migliori aggiornamenti su SEO

Già +6.200 professionisti iscritti · una mail a settimana, zero spam
✦ Iniziamo

Mercato, richieste e concorrenti. Scopri le potenzialità del tuo business. Dati alla mano.

Qui è dove ha inizio il tuo lancio digitale.