L’AI legge i giornali senza permesso: oltre 300 editori chiedono una legge per fermare i bot

0
88

La battaglia tra editori e intelligenza artificiale sta entrando in una fase nuova. Fino a pochi mesi fa la discussione sembrava concentrata soprattutto sul copyright e sui compensi: le piattaforme possono utilizzare gli articoli dei giornali per alimentare i propri sistemi e, se possono farlo, quanto devono pagare? Negli Stati Uniti sta emergendo adesso una questione ancora più elementare: un editore è davvero in grado di impedire a una macchina di entrare nel proprio sito e acquisirne i contenuti? È attorno a questa domanda che oltre 300 rappresentanti dell’industria editoriale americana hanno deciso di fare pressione sul Congresso. Nella mobilitazione compaiono grandi realtà come Condé Nast, Hearst, USA Today e The Seattle Times, insieme a numerosi altri operatori dell’informazione. Al centro della protesta ci sono quelli che vengono definiti “stealth bots”, crawler automatici che possono rendere difficile per un editore capire chi sta visitando il proprio sito e soprattutto per quale scopo.

Sembra una questione tecnica, ma riguarda direttamente il futuro economico dei giornali. Internet ha funzionato per decenni sulla base di uno scambio abbastanza comprensibile: i motori di ricerca visitavano le pagine dei giornali, ne leggevano i contenuti per indicizzarli e successivamente mostravano agli utenti un collegamento verso la fonte. Il giornale concedeva quindi una certa possibilità di accesso alle macchine e in cambio poteva ricevere traffico. Google trovava la notizia, il lettore cliccava e arrivava sul sito che l’aveva prodotta. L’intelligenza artificiale modifica profondamente questo equilibrio perché una macchina può leggere un articolo non soltanto per sapere dove si trova, ma per comprenderne le informazioni, combinarle con quelle provenienti da altre fonti e costruire direttamente una risposta. Il lettore può così ottenere ciò che cercava senza necessariamente visitare il giornale.

La differenza economica è enorme. L’editore continua a sostenere il costo necessario per produrre la notizia: giornalisti, inviati, fotografie, documenti, verifiche, redazione, tecnologia e responsabilità legale. Una volta pubblicato, però, il risultato di quel lavoro può diventare materia prima per un sistema automatico capace di rispondere direttamente a milioni di persone. È per questo che sempre più editori stanno cercando di controllare l’accesso dei crawler dell’AI. E proprio qui nasce il problema dei cosiddetti bot invisibili: se un sistema automatico non si identifica chiaramente oppure utilizza modalità di accesso che rendono difficile distinguerlo dal normale traffico Internet, per il proprietario del sito diventa molto più complicato decidere chi può entrare e chi deve rimanere fuori. È come mettere sulla porta un cartello con scritto “vietato entrare” e scoprire che chi vuole entrare ha semplicemente smesso di presentarsi con il proprio nome.

La richiesta degli editori americani al Congresso parte da qui. L’obiettivo è imporre maggiore trasparenza ai crawler automatici, obbligandoli a identificarsi e a rendere comprensibile lo scopo per il quale accedono ai contenuti. Non è soltanto una battaglia tecnologica: è una condizione necessaria perché possa esistere un vero mercato dei contenuti nell’era dell’intelligenza artificiale. Prima ancora di stabilire quanto debba essere pagato un articolo, bisogna riconoscere a chi lo ha prodotto la possibilità di decidere se quell’articolo possa essere utilizzato.

Il tema diventa ancora più importante proprio mentre sta nascendo un mercato delle licenze e delle remunerazioni per l’AI. Google sta sperimentando sistemi che riconoscono un compenso ad alcuni editori quando i loro contenuti contribuiscono alle risposte generate dall’intelligenza artificiale, mentre altre aziende tecnologiche hanno concluso accordi direttamente con gruppi editoriali e agenzie di stampa. Sta quindi cominciando ad affermarsi un principio fondamentale: l’informazione professionale utilizzata dalle macchine possiede un valore economico. Ma questo mercato può funzionare soltanto se chi possiede il contenuto ha realmente il potere di negarne l’utilizzo. Se un giornale può chiudere l’accesso ai propri articoli, una società tecnologica interessata a utilizzarli avrà un motivo per negoziare. Se invece quei contenuti possono essere acquisiti comunque attraverso sistemi difficili da identificare o bloccare, il potere contrattuale dell’editore si riduce drasticamente.

Ed è qui che la vicenda americana diventa interessante anche per l’Europa e per l’Italia. Il dibattito sul rapporto tra piattaforme ed editori sta ormai convergendo su una distinzione fondamentale: indicizzare un contenuto per consentire a un utente di trovarlo e utilizzare quel contenuto per costruire una risposta artificiale non sono necessariamente la stessa cosa. Un editore potrebbe voler continuare a essere presente nella ricerca tradizionale perché Google gli porta lettori e contemporaneamente non voler consentire che i propri articoli vengano utilizzati per produrre risposte capaci di sostituire la visita al sito. Oppure potrebbe essere disponibile a permetterne l’utilizzo, ma soltanto attraverso una licenza e una remunerazione adeguata.

Il problema, quindi, non è impedire all’intelligenza artificiale di leggere Internet. È stabilire chi decide le condizioni alle quali può farlo. La questione riguarda soprattutto l’informazione originale. Una notizia di poche righe può avere richiesto un’intera giornata di lavoro, una telefonata a una fonte, l’analisi di documenti, un’intervista o una verifica sul territorio. Una macchina può invece leggere migliaia di articoli, estrarne le informazioni e rielaborarle in pochi secondi. Il costo della rielaborazione diventa minuscolo rispetto a quello necessario per produrre l’informazione originale.

Da qui nasce il grande paradosso che sta attraversando l’industria dell’informazione: l’intelligenza artificiale ha bisogno di contenuti affidabili per produrre risposte affidabili, ma se il suo sviluppo riduce traffico e ricavi proprio dei soggetti che producono quei contenuti rischia di indebolire progressivamente la propria materia prima. Il problema è ancora più delicato per le piccole testate e per l’informazione locale, dove anche poche migliaia di visite possono avere un peso economico rilevante e dove una notizia originale può essere prodotta da una redazione composta da pochissimi giornalisti.

La mobilitazione degli editori americani segna quindi un passaggio importante. Dopo la battaglia sul copyright sta arrivando quella sul controllo dell’accesso e subito dopo arriverà inevitabilmente quella sul prezzo. Perché un mercato dei contenuti destinati all’intelligenza artificiale può esistere soltanto se vengono riconosciuti tre principi: sapere quando una macchina entra, poter decidere se farla entrare e poter negoziare le condizioni alle quali utilizzerà ciò che trova. Se un giornale decide di chiudere la porta all’intelligenza artificiale, quella porta deve poter rimanere davvero chiusa. Solo allora editori e piattaforme potranno discutere seriamente di quanto costa la chiave per riaprirla.

LASCIA UN COMMENTO

Inserisci il tuo commento
Inserisci il tuo nome