Reddit demanda Perplexity per extreure dades: claus del cas

  • Reddit va presentar una demanda a Nova York contra Perplexity i tres empreses per la suposada extracció no autoritzada de dades.
  • Perplexity nega les acusacions i defensa l'accés just al coneixement públic; SerpApi i Oxylabs també rebutgen els càrrecs.
  • La plataforma ia llicència contingut a Google i OpenAI; va enviar un requeriment previ i cita un augment x40 en referències a Reddit.
  • El cas frega Europa per la lituana Oxylabs i revifa el debat sobre scraping i drets en el marc regulador de la UE.

Demanda de Reddit a Perplexity per extracció de dades

La xarxa social amb seu a San Francisco ha interposat una demanda federal a Nova York contra Perplexity AI i diverses firmes vinculades a la recol·lecció d'informació a la web, al·legant que han obtingut contingut de Reddit sense permís per alimentar eines basades en intel·ligència artificial.

Segons l'escrit, Perplexity no comptaria amb llicència per utilitzar el material de la plataforma, mentre que Reddit sí que ha arribat a acords amb altres tecnològiques com Google i OpenAI; a més, després d'un requeriment de cessament i desistiment remès l'any passat, la companyia assegura que les mencions a Reddit al sistema de Perplexity es van multiplicar per quaranta.

Què es denuncia

Reddit sosté que diferents serveis de scraping haurien eludit mesures antiextracció de la plataforma i demanat publicacions a través de resultats del cercador de Google, descrivint la pràctica com una “economia de blanqueig de dades” a escala industrial.

A la demanda es detalla que Perplexity hauria recorregut almenys a un d'aquests proveïdors per obtenir contingut de Reddit, en lloc de subscriure una llicència amb la mateixa plataforma, i que els extractors haurien emmascarat identitats i ubicacions per esquivar els controls.

Qui són els implicats

A més de Perplexity, el litigi assenyala a Oxylabs UAB (Lituània), al domini AWMProxy (que Reddit descriu com a vinculat a un antic botnet rus) ia la startup SerpApi (Texas), cosa que situa el cas en un mapa que barreja actors dels Estats Units i Europa.

La resposta de les empreses demandades

Perplexity ha afirmat que encara no ha estat formalment notificada i que defensarà amb fermesa el dret dels usuaris a accedir de forma lliure i justa al coneixement públic, ressaltant que el seu enfocament pretén oferir respostes precises amb IA de manera responsable.

Des de SerpApi, un portaveu ha rebutjat completament les acusacions i ha avançat que la companyia es defensarà enèrgicament davant dels tribunals; Oxylabs, per part seva, es va mostrar sorpresa i decebuda, assegurant que no va rebre un contacte previ de Reddit i defensant la recopilació de dades públiques.

Pel que fa a AWMProxy, la plataforma indica que no ha estat possible demanar comentaris de l'entitat.

Antecedents i acords de llicència

Aquest pas legal se suma a un altre front obert per Reddit: al juny va presentar una demanda semblant contra la companyia d'IA Anthropic, un procediment que roman en curs després del trasllat a un tribunal federal.

Reddit recalca que la seva comunitat, composta per milers de subreddits i més de 100 milions d'usuaris diaris, és una font clau de converses a internet, raó per la qual ha signat llicències amb Google, OpenAI i altres firmes per a l'entrenament de models.

En el pla borsari, després de conèixer l'acció judicial, les accions de Reddit van tancar la sessió amb una caiguda superior a 4% a Nova York, reflectint la sensibilitat del mercat a les disputes per dades al sector de la IA.

Implicacions per a Europa i Espanya

La presència d'Oxylabs, amb seu a la Unió Europea, introdueix un angle europeu a la controvèrsia i torna a posar sobre la taula el debat sobre el ús de dades públiques, el scraping i els límits del copyright sota la normativa comunitària.

Més enllà del litigi als EUA, actors europeus —inclosos editors, plataformes i desenvolupadors— segueixen molt atents a com s'equilibra el accés a informació disponible públicament amb la protecció de drets i les condicions dús, en un context marcat per la Directiva de Drets dAutor i el marc regulador emergent per a la IA.

Què demana Reddit i propers passos

La companyia sol·licita una indemnització econòmica no especificada i una ordre judicial que impedeixi a Perplexity utilitzar dades de Reddit, en espera que el tribunal determini si hi va haver vulneració de drets i quin abast tindrien eventuals mesures cautelars.

Queden per definir els temps processals i l'encaix de les defenses, però tot apunta que aquest cas marcarà jurisprudència en un terreny on xoquen l'interès públic per la informació, la propietat intel·lectual i les necessitats d'entrenament dels sistemes d'IA.

El pols entre plataformes amb grans repositoris de conversa humana i empreses d'intel·ligència artificial s'intensifica: amb llicències a un costat i al·legacions de scraping a l'altra, la disputa entre Reddit i Perplexity il·lustra el nou tauler on es negocien valor, permisos i límits de les dades en línia.

com comprar des de ChatGPT-2
Article relacionat:
Comprar des de ChatGPT: guia completa per aprofitar la IA a les teves compres online

Add as preferred source