En una reciente entrevista, Steve Huffman, el CEO de Reddit, ha dejado clara su intención de exigir que compañías como Microsoft y otras paguen por el uso de los datos de su plataforma. Tras alcanzar acuerdos con Google y OpenAI, Huffman afirmó que Reddit ha decidido bloquear a aquellos que no han llegado a un acuerdo sobre el uso de su contenido, nombrando específicamente a Microsoft, Anthropic y Perplexity, y llegando a decir que “ha sido un verdadero grano en el culo bloquear a estas empresas”.
En los últimos meses, Reddit ha intensificado su lucha contra los rastreadores web (popularmente conocidos como “crawlers”). A principios de julio, la compañía actualizó su archivo robots.txt para bloquear el acceso a aquellas webs sin acuerdos previos. Este movimiento resultó en que los datos de Reddit solo aparezcan actualmente en los resultados de Google, que paga por mostrar dichos datos, y no en otros motores de búsqueda como Bing.
Huffman reveló que Microsoft ha estado utilizando los datos de Reddit para entrenar su IA y resumir contenido sin previo aviso, y que estos datos también se vendieron a otros motores de búsqueda a través de la API de Bing. Además, criticó la postura de Microsoft y otras compañías, acusándolas de tratar el contenido de Internet como “freeware”.

En respuesta a estas declaraciones, Jordi Ribas, jefe de búsqueda de Microsoft, dijo en Twitter que “Reddit ha bloqueado a Bing el rastreo de su web para la búsqueda, favoreciendo a otro motor de búsqueda y afectando a la competencia de Bing y los motores impulsados por Bing”. La portavoz de Microsoft, Caitlin Roulston, también señaló que la compañía respeta las indicaciones de las webs que no desean que su contenido se utilice en modelos generativos de IA. Asimismo, Jennifer Martínez, portavoz de Anthropic, afirmó que Reddit está en su lista de bloqueo desde mayo y que respetaban el archivo robots.txt.
Huffman citó como ejemplo el acuerdo con OpenAI, que permite a SearchGPT mostrar resultados de Reddit, y explicó que el valor tradicional del intercambio de datos entre motores de búsqueda y páginas web está cambiando. “La búsqueda y el resumen y la formación se están fusionando, y el intercambio de valor del rastreo a cambio de tráfico de vuelta se está enturbiando”, dijo.
Fuente: The Verge