Estas son las páginas web de las que ChatGPT extrae su información

Guardar

ChatGPT consulta miles de sitios web de los que extrae la información para generar una respuesta a los usuarios. (Pexels)

Los programas de inteligencia artificial como ChatGPT requieren grandes cantidades de información para ejecutar sus procesos y ofrecer la mejor calidad y cantidad de datos posibles, en el caso de OpenAI, se conoce que la data, en su mayoría, proviene de millones de páginas web.

Una investigación realizada por The Washington Post indica cuáles serían las páginas web que utiliza esta inteligencia artificial para “alimentarse” y generar las respuestas de las consultas realizadas por los usuarios.

Si bien no es posible identificar las páginas web exactas que se utilizan como fuente en el caso de ChatGPT pues solo OpenAI tiene la lista completa, sí es posible identificar de qué conjunto de datos extrae la información, no solo esta, sino la gran mayoría de inteligencias artificiales.

Te puede interesar: OpenAI no avanzará con GPT-5 y su CEO llamó “ridícula” la petición de suspender el avance de ChatGPT

La información en internet está organizada en grandes conjuntos que actúan como pozos que son visitados para extraer lo que se necesite de ellos.

El llamado C4 es el conjunto visitado por ChatGPT y otros modelos similares para generar respuestas a las consultas de internet y está compuesto por alrededor de 15.1 millones de sitios web de diferentes temas y orígenes.

La inteligencia artificial de ChatGPT se alimenta de información obtenida de diversos sitios web. (Hipertextual)

La investigación realizada indica que en este conjunto de datos se encuentran sitios web relacionados con los negocios, tecnología, noticias, arte, ciencia, entre otras especialidades.

Muchos contenidos extraídos de estos sitios están protegidos por derechos de autor, por lo que cada chatbot que utilice el conjunto C4 como fuente, podría estar infringiendo esta normativa en el proceso, ya sea para una consulta eventual o en caso de que un estudiante pida que la inteligencia artificial haga su tarea.

Según el Instituto Allen para la Inteligencia Artificial, que también participó en la investigación, el símbolo de copyright “©” aparece más de 200 millones de veces en el conjunto de datos C4.

Algunas de las páginas web de las que se extraen datos son Fool.com, Kickstarter.com, Patreon.com en lo que respecta a contenido relacionado con negocios, aunque muchos de ellos estén protegidos por derechos de autor.

Te puede interesar: ChatGPT: cuál es la información que recolecta de los usuarios y por qué

Sin embargo, estos no son los sitios web más utilizados en el cómputo global. Esta categoría la comprenden páginas como patents.google.com que recoge patentes emitidas en todo el mundo; wikipedia.org, la conocida enciclopedia online que puede ser editada por los usuarios; además de scribd.com, una biblioteca digital por suscripción.

Modelos de inteligencia artificial extraen sus datos de conjuntos de información que incluye resultados protegidos por leyes de copyright (REUTERS/Florence Lo)

El contenido buscado por las inteligencias artificiales también comprende algunos medios de comunicación y sitios web de recopilación de información; pero aunque muchos de ellos puedan ser fuentes fiables de producción de contenido que es útil para los usuarios, esto no implica que no se hayan incluido fuentes que aportan datos falsos, sesgados y en muchos casos incompleto.

Estos sitios web “informativos” incluyen aquellos que difunden teorías conspirativas o información falsa, además de datos que aportan pensamientos radicales que pueden ser dañinos para los usuarios, en caso de que esta información sea presentada a modo de respuesta a una consulta.

Te puede interesar: ChatGPT no es tan novedoso, estos son los chatbots que existieron antes

Una muestra del sesgo informativo es que, según el estudio, se detectó que de los 20 sitios web religiosos de los que se extraen datos, 14 de ellos eran cristianos, dos eran judíos y solo uno era de tendencia musulmana.

Últimas Noticias

Colombia 4.0 lleva la innovación digital a jóvenes y adultos: IA, drones y más

La ministra de las TIC contó que este evento se llevó a 11 ciudades del país por primera vez en 15 años

WhatsApp permitirá hacer llamadas usando solo nombres de usuario, sin necesidad de números de teléfono

La próxima función, detectada en versiones beta de iOS y Android, facilitará comunicarse y proteger la privacidad al eliminar la necesidad de revelar el número personal en la plataforma de mensajería

El libro que Bill Gates sugiere leer para fortalecer el carácter y tener una vida exitosa

El cofundador de Microsoft destaca una obra de David Brooks como una guía esencial para quienes buscan desarrollar valores sólidos y alcanzar una vida plena, al equilibrar la ambición y bienestar interior

Tres funciones de Meta AI que facilitan tareas diarias: imágenes, traducciones y correcciones con una sola orden

El asistente se lanzó de forma global en 2023 y busca que el usuario resuelva tareas rápidas dentro del chat

Estas son las preguntas prohibidas que no le debes hacer a ChatGPT ni Gemini

Los asistentes de inteligencia artificial imponen límites estrictos sobre datos personales, actividades ilegales, contenido ofensivo y asesoría médica o financiera

Estas son las páginas web de las que ChatGPT extrae su información

Modelos de inteligencia artificial generan sus respuestas con base en datos protegidos por leyes de copyright

Últimas Noticias

Colombia 4.0 lleva la innovación digital a jóvenes y adultos: IA, drones y más

La ministra de las TIC contó que este evento se llevó a 11 ciudades del país por primera vez en 15 años

WhatsApp permitirá hacer llamadas usando solo nombres de usuario, sin necesidad de números de teléfono

La próxima función, detectada en versiones beta de iOS y Android, facilitará comunicarse y proteger la privacidad al eliminar la necesidad de revelar el número personal en la plataforma de mensajería

El libro que Bill Gates sugiere leer para fortalecer el carácter y tener una vida exitosa

El cofundador de Microsoft destaca una obra de David Brooks como una guía esencial para quienes buscan desarrollar valores sólidos y alcanzar una vida plena, al equilibrar la ambición y bienestar interior

Tres funciones de Meta AI que facilitan tareas diarias: imágenes, traducciones y correcciones con una sola orden

El asistente se lanzó de forma global en 2023 y busca que el usuario resuelva tareas rápidas dentro del chat

Estas son las preguntas prohibidas que no le debes hacer a ChatGPT ni Gemini

Los asistentes de inteligencia artificial imponen límites estrictos sobre datos personales, actividades ilegales, contenido ofensivo y asesoría médica o financiera

Crimen de Diego Fernández Lima: ya tiene fecha la audiencia para tratar la apelación del sobreseimiento de Cristian Graf

Llegó la versión híbrida del SUV más vendido del mercado

Salidera en Núñez: un policía retirado de la Federal se enfrentó a motochorros y mató a uno de los ladrones

Quirno viaja a EEUU como canciller y crece la expectativa por el acuerdo comercial

Uno por uno, quiénes son los ministros y secretarios del nuevo Gabinete de Javier Milei

David Beckham se convirtió en caballero inspirado por el rey Carlos y con un traje diseñado por su esposa, Victoria

Una operación militar arrasó con 12 hectáreas de minería ilegal en el sur de Ecuador

El vicepresidente electo de Bolivia llamó a sus seguidores a un mitin tras asumir el cargo: “Mi compromiso será ante ustedes”

Aumentan los casos de enfermedad de Chagas fuera de América Latina

Un nuevo brote de gusano barrenador retrasa la reapertura de la frontera estadounidense para el ganado mexicano

El emocionante reencuentro que vivió Guido Kaczka en vivo con un excompañero de elenco: “¡No lo puedo creer!"

Ca7riel & Paco Amoroso actuarán en la gala de los Latin Grammy

La ingeniosa respuesta de Morena Echarri a las críticas que recibió por coser su propia remera: “¿Podría hacer esto?"

Ana Rosenfeld apuntó contra Mauro Icardi en la polémica con Wanda Nara: “Él se queja, pero ayuda poco”

Oriana Sabatini dio una pista sobre el nombre de la beba que espera con Paulo Dybala: “¡Nadie lo sabe!”

Temas Relacionados

Últimas Noticias

Colombia 4.0 lleva la innovación digital a jóvenes y adultos: IA, drones y más

La ministra de las TIC contó que este evento se llevó a 11 ciudades del país por primera vez en 15 años

WhatsApp permitirá hacer llamadas usando solo nombres de usuario, sin necesidad de números de teléfono

La próxima función, detectada en versiones beta de iOS y Android, facilitará comunicarse y proteger la privacidad al eliminar la necesidad de revelar el número personal en la plataforma de mensajería

El libro que Bill Gates sugiere leer para fortalecer el carácter y tener una vida exitosa

El cofundador de Microsoft destaca una obra de David Brooks como una guía esencial para quienes buscan desarrollar valores sólidos y alcanzar una vida plena, al equilibrar la ambición y bienestar interior

Tres funciones de Meta AI que facilitan tareas diarias: imágenes, traducciones y correcciones con una sola orden

El asistente se lanzó de forma global en 2023 y busca que el usuario resuelva tareas rápidas dentro del chat

Estas son las preguntas prohibidas que no le debes hacer a ChatGPT ni Gemini

Los asistentes de inteligencia artificial imponen límites estrictos sobre datos personales, actividades ilegales, contenido ofensivo y asesoría médica o financiera

Crimen de Diego Fernández Lima: ya tiene fecha la audiencia para tratar la apelación del sobreseimiento de Cristian Graf

Llegó la versión híbrida del SUV más vendido del mercado

Salidera en Núñez: un policía retirado de la Federal se enfrentó a motochorros y mató a uno de los ladrones

Quirno viaja a EEUU como canciller y crece la expectativa por el acuerdo comercial

Uno por uno, quiénes son los ministros y secretarios del nuevo Gabinete de Javier Milei

David Beckham se convirtió en caballero inspirado por el rey Carlos y con un traje diseñado por su esposa, Victoria

Una operación militar arrasó con 12 hectáreas de minería ilegal en el sur de Ecuador

El vicepresidente electo de Bolivia llamó a sus seguidores a un mitin tras asumir el cargo: “Mi compromiso será ante ustedes”

Aumentan los casos de enfermedad de Chagas fuera de América Latina

Un nuevo brote de gusano barrenador retrasa la reapertura de la frontera estadounidense para el ganado mexicano

El emocionante reencuentro que vivió Guido Kaczka en vivo con un excompañero de elenco: “¡No lo puedo creer!"

Ca7riel & Paco Amoroso actuarán en la gala de los Latin Grammy

La ingeniosa respuesta de Morena Echarri a las críticas que recibió por coser su propia remera: “¿Podría hacer esto?"

Ana Rosenfeld apuntó contra Mauro Icardi en la polémica con Wanda Nara: “Él se queja, pero ayuda poco”

Oriana Sabatini dio una pista sobre el nombre de la beba que espera con Paulo Dybala: “¡Nadie lo sabe!”