Saltar al contenido
Entrar
Suscribirme

OpenAI tiene sus propios evaluadores humanos y algunos han sido despedidos por usar IA

Contratistas de OpenAI han sido despedidos por automatizar la revisión de respuestas de ChatGPT con inteligencia artificial. La medida busca evitar el colapso del modelo y marca una clara diferencia técnica con el trabajo de los evaluadores de calidad de Google.

Publicado el Revisado el 2 min de lectura

ia no ia

OpenAI expulsa a los contratistas que usan inteligencia artificial para evaluar y mejorar las respuestas de ChatGPT. Unos documentos internos publicados el 22 de septiembre de 2026 por 404 Media revelan que estos proyectos, que reúnen a más de diez mil personas, prohíben estrictamente la automatización. Mercor, una de las agencias intermediarias, ha confirmado que retiran de inmediato a los expertos si descubren el uso de IA para completar tareas.

El motivo de fondo es técnico: el colapso del modelo. El trabajo de estos contratistas de OpenAI consiste en valorar la calidad de la respuesta generada por el chat. Si el evaluador responde usando otra IA, contamina los datos puros que la empresa necesita para depurar su tecnología. Entrenar a un modelo con texto sintético degrada progresivamente sus resultados futuros.

Métodos de detección humana

La vigilancia para evitar infiltraciones sintéticas recae sobre otros contratistas. Su tarea es buscar señales típicas de la generación automática: vocabulario repetitivo, abuso de la raya de puntuación y tareas terminadas de forma anormalmente rápida. Las directrices también prohíben usar detectores de IA como GPTZero al considerarlos poco fiables, así como herramientas de traducción automática o Grammarly. Para dificultar la evasión, tienen orden de no explicar a los evaluados por qué se sospecha de ellos.

No es lo mismo que los evaluadores de Google

La situación contrasta directamente con el ecosistema de la Búsqueda de Google y sus 16.000 evaluadores externos. Sus trabajos son diametralmente distintos: los contratistas de OpenAI evalúan la calidad de una respuesta de chat en un entorno cerrado, mientras que los de Google evalúan la calidad de una página web pública aplicando las quality guidelines del buscador.

Las directrices públicas de Google no prohíben la IA generativa por principio. Reservan la nota más baja para el contenido copiado o generado automáticamente «con poco o ningún esfuerzo». En la búsqueda web, la vara de medir sigue siendo el esfuerzo y la utilidad humana; en los laboratorios de entrenamiento de modelos, la prohibición debe ser absoluta porque la IA se contamina a sí misma.

Markdown:

¿Es la noticia de septiembre?

Hasta el 7 de octubre, cada cuenta vota las piezas de septiembre que más le han aportado, todas las que quiera: la más votada sale en portada con el emblema de noticia del mes. Votan las personas con una cuenta abierta antes del 1 de octubre.

Entra para votarla

Ver las 37 piezas de septiembre

Comentarios

Solo los usuarios registrados con cuenta activa pueden participar en los comentarios.

No hay comentarios aún. Sé el primero en opinar.

Más en Industria

Industria Análisis

AI Act y contenidos de salud: obligación legal para los textos en webs sanitarias

Desde el 2 de agosto de 2026, determinados textos generados o manipulados mediante inteligencia artificial deben identificarse como tales cuando se publican para informar al público sobre asuntos de interés público. El artículo 50 del AI Act contempla una excepción cuando existe una revisión humana real o un control editorial y una persona física o jurídica asume la responsabilidad editorial de lo publicado. En las webs sanitarias, esto conecta con muchas prácticas que ya utilizábamos para trabajar el E-E-A-T, pero conviene distinguir muy bien qué exige realmente la norma y qué son buenas prácticas adicionales.

Carlos Pulido Luque 13 min
Siguiente noticia ¿Por qué las empresas latinoamericanas prefieren comprar tráfico antes que construir visibilidad?