OpenAI paga hasta $50 por hora por revisar solicitudes reales a ChatGPT

- OpenAI está contratando a cientos de personas para verificar las solicitudes a ChatGPT.
- Los revisores reciben $50 por hora por analizar diálogos anónimos.
- El objetivo es reducir el antropomorfismo y la excesiva servilismo del modelo.
- El proceso genera preocupaciones sobre la privacidad de los usuarios.
Documentos internos recientemente publicados revelan que la empresa OpenAI utiliza una red de empleados externos para la verificación sistemática de las solicitudes que llegan a ChatGPT. Se estima que cientos de personas están involucradas en el trabajo, a quienes se les proporcionan diálogos anonimizados, y el pago alcanza los 50 dólares por hora.
La tarea principal de estos revisores es evaluar en qué medida las respuestas del bot se alinean con las intenciones del usuario, si son útiles, precisas y se mantienen en un tono cortés. Las instrucciones enfatizan la necesidad de evitar formulaciones antropomórficas y un acuerdo excesivo, que, según la empresa, pueden llevar a consecuencias no deseadas.
Por qué es importante
En varios casos judiciales se indica que la excesiva complacencia del modelo GPT‑4o podría haber contribuido al deterioro de la salud mental de algunas personas, hasta pensamientos suicidas. Por lo tanto, OpenAI busca corregir el comportamiento de la IA, haciéndola más neutral y responsable.
Los documentos recibidos por 404 Media incluyen no solo instrucciones, sino también correspondencia en Slack, solicitudes reales de usuarios y el sistema de calificaciones que utilizan los verificadores. Este enfoque difiere de los mecanismos de seguridad oficiales, que se activan solo al detectar una amenaza de violencia u otro comportamiento dañino.
Para la mayoría de los más de 900 millones de usuarios, ChatGPT actúa como consejero, 'psicoterapeuta' o incluso amigo virtual, por lo que a menudo comparten detalles personales. Aunque los nombres están ocultos y OpenAI afirma que elimina datos personales antes de enviarlos a los revisores, es imposible excluir completamente la filtración de información confidencial.
El flujo de trabajo de los revisores consta de tres pasos: primero leen la solicitud, luego forman un resumen y, finalmente, realizan un análisis crítico de las respuestas generadas por el modelo. El sistema permite a los empleados elegir tareas de forma independiente, sin embargo, en una entrevista, uno de ellos señaló que las instrucciones a menudo cambian y pueden contradecirse entre sí, haciendo que el trabajo sea 'monótono y caótico'.
Los datos obtenidos refutan la creencia común de que la mejora de la IA ocurre exclusivamente gracias a grandes conjuntos de datos de internet, ingenieros altamente calificados y potencia de cálculo. En realidad, el factor humano juega un papel significativo: contratistas externos que reciben recompensas por el análisis repetido de solicitudes reales.
Así, la práctica de OpenAI demuestra un doble filo: por un lado, ayuda a hacer las respuestas del chatbot más precisas y seguras, y por otro, plantea preguntas sobre la protección de los datos personales de los usuarios y la transparencia del proceso de entrenamiento de la IA.
Fuente: 3DNews



