Los matemáticos quieren pruebas de que OpenAI no utiliza su trabajo

Otro investigador de OpenAI está desafiando el hardware con sus hallazgos matemáticos cada vez más impresionantes. Unos días después de que estallara la amarga disputa sobre si las muestras de trabajo no publicadas de la compañía ayudaron, otro matemático acusó al gigante de la IA de un comportamiento poco ético y «sin escrúpulos» y de falta de transparencia sobre los orígenes de sus datos de entrenamiento.
en un serie de* noticias En Mastodon, el matemático Andreas Thom expresó su preocupación por la interacción que él y sus colegas tuvieron con el chatbot ChatGPT antes de la triunfante noticia de la contribución de OpenAI al campo. uno 10 evento AbiertoAI anunciado con gran entusiasmo El mes pasado involucró el campo de especialización de Thomas, un grupo de los llamados no sofistas, y OpenAI reconoció su éxito en el trabajo anterior de Thomas Gábor Kun y su socio matemático.
Thomas dijo que reflexionó sobre sus interacciones con OpenAI después de que Tristan Buckmaster, profesor de matemáticas en la Universidad de Nueva York, cuestionado públicamente si los modelos de IA de la empresa se beneficiaron del uso de su código OpenAI. Después de que OpenAI anunciara su salida del grupo no sofisticado, fue ampliamente criticado en los círculos matemáticos por no reconocer las contribuciones recientes de Thom y Kun, y el grupo corrigió silenciosamente a sus autores. Los círculos insatisfechos son, en términos generales, estructuras matemáticas infinitas que no pueden aproximarse de forma finita.
Thomas también dijo que estaba impresionado por la «disciplina de nuestra tecnología OpenAI», que según él no era ni la forma más obvia ni la más confiable de resolverlo en ese momento. Dijo que escribió una carta a los investigadores de OpenAI, Sébastien Bubeck y Mark Sellke, también estadístico de Harvard, para preguntarles si sus interacciones con ChatGPT eran «parte de los datos de entrenamiento o un proceso contable accesible» y, por lo tanto, podrían haber contribuido al resultado.
Pero la respuesta no satisfizo a Thomas, quien solo preguntó si se podía acceder directamente a las conversaciones con el chatbot, no si la empresa estaba utilizando grandes grupos de capacitación para mejorar sus modelos. «No se ha dado tal cosa, no se ha dado ninguna explicación ni evidencia», escribió. «Tomo esto como una falta de respeto, por decir lo menos».
Thomas dijo que los investigadores no estaban capacitados para realizar ingeniería inversa en el proceso de OpenAI para determinar si su trabajo se estaba utilizando o no. «Sólo OpenAI tiene los datos relevantes». Si la empresa se niega a hacer esto, dijo que es su deber demostrar que tiene todos los datos necesarios abriendo y explicando las distintas configuraciones y términos de cómo usan los datos.
Para defender su reciente hackeo del Premio del Milenio, abiertamente y a regañadientes excluye de manera concluyente cualquier uso de los datos de los usuarios, tanto en las noticias públicas como en sus comunicaciones con Buckmaster, que estaba trabajando en estos problemas con el investigador antrópico Levent Alpöge a título personal. En la entrada del blog anunciando La solución Navier-Stokes, que se centra en el movimiento de fluidos, se ha negado a utilizar OpenAI de ninguna manera. específico Datos de usuario: «Nosotros (los investigadores y administradores) no revisamos ninguno de sus trabajos de ninguna manera hasta que lo publicaron oficialmente; específicamente, no se accedió a ningún dato de usuario específico para resolver este problema».
Pero no concluye sobre la fuerza indirecta: «Aunque es poco probable, no podemos excluir los datos no identificados del uso de nuestros productos para mejorar los modelos». Thomas, dijo: es la misma distinción oscura que la sociedad ha trazado con él en sus comunicaciones. «La desidentificación elimina el nombre, no elimina la idea matemática intelectual», afirmó.
Según acontecimientos recientes, dijo Thomas, «la respuesta categórica de Sellke fue, por decir lo menos, injustamente amplia y materialmente engañosa; en retrospectiva, fue simplemente deshonesta».
Thomas dijo que sería «éticamente indefendible» si los usuarios apoyaran la investigación no pública para mejorar los modelos que la empresa luego utilizó para publicar a esos mismos usuarios, sin consentimiento, autodivulgación o crédito.
OpenAI no responde de inmediato Bordesolicitud en el comentario.
Sus comentarios se suman a la reiteración sobre OpenAI en los círculos matemáticos de lo que es un triunfo trascendental para la empresa. Su solución anunciada a uno de los problemas matemáticos legendarios del Premio Milenio llegó a ser tan extraordinaria que, si se verificaba, pocos lo negarían. Pero esto se complicó por las circunstancias inusuales que, según OpenAI, lo llevaron a abordar el problema en primer lugar: escuchó rumores en línea de que otros investigadores habían logrado avances importantes y pensaron que era demasiado intentarlo.
El incidente en curso dejó un * Los matemáticos tienen gusto por las uvas. Le dijo a muchos investigadores Borde Este tipo de comportamiento preocupante empuja el campo a un estado más reservado, si los matemáticos siquiera supieran que los rumores de un gran avance están cerca podrían encender una clase de técnicos bien capacitados ansiosos por una gloria masiva.
Sigue los temas y autores de esta historia para ver más de esto en su propia página para alimentar el protocolo y recibir actualizaciones por correo electrónico.
Fuente
Source link