OpenAI y Microsoft se dan cuenta de que han iniciado un “bucle mortal” para la web

Documentos judiciales recientemente revelados en New York TimesCaso contra OpenAI y Microsoft Maldita sea. Los documentos de las empresas advertían que habían iniciado un "bucle fatal" que dañaría Internet, describían su recopilación de datos para entrenar sus modelos como "el mayor robo de mano de obra en la historia de la humanidad" y que "se burlaban completamente de la idea de empleo justo".

Muchas de las citas más llamativas del documento provienen del director de ciencias aplicadas de Microsoft, Brent Hecht. Sin embargo, la empresa intentó distanciarse de las afirmaciones de Hecht. "Estos comentarios reflejan el punto de vista individual de un empleado, no son análisis legales y no representan los puntos de vista de la empresa", dijo el portavoz de Microsoft, Alex Horik, a The Verge.

En una demanda separada, Jordan Osdan, director general de estrategia y operaciones de datos de Microsoft AI, describió el papel de Hecht como contradictorio. Dijo que Hecht "tiene puntos de vista académicos divergentes y con visión de futuro sobre cómo funcionan los ecosistemas de datos de IA, y trabaja en Microsoft para aportar puntos de vista académicos divergentes, con visión de futuro… Tampoco es alguien que hable en nombre de Microsoft específicamente con respecto a sus puntos de vista teóricos sobre el impacto potencial de la IA en los creadores de contenido".

Pero si Microsoft quiere hacerse cargo de estos comentarios o no, está claro Esto se ha logrado. ¡Google Zero es real! ¡La inteligencia artificial se está comiendo la web!

Hay muchas declaraciones descabelladas en New York Times Grabación de una variedad de personalidades, incluidos Satya Nadella, Sam Altman y otros empleados de OpenAI. A continuación se muestran algunos aspectos destacados del documento de 92 páginas.

’Robo increíble'

La introducción cita a Hecht y OpenAI, el director de ChatGPT (presumiblemente Nick Turley), de una manera que muestra que las dos empresas sabían que representaban una "amenaza existencial" para editores como Google. New York Times. Hecht califica la recopilación de datos de ChatGPT y Copilot como "el mayor robo de mano de obra en la historia de la humanidad" y dice que la defensa de Microsoft "se burla completamente de la idea de 'uso justo'".

Satya Nadella, CEO de Microsoft, acordó bajo juramento hablar con chatbots

Satya Nadella admite que los chatbots esencialmente han reemplazado la búsqueda y han eliminado la necesidad de ir directamente a la fuente de información. Pero quizás aún más condenatorio sea un documento interno de Microsoft que dice: "Nuestra estrategia de contenidos de IA ha iniciado un 'bucle fatal' que perjudicará el rendimiento de nuestros modelos y de toda la web al mismo tiempo: es muy inusual que un producto final amenace los fundamentos económicos de sus principales proveedores, pero esta es la situación que hemos creado para nuestro negocio MBA con respecto a su 'cadena de suministro de contenidos'".

Ese ni siquiera es un número real

Casi al mismo tiempo, Greg Brockman, cofundador de OpenAI, escribió que

No se deje engañar por OpenAI o las afirmaciones de intenciones altruistas de Microsoft. Greg Brockman, cofundador de OpenAI, ha expresado más interés en los “miles de millones” de dólares que podría ganar a través de la IA comercial.

Las personas dentro de OpenAI y Microsoft ignoraron problemas como la elusión del muro de pago y las violaciones de los términos de uso al obtener datos. SF521-47, 790-92. Por ejemplo, un representante de OpenAI testificó que no estaba al tanto

Aunque más tarde se citó a Nadella diciendo: "Todo lo que tenga un muro de pago debe tener licencia", un representante de OpenAI admitió que "no estaba al tanto" de ningún esfuerzo para detectar o eliminar contenido con muro de pago de los datos de entrenamiento.

“Increíblemente bueno en regurgitación”

Ese mismo año, OpenAI realizó su API.

Internamente, OpenAI parece haber sido muy consciente de la tendencia de ChatGPT a reproducir "textualmente" material protegido por derechos de autor. Aunque reconoció que "prevenir la preservación" era importante para "minimizar la infracción de derechos de autor", el personal admitió que GPT-4 "ahorró una gran cantidad de datos y, por lo tanto, sería increíblemente bueno en la regurgitación".

Luego, la grabación continúa citando numerosos ejemplos de ChatGPT generando largas cadenas de transcripciones directamente de artículos en un archivo. veces, Noticias de Mercurio, Correo de Denver, hacker de viday eurogamer En respuesta a consultas.

“Una recopilación de todas sus obras.”

    Como se dio cuenta Microsoft:

Microsoft sabía cómo se percibiría su raspado generalizado de Internet y admitió que "casi nadie pretendía que el contenido que creaban (sic) fuera utilizado de esta manera, ni reciben compensación por su uso".

"Un sustituto del trabajo de las personas"

El director de políticas de OpenAI, Jack Clarke, escribió de manera similar:

Jack Clarke, director de políticas de OpenAI, vio la evidencia y dijo que "crea sistemas que reemplazan el trabajo de las personas que definen la 'cultura' de la sociedad". Los documentos internos describieron ChatGPT como un "quiosco moderno". Nick Turley de OpenAI fue citado más tarde diciendo que una vez que obtienes una respuesta de su chatbot, "hay pocas razones para hacer clic" en el enlace de origen.

Destruyendo su cadena de suministro

Los demandados reconocen las consecuencias previsibles de este diseño. Según Microsoft,

Se ha citado a Microsoft admitiendo que “los LLM son un producto que está destruyendo su cadena de suministro” porque en muchos casos son un sustituto de sus datos de capacitación.

OpenAI conoce el tráfico de referencias excelente

Otro economista de OpenAI, el Dr. Goldfarb, opinó:

Los expertos en medios y economía de OpenAI atribuyeron la disminución del tráfico de referencias a sitios como veces Directo a resúmenes de IA, como la descripción general de IA de Google. Proyectaron que las referencias de búsqueda podrían caer hasta en un 60 por ciento.

"El testimonio de Satya y la posición de Microsoft en este caso son totalmente consistentes. Habló sobre principios generales y cambios en curso en cómo la gente encuentra y consume información. Estas observaciones no deben confundirse con conclusiones sobre cuestiones de derechos de autor ante el tribunal, que Microsoft aborda en sus documentos", advirtió el portavoz de Microsoft, Horik.

Pero parece bastante claro, según este documento recientemente revelado, que tanto Microsoft como OpenAI sabían que estarían causando un daño irreparable a la industria editorial y a los "millones de personas" que emplea y, por lo tanto, dañando su propio producto, pero continuaron adelante de todos modos en busca de "miles de millones" de dólares: al diablo con el ciclo de la muerte.

Seguir temas y autores De esta historia para ver más como esto en el feed personalizado de su página de inicio y recibir actualizaciones por correo electrónico.