La controversia en torno a los modelos de lenguaje y la tecnología china
En los últimos meses, la comunidad tecnológica ha estado en el centro de una intensa controversia relacionada con el desarrollo de modelos de lenguaje de gran escala. En particular, la empresa china Moonshot, responsable del modelo Kimi K3, ha sido acusada de copiar el modelo Fable de Anthropic. Estas acusaciones han desatado un debate más amplio sobre la ética, la competencia y la regulación en el ámbito de la inteligencia artificial (IA).
La denuncia de la Casa Blanca
Michael Kratsios, asesor científico de la Casa Blanca, ha sido una de las voces más destacadas en esta discusión. En un tuit reciente, afirmó que Moonshot había construido su modelo a partir de la copia de Fable, utilizando chips que no están autorizados para la exportación a China. “La destilación industrial a gran escala, encubierta y destinada a robar tecnología estadounidense y socavar la investigación americana, es inaceptable,” declaró Kratsios, subrayando la gravedad de la situación.
Esta declaración se produce en un contexto donde se están considerando prohibiciones a los modelos de lenguaje de peso abierto procedentes de China, una medida que ha agitado al sector de la IA. La falta de respuesta por parte de Moonshot a las preguntas sobre su proceso de entrenamiento ha añadido más leña al fuego, dejando a muchos preguntándose sobre la veracidad de las acusaciones de Kratsios.
La situación ha creado un ambiente de desconfianza y rivalidad entre las empresas de IA de Estados Unidos y China.
Los ecos de la acusación
La preocupación de Kratsios fue respaldada por el secretario del Tesoro, Scott Bessent, quien comentó que se han encontrado "marcas de agua" de los modelos de lenguaje de Estados Unidos en muchos modelos chinos. Sin embargo, no está claro a qué se refiere exactamente con estas "marcas de agua", y el Departamento del Tesoro no ha proporcionado más detalles. “Esto es inaceptable,” insistió Bessent, enfatizando la necesidad de proteger la propiedad intelectual estadounidense.
Expertos en el campo de la IA han expresado escepticismo respecto a la capacidad de Moonshot para haber desarrollado un modelo tan avanzado en un tiempo tan corto. Braden Hancock, investigador del Laude Institute y cofundador de Snorkel AI, comentó que no cree que el modelo Kimi K3 se haya creado exclusivamente mediante la destilación del modelo Fable. “No hay tiempo suficiente para destilar tanta información, entrenar un modelo y lanzarlo en solo dos semanas,” afirmó Hancock, lo que pone en duda la viabilidad de las acusaciones de Kratsios.
La destilación: ¿un proceso cuestionable?
La destilación de modelos de IA implica un proceso en el que se interroga a un modelo existente para entender su funcionamiento interno y replicar sus capacidades. Este proceso puede incluir la formulación de preguntas al modelo para que explique su razonamiento y cómo resuelve problemas. Sin embargo, muchos investigadores creen que este enfoque se ha vuelto menos efectivo a medida que los modelos de IA se vuelven más complejos.
Nathan Lambert, investigador en el Allen Institute for AI, también ha señalado que la destilación no es la única técnica que se utiliza en la creación de modelos avanzados. “La destilación ha perdido relevancia a medida que los modelos chinos se acercan a la frontera del desarrollo,” argumentó Lambert. En su opinión, para alcanzar capacidades similares a las de Fable, es probable que se necesiten técnicas de aprendizaje por refuerzo, que requieren una infraestructura más compleja y costosa.
Las acusaciones de destilación sistemática
La tensión entre las empresas de IA en Estados Unidos y China se intensificó cuando Anthropic acusó a Moonshot, DeepSeek y MiniMax de destilar sistemáticamente sus modelos. Según Anthropic, se descubrieron millones de interacciones entre sus modelos y usuarios de estas empresas, lo que indicaba un "esfuerzo deliberado de extracción de capacidades" en lugar de un uso legítimo. Este tipo de acusaciones ha generado una mayor preocupación sobre la ética en la investigación y desarrollo de modelos de IA.
La línea entre la destilación y la creación de conjuntos de datos sintéticos es difusa y ha llevado a un debate sobre la legalidad y la moralidad de estas prácticas.
Elon Musk, por su parte, ha testificado que su empresa SpaceXAI también utilizó la destilación de modelos de OpenAI para desarrollar Grok, lo que sugiere que esta práctica no es exclusiva de las empresas chinas. Este tipo de comportamiento ha llevado a muchos a cuestionar la integridad del ecosistema de IA en general, y si la competencia se está llevando a cabo de manera justa.
El acceso a la tecnología prohibida
Otro aspecto crucial de las acusaciones contra Moonshot es la afirmación de que la empresa ha obtenido chips avanzados de Nvidia, que están prohibidos para la exportación a China. Según Sam Bresnick, investigador en el Centro para la Seguridad y Tecnología Emergente de Georgetown, existe un mercado negro que facilita el acceso a esta tecnología. “Si permites que una empresa realice grandes entrenamientos en tu hardware de última generación, debería haber un mecanismo de informes sobre quién es esa empresa y qué está haciendo,” advirtió Bresnick.
La situación es preocupante, ya que el Departamento de Comercio de Estados Unidos ha propuesto reglas para que los centros de datos conozcan a sus clientes en 2024, pero no ha habido avances significativos en este ámbito. Mientras tanto, las empresas que exportan chips avanzados están obligadas a garantizar que se utilicen solo para fines aprobados, lo que plantea serias dudas sobre la efectividad de estas regulaciones.
Perspectivas a futuro en el desarrollo de IA
A medida que la competencia entre Estados Unidos y China en el campo de la inteligencia artificial continúa intensificándose, la necesidad de establecer normas claras y éticas se vuelve más urgente. La comunidad tecnológica debe reflexionar sobre cómo se desarrollan y utilizan los modelos de lenguaje y qué medidas se pueden implementar para proteger la propiedad intelectual y fomentar un entorno competitivo justo.
La creciente complejidad de los modelos de IA y las técnicas utilizadas para desarrollarlos sugieren que la destilación, aunque común, no es la única ni la más eficaz forma de crear modelos avanzados. La implementación de técnicas de aprendizaje por refuerzo y la utilización de infraestructura más sofisticada son pasos que las empresas deben considerar seriamente.
El dilema de la regulación internacional
Con la creciente interconexión entre las economías y las tecnologías de diferentes países, el dilema de la regulación internacional se hace cada vez más evidente. La cooperación entre naciones puede ser necesaria para abordar los desafíos éticos y legales que surgen en el ámbito de la inteligencia artificial. Sin embargo, las tensiones geopolíticas y las rivalidades económicas complican este proceso.
“Los equipos chinos poseen una experiencia técnica significativa,” ha señalado Hancock, enfatizando que los investigadores y ingenieros en China están realizando un trabajo sólido y legítimo. Esto pone de relieve la necesidad de una conversación más amplia sobre cómo las naciones pueden colaborar y competir de manera justa en el campo de la tecnología.
En resumen, la controversia en torno a los modelos de lenguaje y la tecnología china es un reflejo de las tensiones más amplias en la esfera de la inteligencia artificial. A medida que se desarrollan nuevos modelos y técnicas, la comunidad internacional debe abordar los desafíos que surgen en la intersección de la ética, la propiedad intelectual y la competencia tecnológica.
Otras noticias • IA
Travis Kalanick recauda 1.700 millones para su empresa Atoms
Travis Kalanick ha recaudado 1.700 millones de dólares para su nueva empresa de robótica, Atoms, con el apoyo de Uber y Andreessen Horowitz. Su objetivo...
Incidente de OpenAI expone fallas en IA y ciberseguridad
El incidente de OpenAI revela vulnerabilidades en la IA y errores humanos en la ciberseguridad. La falta de un entorno de prueba seguro y la...
Yope transforma la conexión social con micro comunidades auténticas
Yope es una nueva startup que busca transformar la conexión social en línea, ofreciendo una plataforma centrada en micro comunidades privadas sin algoritmos ni publicidad....
OpenAI invierte 750 mil millones en infraestructura y sostenibilidad
OpenAI invertirá 750 mil millones de dólares en infraestructura hasta 2030, comenzando con el Proyecto Camellia en Georgia, un campus de datos de 20 mil...
Substack implementa herramienta para identificar contenido generado por IA
Substack ha integrado una herramienta de detección de contenido generado por IA, utilizando Pangram, para fomentar la transparencia en la creación de newsletters. Esta función...
Preocupaciones de seguridad por IA china y oportunidades de innovación
La inteligencia artificial de código abierto, especialmente la proveniente de China, genera preocupaciones de seguridad en EE. UU. Sin embargo, expertos argumentan que puede fomentar...
Passionfroot recauda 15 millones para revolucionar el marketing B2B
Passionfroot, una startup alemana, ha recaudado 15 millones de dólares para impulsar su crecimiento en el marketing B2B, conectando creadores de contenido con marcas. Su...
Competencia entre Anthropic y OpenAI se intensifica en 2023
En 2023, la competencia entre Anthropic y OpenAI se intensifica con rumores sobre la adquisición de la startup de robótica Physical Intelligence. La interconexión entre...
Lo más reciente
- 1
ServiceNow invierte 40 millones en BusinessNext para revolucionar banca
- 2
IBM enfrenta caída histórica en acciones tras decepcionantes resultados financieros
- 3
Google Cloud crece un 82% gracias a soluciones de IA
- 4
Adolescente retira demanda contra Meta por adicción a redes sociales
- 5
Tesla retrasa producción por enfoque en baterías y diversificación
- 6
Tensiones EE. UU. y China por apropiación de tecnología AI
- 7
SoundCloud adquiere Nina Protocol para empoderar a artistas independientes

