Los principales asesores de la Casa Blanca expresaron esta semana su alarma ante la posibilidad de que DeepSeek de China pueda haberse beneficiado de un método que supuestamente se aprovecha de los avances de sus rivales estadounidenses, llamado «destilación».
La técnica, que implica que un sistema de IA aprenda de otro sistema de IA, puede ser difícil de detener, según fuentes ejecutivas e inversores de Silicon Valley. Este mes, DeepSeek sacudió el sector tecnológico con un nuevo modelo de inteligencia artificial que parecía rivalizar con las capacidades de gigantes estadounidenses como OpenAI , pero a un costo mucho menor. Y la empresa con sede en China regaló el código.
Algunos tecnólogos creen que el modelo de DeepSeek puede haber aprendido de los modelos estadounidenses para obtener algunos de sus beneficios. La técnica de destilación implica que un modelo de IA más antiguo, más establecido y poderoso evalúe la calidad de las respuestas que surgen de un modelo más nuevo, transfiriendo de manera efectiva los aprendizajes del modelo anterior.
Esto significa que el modelo más nuevo puede aprovechar los beneficios de las enormes inversiones de tiempo y poder de cómputo que se invirtieron en construir el modelo inicial sin los costos asociados. Esta forma de destilación, que es diferente de cómo la mayoría de los investigadores académicos utilizaban anteriormente el término, es una técnica común que se utiliza en el campo de la IA. Sin embargo, es una violación de los términos de servicio de algunos modelos destacados publicados por empresas tecnológicas estadounidenses en los últimos años, incluida OpenAI.
El fabricante de ChatGPT dijo que sabe de grupos en China que trabajan activamente para replicar modelos de inteligencia artificial estadounidenses a través de la destilación y está revisando si DeepSeek pudo haber destilado sus modelos de manera inapropiada, dijo un portavoz a Reuters. Naveen Rao, vicepresidente de IA de Databricks, con sede en San Francisco, que no utiliza esta técnica cuando las condiciones de servicio lo prohíben, dijo que aprender de los rivales es «lo normal» en la industria de la IA. Rao comparó esto con la forma en que los fabricantes de automóviles compran y luego examinan los motores de los demás.
«Para ser totalmente justos, esto sucede en todos los escenarios. La competencia es algo real y, cuando se trata de información que se puede extraer, hay que extraerla y tratar de obtener una victoria», dijo Rao. «Todos tratamos de ser buenos ciudadanos, pero todos competimos al mismo tiempo». Howard Lutnick , el candidato del presidente Donald Trump para Secretario de Comercio que supervisaría los futuros controles de exportación de tecnología de inteligencia artificial, dijo al Senado de Estados Unidos durante una audiencia de confirmación el miércoles que parecía que DeepSeek se había apropiado indebidamente de tecnología de inteligencia artificial estadounidense y prometió imponer restricciones.
«No creo que DeepSeek se haya llevado a cabo de forma totalmente legal. Eso es una tontería», afirmó Lutnick. «Voy a ser riguroso en la búsqueda de restricciones y en la aplicación de las mismas para mantenernos en cabeza». David Sacks , el zar de la inteligencia artificial y las criptomonedas de la Casa Blanca, también expresó su preocupación por la destilación de DeepSeek en una entrevista con Fox News el martes. DeepSeek no respondió de inmediato a una solicitud de comentarios sobre las acusaciones. OpenAI agregó que trabajará con el gobierno de Estados Unidos para proteger la tecnología estadounidense, aunque no detalló cómo.
«Como principal desarrollador de IA, tomamos contramedidas para proteger nuestra propiedad intelectual, incluido un proceso cuidadoso para determinar qué capacidades de vanguardia incluir en los modelos lanzados», afirmó la compañía en un comunicado. La ronda más reciente de preocupación en Washington sobre el uso por parte de China de productos estadounidenses para avanzar en su sector tecnológico es similar a las preocupaciones anteriores sobre la industria de semiconductores , donde Estados Unidos ha impuesto restricciones sobre qué chips y herramientas de fabricación se pueden enviar a China y está examinando restringir el trabajo en ciertas tecnologías abiertas .
AGUJA EN EL PAJAR
Los tecnólogos dijeron que bloquear la destilación puede ser más difícil de lo que parece. Una de las innovaciones de DeepSeek fue demostrar que una cantidad relativamente pequeña de muestras de datos (menos de un millón) de un modelo más grande y más capaz podía mejorar drásticamente las capacidades de un modelo más pequeño. Cuando productos populares como ChatGPT tienen cientos de millones de usuarios, cantidades tan pequeñas de tráfico podrían ser difíciles de detectar, y algunos modelos, como el de Meta Platforms Las ofertas de Llama y la startup francesa Mistral se pueden descargar libremente y utilizar en centros de datos privados, lo que significa que las violaciones a sus términos de servicio pueden ser difíciles de detectar.
«Es imposible detener la destilación de modelos cuando se tienen modelos de código abierto como Mistral y Llama. Están disponibles para todos. También pueden encontrar el modelo de OpenAI en algún lugar a través de los clientes», dijo Umesh Padval, director ejecutivo de Thomvest Ventures. La licencia del modelo Llama de Meta requiere que quienes lo utilicen para destilación revelen esa práctica, dijo a Reuters un portavoz de Meta. DeepSeek reveló en un artículo que utilizó Llama para algunas versiones simplificadas de los modelos que lanzó este mes, pero no mencionó si alguna vez había utilizado el modelo de Meta en el proceso. El portavoz de Meta se negó a decir si la empresa creía que DeepSeek había violado sus términos de servicio.
Una fuente familiarizada con el pensamiento de un importante laboratorio de inteligencia artificial dijo que la única forma de evitar que empresas como DeepSeek destilen modelos estadounidenses serían requisitos estrictos de «conozca a su cliente» similares a cómo las empresas financieras identifican con quién hacen negocios. Pero nada de eso está escrito en piedra, dijo la fuente. La administración del expresidente Joe Biden había planteado tales requisitos, que el presidente Donald Trump podría no aceptar. La Casa Blanca no respondió de inmediato a una solicitud de comentarios.
Jonathan Ross, director ejecutivo de Groq, una empresa de computación con inteligencia artificial que aloja modelos de IA en su nube, ha tomado la medida de bloquear todas las direcciones IP chinas para que no puedan acceder a su nube y así impedir que empresas chinas supuestamente se aprovechen de los modelos de IA que aloja. «Eso no es suficiente, porque la gente puede encontrar formas de evitarlo», dijo Ross. «Tenemos ideas que nos permitirían evitarlo, y será un juego del gato y el ratón… No sé cuál es la solución. Si a alguien se le ocurre una, que nos la haga saber y la implementaremos».
Reportes de Stephen Nellis, Anna Tong y Jeffrey Dastin en San Francisco; Krystal Hu y Katie Paul en Nueva York y David Shepardson en Washington, DC; editado por Kenneth Li y Nick Zieminski
Fuente: reuters

