Los secretos develados de DeepSeek, la IA china que compite con los gigantes de Silicon Valley
Los creadores del modelo de inteligencia argtifical generativa DeepSeek, describieron en una publicación hoy en la revista Nature, cómo su apuesta por reducir al mínimo la intervención humana en el proceso resultó vencedora en la pugna con los gigantes de SIlicon Valley.
A inicios de 2025 se estrenó la IA china con mejores repercusiones y resultados que su competidora directa ChatGPT. Su modelo R1 funcionó tan bien como ChatGPT, pero era gratuita y de código abierto. Hoy se conoce, gracias al artículo publicado por sus creadores, los avances que le permitieron revolucionar el sector y cuya clave está, aseguran, en la apuesta por el llamado aprendizaje por refuerzo.
La IA "aprende" de los datos. Pero la técnica de aprendizaje por refuerzo de DeepSeek se asemeja "al modo en que un niño aprende a jugar a un videojuego. Al mover su personaje por el mundo virtual, aprende mediante prueba y error que algunas acciones, cómo coger monedas le da más puntos, y otras, cómo ser atacado por enemigos se los restan", desgrana El diario español El País.
Ante la guerra comercial entre Estados Unidos y China y la imposibilidad de comprar chips de última genración, los científicos de DeepSeek innovaron y se centraron en el aprendizaje reforzado, algo que no se había hecho antes. "Demostramos que las habilidades de razonamiento de los grandes modelos de lenguaje se pueden incentivar mediante técnicas de aprendizaje reforzado puro, obviando la nacesidad de introducir pastillas de razonamiento etiquetadas por humanos", precisan sus realizadores en el estudio.
Foto: EFE

