Volver al Blog
Herramientas de IA 27 de marzo de 2026 5 min read

GitHub usará tu código para entrenar IA por defecto desde el 24 de abril — así puedes desactivarlo

GitHub anunció el 25 de marzo que los datos de interacción de usuarios de Copilot Free, Pro y Pro+ se usarán para entrenar modelos de IA a partir del 24 de abril de 2026, salvo que se opte por no participar. La decisión afecta a millones de desarrolladores y ha generado una oleada de críticas.

GitHub usará tu código para entrenar IA por defecto desde el 24 de abril — así puedes desactivarlo

A partir del 24 de abril de 2026, GitHub utilizará los datos de interacción de Copilot para entrenar sus modelos de inteligencia artificial, a menos que el usuario lo desactive manualmente antes de esa fecha.

El alcance de los datos que se recopilarán es más amplio de lo que la mayoría de usuarios imagina. GitHub define “datos de interacción” como entradas, salidas, fragmentos de código y contexto asociado. En la práctica, eso incluye los prompts que escribes, las sugerencias que genera Copilot, el código que rodea el cursor, los comentarios y la documentación de tus archivos, los nombres de ficheros y la estructura del repositorio, los patrones de navegación y cualquier valoración positiva o negativa que hayas dado a las sugerencias. Todo ello, por defecto, alimentando los pipelines de entrenamiento.

Quién se ve afectado y quién no. Los clientes de Copilot Business y Enterprise están protegidos por los términos de sus contratos: sus datos no se usan para entrenamiento sin autorización explícita. Los estudiantes y docentes también están exentos. El cambio afecta exclusivamente a los suscriptores individuales de los planes Free, Pro y Pro+.

El argumento de GitHub. La compañía afirma haber entrenado ya con datos de interacción de empleados de Microsoft y haber observado “mejoras significativas”, con tasas de aceptación de sugerencias más altas en varios lenguajes de programación. El argumento para la calidad del modelo es legítimo. Lo que la comunidad cuestiona es el modelo de opt-out en lugar de opt-in.

La reacción ha sido contundente. La publicación en el foro de la comunidad de GitHub que anunció el cambio acumula 117 votos negativos. Los comentarios van desde preocupaciones de privacidad hasta dudas legales sobre el código generado en repositorios privados. Investigadores de seguridad y defensores del software libre señalan que los desarrolladores europeos bajo el RGPD pueden tener argumentos más sólidos para impugnar el modelo de opt-out.

¿Qué pasa con los repositorios privados? GitHub aclara que el código fuente almacenado en repositorios privados en reposo no se usa para el entrenamiento. Sin embargo, los datos de interacción generados durante una sesión de Copilot en un repositorio privado —el prompt, la sugerencia, el contexto circundante— quedan cubiertos por la nueva política. Esa es la distinción relevante para los equipos que trabajan con código propietario.

Cómo desactivarlo. Haz clic en tu foto de perfil → Configuración de Copilot → busca “Allow GitHub to use my data for AI model training” → selecciona Disabled. Si tienes varias cuentas de GitHub, repite el proceso en cada una. Si anteriormente optaste por no compartir datos para la mejora del producto, tu preferencia se mantiene y tus datos no se usarán a menos que decidas cambiarla.

Este movimiento encaja en el patrón de 2026: todos los grandes laboratorios de IA se enfrentan al mismo problema — los modelos se estancan sin datos nuevos y la fuente más accesible es su propia base de usuarios. GitHub al menos sigue las normas de opt-out del mercado estadounidense. Si eso es suficiente para cuarenta millones de desarrolladores, es otra cuestión.

Fuentes: GitHub Blog, The Register

GitHub Copilot Data Privacy AI Policy