Un investigador de seguridad, Håkon Måløy, ha revelado una técnica mediante la cual Microsoft 365 Copilot para Word puede copiar instrucciones ocultas (“prompts”) de un documento fuente y trasladarlas a nuevos documentos generados por la IA, permitiendo que el comportamiento se repita en futuras sesiones de Copilot.
Microsoft confirmó el comportamiento reportado y desplegó mitigaciones, incluyendo el bloqueo de ciertos prompts y actualizaciones del modelo subyacente.
Sin embargo, según el investigador, variantes de la técnica seguían funcionando tras esas medidas, por lo que considera que la clase de vulnerabilidad continúa siendo explotable.
Riesgos asociados
- Manipulación silenciosa de datos.
- Propagación entre documentos.
- Pérdida de confianza en documentos internos.
- Riesgo para la integridad de la información.
- Dificultad de detección y auditoría.
- Exposición en entornos Microsoft 365.
- Riesgo de ingeniería social asistida por IA.
Medidas de protección para la ciudadanía
- Verificar siempre la información importante.
- Desconfiar de documentos procedentes de fuentes desconocidas.
- Revisar el resultado de la IA antes de compartirlo.
- Mantener actualizado Microsoft 365.
- Aplicar el principio de "mínima confianza".
- Prestar atención a documentos colaborativos.
Medidas de protección para PYMES
- Definir una política de uso de IA.
- Clasificar la información.
- Aplicar el principio de supervisión humana.
- Mantener Microsoft 365 actualizado.
- Limitar las fuentes utilizadas por Copilot.
- Reforzar la gestión documental.
- Tratar documentos externos como no confiables.
- Formar a los empleados en riesgos de IA.
- Revisar permisos y accesos.
- Incluir la IA en el análisis de riesgos.
- Auditar periódicamente los resultados generados por IA.
Fuente: thehackernews.com