¿Dónde falla ChatGPT al utilizarlo para gestionar normas ISO 9001, 14001 o 45001? ChatGPT genérico fracasa en entornos de auditoría oficial por 4 razones determinantes: 1) Alucinación de cláusulas y requisitos (inventa títulos de subcláusulas que no existen en el estándar oficial); 2) Desconocimiento absoluto de tus procedimientos internos reales (responde con buenas prácticas teóricas de internet en lugar de citar tu manual de planta PG-04 rev.3); 3) Filtración de secretos industriales y propiedad intelectual (en versiones estándar los datos introducidos entrenan modelos públicos de OpenAI); y 4) Incapacidad de garantizar trazabilidad legal ante auditores de ENAC o TÜV, lo que puede provocar la no conformidad mayor del sistema.
1. Los Cuatro Fallos Fatales de ChatGPT en Auditorías Reales
Fallo 1: Alucinaciones Plausibles pero Falsas
Los modelos de lenguaje autoregresivos predicen la palabra estadísticamente más probable, no la legalmente correcta. En pruebas controladas con ChatGPT-4o en consultas sobre la norma ISO 45001:2018, el modelo cita con frecuencia el "apartado 9.4" (inexistente en la norma) o confunde requisitos específicos de la antigua OHSAS 18001. Si un responsable de calidad traslada ese texto a su procedimiento, el auditor de certificación detectará inmediatamente la inconsistencia técnica.
Fallo 2: Falta de Anclaje a tus Documentos Propios (Grounding)
ChatGPT no conoce las tolerancias de mecanizado de tu centro de trabajo, los nombres de tus proveedores homologados ni la vigencia de los contratos de mantenimiento de tus carretillas. Responderá generalidades como "es recomendable hacer una revisión periódica", cuando tu sistema exige "revisión quincenal según IT-MEC-012".
Fallo 3: Secreto Industrial y Cumplimiento del Reglamento Europeo de IA (EU AI Act)
Introducir en un chat público descripciones de fallos en piezas aeronáuticas, fórmulas químicas o planes de contingencia vulnera los acuerdos de confidencialidad (NDA) de clientes y los mandatos de ciberseguridad industrial.