Por qué las cajas negras de IA son peligrosas: riesgos de seguridad y la necesidad de una IA explicable

12

Cuando escuche “caja negra”, puede imaginarse las grabadoras de vuelo indestructibles que sobreviven a los accidentes aéreos. O tal vez pienses en teatros pequeños e independientes. Sin embargo, en inteligencia artificial el término describe algo mucho más opaco. Una caja negra de IA es un sistema donde la lógica interna es completamente invisible. Puede proporcionarle datos y obtener un resultado, pero no puede examinar el código o el razonamiento detrás de ese resultado.

El aprendizaje automático es el motor que impulsa la IA moderna, incluidas herramientas generativas como ChatGPT y DALL-E 2. Se basa en tres pilares: algoritmos, datos de entrenamiento y el modelo resultante. Un algoritmo es un conjunto de procedimientos que aprende patrones de un gran conjunto de datos. Una vez entrenado, se convierte en modelo. Piénselo de esta manera: un algoritmo diseñado para detectar perros, entrenado con miles de fotografías de perros, se convierte en un modelo de “observador de perros”. Aliméntelo con una imagen y le indicará si hay un perro presente y dónde.

El problema es que cualquiera de estos tres componentes se puede ocultar. A menudo, el algoritmo en sí es de conocimiento público, por lo que ocultarlo no ayuda mucho. En cambio, los desarrolladores tratan el modelo o los datos de entrenamiento como una caja negra para proteger la propiedad intelectual. Lo opuesto es una “caja de cristal”, donde los algoritmos, los datos y los modelos son totalmente visibles. Sin embargo, incluso las cajas de cristal tienen sombras. Los investigadores aún no comprenden completamente cómo funcionan los algoritmos de aprendizaje profundo. Esta brecha ha desencadenado el campo de la IA explicable, cuyo objetivo es hacer que estos sistemas se parezcan menos a la magia y más a una maquinaria comprensible.

Por qué los algoritmos opacos generan señales de alerta

Hay una buena razón para desconfiar del aprendizaje automático de caja negra. Imagínese un modelo diagnosticando su salud. ¿Aceptaría un plan de tratamiento si no supiera cómo el sistema llegó a su conclusión? Probablemente su médico tampoco lo haría. Necesitan comprender la lógica para verificar el diagnóstico.

Considere las decisiones financieras. Si un modelo de IA le niega un préstamo comercial, una caja negra lo deja en la oscuridad. Sin saber por qué fue rechazado, no puede apelar de manera efectiva. No puedes ajustar tus finanzas para mejorar tus posibilidades la próxima vez. La transparencia no sólo es agradable de tener; es esencial para recurrir.

La seguridad es otro factor crítico. Durante años, la industria tecnológica funcionó con una suposición errónea: si se mantiene el software oculto, los piratas informáticos no pueden encontrar vulnerabilidades. No pueden invertir el motor de lo que no pueden ver. Esta lógica ha fracasado en gran medida. Los piratas informáticos pueden aplicar ingeniería inversa al software observando su comportamiento y creando un facsímil para descubrir debilidades. No necesitan el código fuente.

Si el software es transparente (una caja de cristal), los evaluadores y los piratas informáticos éticos pueden examinarlo. Pueden informar debilidades antes de que actores malintencionados las exploten. Mantener las cosas ocultas no las hace seguras; simplemente los hace vulnerables a quienes tienen la paciencia para sondearlos desde afuera.

El elemento humano en la IA explicable

El impulso hacia una IA explicable no se trata sólo de curiosidad. Se trata de confianza y responsabilidad. Cuando un algoritmo toma una decisión de alto riesgo, lo que está en juego es demasiado como para confiar en la intuición. Necesitamos saber cómo piensa la máquina.

Saurabh Bagchi, profesor de ingeniería eléctrica e informática en la Universidad Purdue, ha destacado estas cuestiones ampliamente. Su investigación, financiada por varias fuentes gubernamentales y privadas, subraya la necesidad de contar con sistemas que los humanos realmente puedan comprender.

La tensión entre proteger la propiedad intelectual y garantizar la seguridad es real. Los desarrolladores quieren proteger sus modelos. Los usuarios deben confiar en ellos. ¿Podemos tener ambos? La respuesta parece inclinarse hacia la transparencia. Porque si no podemos explicar la decisión, no podemos impugnarla. Y si no podemos desafiarlo, no podemos mejorarlo.

Es posible que el futuro de la IA no se base en cajas de cristal perfectamente transparentes. Podría tratarse de sistemas que, si bien no son completamente abiertos, proporcionan suficiente información para ser confiables. ¿Cuánto detalle es suficiente? Ésa es una pregunta que la industria todavía está intentando responder.

Artículo anteriorPor qué los registradores de vuelo están enterrados en la cola y construidos como tanques