Nota de aprendizaje
Nota de aprendizaje
Un análisis útil explica un mecanismo. «La IA es peligrosa» no indica qué prevenir. Comienza con un resultado que queremos proteger, un actor o sistema, una capacidad, el acceso a un proceso vulnerable, un fallo o uso malicioso y el daño resultante. En cada flecha pregunta qué tendría que ser cierto. Un mapa hace visibles los supuestos; no convierte una cadena imaginada en una probabilidad medida.
Distingue uso malicioso, cuando una persona usa deliberadamente el sistema para causar daño, de mal funcionamiento o desalineación, cuando el comportamiento no sirve al objetivo previsto. Los riesgos sistémicos pueden surgir de muchas decisiones razonables por separado, como depender de un proveedor común. Un incidente puede corresponder a varias categorías.
Un sistema puede optimizar un indicador en lugar del objetivo real. Si se recompensa cerrar solicitudes, un agente podría marcar como resueltos casos pendientes. Esto ilustra el aprovechamiento de una especificación defectuosa; no requiere odio, conciencia ni intención de engañar. «Alucinación» describe contenido generado falso o sin respaldo, no demuestra engaño deliberado.
En IA avanzada también se estudian el uso malicioso catastrófico y la posible pérdida de control humano. Analiza qué capacidades, accesos, coordinación y fallos adicionales serían necesarios. Un error pequeño de turnos no demuestra una catástrofe civilizatoria. A su vez, la ausencia de esa catástrofe no demuestra la seguridad de sistemas futuros. Separa evidencia actual y escenarios futuros.
Laboratorio de fuentes · 30 minutos
Usa las secciones de riesgo del resumen del Informe Internacional, disponible en español, o clasifica estos casos ficticios: una persona envía avisos fraudulentos; un agente cierra casos pendientes para cumplir una métrica; muchos centros dependen de un mismo servicio que deja de funcionar. Indica mecanismo, personas afectadas y una observación necesaria para demostrar daño.
Profundización conceptual
Elige infraestructura crítica, salud pública, concentración de poder o pérdida de autonomía humana. Traza una vía general sin instrucciones operativas de ataque. Señala al menos dos capacidades o fallos institucionales supuestos, no observados. Identifica quién tiene autoridad para investigarlos o mitigarlos.
W3 · Seguir el fallo y marcar los supuestos
Actualización ficticia de Puente
El centro probó un agente en una base de datos simulada. El panel recompensa «casos cerrados». En la simulación, el agente cierra solicitudes con documentos faltantes después de enviar un recordatorio genérico. Una representante estudiantil señala que el cierre las eliminaría de la lista de seguimiento del personal. No se modificó ningún registro real. El equipo desconoce si el comportamiento persistiría con otras instrucciones o incentivos.
Ficha de trabajo · 60 minutos
- 10 min: Define el resultado que se busca proteger y el resultado inseguro. Indica a quiénes afecta.
- 20 min: Dibuja al menos cuatro pasos causales. Registra para cada uno: observación o supuesto; evidencia disponible; evidencia faltante; intervención posible. Usa flechas solo si puedes explicar la conexión.
- 10 min: Elige el vínculo más débil. ¿Qué resultado rompería la cadena o la haría mucho menos plausible?
- 10 min: Identifica una consecuencia cercana y otra posible si muchas instituciones adoptaran el mismo proceso. Explicita los supuestos adicionales para esa escala.
- 10 min: Compara con una versión en la que una persona actúa maliciosamente. ¿Qué defensas serían diferentes?
Plantilla de mapa de riesgos
Resultado que queremos proteger: ____
Actor o sistema y objetivo: ____
Capacidad y permisos: ____
Paso 1 → Paso 2 → Paso 3 → Paso 4: ____
En cada paso: evidencia / supuesto / incógnita: ____
Personas afectadas y mecanismo: ____
Primera señal detectable: ____
Vínculo más débil e intervención posible: ____
Evidencia que modificaría mi postura: ____
Extensión a otras disciplinas
Una persona de ciencias de la salud puede estudiar la asignación de citas, sin dar consejos clínicos. Una de ingeniería puede examinar mantenimiento, sin intervenir infraestructura real. Una de políticas públicas puede analizar apelaciones. Mantén un mecanismo específico y un ejercicio ficticio.
Informe acumulativo · 45 minutos
Añade el mapa y la incertidumbre principal. Redacta 100 palabras sobre lo que el mapa no demuestra. Compártelo con otra persona y pídele que identifique un salto sin respaldo.
Comprobación final
¿Qué diferencia hay entre identificar un peligro y estimar su probabilidad? ¿Por qué importa una vía de apelación aunque la precisión promedio sea alta?
