REALITYWIPE

PONDÉ_A_PRUEBA

La ciencia de los incidentes de ingeniería y la identidad: por qué rara vez es culpa del villano

"¿Quién rompió prod?" parece la pregunta correcta después de una interrupción. La investigación sobre sistemas da una respuesta menos satisfactoria pero mucho más útil: los sistemas complejos fallan por la alineación de muchas condiciones pequeñas, no por un actor imprudente (Reason 1990; Google SRE 2016). Mientras tanto, las personas más responsables de mantener esos sistemas vivos — las que hacen trabajo de infraestructura, turnos de guardia y trabajo de pegamento — están sistemáticamente subvaloradas (Champion et al. 2024). Y ahora se añade una nueva amenaza de identidad: las herramientas de IA que prometen reemplazar a los ingenieros son confiables para una minoría cada vez menor de desarrolladores (Stack Overflow 2025). El viejo guion — 'alguien aquí es el villano' — casi siempre está mal leído.

PONTE_A_PRUEBA · ¿Cuánto sabes de esta ciencia?

  1. 01 ¿Qué dice el modelo del queso suizo de James Reason sobre cómo fallan los sistemas complejos?

    El modelo de Reason muestra que las fallas en sistemas complejos son multicausales: una serie de agujeros en capas defensivas que de otro modo son robustas deben alinearse para que un accidente llegue al resultado. Ninguna persona sola crea todos los agujeros. fuente

  2. 02 Según el capítulo del libro de SRE de Google sobre la cultura de postmortems, ¿cuál es el objetivo principal de un postmortem sin culpa?

    El libro de SRE de Google establece que los objetivos principales de un postmortem son garantizar que el incidente esté documentado, que se comprendan todas las causas raíz contribuyentes y que se implementen acciones preventivas efectivas — no asignar culpa a individuos. fuente

  3. 03 ¿Qué encontró el estudio de Champion et al. de 2024 sobre el trabajo de infraestructura y pegamento en los ecosistemas de software de código abierto?

    Champion et al. encontraron que el mantenimiento de infraestructura, la documentación, la revisión de código y la gestión comunitaria son estructuralmente invisibles en la mayoría de los sistemas de reconocimiento — a pesar de ser esenciales para el funcionamiento del ecosistema — mientras que los commits de características atraen crédito desproporcionado. fuente

  4. 04 Según la encuesta de desarrolladores de Stack Overflow de 2025, ¿qué está pasando con la confianza de los desarrolladores en el código generado por IA?

    La encuesta de desarrolladores de Stack Overflow de 2025 encontró la confianza de los desarrolladores en la salida de IA en un mínimo histórico — la mayoría de los desarrolladores no confía completamente en el código generado por IA, a pesar de la rápida proliferación de herramientas de codificación de IA. fuente

  5. 05 ¿Qué encontraron Allspaw y Robbins sobre el efecto de la cultura de culpa en las investigaciones de incidentes de ingeniería?

    Allspaw y Robbins documentaron que el miedo al castigo hace que los ingenieros oculten información sobre lo que ocurrió durante un incidente. Esa información oculta impide que la organización comprenda y corrija las condiciones reales, haciendo más probable el próximo incidente. fuente

Ver archivo de investigación completoToda la investigación