REALITYWIPE

POR_LOS_NÚMEROS

La ciencia de los incidentes de ingeniería y la identidad: por qué rara vez es culpa del villano

"¿Quién rompió prod?" parece la pregunta correcta después de una interrupción. La investigación sobre sistemas da una respuesta menos satisfactoria pero mucho más útil: los sistemas complejos fallan por la alineación de muchas condiciones pequeñas, no por un actor imprudente (Reason 1990; Google SRE 2016). Mientras tanto, las personas más responsables de mantener esos sistemas vivos — las que hacen trabajo de infraestructura, turnos de guardia y trabajo de pegamento — están sistemáticamente subvaloradas (Champion et al. 2024). Y ahora se añade una nueva amenaza de identidad: las herramientas de IA que prometen reemplazar a los ingenieros son confiables para una minoría cada vez menor de desarrolladores (Stack Overflow 2025). El viejo guion — 'alguien aquí es el villano' — casi siempre está mal leído.

~75%de los encuestados de Stack Overflow 2025 reportan desconfianza o baja confianza en el código generado por IA — el nivel más bajo de confianza de los desarrolladores en la salida de IA jamás registrado en la encuesta5+ layersde barreras defensivas que deben tener agujeros simultáneos para que ocurra una falla en el sistema complejo, según el modelo del queso suizo de Reason — no un mal actor, no una verificación omitidaSystematicsubvaloración del trabajo de infraestructura, documentación y revisión en ecosistemas de código abierto — Champion et al. 2024 encontraron que estas contribuciones son estructuralmente invisibles en comparación con los commits de características en la mayoría de los sistemas de reconocimiento1 chapteren el Libro de SRE de Google dedicado completamente a la cultura de postmortems — codificando la ausencia de culpa como un requisito organizacional, no como algo deseable, porque la culpa degrada activamente la calidad de la información necesaria para prevenir futuros incidentes
Ver archivo de investigación completopondé a pruebaToda la investigación