/incident-response
Protocolo de respuesta ante incidentes en produccion: triaje, mitigacion, causa raiz y postmortem. Usar ante caidas, errores criticos, incidentes de seguridad o degradacion de servicio.
$ npx -y skills add 686f6c61/alfred-dev --skill incident-response --agent claude-codeHow it fires
How this skill gets triggered: by you, by Claude, or both.
- Fires itselfAuto-invocation. Claude auto-loads it when your prompt matches the work.
- You can call itInvoke it directly when you want it.
- Slash command
/incident-response
Context preview
The summary Claude sees to decide when to auto-load this skill.
Protocolo de respuesta ante incidentes en produccion: triaje, mitigacion, causa raiz y postmortem. Usar ante caidas, errores criticos, incidentes de seguridad o degradacion de servicio.
SKILL.md
incident-response.SKILL.mdname: incident-response
description: "Protocolo de respuesta ante incidentes en produccion: triaje, mitigacion, causa raiz y postmortem. Usar ante caidas, errores criticos, incidentes de seguridad o degradacion de servicio."
disable-model-invocation: true
Respuesta ante incidentes
El usuario ha reportado o detectado un incidente en produccion. Sigue este protocolo paso a paso para gestionar la respuesta de forma estructurada, desde el triaje inicial hasta el postmortem final.
Resumen
Los incidentes en produccion requieren una respuesta rapida pero ordenada. La tentacion es saltar directamente al codigo, pero sin un triaje previo se pierde tiempo en diagnosticos erroneos. Este protocolo exige documentar cada paso y registrar las lecciones aprendidas para reducir recurrencias.
Proceso
Fase 1: Triaje (qa-engineer)
Usa la herramienta Agent para lanzar al agente `qa-engineer` con la siguiente mision:
1. Clasificar la severidad del incidente (P0 critico, P1 alto, P2 medio, P3 bajo). 2. Identificar el impacto: usuarios afectados, funcionalidad comprometida, datos en riesgo. 3. Recopilar evidencia: logs, trazas, capturas, mensajes de error. 4. Definir si hay workaround inmediato.
**Artefacto:** informe de triaje con severidad, impacto y evidencia.
Fase 2: Mitigacion (senior-dev)
Si el triaje indica P0 o P1, ejecutar mitigacion inmediata:
1. Aplicar workaround si existe (rollback, feature flag, redirect de trafico). 2. Si no hay workaround, desarrollar hotfix minimo con test de regresion. 3. Desplegar la mitigacion y verificar que el impacto se reduce.
**Artefacto:** commit de mitigacion con test de regresion.
Fase 3: Analisis de causa raiz (senior-dev + security-officer)
Una vez mitigado el impacto, investigar la causa raiz:
1. Trazar la cadena de eventos desde el trigger hasta el fallo. 2. Identificar la causa raiz (no el sintoma). 3. Si el incidente tiene componente de seguridad, el security-officer audita la cadena. 4. Registrar la causa raiz como decision en la memoria del proyecto.
**Artefacto:** documento de RCA (Root Cause Analysis).
Fase 4: Postmortem
Generar un informe postmortem completo:
1. Cronologia del incidente (cuando se detecto, cuando se mitigo, cuando se resolvio). 2. Causa raiz confirmada. 3. Acciones correctivas con responsable y fecha limite. 4. Acciones preventivas para evitar recurrencia. 5. Lecciones aprendidas.
**Artefacto:** documento postmortem en formato Markdown.
Formato del postmortem
# Postmortem: [titulo del incidente]
**Fecha:** YYYY-MM-DD
**Severidad:** P0/P1/P2/P3
**Duracion:** X horas/minutos
**Impacto:** [descripcion del impacto]
## Cronologia
- HH:MM - [evento]
- HH:MM - [evento]
## Causa raiz
[Explicacion detallada]
## Acciones correctivas
- [ ] [accion] - Responsable: [nombre] - Fecha: YYYY-MM-DD
## Acciones preventivas
- [ ] [accion] - Responsable: [nombre] - Fecha: YYYY-MM-DD
## Lecciones aprendidas
1. [leccion]
Criterios de exito
- El incidente tiene una severidad asignada con criterios objetivos.
- La mitigacion se aplica antes de investigar la causa raiz (primero apagar el fuego).
- Existe un documento de RCA que identifica la causa raiz real, no solo el sintoma.
- El postmortem esta completo con cronologia, acciones correctivas y preventivas.
- Las lecciones aprendidas quedan registradas en la memoria del proyecto.
- Las acciones correctivas tienen responsable y fecha limite asignados.
Que NO hacer
- **No saltar el triaje para ir directamente al codigo.** Sin un triaje previo se pierde tiempo en hipotesis equivocadas y se corre el riesgo de aplicar cambios que empeoren la situacion. El triaje estructura la respuesta y prioriza correctamente.
- **No cerrar el incidente sin postmortem.** Un incidente sin postmortem es una oportunidad perdida de aprendizaje. Aunque el fix sea trivial, documentar que fallo y por que evita recurrencias y genera conocimiento institucional.
- **No culpar personas en el postmortem.** El postmortem se enfoca en procesos y sistemas, no en individuos. La pregunta correcta es "que fallo en el sistema que permitio este error" y no "quien cometio el error". Un postmortem punitivo destruye la confianza y desincentiva la transparencia.
Read more
name: incident-response description: "Protocolo de respuesta ante incidentes en produccion: triaje, mitigacion, causa raiz y postmortem. Usar ante caidas, errores criticos, incidentes de seguridad o degradacion de servicio." disable-model-invocation: true
Respuesta ante incidentes
El usuario ha reportado o detectado un incidente en produccion. Sigue este protocolo paso a paso para gestionar la respuesta de forma estructurada, desde el triaje inicial hasta el postmortem final.
Resumen
Los incidentes en produccion requieren una respuesta rapida pero ordenada. La tentacion es saltar directamente al codigo, pero sin un triaje previo se pierde tiempo en diagnosticos erroneos. Este protocolo exige documentar cada paso y registrar las lecciones aprendidas para reducir recurrencias.
Proceso
Fase 1: Triaje (qa-engineer)
Usa la herramienta Agent para lanzar al agente `qa-engineer` con la siguiente mision:
1. Clasificar la severidad del incidente (P0 critico, P1 alto, P2 medio, P3 bajo). 2. Identificar el impacto: usuarios afectados, funcionalidad comprometida, datos en riesgo. 3. Recopilar evidencia: logs, trazas, capturas, mensajes de error. 4. Definir si hay workaround inmediato.
**Artefacto:** informe de triaje con severidad, impacto y evidencia.
Fase 2: Mitigacion (senior-dev)
Si el triaje indica P0 o P1, ejecutar mitigacion inmediata:
1. Aplicar workaround si existe (rollback, feature flag, redirect de trafico). 2. Si no hay workaround, desarrollar hotfix minimo con test de regresion. 3. Desplegar la mitigacion y verificar que el impacto se reduce.
**Artefacto:** commit de mitigacion con test de regresion.
Fase 3: Analisis de causa raiz (senior-dev + security-officer)
Una vez mitigado el impacto, investigar la causa raiz:
1. Trazar la cadena de eventos desde el trigger hasta el fallo. 2. Identificar la causa raiz (no el sintoma). 3. Si el incidente tiene componente de seguridad, el security-officer audita la cadena. 4. Registrar la causa raiz como decision en la memoria del proyecto.
**Artefacto:** documento de RCA (Root Cause Analysis).
Fase 4: Postmortem
Generar un informe postmortem completo:
1. Cronologia del incidente (cuando se detecto, cuando se mitigo, cuando se resolvio). 2. Causa raiz confirmada. 3. Acciones correctivas con responsable y fecha limite. 4. Acciones preventivas para evitar recurrencia. 5. Lecciones aprendidas.
**Artefacto:** documento postmortem en formato Markdown.
Formato del postmortem
# Postmortem: [titulo del incidente] **Fecha:** YYYY-MM-DD **Severidad:** P0/P1/P2/P3 **Duracion:** X horas/minutos **Impacto:** [descripcion del impacto] ## Cronologia - HH:MM - [evento] - HH:MM - [evento] ## Causa raiz [Explicacion detallada] ## Acciones correctivas - [ ] [accion] - Responsable: [nombre] - Fecha: YYYY-MM-DD ## Acciones preventivas - [ ] [accion] - Responsable: [nombre] - Fecha: YYYY-MM-DD ## Lecciones aprendidas 1. [leccion]
Criterios de exito
- El incidente tiene una severidad asignada con criterios objetivos.
- La mitigacion se aplica antes de investigar la causa raiz (primero apagar el fuego).
- Existe un documento de RCA que identifica la causa raiz real, no solo el sintoma.
- El postmortem esta completo con cronologia, acciones correctivas y preventivas.
- Las lecciones aprendidas quedan registradas en la memoria del proyecto.
- Las acciones correctivas tienen responsable y fecha limite asignados.
Que NO hacer
- **No saltar el triaje para ir directamente al codigo.** Sin un triaje previo se pierde tiempo en hipotesis equivocadas y se corre el riesgo de aplicar cambios que empeoren la situacion. El triaje estructura la respuesta y prioriza correctamente.
- **No cerrar el incidente sin postmortem.** Un incidente sin postmortem es una oportunidad perdida de aprendizaje. Aunque el fix sea trivial, documentar que fallo y por que evita recurrencias y genera conocimiento institucional.
- **No culpar personas en el postmortem.** El postmortem se enfoca en procesos y sistemas, no en individuos. La pregunta correcta es "que fallo en el sistema que permitio este error" y no "quien cometio el error". Un postmortem punitivo destruye la confianza y desincentiva la transparencia.
Plugin de Claude Code: 18 agentes especializados, 60 skills, 25 comandos, 13 hooks, memoria persistente, Memory UI local, quality gates, evidence guard, continuidad operativa y modo autopilot.
Repo: 686f6c61/alfred-dev
Other skills on alfred-dev.
- /alfred
Alias global /alfred para abrir el asistente contextual de Alfred Dev sin escribir el namespace completo. Activar solo cuando el usuario invoque explicitamente /alfred.
Open skill - /choose-stack
Usar para evaluar y elegir tecnologías con matriz de decisión ponderada. Activar cuando el usuario quiera elegir tecnología, comparar frameworks, decidir entre alternativas técnicas, construir una matriz de decisión, evaluar stack, seleccionar base de datos, elegir lenguaje o
Open skill - /design-system
Usar para diseñar la arquitectura de un sistema con diagramas y contratos. Activar cuando el usuario quiera diseñar arquitectura, definir componentes del sistema, crear un diagrama de flujo, establecer contratos entre módulos, planificar la estructura del proyecto o decidir cómo
Open skill - /evaluate-dependencies
Usar para evaluar si una dependencia merece la pena antes de añadirla. Activar cuando el usuario quiera añadir una librería, saber si merece la pena esta dependencia, evaluar un paquete antes de instalarlo, hacer npm install o pip install de algo nuevo, buscar alternativas a una
Open skill - /write-adr
Usar para documentar decisiones arquitectónicas como ADR. Activar cuando el usuario quiera documentar por qué se tomó una decisión, registrar alternativas descartadas, crear un ADR, un decision record, dejar constancia de una elección técnica o justificar una decisión de diseño
Open skill - /code-review
Usar para revisar código con foco en calidad, legibilidad y errores lógicos. También: revisar código, buscar errores, calidad del código, revisión de PR, pull request review.
Open skill

