Resolvemos
incidentes de
producción.

Tu producción en AWS se cayó, o sigue en pie pero está quemando dinero. Un ingeniero senior entra hoy mismo y revisa infraestructura y código como un solo sistema. Encuentra la causa real, la corrige en producción y te deja el análisis de causa raíz por escrito. Y si no se resuelve, no cobramos.

15 minPRIMERA RESPUESTA, POR CONTRATO — PLAN
Precio fijoPOR INCIDENTE, CON EL RCA INCLUIDO
Infra + códigoUN INGENIERO, TODO EL SISTEMA
Sin resolverNO SE COBRA. EL RIESGO ES NUESTRO.
01 / LO QUE AWS SUPPORT NO RESUELVE

Cuando tu sistema se cae, AWS no lo levanta.

"El soporte de AWS no incluye desarrollo de código a medida, depuración de software, tareas de administración de sistemas ni acceso remoto a los sistemas y cuentas del cliente."
— FAQ DE AWS SUPPORT, TRADUCIDO DEL INGLÉS

La escena se repite en todas partes: producción caída, tus ingenieros dando vueltas porque el problema vive en una capa que no manejan, o entre dos capas a la vez, y el partner que "ya lo está viendo" desde un ticket. Cada hora te cuesta: más de la mitad de las caídas graves ya superan los $100,000 (Uptime Institute, 2024). Aquí no hay mesa de ayuda: quien te contesta es quien entra a resolver, hoy.

02 / ¿CÓMO TRABAJAMOS?

Reportas. Lo resolvemos. Recibes el RCA. Fin.

PASO 01

Reporta el incidente

Cuéntanos qué está pasando y cuánto te cuesta cada hora. Antes de empezar dejamos acordado qué significa "resuelto": contra eso se mide el "si no se resuelve, no se cobra".

PASO 02

Entramos hoy

Un ingeniero senior toma tu caso el mismo día: telemetría, arquitectura y código, leídos juntos, y te decimos cuál es el siguiente paso.

PASO 03

Lo resolvemos en producción

Avances por escrito con cadencia fija, estilo war-room. El precio incluye exactamente dos llamadas: 30 minutos al inicio y 45 para leer el RCA. El resto del tiempo se usa en resolver, no en reuniones.

PASO 04

Estable y por escrito

El trabajo termina cuando el sistema está estable y tienes el análisis de causa raíz en la mano, con la lista de lo que hay que cambiar para que no se repita.

Después del incidente: el RCA cierra con la lista de lo que hay que cambiar para que no se repita. Si quieres que la ejecutemos, es un trabajo aparte con su propia cotización: endurecer el sistema, pruebas de carga antes de tu próxima campaña, revisión de seguridad o de arquitectura, bajar tu factura.

03 / PRECIOS

Precios fijos, publicados.

El incidente

Reportas, entramos, se encuentra la causa, se corrige en producción, se prueba, y se cierra con el RCA por escrito.

$2,000 por incidente

Plan de disponibilidad · 5 cupos

Primera respuesta contractual en 15 minutos. Domingos y madrugadas cubiertos, primero en la cola, y tus accesos, canal de alertas y runbook listos y ensayados antes de que algo se caiga. Cada mes tranquilo, un reporte firmado.

$1,000/mes · plan de 6 meses

Plan de Temporada

El plan de disponibilidad completo solo para tu temporada pico de 2–3 meses: campaña navideña, Cyber Wow, cierre fiscal, un lanzamiento.

$1,500/mes · mínimo 2 meses

Un solo precio por incidente, sin sorpresas: cubre todo, hasta el RCA. Si no se resuelve, no se cobra.

Con planSin plan
Primera respuesta15 min por contratoMejor esfuerzo, normalmente el mismo día
Domingos y madrugadasCubiertosAl doble del precio
ColaPrimero, siempreDespués de los clientes con plan
Minuto ceroAccesos y runbook listos y ensayadosEmpieza pidiendo accesos
Precio por incidenteEl mismo precio fijoEl mismo precio fijo
04 / CASOS REALES

Todo el sistema, no una sola capa.

Cuatro años corriendo producción en AWS para una plataforma de impuestos de Estados Unidos —primero como ingeniero, hoy liderando el equipo—, donde el tráfico de todo el año llega en una sola temporada. Trabajo con equipos de Chile, Colombia, Argentina y EE.UU., incluidos dos partners consultores de AWS. AWS Certified Solutions Architect.

El sistema que se congelaba por culpa de otro

El sistema de tickets se congelaba cada día pico y todos miraban al sistema de tickets. Los logs del balanceador contaron otra historia: las rutas más pesadas llevaban a un código del dashboard que consultaba una API interna en cada login, y detrás había una API que no podía escalar. El síntoma en un sistema, la causa en otro, la evidencia en un tercero. Se reescribió el código, se escaló la API, y la temporada se salvó.

SÍNTOMA → LOGS → CÓDIGO → CAUSA

Cuando agregar servidores no resolvió nada

Una aplicación legada escalaba servidores sobre un caché FSx compartido y la latencia ni se movía, con los tableros de AWS jurando que el almacenamiento estaba sano. El cuello estaba en las operaciones de metadata: apareció recién al meter métricas del agente de CloudWatch y compararlas contra la línea base de pruebas de carga. El caché pasó a volúmenes NVMe con stickiness y el sistema aguantó 170,000 requests por minuto, con 10,000 usuarios al mismo tiempo en una ventana de 15 minutos, sobre una arquitectura que ya habían dado por muerta.

170,000 REQ/MIN · 10,000 USUARIOS CONCURRENTES
05 / PREGUNTAS FRECUENTES

Lo que preguntan antes del incidente.

Se me cayó producción y nadie encuentra la causa. ¿Quién me ayuda?

Para eso existe esto. Escribe a incidents@kernelpanic.pe y un ingeniero senior te responde y entra a tu sistema hoy mismo, de lunes a sábado, de 8am a 10pm (hora de Lima). Con el plan de disponibilidad, la primera respuesta es contractual en 15 minutos y hay cobertura de domingos y madrugadas.

¿Cuánto cuesta?

Precio fijo: $2,000 por incidente. Incluye todo, hasta el análisis de causa raíz por escrito. Si no se resuelve, no se cobra.

¿Y si no lo resuelven?

No se cobra. Qué significa "resuelto" queda acordado al reportar el incidente, antes de empezar.

¿Esto no lo cubre el soporte de AWS que ya pago?

No. El propio FAQ de AWS lo dice: su soporte no incluye desarrollo ni depuración de código, ni administración de sistemas, ni acceso remoto a tus sistemas. AWS le da soporte a AWS. Aquí entramos y resolvemos en el tuyo: infraestructura y código, juntos.

¿Atienden solo en Perú?

Perú, Latinoamérica y Estados Unidos, en español e inglés. Lima está en UTC-5: el mismo huso horario de la costa este de EE.UU., sin jet lag para tus equipos remotos.

06 / LO QUE NO HACEMOS

Todo trabajo tiene un final.

No hacemos staff augmentation, ni guardias permanentes, ni "optimización cloud" que nunca termina. Entregado el RCA, el trabajo terminó. Las reuniones fuera de las dos llamadas incluidas se facturan, y se ven en la factura. Cada trabajo tiene una pregunta concreta, evidencia, límites y un final.