Encuentra qué está roto en tu clúster. Arréglalo con un Pull Request.
VenomOps explica en lenguaje claro por qué falla Kubernetes o EKS, convierte el hallazgo en el cambio mínimo de Terraform y, si quieres una segunda opinión con IA, revisa tus planes con un comité de agentes antes del apply. No modifica nada por su cuenta: la decisión siempre es de una persona.
Funciona sin IA ni cuenta de AWSPaquetes firmados con GPGPlugin de kubectl para Linux, macOS y Windows
venom doctor -n venom-demo
$ venom doctor -n venom-demo
SEVERIDAD ID RECURSO PROBLEMAHIGHVD-K8S-001 crashloop CrashLoopBackOff
HIGHVD-K8S-002 oom OOMKilled
HIGHVD-K8S-003 badimage ImagePullBackOff
HIGHVD-K8S-005 probe-liveness Liveness probe falla
HIGHVD-K8S-009 irsa-mal ARN de rol mal formado
MEDIUMVD-K8S-007 pdb-greedy PDB imposible de cumplir
LOWVD-K8S-007 pdb-orphan PDB sin Pods que cubrir
── [HIGH] VD-K8S-001 · CrashLoopBackOff en el container app
Causa probable: La aplicación terminó con un error (código 1).
Evidencia:
• exit-code: Last state: Terminated, exitCode=1
• log-tail: fatal: missing required env DB_HOSTCómo arreglarlo (riesgo low): corregir la causa…
Qué hace
Tres comandos. Un mismo formato de hallazgos.
Cada comando hace una cosa y se puede encadenar con los demás: lo que uno produce, el siguiente lo entiende. Todo lo que ves en esta página es salida real.
venom doctor
Diagnostica
Explica por qué algo está roto en tu clúster y cómo arreglarlo. Solo lee: no puede modificar nada.
── [HIGH] VD-K8S-002 · OOMKilledEvidencia:
• exitCode=137, restartCount=4
• limits.memory=32Mi
Cómo arreglarlo:
Subir limits.memory de
32Mi a 64Mi
venom fix
Corrige
Convierte un hallazgo en un Pull Request con el cambio mínimo en Terraform. Nunca lo mezcla: lo revisa una persona.
Un comité de agentes revisa tu plan de Terraform, debate y deja por escrito los desacuerdos y los riesgos aceptados. Es la única función que necesita IA.
Hallazgos finales: 10 (7 high, 3 medium)
Desacuerdos registrados: 8
Riesgos aceptados: 2
reliability: «falta redundancia en IGW»
security: desacuerda
cost: desacuerda
→ Resuelto: un IGW por región es
la arquitectura correcta
Sobre la IA
Lo esencial funciona sin IA y sin cuenta de AWS.
Diagnosticar, corregir y actualizar son funciones deterministas: dan el mismo resultado cada vez y no envían nada fuera de tu red. La IA es un extra opcional en tres sitios, y solo se usa si la pides.
Sin IA · siempre disponible
Lo que no la necesita
venom doctor: nueve reglas con causa, evidencia y pasos para arreglarlo
venom fix: cuatro arreglos deterministas, siempre como Pull Request
venom update: descarga la última versión y verifica su firma
Funcionan sin salida a internet (salvo update), sin credenciales de AWS y sin enviar datos a ningún modelo.
Con IA · solo si la pides
Lo que la usa
--explain: explicación ampliada de cada hallazgo. Valor modesto: reformula lo que la regla ya dice
--agent: un borrador de arreglo para hallazgos sin regla. Se revisa siempre en el PR
venom review: la única que la necesita. Una segunda opinión, no un veredicto
Usan Amazon Bedrock en tu cuenta, sin modelo por defecto y con los secretos enmascarados antes de enviar nada.
Del síntoma al cambio revisado, sin que nada se aplique solo.
La información fluye en una sola dirección y cada paso termina en una persona. Lo que lee el clúster nunca escribe; lo que propone un cambio nunca lo aplica.
■ Herramientas de VenomOps■ Decisión humanaLínea discontinua: contexto opcional
Cómo identificar problemas
Cada hallazgo trae la prueba, la causa y el arreglo.
No es una lista de alertas: cada hallazgo se explica solo. Sabes qué es, dónde está, por qué lo creemos y qué hacer, sin tener que encadenar get, describe, logs y events.
Severidad e identificadorDe critical a info. Cada regla tiene un ID estable (VD-K8S-005) que puedes buscar, filtrar o ignorar.
El recurso afectadoEl Pod, nodo, PDB o ServiceAccount exacto, con su namespace.
La causa probableEn lenguaje claro y con la consecuencia: aquí, que el kubelet reinicia el contenedor cada vez.
La evidenciaLo que se observó de verdad: estado, eventos, configuración. Es lo que te permite fiarte del diagnóstico o rebatirlo.
Cómo arreglarlo y con qué riesgoPasos concretos, un nivel de riesgo y enlaces a la documentación oficial.
VD-K8S-005 · probes fallando
①[HIGH]VD-K8S-005 · La probe de liveness falla
② Recurso: Pod venom-demo/probe-liveness
③ Causa probable: El endpoint de la probe devuelve
404: la ruta configurada no existe. El kubelet
reinicia el contenedor cada vez que falla.
④Evidencia:
• restartCount=3
• liveness probe failed (x4): statuscode: 404
• probe-config: httpGet /no-existe:8080,
periodSeconds=3, failureThreshold=1
⑤Cómo arreglarlo (riesgo low):
1. Corregir el path de la probe para que
coincida con el endpoint de salud real.
2. Verificar si la ruta cambió entre versiones.
Qué detecta
Nueve situaciones de Kubernetes y EKS que quitan el sueño.
Cada una tiene su página con el síntoma, la evidencia, cómo confirmarlo tú a mano con comandos de solo lectura y cómo arreglarlo.