2026-08-01T05:02:15.088Z

Agente Watchdog: Un propietario, evidencia reciente, trabajo verificado

Construye un perro de vigilancia de un solo propietario que preserve la espera y la incertidumbre, bloquee el control duplicado y verifique el resultado solicitado antes de completarlo.

Un agent vigilante es un observador separado que sigue el funcionamiento de otro agente, decide si está funcionando, esperando legítimamente, atrapado, incierto, fallido o terminado, y audita el resultado reclamado. El defecto útil es un perro de vigilancia de lectura mayormente con un contrato de arrendamiento, una cadencia lenta basada en la evidencia, y ninguna autoridad de mutación automática. El proceso está vivo y el trabajo solicitado es correcto son veredictos separados. Esta definición también resuelve una ambigüedad en los resultados de búsqueda actuales. Watchdog puede significar un viejo demonio de reinicio de infraestructura, un producto de seguridad AI, o un agente que supervisa a otro agente. Esta guía aborda el tercer significado. La habilidad actual de agent watchdog de Builder.io describe la misma entrega concreta: esperar a otro agente, reconstruir la solicitud, luego comprobar las reclamaciones contra diferencias, archivos, pruebas, CI, capturas de pantalla y estado de revisión. Su modo de reparación es separado y requiere autorización. Esa separación es el punto de partida correcto. Dar exactamente un perro guardián de propiedad Un perro guardián necesita su propia identidad y contrato de arrendamiento. Sin ellos, dos controles programados pueden concluir que poseen la misma carrera. Incluso si ambos diagnósticos son correctos, dos empujamientos, retomadas o reinicios pueden producir efectos duplicados. Usa un disco como este: runId une al observador a una pieza de trabajo. watchdogId identifica al propietario. La expiración obliga a la reelección después de que un observador se estrelló en lugar de dejar atrás la propiedad permanente. observedAt dice lo reciente que es el veredicto; no es intercambiable con lastProgressAt . Un observador puede tener un registro de progreso reciente mientras su propia conexión se ha quedado obsoleta. Antes de cada veredicto, aplica tres reglas de propiedad: 1. Debe haber exactamente un contrato de alquiler de perros de vigilancia sin vencimiento para la carrera. 2. El observador deberá actualizar las pruebas antes de clasificar o recomendar una intervención. 3. Un perro de vigilancia sustitutivo solo podrá hacerse cargo después de que expire o se libere explícitamente el contrato de arrendamiento anterior. Si existen dos IDs en vivo, devuelva conflict . No dejemos que los dos solo ayuden a convertirse en una política de concurrencia implícita. Las puertas de observación, intervención y resultado separadas Kubernetes documenta las sondas de inicio, preparación y vitalidad por separado porque responden a preguntas diferentes y desencadenan diferentes acciones. Su documentación también advierte de que una mala regla de vida puede convertir los reinicios bajo carga en un fracaso en cascada. Un perro de vigilancia con agente AI necesita una separación equivalente, con una puerta de salida adicional. Puerta de observación: ¿Es la evidencia lo suficientemente fresca como para clasificar la carrera? Compruebe el sello de tiempo del observador, la accesibilidad del agente, el recibo de progreso, los metadatos de espera y el estado terminal actual. Un tiempo de espera o una muestra faltante da uncertain ; no demuestra que stuck . Puerta de intervención: ¿Es una acción justificada y autorizada? Un perro de vigilancia que sólo lee puede informar de una credencial obsoleta, una espera sin propietario, o diez minutos sin progresos útiles. No puede inferir permiso para reiniciar, cancelar, editar archivos, enviar mensajes o gastar más presupuesto. Dar a cada acción permitida su propia prueba, tiempo y costo límite. O puerta de salida: ¿El trabajo solicitado ha aprobado su verificador? Un estado de proceso terminal es sólo evidencia de actividad. Para una tarea de código, el recibo puede combinar un compromiso esperado, una prueba específica limpia y una captura de pantalla requerida. Para una tarea de publicación, podría requerir paridad de API, una página HTTP 200, inclusión de sitemap y activos renderizados. Para un efecto secundario externo, puede necesitar un registro de lectura de destino o de idempotencia. La guía SRE de Google hace la misma distinción práctica de otra dirección: las señales de la caja blanca explican los elementos internos, mientras que las comprobaciones de la caja negra exponen el contenido incorrecto que un estado de protocolo exitoso no puede detectar. El perro guardián debe conservar ambos. Los registros pueden explicar por qué la carrera se detuvo; el recibo de resultados determina si la solicitud del usuario fue satisfecha. Usar una regla estatal que preserve la incertidumbre El siguiente orden es importante. La propiedad y la frescura vienen antes que el progreso. Un auto reporte terminal viene antes que un temporizador de espera genérico, pero aún así no evita la verificación. La actualidad de la observación de dos minutos y la ventana de progreso de diez minutos son valores fijos, no valores predeterminados universales. Derivarlos del flujo de trabajo. Una implementación que normalmente produce un hito cada cuarenta minutos necesita una ventana de progreso diferente de una ejecución de codificación interactiva que cambia archivos cada minuto. Ejecutar la regla contra los casos que varían una condición a la vez: El caso Pruebas cambiadas El veredicto La próxima acción restringida Nuevos avances Nuevo hito de la prueba working Observe más tarde. Propiedad de la espera Propietario y plazo futuro waiting Notificar el plazo cercano Esperar sin propiedad No hay propietario ni fecha límite needs human Asignar a ambos Correr en retraso No hubo progreso durante 18 minutos. stuck Preparar un diagnóstico Observador inmóvil La última observación es de cuatro minutos. uncertain Pruebas de actualización Perros de vigilancia duplicados Dos identidades de perro de vigilancia en vivo conflict Elegir un propietario Se informó que se ha hecho No hay recibo de resultado audit required Verificar el artefacto Verificado hecho Pases de recibo complete Contrato de arrendamiento En la fijación ejecutable utilizada para este artículo, se aprobaron las ocho clasificaciones esperadas. Dos comparaciones son especialmente útiles. El nuevo progreso con un observador vivo es working ; la misma evidencia con dos identificadores de observador vivo es conflict . Un auto reporte completado con un recibo faltante es audit required ; añadir un recibo verificado es el único cambio necesario para llegar a complete . Elige la cadencia de los cambios esperados de la evidencia Las votaciones más rápidas no necesariamente detectan el fracaso antes. Puede crear costos, ruido, presión de límite de tasa y juicios repetidos sobre datos inalterados. Establecer la cadencia de las pruebas de la tasa de cambio esperada y de las consecuencias del retraso. Para una larga carrera de investigación, una observación de cinco minutos puede ser razonable si los hitos normalmente llegan cada quince minutos. Un producto de entrega programado se verifica alrededor de su inicio esperado y fecha límite, no las encuestas constantes todo el día. Una espera de aprobación humana necesita un propietario nombrado y una fecha límite para la escalada; llamadas repetidas todavía esperando no agregan información. Un calendario útil tiene cuatro números: Intervalo de observación cuando se actualice la accesibilidad y el estado; límite de frescura cuando las pruebas propias del observador se vuelvan inutilizables; ventana de progreso el espacio normal más largo entre hitos significativos; Acción refrigeración el retraso mínimo antes de otra intervención autorizada. Graba la última evidencia hash así como la timestamp. Las nuevas líneas de registro no son necesariamente un nuevo progreso. Una llamada repetida a la herramienta, un fallo de ensayo inalterado o un proyecto idéntico regenerado no deben restablecer el reloj de progreso simplemente porque el proceso está activo. El incumplimiento razonable de recuperación sigue siendo el primer informe. Si la carrera es stuck , prepare un diagnóstico o empuje limitado. Si se trata de waiting , envía la decisión al propietario designado. Si es uncertain , recoge pruebas mejores. Si es conflict , retire a los supervisores adicionales. Sólo una política aprobada por separado debe permitir un reinicio reversible, y el organismo de vigilancia debe verificar los progresos útiles posteriormente. Mantenga el perro vigilante más pequeño que el trabajo Un agente de vigilancia no debe convertirse en un segundo tiempo de ejecución, un revisor sin restricciones, y un arreglador autónomo a la vez. Sus entradas mínimas útiles son la solicitud original, cambios posteriores en el alcance, una identidad de ejecución estable, evidencia de progreso fresco, propiedad de espera, estado terminal y un verificador de resultados específico de la tarea. Todo lo demás debería ganarse el costo de la recolección. Este diseño tiene un límite: la telemetría genérica no puede ser un producto arbitrario. Alguien debe definir lo que significa "hacido" para la tarea. Cuando no existe una verificación determinista, el perro de vigilancia puede dirigir el resultado a un humano o a un juez de escaso alcance, preservar la evidencia y etiquetar la confianza. No debería producir un estado verde. El territorio del producto destinado a Sidewisp es la capa de salud alrededor de los agentes existentes: accesibilidad, progreso útil, espera, herramientas, resultados y límites de recuperación seguros. Sidewisp se encuentra actualmente en versión preliminar privada. Su motor de monitoreo de producción y los adaptadores de tiempo de ejecución no se envían generalmente, por lo que el contrato en este artículo es un patrón operativo que puede implementar en su tiempo de ejecución actualno una afirmación de que Sidewisp ya vigila o repara agentes en vivo. Comience con una carrera y un observador. Requerir un contrato de arrendamiento, mantener la observación de lectura, preservar uncertain , y definir el recibo de resultado antes de que comience el trabajo. Eso es suficiente para que un agente de vigilancia sea útil sin dejar que la supervisión se convierta en otra fuente de fracaso. Fuentes Builder.io agente perro de vigilancia README en el cometido 51bb048 Kubernetes: vigilancia, preparación y pruebas de inicio Google SRE Book: Monitoreo de los sistemas distribuidos