2026-08-01T19:16:35.918Z
AI Agente Salud por tiempo: Construye un presupuesto por plazo
Propagar un plazo de extremo a extremo, reservar tiempo de limpieza y verificación y distinguir el riesgo de tiempo de espera del progreso del agente AI estancado.
Un año AI El agente necesita uno . plazo de ejecución absoluto , no un nuevo tiempo fuera para cada modelo de llamada y herramienta. Antes de cada etapa costosa, calcular: Continuar sólo cuando el presupuesto restante cubra el presupuesto requerido y los progresos útiles siguen cambiando. Si la carrera tiene 75 segundos restantes, pero necesita 90 segundos de trabajo más 15 segundos para cancelar, reconciliar los efectos secundarios y verificar el resultado, ya está en timeout risk incluso mientras los estallidos y los latidos cardíacos permanecen frescos. Este es el papel práctico de la observabilidad del agente AI consciente de los plazos: mostrar si la carrera actual todavía puede proporcionar un resultado verificado dentro de su límite temporal. Un tiempo fuera en una llamada es simplemente un límite local. No demuestra que el trabajo infantil se haya detenido, que un nuevo intento sea seguro o que exista el resultado solicitado. Dar a toda la carrera un presupuesto de tiempo reducido El GRC define un plazo como el punto después del cual un cliente no está dispuesto a esperar. Su documentación recomienda plazos explícitos y realistas porque ningún plazo puede dejar a un cliente esperando indefinidamente. También distingue un plazo de un tiempo de espera: el plazo es un punto absoluto en el tiempo, mientras que un tiempo de espera es una duración máxima que se puede convertir en un plazo cuando comienza la llamada. Esa distinción importa en una carrera de agentes. Considere un trabajo con un plazo de cinco minutos para el usuario: 1. La planificación toma 40 segundos. 2. Una llamada modelo toma 55 segundos. 3. Una herramienta espera en cola durante 70 segundos. 4. El agente inicia otra herramienta con su habitual tiempo de dos minutos. La cuarta etapa puede configurarse correctamente localmente, pero sólo quedan 135 segundos antes de que se contabilice la validación y limpieza del resultado. El inicio de una nueva llamada de dos minutos ha asignado silenciosamente casi todo el presupuesto residual. Comenzar otro nuevo tiempo después de eso extendería el trabajo más allá de la promesa hecha al usuario. Llevar un valor deadlineAt durante la carrera. En cada límite infantil, obtenga un tiempo local más corto del presupuesto restante. Nunca restablezca la fecha límite original. Las directrices de propagación de gRPC describen el mismo principio de fiabilidad para los árboles de RPC: pasar el plazo de la llamada a la baja y deducir el tiempo ya transcurrido, en lugar de conceder a cada niño un nuevo intervalo completo. Mantenga el historial médico pequeño e inspectable: El campo Lo que establece Lo que no puede establecer deadlineAt El último final aceptable de la carrera Ese trabajo infantil honrará la cancelación estimatedRemainingSeconds Estimación actual del trabajo útil dejado Que la estimación cubre una rama invisible cleanupMarginSeconds Tiempo reservado para la cancelación y la verificación Esa limpieza está limitada en todos los proveedores lastProgressAt Frescura del movimiento específico de la tarea Esa actividad produjo el resultado correcto progressChanged Cambios en un hito o huella digital inspectables Que el resultado final es correcto terminal El tiempo de carrera terminó su camino Que el entregable existe outcomeVerified Se ha aprobado un control de aceptación externo Que todas las expectativas no declaradas se cumplieron El campo de progreso debe reflejar el trabajo y no el tráfico genérico. Una digestión de artefactos canónicos, el resultado de la prueba, la identificación del objeto de destino, el recuento de filas o un hito monótono pueden mostrar movimiento útil. El recuento de tokens, el volumen de registro y los totales de llamadas de herramientas muestran actividad pero pueden aumentar durante un bucle. Prueba de la regla del plazo contra seis casos límite El artefacto que acompaña fija el tiempo de observación y ejecuta seis instantáneas sintéticas a través de un clasificador determinista: La carrera producida: fresh build tiene 180 segundos restantes. Su trabajo restante es de 90 segundos, su margen de limpieza es de 15 segundos, y su huella digital cambió hace 30 segundos. El presupuesto requerido es de 105 segundos, por lo que la carrera sigue siendo factible y el clasificador devuelve working . slow export también ha cambiado recientemente el progreso, pero sólo quedan 75 segundos. La misma estimación de trabajo de 90 segundos más el margen de 15 segundos requiere 105 segundos. La actividad es saludable; la viabilidad no lo es. El veredicto correcto es timeout risk , no working y aún no deadline exceeded . quiet retry muestra un fallo diferente. Le quedan 300 segundos y sólo necesitan 150, así que su fecha límite de cálculo pasa. Sin embargo, su evidencia de progreso útil es de 1.200 segundos y no ha cambiado más allá de la ventana de espera de 600 segundos de la fijación. Vuelve a stalled . Añadir más tiempo no abordaría la evidencia de que la carrera se repite sin movimiento. legacy task no tiene fecha límite ni estimación del trabajo restante. La actividad nueva no puede reparar la evidencia de tiempo faltante, así que se mantiene uncertain . expired call está diez segundos más allá de su plazo absoluto y devuelve deadline exceeded . published report se convierte en complete sólo porque la ejecución terminal está emparejada con una verificación de resultados independiente. La orden de decisión es deliberada: 1. Acceptar complete sólo con ejecución terminal y resultado verificado. 2. Cuando haya pasado el plazo absoluto, devuelva deadline exceeded . 3. Regresar timeout risk cuando el tiempo restante no pueda cubrir el trabajo más el margen. 4. Regresa stalled cuando queda tiempo pero el progreso es anticuado e inalterado. 5. Solo devuelva working cuando la carrera sea factible y las pruebas se muevan. 6. Mantenga pruebas de tiempo faltantes o contradictorias uncertain . Este orden permite que una carrera en progreso sea poco saludable porque no puede terminar a tiempo, manteniendo una carrera estancada separada de un fracaso de presupuesto temporal. La fijación es una prueba de decisión inspectable, no prueba de que estos estados ocurren con la misma frecuencia. Su ventana de espera de 600 segundos y las estimaciones de tiempo son valores de política de ejemplo. Un adaptador real debe derivarlos de la clase de tareas y la distribución de duración observada. Propagar la cancelación así como el plazo Una fecha límite que impide que el padre espere no es prueba de que el trabajo infantil se haya detenido. gRPC señala explícitamente que las aplicaciones de servidor son responsables de detener la actividad que generaron después de la cancelación. Ese límite es especialmente importante para los agentes: una herramienta agotada puede seguir exportando datos, escribiendo un archivo, cobrando una cuenta o manteniendo una cerradura después de que el orquestrador haya pasado. Orientación de SRE de Google sobre fallos en cascada describe los plazos de RPC no cumplidos como trabajo perdido que puede invitar a retrasos y sobrecarga adicional. También explica que la cancelación de otro trabajo en un árbol de llamadas evita que los recursos se gasten en un resultado que ya no puede ser entregado. El operador de agentes debe aplicar el mismo principio sin suponer que todas las herramientas apoyan la cancelación de la cooperativa. Para cada etapa infantil: pasar el plazo absoluto cuando el protocolo lo respalde; de otra manera derivar childTimeout = deadlineAt now reservedMargin ; rechazar el inicio cuando el tiempo de espera derivado no sea positivo o sea poco plausible; propagar una señal de interrupción o cancelación; registrar si el menor reconoció la cancelación; conciliar los efectos visibles externamente antes de cualquier reanálisis; reservar tiempo suficiente para la verificación independiente de los resultados. Un evento compacto puede mantenerse libre de pedidos y respuestas: Una referencia opaca o con teclado es más segura que un identificador de usuario bruto o un camino del sistema de archivos. No envíe avisos, respuestas, credenciales, cargas útiles de herramientas o nombres sensibles de destino simplemente para calcular el estado de la fecha límite. La cancelación también necesita un límite de resultados. Si una solicitud de escritura se detiene después de salir del host, el servicio remoto puede haberlo cometido antes de que desapareciera la respuesta. Intentar de nuevo sólo después de comprobar una clave de idempotencia o consultar el destino. Un segundo intento dentro del presupuesto restante puede ser equivocado. Estimar el presupuesto sin pretender que es seguro El defecto razonable es estimar cada clase de tareas a partir de la duración observada de alto porcentaje, luego agregar márgenes explícitos para retraso en la cola, cancelación, reconciliación y verificación de resultados. Actualice la estimación cuando cambie la sucursal prevista. Una inspección de archivos y un conjunto de ensayos en todo el repositorio no deben compartir un tiempo de espera genérico. Mantenga la versión estimativa en la evidencia para que los operadores puedan explicar un veredicto. Alerta sobre transiciones como working → timeout risk en lugar de cada disminución del reloj. Si el reloj del colector está por delante del tiempo de ejecución, las edades negativas pueden invertir la decisión; registrar tanto el tiempo de observación como el tiempo de fuente, rechazar valores imposibles y preferir duradas monótonas dentro de un proceso. OpenTelemetry s AI observabilidad general del agente argumenta por rastros, métricas y registros interoperables a través de convenciones semánticas emergentes. Esas señales son entradas útiles, pero un período estándar no conoce el tiempo de finalización prometido por el usuario, qué artefacto cuenta como progreso o cuánto tiempo necesita la verificación de resultados. Estos siguen siendo contratos de nivel de tarea. El modelo también tiene límites difíciles. Las estimaciones de duración fallan en las nuevas formas de tareas. Los proveedores pueden ignorar la cancelación. Un niño puede terminar después de la fecha límite de los padres. La inclinación del reloj, la fila, los límites de velocidad o una rama no observada pueden consumir el margen. Por lo tanto, la salud de los plazos es una prueba con frescura y confianza, no una garantía. La regla reutilizable es estrecha: propagar un plazo de ejecución absoluto, gastarlo antes de cada etapa, reservar tiempo de limpieza y verificación y clasificar los progresos obsoletos por separado del tiempo insuficiente. La finalización todavía requiere el resultado previsto, no sólo un reloj parado. Sidewisp se encuentra actualmente en versión preliminar privada. Su sitio público y su biblioteca de artículos están en vivo, pero la colección de agentes de producción salud, adaptadores de tiempo de ejecución, monitoreo de plazos y recuperación generalmente no se envían. El Sidewisp está destinado a trabajar junto con los horarios de ejecución existentes y a mantener visible la autoridad humana. Si la fecha límite de fin a fin de salud es un fallo que necesita salir a la superficie, puede unirse a acceso temprano sin tratar este artículo como una reclamación de monitoreo desplegado.