2026-08-01T10:18:41.592Z
AI Empleo de agentes: Requiere cinco recibos antes de la producción
Transformar la accesibilidad, los permisos, los horarios, el retroceso y un resultado canario verificado en una puerta de salida/no salida limitada a la versión.
Un despliegue de agente AI está listo solo cuando cinco pruebas independientes coinciden sobre la misma versión: el tiempo de ejecución es alcanzable, su identidad tiene exactamente los permisos que requiere la tarea, el trabajo programado tiene un tiempo explícito y semántica duplicada, se puede restaurar una versión anterior y un canario produjo el resultado prometido. Un punto final saludable prueba sólo el primero de esos hechos. Utilice una puerta bloqueada por defecto. Atad todos los recibos a un inmutable digesto de liberación, graba cuando se comprobó, y deje de promover cuando la evidencia está faltando, anticuado, contradictorio, o pertenece a otra construcción. No promedies los cinco cheques en una puntuación de preparación. Un alcance de escritura faltante y un artefacto de cliente faltante son fallas diferentes con diferentes propietarios. Esta guía convierte esa regla en un manifiesto compacto y una fijación ejecutable de ocho casos. Es intencionalmente neutro en el tiempo de ejecución: adapta los nombres de campo a Kubernetes, una plataforma sin servidor, un cronista de agentes nativos o un proceso de host, pero mantenga las cinco preguntas separadas. Hacer que el despliegue sea una decisión de prueba limitada a la versión El despliegue de producción no es solo el momento en que una imagen o función llega a una plataforma de alojamiento. La guía de producción de Google identifica el estado de la sesión, la memoria persistente, la autenticación y los permisos de las herramientas, el registro y el despliegue en etapas de sandbox a canario a producción como preocupaciones específicas de los agentes. Esos son ingredientes útiles, pero una decisión de liberación todavía necesita evidencia de la construcción exacta que se está promoviendo. Comience con un identificador estable como un digesto de imagen, un comit de Git, un hash de paquetes o un identificador de lanzamiento firmado. Pon ese identificador en cada recibo. Una ruta puede responder desde la liberación v27 mientras se recoge una sonda de permiso o un resultado canario de v26 ; unir esos registros sin una clave de liberación crea un falso verde. La salud de las infraestructuras tiene un significado más estrecho. El Documentación de la sonda Kubernetes distingue la vitalidad, que puede desencadenar un reinicio, de la preparación, que controla si un contenedor recibe tráfico. Un proceso listo puede aceptar una solicitud mientras que su credencial de herramienta expira, su programador apunta a un viejo comando o su verificador de salida no tiene artefacto para inspeccionar. El manifiesto de liberación puede permanecer pequeño: El ejemplo almacena hashes e identificadores en lugar de instrucciones, contenido de transcripción, secretos o cargas útiles de herramientas crudas. La evidencia debe ser suficiente para decidir, no una excusa para copiar material sensible en un sistema de liberación. Recoge cinco recibos que responden a diferentes preguntas Los cinco recibos deliberadamente no son intercambiables. Recibo Prueba requerida Lo que no demuestra Accesividad La liberación exacta acepta el trabajo a través de la ruta prevista El agente puede terminar una tarea Las autorizaciones La identidad de tiempo de ejecución tiene todos y sólo los ámbitos declarados, con caducidad utilizable Se produjo un efecto herramienta Programación Zona horaria, próxima ocurrencia, fecha límite de incidencia, concurrencia y protección duplicada son explícitos La ocurrencia dio su resultado Rollo trasero Se restauró un objetivo conocido y se verificó de nuevo su resultado relevante. La nueva versión es correcta. El resultado Un canario creó el estado de destino esperado Las carreras futuras se mantendrán saludables Para los permisos, comparar conjuntos en lugar de preguntar si la autenticación tuvo éxito. La Definición del NIST de menor privilegio restringe un proceso a las autorizaciones y recursos mínimos necesarios para su función. La falta de autoridad bloquea la tarea; el exceso de autoridad amplía el efecto de una mala instrucción o de un nuevo intento. Ambos deberían bloquear la promoción hasta que el contrato declarado y la identidad desplegada coincidan. Para los agentes programados, graba la semántica real del programador. Kubernetes documenta .spec.timeZone , startingDeadlineSeconds , y concurrencyPolicy , luego advierte que un CronJob puede crear dos Trabajos o ningún Trabajo en algunas circunstancias. Por lo tanto, su Documentación CronJob recomienda puestos de trabajo idempotentes. Otro programador puede usar nombres diferentes, pero la puerta de liberación todavía necesita una respuesta para arranques tardíos, superposición, duplicados, suspensión y la próxima ocurrencia esperada. Un recibo de regreso es más fuerte que un código de salida de comando. El Documentación sobre el despliegue de Kubernetes expone el estado de implementación, las implementaciones atascadas y el retroceso a una revisión anterior. Eso confirma el estado de la plataforma. Para un agente, añade una prueba más: después de restaurar la digestión anterior, vuelva a ejecutar un canario seguro o inspeccione un resultado conocido específico de la tarea. De lo contrario, el rollback puede restaurar un proceso sin restaurar el trabajo útil. El recibo de resultados debe utilizar el oráculo práctico más fuerte: un objeto en su destino, una fila de base de datos con la clave de idempotencia esperada, una prueba de aprobación vinculada a la liberación o un registro de decisiones humanas seguido de un progreso observable. Un mensaje del agente que dice done es evidencia de actividad, no un entregable. Corre la puerta contra fallos inconvenientes El deployment readiness fixture.json que lo acompaña contiene ocho versiones. Todos los puntos finales están listos. Sólo un caso tiene cinco recibos frescos vinculados a sha256:agent v27 ; los otros siete aislan una falla diferente: una verificación de la accesibilidad obsoleta; un recibo de permiso de la publicación anterior; un alcance requerido que no se cumpla; el ámbito de aplicación del administrador de excedentes; un calendario sin protección contra efectos duplicados; un retroceso que no restableció el resultado esperado; Un canario que reportó éxito sin un artefacto. Ejecutar el clasificador y sus afirmaciones: El resultado observado es ocho puntos finales alcanzables, una liberación READY y siete liberaciones bloqueadas. La puerta devuelve el primer estado accionable en lugar de un porcentaje: Esta prioridad es importante. Si un recibo pertenece a un registro más antiguo, la inspección detallada de su resultado puede perder tiempo porque la evidencia no es admisible para la publicación actual. Una vez que la identidad y la frescura hayan pasado, el operador puede actuar en el límite específico: ajustar un alcance, reparar un horario, volver a ejecutar el simulacro de retroceso o implementar un verificador de destino. No convierta a unknown en pase. Si un sistema externo no está disponible durante el canario, el resultado es BLOCKED OUTCOME UNVERIFIED , no un éxito adivinado. Si la tarea no puede ser verificada deterministicamente, utilice una revisión humana limitada y guarde el recibo de decisión, la autoridad del revisor, la liberación de la digestión y el tiempo. Promover en etapas sin debilitar el contrato de pruebas El Guía de agentes de producción de Google Cloud recomienda la progresión de la caja de arena a la canaria a la producción. Mantenga los mismos cinco recibos en cada etapa; cambie la exposición permitida, no el significado de listo. En una caja de arena, el recibo de permiso puede utilizar cuentas sintéticas y el resultado puede dirigirse a un destino desechable. En el canario, envía una pequeña cohorte de fronteras, prohíbe acciones irreversibles a menos que se apruebe por separado y recoge el mismo recibo a nivel de destino. Antes de la promoción completa, actualice los controles de estado actual y confirme que el objetivo de retroceso sigue disponible. Elige ventanas de frescura de riesgo operativo. Un recibo de accesibilidad o permiso puede expirar en minutos; un simulacro de retroceso puede permanecer válido durante días si ni el mecanismo de despliegue ni el contrato de destino cambian. Reinicie el simulacro cuando cambie el tiempo de ejecución, la autoridad de la herramienta, el esquema de estado o la ruta de retroceso. Registra la regla junto al sello de tiempo para que sea inspectable y no subjetiva. Después de la promoción, estos ingresos se convierten en insumos de monitoreo, pero la decisión de despliegue y la salud continua no son el mismo sistema. Una liberación que haya pasado a las 21:00 puede perder una credencial a las 22:00 o perder una carrera programada a las 23:00. Preservar el manifiesto de liberación, luego evaluar las nuevas ocurrencias y resultados en sus propios plazos. Mantenga la frontera honesta Este dispositivo prueba la lógica de la decisión, no una plataforma en la nube en vivo. Los nombres de los permisos, los campos del programador, las ventanas de frescura, la seguridad de los canarios, la duración del retroceso y los oráculos de resultados deben adaptarse al entorno real. La estructura de cinco recibos es útil porque esas adaptaciones siguen siendo explícitas. Sidewisp se encuentra actualmente en versión preliminar privada. Por lo general, no se envían sus adaptadores de monitoreo de producción y sus sistemas de recuperación. La puerta de preparación descrita aquí es una práctica operativa local que los equipos pueden implementar hoy en día, no una afirmación de que Sidewisp actualmente despliega agentes, observa lanzamientos en vivo o realiza rollbacks. La cuestión relevante de la vista previa privada es si las pruebas de salud futuras pueden mantener la accesibilidad, la autoridad, los horarios, la recuperación y los resultados verificados separadossin convertir una verificación del proceso verde en un veredicto de producción.