2026-08-01T13:20:00.464Z

Modèles de conception de l'agent AI: Choisissez par défaillance de contenu

Choisissez la topologie d'agent la moins complexe par les états d'échec qu'elle crée, puis demandez des reçus pour les étapes, les branches, les remises, les boucles et les résultats.

Les modèles de conception de l'agent AI doivent être choisis en fonction de la limite de défaillance que vous pouvez utiliser. Commencez par un appel de modèle direct ou un agent avec des outils. Ajouter des étapes séquentielles, des branches parallèles, des remises spécialisées ou une boucle d'examen uniquement lorsqu'une exigence de charge de travail mesurée justifie la nouvelle topologieet uniquement lorsque vous pouvez enregistrer les preuves dont la topologie a besoin. Cette réponse est moins glamour que d'attirer une flotte d'agents collaborateurs. Il est également plus facile de déboguer, moins cher à exécuter et plus difficile de confondre avec un système sain quand une partie du travail a disparu. La règle centrale est simple: Chaque nouvelle exécution crée une dette de preuve. N'ajoutez pas le bord jusqu'à ce que vous puissiez nommer son état de faux vert et le reçu qui le réfute. Cet article applique cette règle à six choix communs: un appel de modèle direct, un agent unique, un pipeline séquentiel, un ventilateur parallèle, une remise spécialisée et une boucle d'examen limitée. Il comprend un sélecteur déterministe joué contre six charges de travail. Commencez en dessous de agent à moins que la tâche ne gagne de l'autonomie Un diagramme d'architecture devrait commencer par le mécanisme le moins puissant qui puisse satisfaire le contrat de tâche. Une classification ou une traduction en une seule étape ne nécessite généralement ni outils ni boucle d'agent. La question de la santé est simplement de savoir si la production répond à une affirmation définie. Un seul agent devient utile lorsque la tâche est suffisamment ouverte pour nécessiter plusieurs décisions ou appels à l'outil. Un agent de soutien aux commandes, par exemple, peut interpréter une demande, récupérer une commande et composer une réponse. Il a toujours un propriétaire et un endroit pour vérifier le résultat. Cela est conforme aux directives officielles actuelles. Guide des modèles d'agents de Google Cloud dit de définir la complexité de la tâche, la latence, le coût et les exigences d'implication humaine avant de sélectionner un modèle. Il recommande de commencer par un seul agent au début du développement et note que les conceptions multi agents ajoutent des préoccupations d'évaluation, de sécurité, de fiabilité et de coûts. Le Centre d'architecture Azure recommande de même la plus faible complexité qui satisfait de manière fiable aux exigences; il appelle les modes de coordination, de latence et de défaillance supplémentaires dans les systèmes multi agents. Utilisez cette première limite de décision: Propriété de charge de travail Un défaut raisonnable Épreuves d'achèvement Une transformation limitée, pas d'outils Appel de modèle direct La sortie passe l'affirmation de tâche Plusieurs décisions au sein d'un même domaine Un seul agent avec des outils Les effets des outils requis et le résultat final sont vérifiés Étapes fixes avec des dépendances strictes Pipeline séquentielle Chaque étape consomme la version précédente attendue Les sous tâches indépendantes dont la latence est importante Ventilatrice parallèle Chaque branche requise est comptabilisée avant l'agrégation Routage dynamique entre domaines ou autorités distincts Transfert de spécialistes Un récepteur a accepté la propriété et peut reprendre à partir d'un curseur durable La révision doit se poursuivre jusqu'à ce qu'une condition mesurable soit maintenue. Boucle restreinte Les progrès ont changé, le vérificateur a passé, et le budget d'itération a été maintenu La table est par défaut, pas automatique. Un appel direct peut toujours être dangereux si sa sortie déclenche une action irréversible. Un seul agent peut encore être trop large s'il possède des dizaines d'outils avec des autorisations incompatibles. Le modèle suit la charge de travail et la limite de l'autorité. La retenue importante est d'éviter de considérer la décomposition comme une fiabilité libre. Le partage d'une tâche entre plusieurs composants peut améliorer la spécialisation, la latence ou l'isolement de la sécurité. Il crée aussi des états plus partiels. L'opérateur doit être en mesure de déterminer l'état de la course sans avoir lu un message final convaincant. Faites payer à chaque topologie sa dette de preuve Les directives de l'AWS décrit les modèles d'agents comme des blocs de construction réutilisables et composables. La réutilisation est précieuse, mais la composition change ce que signifie done. Une composante du rapport de réussite n'est que la preuve de l'activité. La question utile est de savoir si l'ensemble de la topologie a produit le résultat prévu. Sequence: prouver la chaîne, pas la dernière étape Un schéma séquentiel est approprié lorsque l'ordre des étapes fait partie de la correction: extraire, valider, approuver, puis publier. Le cas faux vert apparaît lorsqu'une étape ultérieure s'exécute après un échec d'une étape antérieure, utilise une sortie obsolète ou produit une version incompatible. Donner à chaque étape un reçu contenant au moins: l'identifiant d'exécution et l'identifiant d'étape; le reçu ou le hash d'entrée du prédécesseur; le hash de sortie ou l'ID d'effet durable; l'état terminal et le temps d'achèvement; l'affirmation qui permet la prochaine étape. La prochaine étape devrait rejeter un prédécesseur manquant ou inégalé plutôt que de deviner. Un événement final publier terminé ne peut pas réparer un reçu de validation absent. Parallèlement: congeler l'adhésion avant la fin du comptage Un déploiement parallèle est justifié lorsque les succursales indépendantes réduisent la latence ou recueillent des preuves distinctes. Son défaut caractéristique est un collecteur qui renvoie une réponse polissée alors qu'une branche requise est absente, dupliquée, tardive ou basée sur une entrée obsolète. Congeler un manifeste de branche avant expédition. Marquer les branches requises ou facultatives. Ensuite, définissez un quorum sur le manifeste gelé, pas sur les réponses qui arrivent. Le collectionneur a besoin d'identité de branche, de version d'entrée, d'état terminal, d'identité d'effet et de fraîcheur. Trois réponses reçues ne suffisent pas si quatre étaient nécessaires. Transfert: propriété de transfert, pas seulement le contexte Un transfert spécialisé est utile lorsque l'agent suivant a besoin d'un domaine, d'un ensemble d'outils ou d'une limite de permissions différente. Il échoue silencieusement lorsque l'expéditeur rapporte transféré mais que le destinataire n'a jamais accepté le travailou l'a accepté sans l'état requis pour continuer. Un transfert durable a besoin de deux côtés: 1. l'expéditeur enregistre le récepteur prévu, l'identifiant de travail, la version contextuelle et le résultat restant; 2. le destinataire enregistre l'acceptation, son époque de propriété et un curseur de CV. Jusqu'à ce que l'acceptation existe, le travail attend avec l'expéditeur. Après acceptation, seul le destinataire peut effectuer l'effet suivant. Cela empêche une lacune ambiguë et réduit le travail dupliqué après des essais répétitifs. Boucle: progrès budgétaire, pas seulement des itérations Une boucle de génération critique ou de réparation vérification est appropriée lorsque la qualité s'améliore grâce à une évaluation répétée. Ce n'est pas approprié simplement parce que le premier résultat pourrait être faible. La boucle doit avoir un signal de progression mesurable, un vérificateur et une condition d'arrêt. Le dossier: le nombre d'itérations et le maximum; la date limite et le coût restant; les empreintes digitales d'entrée et de sortie; un delta de progression spécifique au domaine; le résultat du vérificateur; raison de continuer, d'arrêter ou d'escalader. Une boucle qui répète une formulation différente sans modifier les tests, les contraintes ou l'artefact attendu est active mais ne progresse pas. Arrêtez le avant qu'il ne consomme le budget final nécessaire pour préserver les preuves, reculer, ou demander à une personne. Répétez une règle de sélection avant d'adopter le diagramme J'ai converti les limites précédentes en un petit sélecteur déterministe. Il préfère délibérément des modèles plus simples. La priorité est explicite de sorte qu'une charge de travail nécessitant un vérificateur itératif ne tombe pas accidentellement dans la catégorie séquentielle simplement parce que ses étapes ont un ordre. L'artefact complet utilise pattern cases.json , select agent pattern.mjs , et un rapport attendu. Faites le avec: La répétition de six cas a produit la parité prévue exacte: Charge de travail Modèle sélectionné Résumé requis Classifier un message Appel de modèle direct Affichage de l'entrée/sortie Recherchez un ordre et répondez Agents uniques Manifeste d'exécution, reçus de l'effet outil, affirmation du résultat Extrait, révision, publication Sequence Chaîne de réception en phase, version d'entrée, état d'arrêt sur défaillance Rechercher quatre sources indépendantes Ventilatrice parallèle Manifeste de branche gelée, quorum requis, affirmation agrégée Assistance en route à un spécialiste Transfert de spécialistes Résumé de l'acquisition, cursor de résumé, affirmation finale Réviser le code jusqu'à ce que les tests soient passés Boucle restreinte Budget d'itération, delta de progrès, verdict du vérificateur Toutes les six recommandations correspondent, et les six ont tous émis une obligation de preuve distincte. Ce second résultat importe plus que l'exactitude du sélecteur. Un nom de modèle sans contrat de réception est une préférence de conception et non une décision opérationnelle. Trois observations sont venues de la répétition. Premièrement, la topologie des cartes d'ambiguïté à l'ambiguïté de la preuve. Les étapes séquentielles créent l'ambiguïté de l'achèvement partiel; les branches parallèles créent l'ambiguïté de l'adhésion; les remises créent l'ambiguïté de la propriété; les boucles créent l'ambiguïté de la terminaison. Deuxièmement, la même affirmation finale reste nécessaire dans chaque modèle. Un manifeste complet de la succursale prouve la comptabilité de la succursale, et non que le rapport réuni ait répondu à la question du client. Un reçu de remise prouve la propriété, pas la livraison. Un verdict passager de critique ne prouve que les critères que le critique a réellement évalués. Troisièmement, les déclencheurs de la migration sont plus fiables que l'enthousiasme des modèles. Éloignez vous d'un agent lorsque les preuves montrent une surcharge d'outils, une limite de sécurité stricte, une latence indépendante ou une défaillance récurrente que la topologie plus simple ne peut contenir. Multi agent est plus évolutif n'est pas un déclencheur mesurable. Traiter le modèle comme un contrat d'exploitation Avant la mise en œuvre, écrivez un contrat d'une page pour le modèle choisi: IRésultat attendu: Quel artefact ou effet observable doit exister? AAutorité: Quel composant peut faire chaque changement réversible ou irréversible? Membre: Quelles étapes, branches ou spécialistes appartiennent à cette course? Progress: Quels changements se produisent lorsque des travaux utiles progressent? Attendez: Quelle dépendance ou décision humaine interrompt légitimement le travail? Failure: Quelle preuve distingue une erreur transitoire d'une course bloquée? Completation: Quelles vérifications déterministiques éliminent le travail? Budget: Qu'est ce qui limite le temps, les tentatives, les jetons et les effets secondaires? Puis injecter l'échec caractéristique de la topologie avant le lancement. Retirez un reçu d'étape séquentielle. Jetez une branche parallèle requise. Retardez l'acceptation de la remise. Retourner un artefact inchangé d'une itération de révision. Le système doit être bloqué, attendu ou incertain. Il y a ici une limite pratique. Le sélecteur ne peut pas établir que la description de votre charge de travail est correcte. Il ne mesure pas la qualité du modèle, la disponibilité des fournisseurs ou la fiabilité réelle d'un cadre. Un schéma de réception ne peut pas non plus prouver que sa mise en œuvre émet des événements véridiques. Valider le modèle choisi avec des fixations en forme de production, une injection de défaillance et des contrôles de résultats au niveau de la destination. La question de révision la plus sûre n'est donc pas Quel modèle de conception d'agent AI est le mieux? C'est: Quel est le modèle le moins complexe qui satisfait cette charge de travail, et pouvons nous prouver ses nouveaux états partiels sans inspecter le contenu privé? Si la réponse est un appel direct ou un agent, gardez le. Si la réponse est une topologie plus complexe, faites de ses reçus une partie de la conception plutôt qu'un projet de suivi ultérieur. Le Sidewisp est destiné à ajouter une couche de santé autour des temps d'exécution des agents existants, en accordant une attention particulière à la facilité d'accès, aux progrès utiles, au contexte, aux outils, aux résultats et au coût. Sidewisp est actuellement en préversion privée. Son site Web public et sa démonstration interactive sont en direct, mais la collection de produits et les adaptateurs de temps d'exécution ne sont pas expédiés dans le référentiel actuel du site Web. Si cette approche de la première preuve correspond à la façon dont vous voulez utiliser les agents, vous pouvez rejoindre la liste d'attente d'avant première privée.