2026-07-31T06:15:30.846Z

Testen Sie einen KI-Agenten in Agentforce Testing Center: Ergebnisbelege erforderlich

Verwandeln Sie separate Subagenten-, Aktions- und Antwortauswertungen in ein versioniertes Promotion-Gate mit Genehmigungs- und Zielergebnisbelegen.

Wenn Sie müssen Testen Sie einen KI Agenten in Agentforce Testing Center , verwenden Sie seine Subagenten , Aktions und Antwortbewertungen als drei separate Beweisstücke – nicht als ein einziges Freigabeurteil. Der sinnvolle Standardwert ist: Führen Sie positive und negative Fälle in einer Sandbox aus, fordern Sie neue Durchgänge für die erwartete Route und die erwarteten Aktionen und überprüfen Sie dann die Geschäftsauswirkungen vor der Beförderung unabhängig. Die letzte Quittung ist wichtig. Ein Agent kann den erwarteten Subagenten auswählen, die erwartete Aktion aufrufen und eine akzeptable Antwort erzeugen, während die beabsichtigte Datensatzänderung fehlt, dupliziert wird, auf den falschen Bereich angewendet wird oder noch auf Genehmigung wartet. Eine grüne Testzeile beweist, was diese Zeile auswertet. Es beweist nicht automatisch das Zielergebnis. Dieser Leitfaden verwandelt einen Agentforce Testlauf in ein Promotion Gate in acht Bundesstaaten. Das Gerät speichert keine Äußerungen, Antworten, Kundendaten oder Geheimnisse; Es behält nur die Status „Bestanden/Nicht bestanden“, „Aktualität“, „Genehmigungsstatus“ und ein Ergebnis Empfangs Urteil bei. Das Ergebnis des Testing Centers ist ein Beweis, nicht das Freigabeurteil Salesforce ist aktuell Prüfaufbaueinheit beschreibt Testfälle mit einer Äußerung, einem erwarteten Subagenten, erwarteten Aktionen und einer erwarteten Antwort. Es ist Ergebniseinheit Anschließend werden der eigentliche Subagent und die Aktionen sowie separate Subagenten , Aktions und Antwortauswertungen angezeigt. Diese Trennung ist nützlich, da jeder Fehler auf eine andere Reparatur hinweist: Fehler des Subagenten: Beim Routing wurde die falsche Verantwortungsgrenze ausgewählt. Aktionsfehler: Die Route war plausibel, aber die erforderliche Bedienung fehlte oder war unterschiedlich. Antwortfehler: Die Route und die Anrufe sind möglicherweise richtig, aber die Antwort hat nicht das erwartete semantische Ergebnis erfüllt. Reduzieren Sie diese Felder nicht auf einen einzigen Prozentsatz. Angenommen, ein Kontaktaktualisierungsfall besteht die Antwortauswertung, weil der Agent angibt, dass die Adresse aktualisiert wurde. Wenn die Aktionsauswertung fehlschlägt, ist der Satz kein Beweis dafür, dass der Schreibvorgang stattgefunden hat. Selbst wenn alle drei Bewertungen erfolgreich sind, ist ein Rücklesen des Zielorts immer noch der stärkere Beweis für einen Nebeneffekt. Die gleiche Vorsicht gilt auch für die Frische. Ein bestandener Lauf für Agent Version 12, Testsuite Revision 4 und die Aktionsmetadaten von gestern kann Version 13 nach einer Anweisungs oder Berechtigungsänderung nicht zertifizieren. Binden Sie jede Beförderungsentscheidung mindestens an Folgendes: Bewahren Sie die Quittung inhaltsfrei auf. Speichern Sie undurchsichtige Bezeichner, Versionen, Zeitstempel, Boolesche Werte und Hashes. Kopieren Sie keine Eingabeaufforderungen, Kundendaten, Anmeldeinformationen oder vollständige Modellantworten in einen Überwachungsdatensatz. Es gibt auch eine Sicherheitsgrenze, bevor ein Punktestand zählt. Salesforce ist aktuell Einheit zum Testen von Werkzeugen und Überlegungen warnt, dass Agententests CRM Daten ändern können, und weist die Bediener an, in einer Sandbox zu testen. Betrachten Sie das als eine harte Voraussetzung, nicht als Fußnote. Verwenden Sie dedizierte Vorrichtungen, umkehrbare Datensätze, Testidentitäten mit den geringsten Rechten und eine Bereinigungsüberprüfung. Ein erfolgreicher Test, der versehentlich die Produktion berührt hat, ist kein gesunder Test. Verwandeln Sie einen Testlauf in ein Aufstiegstor für acht Bundesstaaten Das diesem Artikel beigefügte inspizierbare Artefakt bewertet acht inhaltsfreie Fälle in einer strengen Reihenfolge. Diese Anordnung verhindert, dass eine nachgelagerte grüne Wiese einen früheren Fehler verbirgt: Zustand Beweis Betreiberentscheidung RUN INCOMPLETE Der Testauftrag wurde nicht abgeschlossen Warten; schließen Sie nicht auf Misserfolg oder Erfolg STALE RESULT Das Ergebnis überschreitet das akzeptierte Nachweisalter Führen Sie die Ausführung erneut mit den beabsichtigten Versionen durch SUBAGENT MISMATCH Die Auswertung des Subagenten ist fehlgeschlagen Reparaturroute, Umfang oder Testerwartung ACTION MISMATCH Die Aktionsauswertung ist fehlgeschlagen Überprüfen Sie Berechtigungen, Anweisungen und Aktionsplan RESPONSE MISMATCH Die Antwortauswertung ist fehlgeschlagen Antwortkriterien oder Antwortverhalten reparieren WAITING Eine rechtmäßige Genehmigung steht aus Benachrichtigen Sie den Eigentümer; Behalten Sie den Lebenslaufkontext bei OUTCOME UNVERIFIED Die Felder des Testzentrums sind bestanden, der Bestimmungsnachweis fehlt Lesen Sie die Wirkung vor der Promotion noch einmal durch HEALTHY Neue Erkenntnisse zu Route, Aktion, Reaktion und Ergebnis stimmen überein Erlauben Sie die begrenzte Beförderungsentscheidung Führen Sie das Artefakt mit Node.js aus: Die erwartete Zusammenfassung lautet: Das wichtige Experiment ist das letzte Fallpaar. Beide haben einen abgeschlossenen, neuen Lauf und bestehen die Subagenten , Aktions und Antwortbewertungen. effect unverified hat keinen Zielempfang und wird aufgelöst OUTCOME UNVERIFIED ; healthy Fügt ein verifiziertes Rücklesen hinzu und löst auf HEALTHY . Ein Feld ändert das Freigabeurteil. Diese Rücklesung sollte dem versprochenen Ergebnis entsprechen: Fragen Sie bei einem CRM Update den beabsichtigten Datensatz mit einer isolierten Testidentität ab und vergleichen Sie nur die erwarteten Felder. Überprüfen Sie für eine E Mail oder Benachrichtigung den Sandbox Postausgang oder den Anbieterbeleg und bestätigen Sie genau einen akzeptierten Effekt. Für eine Wissensantwort validieren Sie die erforderlichen Zitate oder Quellenangaben, anstatt Prosa Wort für Wort abzugleichen. Überprüfen Sie für eine Workflow Übergabe den dauerhaften Übergabedatensatz, den Besitzer, die Frist und das Fortsetzungstoken. Für eine Anfrage, die eine Genehmigung erfordert, protokollieren Sie diese WAITING ; Markieren Sie nicht, dass der Agent hängen bleibt, nur weil er ordnungsgemäß angehalten wurde. Dies ist bewusst kein universeller Evaluator. Der Klassifikator geht davon aus, dass Sie die aktuellen Ergebnisfelder von Agentforce Ihrem eigenen stabilen Empfangsvertrag zugeordnet haben. Es beurteilt nicht die sachliche Qualität, simuliert nicht jede Benutzerphrase und beweist nicht, dass eine Sandbox die Produktionsberechtigungen widerspiegelt. Es kann auch nicht über Ihre akzeptable Erfolgsquote entscheiden. In der Dokumentation von Salesforce wird darauf hingewiesen, dass generatives Verhalten probabilistisch ist und dass jede Organisation ihren eigenen Schwellenwert für die Produktionsbereitschaft definieren muss. Führen Sie die Übung durch und legen Sie dann die Produktionsgrenze fest Beginnen Sie mit einer hochwertigen Aufgabe, deren Ergebnis deterministisch überprüfbar ist. Beginnen Sie nicht mit tausend generierten Eingabeaufforderungen. Eine kleinere Suite mit vertrauenswürdigen Erwartungen wird mehr offenbaren als eine große Suite, deren erwartete Aktionen aus einem zufälligen Lauf kopiert wurden. 1. Frieren Sie die Testidentität ein. Notieren Sie die Agentenversion, Suite Revision, Aktionsmetadaten Revision, Berechtigungssatz Revision und Sandbox ID. 2. Definieren Sie positive und negative Fälle. Die Einrichtungsanleitung von Salesforce empfiehlt beides. Schließen Sie eine gültige Anfrage, eine ungültige Anfrage, eine unzulässige Anfrage, einen Fall mit fehlender Berechtigung und einen Fall mit erforderlicher Genehmigung ein. 3. In einer Sandbox ausführen. Reversible Aufzeichnungen säen und Bereinigung nachweisen. Abbruch, wenn die Umgebung oder Identität nicht eindeutig ist. 4. Sehen Sie sich die drei Bewertungen getrennt an. Reparieren Sie die früheste fehlerhafte Grenze. Durch das Umschreiben einer Antwort darf eine fehlende Aktion nicht verdeckt werden. 5. Lesen Sie das Ergebnis noch einmal durch. Verwenden Sie eine zielspezifische Behauptung mit einem Idempotenzschlüssel oder einem stabilen Testdatensatz. 6. Wiederholen Sie die gesunden Fälle. Ein einziger Durchgang deckt keine Wahrscheinlichkeitsschwankung auf. Halten Sie die Laufanzahl und das Konfidenzintervall sichtbar, anstatt Gewissheit zu deklarieren. 7. Bewerben Sie nur das angeheftete Artefakt. Wenn sich Anweisungen, Aktionen, Berechtigungen, Modellkonfiguration oder Testerwartungen ändern, verfällt die alte Quittung. 8. Überwachen Sie das Live Ergebnis separat. Eine Evaluierung vor der Produktion reduziert das Risiko; Es ersetzt nicht die Erreichbarkeit, den Zeitplan, den Wartezustand, die Erlaubnis, die Kosten oder den Lieferzustand nach dem Start. An dieser letzten Grenze weichen Agententests und Agentenzustand voneinander ab. Beim Testen wird gefragt, ob sich ausgewählte Szenarien akzeptabel verhalten, bevor eine Änderung gefördert wird. Operational Health fragt, ob der laufende Agent erreichbar bleibt, nützliche Fortschritte macht, seine Tools erreicht, Genehmigungsgrenzen respektiert und jetzt das erwartete Ergebnis liefert. Man braucht beides, aber das eine kann das andere nicht ersetzen. Sidewisp ist auf diese Betriebsgesundheitsebene ausgelegt: Beweisaktualität, nützlicher Fortschritt, Werkzeugzugriff, Warten versus Feststecken und überprüfte Ergebnisse. Sidewisp befindet sich derzeit in einer privaten Vorschauphase. Die öffentliche Website und die interaktive Demonstration sind live; Ein Produktions Agentforce Adapter, eine Live Überwachungs Engine und ein automatisierter Wiederherstellungs Executor werden nicht mitgeliefert. Der praktische Schritt heute besteht darin, den inhaltsfreien Beleg neben Ihrem Agentforce Testlauf aufzubewahren und die Beförderung abzulehnen, wenn das Zielergebnis noch unbekannt ist.