2026-08-01T19:16:18.023Z

AI 에이전트 루프에 대한 관찰성: 진전에 대한 테스트 반복

반복되고 흔들리는 동작 루프를 발견하는 실행 가능한 6 케이스 탐지기가 페이지화 된 진행, 제한된 백카프, 승인을 기다리는 또는 증거가 부족한 것을 표시하지 않습니다.

반복된 도구 호출은 AI 에이전트를 막아줄 수 있는 것만으로는 충분하지 않습니다. 정상화된 액션 시퀀스가 반복될 때만 루프를 표시하고, 작업에 대한 구체적인 증거가 변하지 않으며, 선언된 의존성이나 정책 내 재실험은 반복을 설명하지 않습니다. 이 규칙은 A A A A 및 A B A B 사이클을 모두 페이지화, 백오프 또는 승인을 기다리는 오류 없이 잡습니다. 실질적인 최소한은 네 가지 종류의 증거를 포함하는 관찰 창입니다. 안전 행동 서명, 진전 지문, 재실험 정책 사실 및 의존 임대 계약. 진단에 대한 원료의 흔적을 유지하지만, 전화 수표나 기간 성공이 건강 판결이 되지 않도록하십시오. 반복된 호출은 활동이고 아직 순환이 아닙니다. 요원 러닝타임은 이미 상세한 활동을 드러내고 있습니다. OpenAI 에이전트 SDK 추적 문서는 세대, 함수 호출, 경비선, 핸드오프 및 사용자 지정 범위를 나열합니다. 현재 OpenTelemetry GenAI 에이전트 랜딩 컨벤션, 개발이라는 표기판은 에이전트 및 작업 흐름, 기획 및 실행 도구를 호출하는 작업을 설명합니다. 그 기록은 작전이 실행되었는지, 얼마나 오래 걸렸는지, 오류가 발생했는지 여부를 확인할 수 있습니다. 그들은 당신의 작업에 유용한 움직임이 무엇을 의미하는지 정의할 수 없습니다. fetch page 에 대한 네 번의 호출은 네 개의 다른 결과 페이지를 수집할 수 있습니다. 동일한 정상화된 질의와 동일한 승인된 증거와 같은 search 에 대한 네 번의 호출은 루프일 수 있습니다. 이 두 예제에서 작업 이름은 동일합니다. 각각의 결과적 사건에 대해 두 개의 값을 도출하여 시작하십시오. 가치 예제 목적 actionSignature search:topic:timeout 휘발성 필드 제거 후 의미 작용을 비교합니다 progressFingerprint brief:sha 4 작업 후 작업 증거의 안전한 투영을 기록합니다. 행동 서명에는 행동의 의미를 변화시키는 주장이 보존되어야 하며, 소음만 일으키는 값을 버려야 한다. 페이지 토큰, 목적지 클래스, 정상화된 질의, 도구 이름 및 권한 범위를 행동에 영향을 미치면 유지하십시오. 요청 ID, 벽 시계 시간표, 무작위 씨앗, 추적 ID 및 JSON 키를 다시 순서대로 제거하면 그렇지 않습니다. 진보의 지문으로서는 별도의 질문에 답합니다. 이 단계가 도움이 된다면 어떤 지속 가능한 관찰이 달라질까요? 코드 에이전트에서, 그것은 목표 테스트 결과와 가성적인 Git 트리 소화가 결합될 수 있습니다. 연구실험에 있어서, 그것은 승인된 소스 ID와 짧은 소재를 포함할 수 있습니다. 출판업에서는 콘텐츠 소재, 공공자원 아이디, 확인 상태를 결합할 수 있습니다. 모델이 진전을 했다는 말을 사용하지 마십시오. 가장 짧은 순환을 찾아서 그 효과를 시험해 보세요. 유용한 첫 번째 탐지기는 짧은 반복 기간으로 완전한 행동 창을 설명할 수 있는지 여부를 묻습니다. 다음 함수는 1~3기를 검사하며 적어도 2번 반복이 필요합니다. search, search, search, search 에 대해서는 1단계를 반환합니다. search, read, search, read, search, read 에 대해서는 2단계를 반환합니다. 인접한 복제 카운터는 첫 번째 순서를 잡지만 두 번째 순서를 놓친다. 주기율만으로는 여전히 정지하지 않습니다. 진전 발자국과 함께 기간을 평가한다. 질서가 중요해요 액션 창을 해석하기 전에 접근성을 확인하십시오. 의존성을 존중하는 것은 소유자의 이름을 지고 만연한 기간이 있는 경우에만 가능합니다. 루프를 계산하기 전에 완전하고 안전한 증거를 요구하십시오. 실종된 지문이란 progress을 추론할 수 있는 권한이 아니라 uncertain 를 생성합니다. 저는 그 결정 명령을 한 고정된 관찰 시간에 6개의 합성 스냅샷에 반해서 재생했습니다. 사건 순서 또는 상태 결과 카탈로그 페이징 네 개의 다른 페이지 서명; 지문 50 줄에서 182 줄까지 증가합니다 working 공급자 백코프 3개의 동일한 호출, 재발전 가능한 오류, 2s의 지연, 4s의 지연 retrying 같은 호출 루프 4개의 동일한 검색, 변함없는 증거 소화 stuck loop , 분기 1 검색/읽기 기동 A/B 쌍의 3번 반복; 변경되지 않은 짧은 소화 stuck loop , 제2항 승인 대기 반복과 명명 소유자 및 미래 연장 waiting 다시 작성된 증거 반복된 글쓰기, 하지만 안전한 진보의 지문 uncertain 유물 명령은: 6개의 통과된 주장, 0개의 실패, 그리고 정확히 두 개의 의도된 루프 케이스를 반환했습니다. 이것은 규칙에 대한 거짓된 단위 시험이고, 이러한 비율이 생산에서 발생한다는 증거가 아닙니다. 한정된 재시험, 페이지화 및 루프 버킷에서 기다림 재시험 증거는 카운터 이상의 것이 필요합니다. 오류 클래스, 적용되는 정책, 시도 번호 및 실제 지연을 기록하십시오. AWS 단계 기능 오류 처리 문서는 이 계약의 구체적인 예시를 제공합니다. 레트리어는 이름 오류와 일치하며 IntervalSeconds , MaxAttempts , 그리고 BackoffRate 를 포함한 필드를 사용합니다. 이룰 수 있는 교훈은 명시적인 한계이며 단계 함수를 사용해야 하는 요구가 아닙니다. 이 장치에서 3명의 공급자가 rate limit 남아 있는 것 retrying 오류가 허용되기 때문에, 재실험 수치는 정책 안에 있으며, 관찰된 격차는 예상되는 2초의 후 4초의 백오프를 만족합니다. 탐지기는 1기 주기를 계산하지만, 재시험 증거는 우선입니다. 오류가 되돌릴 수 없게 되고, 지연이 붕괴되거나 시도 예산이 채우면 그 예외는 더 이상 적용되지 않습니다. 페이징은 다른 보호가 필요합니다. 요청된 슬라이드를 변경할 경우 커서나 페이지 토큰을 정상화하지 마십시오. 더 중요한 것은 그 효과를 확인하는 것입니다. 도구는 목적지가 변하지 않는 동안 다른 커서 문자열을 통해 순환 할 수 있으므로 진행 델타가없는 논쟁 변이는 약한 증거입니다. 대기에는 자유 텍스트 상태가 아닌 임대 계약이 필요합니다. 그 기간이 지나면 남은 증거로부터 재분류를 해야 합니다. 신축을 제한하고 소유자를 유지하십시오. 그렇지 않으면 에이전트가 입력 메시지를 무한히 업데이트하는 를 기다리고 있는 루프를 숨길 수 있습니다. 작업 주변의 관찰 창을 캘리버링 이 기기는 최대 6개의 액션 이벤트를 사용하며 최대 3개의 기간을 검색합니다. 이러한 값은 예를 검사할 수 있게 해줍니다. 그들은 보편적인 생산 부실이 아닙니다. 작업 흐름의 정상적인 리듬과 가장 짧은 해로운 순환에서 창을 선택하십시오. 인터랙티브 코딩 에이전트는 몇 분 이내에 잘못된 읽기/편집/테스트 패턴을 반복할 수 있습니다. 일 시간 후에 정해진 연구 대리인은 정당한 이유로 원천을 다시 방문할 수 있습니다. 경고를 첨부하기 전에 역사적인 건강 및 사고 재현을 사용하여 탐지 지연 및 거짓 긍정적 인 결과를 측정하십시오. 모든 전환을 재현하기 위해 충분한 증거가 지속됩니다. 핵심 소화 또는 비 민감한 투영을 저장할 때 근본적인 증거는 고객 데이터, 명령어, 비밀 또는 절대 경로를 노출시킬 수 있습니다. 서명 정상화와 지문 정의 버전. 변경된 정상화는 갑자기 회복되거나 사고로 보일 수 있습니다. 국가 전환에 대한 경고, 반복되는 모든 기간이 아닙니다. 소음거래기에는 같은 주기로 연속적으로 두 개의 창이 필요하며 변하지 않는 증거가 필요합니다. 그 히스테리스는 결정적인 결과 실패 또는 어려운 허가를 잃는 것을 지연시키지 마십시오. 진단도 개입을 허용하지 않습니다. stuck loop 의 발견은 한 번의 제한된 추진을 준비하거나 검증된 탈피 과정을 중단하거나 인간 검토를 요청하는 것을 정당화 할 수 있습니다. 다시 시작하거나 신분 변경, 삭제, 외부 메시지 또는 무한한 재 시도를 묵묵히 허용하지 않습니다. 승인된 모든 조치 후, 회복을 선언하기 전에 새로운 진전 지문 또는 검증된 결과를 요구하십시오. 이 탐지기가 무엇을 확인할 수 없는지 알아 빈약한 발자국으로 건강한 작업이 눈에 띄는 루프로 변할 수 있습니다. 파일 이름만 해시하면 기존 파일의 유용한 편집이 사라집니다. 시간표가 포함되면, 변경되지 않은 작업은 신선한 것처럼 보입니다. 무작위적인 행동 서명은 새로운 ID 또는 재편된 주장 뒤에 안정적인 의미적 순환을 숨기고 반대 실패를 일으킬 수 있습니다. 어떤 유용한 작업은 단조로운 것이 아닙니다. 연구 에이전트는 가설을 거부하고 이전 원천으로 돌아갈 수 있습니다. 코딩 에이전트는 깨진 접근 방식을 되돌릴 수 있습니다. 모든 카운터가 상승해야 한다고 가정하는 대신 중요한 전환이나 받아들여진 증거 변경을 유지하십시오. 또한 짧은 기간은 의도적으로 제한됩니다. 6단계 순환은 최대 3단계로 감지되지 않습니다. 창과 기간의 천장을 늘리는 것은 커버링을 향상시키지만 기억력을 잃게 하고 판결을 늦추고 우연한 반복의 가능성을 높인다. 알려진 사건에 대한 캘리브레이션, 그리고 증거가 안전한 결론을 뒷받침할 수 없을 때 uncertain 를 유지하십시오. 운영 규칙은 좁습니다. 반복된 활동은 정상화된 순서가 주기적이면, 유용한 증거가 변하지 않고, 유효한 재실험 또는 의존 계약이 설명되지 않을 때만 루프 판례가됩니다. 이것은 빈번한 흔적을 검사할 수 있는 진단으로 바꾸기에 충분합니다. 반복되는 모든 도구 호출이 깨진 것처럼 하지 않고요. Sidewisp는 현재 비공개 프리뷰 단계입니다. 공공 사이트와 기사 라이브러리는 실시간이지만 생산 에이전트 건강 수집, 런타임 어댑터 및 복구 일반적으로 배송되지 않습니다. Sidewisp는 기존의 실행 시간과 함께 건강 계층을 추가하고, 이를 대체하거나 자율 고정 장치로 작용하는 것이 아닙니다. 만약 루프 증거가 명확하게 볼 필요가 있는 오류 모드라면, 현재 제품을 보시는 대신 초기 접근에 참여할 수 있습니다.