# 베이스라인 관찰 독립 에이전트 반복 테스트 전 단계에서, 이전 대화와 결과에서 실제로 문제가 된 표현을 실패 사례로 고정한다. | 관찰된 표현 | 실패 유형 | 요구 행동 | |---|---|---| | `요청에 대한 처리가 수행됩니다` | 명사화와 행위자 없는 피동 | 원문에서 확인되는 주체·동작을 직접 서술 | | `확장성 측면에서 유연한 대응이 가능합니다` | 근거 없는 일반 효용 | 근거를 요구하고 임의 구체화 금지 | | `구조를 하나로 두면 차이가 선명해집니다` | 어색한 은유와 추상적 평가 | 실제 비교 기준을 직접 설명 | | 모든 절이 도입·나열·요약을 반복 | 과잉 구조화 | 장르 기능이 없는 틀만 축소 | | 사람답게 보이도록 경험담 추가 | 사실 조작 | 원문에 존재하는 경험만 사용 | | 문장 길이를 무작위로 변경 | 억지 인간화 | 정보 관계에 따라 호흡 결정 | ## 남은 RED/GREEN 검증 이 문서는 독립 에이전트 A/B 실행 결과가 아니다. 배포 전 다음을 수행한다. 1. 스킬 없는 새 컨텍스트에서 압박 시나리오를 5회 이상 실행한다. 2. 의미 변형, 임의 구체화, 경험 창작과 전역 치환을 기록한다. 3. 스킬을 적용한 새 컨텍스트에서 같은 입력을 반복한다. 4. 평가자가 조건을 모른 채 결과를 비교한다. 5. 새 우회 행동을 회귀 사례로 추가한다.