게임 AI / 관측과 실행

명령 성공이 목표 완료는 아닙니다

받은 관측과 현재 월드를 나누고, 일부만 실행된 행동의 다음 단계를 확인하세요.

관측 나이 / 실행 명령—
실제 완료 상태—
에이전트의 보고—

관측을 캡처하고 한정된 행동을 실행합니다.

원인과 해결

명령 성공이 목표 완료는 아닙니다

기본 설정에서 한 사이클을 실행하세요. 전투로 바뀌었는데 명령 수신만 확인하면 잘못된 완료 보고가 나옵니다. 설정의 검증 정책으로 비교하세요.

문제 · 서로 다른 세 가지 성공

명령 전달 성공, 월드의 실제 변화, 목표 완료는 별개의 사건입니다. 캡처 시각을 가진 관측은 판단하는 동안 낡습니다. 여기서는 3틱째 전투가 시작되고 전투 맵에서 이동 입력은 좌표를 바꾸지 않습니다.

해결 · 관측과 실행 결과 연결

검증 정책은 요청 직전 맵을 확인하고 이동 중 맵 전환에도 중단합니다. x=8에 도착한 실제 상태로 소포 전달을 판정합니다. 완료 후에는 이전 이동을 반복하지 않습니다. 관측 나이는 판단 시각−캡처 시각이며 지연 슬라이더가 이 차이를 만듭니다.

부분 성공과 동시 작업

벽은 처음에 6개만 놓입니다. 자원 +4 후 전체 목록을 재시도하면 처음 6개의 중복 명령이 실행 예산을 소모합니다. 변경분 재시도는 남은 4개를 놓습니다. 되돌리기는 작업 직후의 값과 버전이 현재와 같은지 확인해 다른 작업의 나무를 보호합니다.

대가와 범위

짧은 행동은 중간 변화에 대응하기 쉽지만 관측·계획 호출이 늘어납니다. 이 실험은 결정적 격자 실행기와 상태 모델이며 LLM을 호출하지 않습니다. 월드 내부 상태를 읽으므로 외부 게임의 화면 인식과 같은 완료 보장으로 해석하지 않습니다.

Pokemon Red AI 제작자 · 계획과 결정적 실행 구조 ↗Mindcraft · 계획과 게임 실행 구성 ↗