AI 자율 개선 루프 (Phase 2-2)
AI가 테스트→로그 분석→개선→재테스트. 69판 전부 0% — TT 히트율 1% 미만, 폭 제한 회귀, 평가 개선은 턴 수만 향상(19.6→23.2)
AI 오목 엔진 개발 및 자율 개선 실험
단계별 결과를 쌓아가는 실험입니다.
현재 오목 실험 조건에서는 LLM 단독 구조보다 ThreatAnalyzer와 탐색 엔진을 결합한 구조가 더 오래 방어했지만, AI가 만든 Minimax 엔진은 Rapfi에 5:0으로 패배했고 자율 개선 루프도 승률을 높이지 못했습니다.
Evidence
Scope
현재 AI Omok 구현·평가 환경과 기록된 69판의 실험 범위
Confidence · limited
AI가 테스트→로그 분석→개선→재테스트. 69판 전부 0% — TT 히트율 1% 미만, 폭 제한 회귀, 평가 개선은 턴 수만 향상(19.6→23.2)
2026.08 · AI 자율 개선 루프 (Phase 2-2)
2026.08
AI가 테스트→로그 분석→개선→재테스트. 69판 전부 0% — TT 히트율 1% 미만, 폭 제한 회귀, 평가 개선은 턴 수만 향상(19.6→23.2)
2026.07
Minimax vs Rapfi(NNUE) 5:0 패배. NNUE 로드·유령 돌 등 버그 6종 수정 후 정상 결과 확인
2026.07
Deepseek가 1시간 만에 작성한 780줄 Minimax + Alpha-Beta 엔진. 유령 돌 버그 발견 및 수정, 최종 Rapfi 5:0
AI가 테스트→로그 분석→개선→재테스트. 69판 전부 0% — TT 히트율 1% 미만, 폭 제한 회귀, 평가 개선은 턴 수만 향상(19.6→23.2)
Minimax vs Rapfi(NNUE) 5:0 패배. NNUE 로드·유령 돌 등 버그 6종 수정 후 정상 결과 확인
Deepseek가 1시간 만에 작성한 780줄 Minimax + Alpha-Beta 엔진. 유령 돌 버그 발견 및 수정, 최종 Rapfi 5:0
LLM 혼자서는 RuleBot을 이기지 못했으나 ThreatAnalyzer 도구 연결 후 22턴 방어 성공