한 판의 오류가 연쇄 서비스 회귀를 드러내기까지
8월 30일, 지원하지 않는 덤이 든 한 판이 먼저 KataGo parameter 오류를 일으켰습니다. 같은 조사에서 비대해진 stream 완료 event, 가입 runtime 불일치, Token 반복 생성과 구형 client 동기화 실패도 발견했습니다. 시간선, 측정한 영향, 복구 증거와 남은 일을 공개합니다.
복기 가이드 3편, KataGo와 서비스 기술 글 8편, AI와 정석사 연구 특집 17편, 에도 시대부터 AlphaGo 시대까지 명국 12편을 합친 40편의 독립 글입니다. 각 글은 질문 하나를 단계, 자료와 집중된 시각화로 설명합니다.
8월 30일, 지원하지 않는 덤이 든 한 판이 먼저 KataGo parameter 오류를 일으켰습니다. 같은 조사에서 비대해진 stream 완료 event, 가입 runtime 불일치, Token 반복 생성과 구형 client 동기화 실패도 발견했습니다. 시간선, 측정한 영향, 복구 증거와 남은 일을 공개합니다.
LoGos는 구조화 바둑 data, 긴 reasoning과 RL을 섞어 프로급 착수를 보고합니다. 하지만 유창한 해설에도 판이나 engine이 지지하지 않는 atomic claim이 있을 수 있습니다. 문체 아닌 claim을 검증합니다.
ICML adversarial policy는 초인 설정 KataGo에 97% 넘게 이겼습니다. 더 강한 바둑이 아니라 systematic mistake를 유도했습니다. 평균 기력과 worst-case robustness는 다릅니다.
옛 AI 추천이 사라졌다고 반박된 것은 아닙니다. 타이밍 변화, search 불안정, training의 blind spot 수정일 수도 있습니다. 박물관은 예전 합리성과 뒤의 실효 이유를 보존합니다.
HumanSL은 기력별 인간 착수를 예측하지만 최대 확률, sampling과 목표 기력은 같지 않습니다. 교육은 AI와 가장 닮은 사람이 아니라 다음에 닿을 판단을 찾아야 합니다.
komi는 승패 경계를 옮기고 area, territory, ko, 자살과 tax rules는 끝내기 장부를 바꿉니다. 승률 이동보다 후보 순위가 어디서 교차하는지 봅니다.
공개 프로 기보 표본에서 맨 화점 이른 3·3은 2017년 9.72%에서 2018~2020년 40.06%로 늘었습니다. 채택률은 이 수법을 쓰는 기사가 늘었다는 뜻입니다. 덜 교환하고 손빼며 돌아올 타이밍까지 익혔는지는 실제 대국 내용에서 읽어야 합니다.
같은 국면도 네트워크, 엔진, 탐색량이나 대칭 방향을 바꾸면 첫 후보가 움직입니다. 분석 조건을 먼저 읽고 옛 결론을 유지·주석·퇴역 중 어디에 둘지 판단합니다.
이른 3·3이 바꾼 것은 한 귀의 답이 아니라 완성의 정의입니다. 세 수를 생략하고 끊는 자리를 남긴 채 다른 귀로 가는 편이 국부를 끝내는 것보다 효율적일 수 있지만 미완성의 뒷맛을 계속 관리해야 합니다.
1933년 신포석은 한 귀씩 끝내는 습관을 깼습니다. 중국식과 고바야시 포석은 더 나아가 변의 기존 돌이 걸침, 협공과 손빼기의 효율을 정석 시작 전에 매기게 했습니다.
슈사쿠 코스미는 시대 밖의 영원한 정답이 아닙니다. 덤 없음, 흑의 이해관계, 가문 연구와 이후의 덤을 판에 돌려놓으면 같은 좌표가 견실함에서 느림으로 갔다가 AI 뒤 다른 이유로 돌아오는 과정이 보입니다.
같은 프로 기보 50국과 500국면에서 AI의 1집 이내 좋은 수 집합에 대한 Human SL 중앙값은 9단 82.7%, 5단 77.5%였습니다. 차이는 실제지만 모든 국면에서 오르는 계단은 아닙니다.
프로 500국면, 강한 model 둘과 판 대칭 여덟 개는 탐색 증가가 보통 중앙 흔들림을 줄이지만 먼저 분열을 드러낼 수도 있음을 보여 줍니다. 좌표, 가치와 교육 label 안정성은 서로 다릅니다.
조와의 묘수, 귀를 붉힌 수, AlphaGo 37과 이세돌 78까지 열두 변화도는 같은 경계를 보입니다. 객관 가치, 실전 난도와 역사적 용기는 하나의 지표가 아닙니다.
프로 기보 50국, 500국면, 실제 검색 visits 397,561회, 대국 단위 bootstrap 10,000회, 그리고 여덟 가지 판 대칭에서 최대 8,192 visits까지 감사했습니다. 최선의 수뿐 아니라 인간이 왜 놓치는지, label이 안정적인지, 무엇을 가르칠 가치가 있는지를 측정합니다.
프로의 6단계 AI 복기, 대규모 연구와 Read19 분석 60국으로 다섯 기풍과 일치율·승률·암기의 실제 관계를 해부합니다.
공개 model이 프로를 크게 넘어선 지금 승률, 집 차이와 첫 후보만으로는 중요한 증거가 사라집니다. 최적성, 인간의 발견 가능성과 model 불확실성을 한 국면에서 결합해 복기를 정답 기계에서 학습 측정기로 바꾸는 연구 틀을 제안합니다.
2016~2026년 최전선을 논문, 공개 가중치와 직접 대국으로 재구성합니다. 너비, 깊이, 파라미터, 학습과 탐색을 비교하고 5,185, 14,554와 상대 +300 Elo가 같은 척도가 아닌 이유를 설명합니다.
데스크톱 복기, 클라우드 학습, 프로 기보 데이터베이스, 온라인 대국과 문제 훈련은 다른 제품입니다. 주 작업부터 고르세요.
모델은 속도, 기력과 기풍을 바꾸고 탐색량은 안정성을 바꿉니다. 승률, 집 차이, visits, 주요 변화와 소유 정보를 함께 읽습니다.
네이티브 CLI에서 한 번 로그인한 뒤 GTP나 Analysis Engine JSONL을 고릅니다. 로컬 클라이언트는 모델이나 GPU를 관리하지 않습니다.
표준 입출력을 함께 쓰지만 GTP v2와 Analysis Engine JSONL은 상태, 메시지 경계와 대상 클라이언트가 다릅니다.
Read19 암호화 WebSocket 세션을 설명합니다. 각 텍스트 프레임은 표준 KataGo Analysis Engine JSON이며 탐색 중에도 갱신됩니다.
엔진, 신경망 모델, 탐색, 프로토콜과 화면을 나눠 무엇을 설치하고 연결하거나 진단할지 정리합니다.
모든 숫자를 좇지 않는 깊은 복기법입니다. 자신의 판단을 되짚고 KataGo 전환점을 찾은 뒤 실전과 세 후보 경로가 왜 다른지 비교해 다음 대국의 교훈을 남깁니다.
FF[4] 원문에서 노드, 속성, 좌표와 분기를 읽고 OGS, KaTrain, Sabaki, SmartGo에서 기보를 내보낸 뒤 Read19와 KataGo로 분석합니다.
컴퓨터에서는 KaTrain 인터페이스를 그대로 쓰고 KataGo 계산은 Read19 클라우드 엔진에 맡깁니다. 로컬 GPU 설정이 필요 없습니다.
10년 전 프로는 정석이 끝났는지 물었습니다. 지금은 어떤 교환을 지금 해야 하고 무엇을 열 수 뒤로 미룰지 묻습니다. 공개 SGF 96,058개, 두 대회 기보와 KataGo 노드 분석으로 변화를 추적합니다.
신의 계시와 패자의 토혈이라는 전설로 알려졌지만 바둑판의 사실은 더 복잡합니다. 현대 KataGo는 첫 묘수에 전승과 거의 반대인 평가를 냅니다.
흑 127은 천원 가까이에 놓였습니다. 의사는 바둑판이 아니라 겐난의 붉어진 귀에서 충격을 읽었다고 전해집니다. KataGo는 아름다운 방향과 긴급함은 다르다고 반박합니다.
1933년 바둑계의 최고 권위가 백에 앉았습니다. 열아홉 우칭위안은 실리, 속도, 그리고 판 한가운데의 돌로 옛 질서를 우회했습니다.
기타니 미노루가 흑 121을 봉투에 넣으며 일본 대국에 봉수 제도가 들어왔다. 공정한 규칙은 승부의 무기도 되었고 가와바타 야스나리는 이를 소설 명인으로 남겼다.
히로시마 원폭은 백 106까지 복기한 직후 터졌다. 충격파가 방을 흔들고 사람들은 서로 돕고 정리한 뒤 재개했다. 재앙을 낭만화하지 않아야 이 대국을 읽을 수 있다.
후지사와 슈코는 7연패까지 한 승, 조치훈은 네 판을 연속으로 이기고 마지막을 1집 반으로 끝냈다. 흑 143부터 선두가 주도권을 조금씩 돌려주는 과정이 핵심이다.
연승 방식 단체전은 마지막 주장끼리 만났다. 베이징에서 녜웨이핑이 3집 반 승리했다. 사회적 서사는 컸지만 판의 분기는 백 50의 전판 방향이다.
한국에서 홀로 출전한 조훈현은 1대2를 뒤집고 응씨 룰 흑번 결승을 이겼다. 한국기원은 이른 백 28을 완착으로 본다. 세계 우승은 포석 속도에서 이미 쌓이고 있었다.
루이나이웨이는 한국 국수를 얻은 첫 여성, 첫 외국 기사가 됐다. 판에서는 백 60의 손 뺌 뒤 흑이 한쪽을 죽이려 쫓지 않고 두 백 대마의 탈출이 서로 짐이 되게 했다.
교과서는 축이 불리하면 몰지 말라 한다. 이세돌은 홍창식전 흑 67부터 97까지 일부러 몰며 매 전환에서 먼 선수 이익을 받아 판을 대각선 장부로 만들었다.
P10 어깨 짚기는 마법이 아닙니다. 우변 백을 낮추고 중앙으로 향할 자유를 남깁니다. 인간이 우선하기 어려운 수가 바둑 언어로 설명된다는 점이 충격이었습니다.
현대 KataGo는 L11 뒤에도 AlphaGo를 약 98.7%로 봅니다. 그래도 신의 한 수인 이유는 한 번의 오답이 대국을 바꿀 구체적 질문을 연속으로 만들었기 때문입니다.