FORECAST RECORD

맞았는지만 보면 확률의 질을 놓칩니다.

60%라고 말한 예측과 90%라고 말한 예측은 틀렸을 때 같은 실수가 아닙니다. 그래서 확률 자체를 기록합니다.

최근 체크백

공개된 예측이 있는 날짜만 결과를 붙입니다. 예측 보류였던 날은 뒤늦게 맞음·틀림으로 바꾸지 않습니다.

Brier Score를 쓰는 이유

결과가 일어났으면 1, 아니면 0으로 놓고 예측확률과 실제 결과의 차이를 제곱합니다. 예를 들어 90%라고 강하게 말하고 틀리면 0.81, 60%라고 말하고 틀리면 0.36입니다. 자신감이 컸던 오판에 더 큰 벌점이 붙습니다.

낮을수록 좋습니다.

한 번의 점수보다 여러 예측에서 보정과 기준모델 대비 성과가 반복되는지 보는 게 중요합니다.

Brier Score 쉽게 보기

아직 성능을 크게 말하지 않는 이유

표본이 적을 때는 몇 번의 적중만으로 실력을 판단하기 어렵습니다. 충분한 사후검증과 훈련에 쓰지 않은 구간의 결과가 쌓이기 전까지는 성능 주장을 제한합니다.