계산과 한계
방법론
숫자가 무엇을 뜻하고 무엇을 뜻하지 않는지 재현 가능한 기준으로 기록합니다.
시간
공개 시각은 모두 한국 표준시로 표시합니다. 원본 테이블의 기록 시각과 추가 시각이 서로 다른 시간대를 사용했을 가능성이 있어 사건 분석에는 사건 시각 필드를 우선 사용했습니다.
사건 연결
알고리즘 경보 직전 10분 안에 발생한 가장 가까운 기상청 사건을 후보로 연결합니다. 현재 공개 상세 사건은 수동 검토한 세 사건입니다. 2016년 이후 전체 경보는 기상청 전수 대조 전이므로 실제 지진과 오경보로 나누지 않습니다.
가동률
선택 사용자 패널 테이블에서 하루 1,440분 중 자료가 존재하는 분의 비율을 계산합니다. 95% 이상은 완전, 50% 이상은 부분, 그 미만은 희소 관측으로 표시합니다.
활동 보정
월 전체 트윗 수를 각 관측 분의 패널 인구 합으로 나눈 뒤 10,000을 곱합니다. 이는 선택 패널 내부 비교를 위한 값이며 한국 전체 이용률이 아닙니다.
반응지수
사건 전 기준 구간의 중앙값 또는 평균에 대한 사건 후 집계의 배수입니다. 기준값이 0이거나 관측이 없으면 지수를 계산하지 않습니다.
지역 공개
본문 또는 프로필 위치에서 지명을 추정합니다. 사건·시간창·지역 조합이 20건 미만이면 공개하지 않습니다.
중복
2016년 상세 사건의 여러 실험 테이블이 겹치는 경우 게시물 ID는 비공개 처리 과정 안에서만 중복 제거에 사용하고 공개 파일에는 쓰지 않습니다.
재현성
모든 데이터 파일은 동일한 원본과 규칙으로 다시 생성할 수 있습니다. 공개 묶음에는 데이터 사전, 버전, 행 수, SHA-256 체크섬이 포함됩니다.