본문으로 건너뛰기
CalcMax

백분위수 계산기

범위: 0 – 100

계산 결과

7.6000

해당 백분위수의 값

보간의 아래쪽 값
7.0000
보간의 위쪽 값
9.0000
개수
8

백분위수는 순위에 대한 질문에 값으로 답합니다. 90번째 백분위수란 데이터의 90%가 그 값 이하에 놓이는 지점입니다. 성장 곡선 위의 아이 키, 전국 분포 위의 시험 점수, 서비스 수준 협약에 적힌 응답 시간의 95번째 백분위수가 모두 이 자리에 옵니다. 숫자를 붙여 넣으면 이 백분위수 계산기가 요청한 백분위의 값을 돌려주고, 그 값이 보간된 두 이웃 값도 나란히 보여 줍니다. 정렬된 목록과 대조해 확인할 수 있도록, 다시 정렬할 필요가 없습니다. 목록은 어떤 언어로 쓰든 입력한 그대로 읽으며, n − 1로도 n으로도 나누지 않습니다.

공식

위치 = (n − 1) × p (p는 백분위수를 분수로 쓴 값). 답은 그 위치의 값이며, 이웃한 두 관측값 사이를 선형 보간해 구합니다

xᵢ
데이터에 들어 있는 값 하나입니다. 백분위수는 크기가 아니라 위치를 쓰므로, 극단값 하나가 이웃을 조금 밀어낼 뿐 평균처럼 답을 끌고 가지는 못합니다
n
목록에 들어 있는 값의 개수이며 여기서는 최대 200개까지 받습니다. 만들 수 있는 가장 큰 위치를 정합니다. 100번째 백분위수에서 위치는 n − 1이고, 그것이 정렬된 목록의 마지막 값입니다
p
요청한 백분위수를 분수로 쓴 값입니다. 90은 0.9가 됩니다. 0부터 100까지 아무 값이나 넣을 수 있고 소수점도 됩니다. 97.5번째 백분위수도 50번째만큼이나 정당합니다
위치
정렬된 목록에서 0부터 세어 어디를 볼지입니다. 값이 8개라면 90번째 백분위수의 위치는 6.3이고, 이는 일곱 번째 값에서 여덟 번째 값 쪽으로 10분의 3만큼 건너간 자리입니다
Y₍ₖ₎와 Y₍ₖ₊₁₎
그 위치를 사이에 둔 두 관측값입니다. 결과 옆에 인쇄되는 두 수가 이것이고, 답은 언제나 그 사이에 있습니다. 위치가 정수로 떨어지면 둘 중 하나와 정확히 같아집니다

크기가 아니라 서열이 궁금할 때 백분위수를 씁니다. 어떤 측정값이 전체 분포와 견주어 어디쯤인가 하는 질문입니다. 성장 곡선, 시험 점수, 지연 시간 예산, 소득 분위, 임상 참고 범위가 모두 백분위수이고, 중앙값도 그중 하나입니다. 중앙값은 50번째 백분위수일 뿐입니다. 근거를 대야 하는 기준선에도 맞는 도구입니다. 정상 트래픽의 95번째 백분위수를 넘으면 경보를 울린다는 규칙은 다시 계산하고 감사할 수 있는 규칙입니다. 두 가지만 헷갈리지 마세요. 첫째, 백분위수는 백분율이 아닙니다. 90번째 백분위수에 들었다는 것은 90점을 맞았다는 뜻이 아니라 집단의 90%가 나 이하의 점수를 받았다는 뜻입니다. 둘째, 백분위 순위와 백분위수 값은 방향이 다릅니다. 이 페이지는 순위 p에 어떤 값이 놓이는가에 답하지, 이 값이 몇 번째 순위인가에는 답하지 않습니다. 둘은 이름을 댄 값이 마침 데이터에 들어 있을 때만 서로의 역함수가 됩니다. 여기서 쓰는 약속은 Hyndman–Fan type 7이고, R의 quantile 함수와 NumPy의 method=“linear”가 기본으로 쓰는 방식입니다. 이것이 유일한 규칙은 아닙니다. OpenStax의 입문 교재는 i = k/100 × (n + 1)을 쓰면서, 조금만 찾아봐도 여러 공식이 나온다고 스스로 적어 두었습니다. 그래서 같은 목록이라도 소프트웨어마다 조금씩 다른 백분위수를 인쇄하며, 어느 쪽도 틀리지 않습니다.

계산 예시

  1. 여덟 개 값의 90번째 백분위수: 7.6

    1. 정렬: 2, 4, 4, 4, 5, 5, 7, 9 — 값이 8개이므로 n − 1 = 7
    2. 위치: 7 × 0.90 = 6.3, 0부터 세어
    3. 위치 6.3은 6번 자리의 값 7과 7번 자리의 값 9 사이에 있습니다
    4. 7에서 9 쪽으로 10분의 3: 7 + 0.3 × (9 − 7) = 7.6

    7.6은 여덟 수 가운데 하나가 아니고, 그게 정상입니다. 백분위수는 데이터의 눈금 위에 있는 위치이지 데이터의 구성원이 아닙니다. 두 이웃을 답 옆에 인쇄하는 이유는 보간이 사람들이 가장 자주 틀리는 단계이기 때문입니다. 7과 9가 보이면 7.6이 그 사이를 30%만큼 건너간 자리라는 것을 누구나 확인할 수 있고, 그것이 위치 6.3의 뜻입니다.

  2. 위치가 값 위에 정확히 떨어지는 경우: 1부터 5의 25번째 백분위수

    1. 정렬: 1, 2, 3, 4, 5 — 값이 5개이므로 n − 1 = 4
    2. 위치: 4 × 0.25 = 1, 정수
    3. 위치 1에는 값 2가 있고 보간할 것이 없습니다
    4. 두 이웃이 모두 2이므로 답도 2

    위치가 정수로 떨어지면 두 이웃이 하나로 합쳐지고 두 줄에 같은 수가 인쇄됩니다. 보간이 일어나지 않았다는 것을 패널이 그렇게 말해 주는 것입니다. 이 자리에서는 약속들이 서로 일치합니다. 세상에 돌아다니는 어떤 공식을 넣어도 여기서는 2가 나오고, 의견이 갈리는 곳은 전부 그 사이입니다.

  3. 값이 하나뿐일 때: 모든 백분위수가 그 값

    1. 정렬: 42 — 값이 하나이므로 n − 1 = 0
    2. 위치: 0 × 0.90 = 0
    3. 유일한 값이 위치 0에 있으므로 0부터 100까지 어떤 백분위수를 넣어도 그 값이 나옵니다
    4. 답: 42

    값이 하나면 보간할 것도, 백분위수를 매길 대상도 없습니다. 그래서 이 도구는 거부하는 대신 어떤 백분위수를 넣어도 그 값을 돌려줍니다. 양 끝값도 특별 취급이 필요 없다는 점을 눈여겨보세요. 0번째 백분위수는 가장 작은 값이고 100번째는 가장 큰 값인데, 둘 다 같은 위치 공식이 스스로 만들어 냅니다.

한계

백분위수는 값들이 얼마나 흩어져 있는지는 말해 주지 않으며, 뒤에 있는 목록만큼만 의미가 있습니다. 값이 열 개면 90번째 백분위수는 그중 두 값 사이의 보간이고, 몇 개만 더 있으면 거의 움직이지 않습니다. 답은 약속에 따라 달라지고 여러 약속이 함께 돌아다닙니다. 이 페이지는 R과 NumPy의 기본인 Hyndman–Fan type 7을 쓰고, 다른 교재는 다른 위치 공식을 쓰므로 다른 곳에서 계산한 백분위수는 조금 다를 수 있습니다. 이 페이지는 한 방향으로만 갑니다. 백분위수를 값으로 바꿀 뿐입니다. 반대 질문, 즉 어떤 값이 몇 번째 백분위에 놓이는가는 다른 계산이고 여기서는 다루지 않습니다. 백분위수는 백분율도 아닙니다. 90번째 백분위수에 있다는 것은 집단에 대한 진술이지 100점 만점에 90점이라는 뜻이 아닙니다. 목록은 200개까지이며, 1,500 같은 표기는 추측하지 않고 거부합니다. 자릿수 사이의 쉼표가 어떤 나라에서는 소수점이고 다른 나라에서는 천 단위 구분 기호이기 때문입니다. 모든 계산은 입력한 숫자 그대로 하며, 보간 전에 반올림하지 않습니다.

자주 묻는 질문

백분위수는 어떻게 계산하나요?
목록을 정렬한 뒤 위치 (n − 1) × p를 찾습니다. n은 값의 개수이고 p는 백분위수를 분수로 쓴 값입니다. 값이 여덟 개일 때 90번째 백분위수의 위치는 7 × 0.9 = 6.3이므로, 답은 일곱 번째 값에서 여덟 번째 값 쪽으로 10분의 3만큼 건너간 자리에 있습니다. 위치가 정수로 떨어지면 값 위에 바로 앉고 보간할 것이 없습니다. 개수와 두 이웃 값, 결과가 위에 모두 인쇄되므로 한 번에 검산할 수 있습니다.
90번째 백분위수는 실제로 무슨 뜻인가요?
값의 90%가 그 값 이하에 있고 10%쯤이 그 값 이상에 있다는 뜻입니다. 정답률이 아니라 서열에 대한 진술입니다. 시험에서 90번째 백분위수에 들었다고 해서 문제의 90%를 제대로 풀었다는 뜻이 아닙니다. 이 혼동이 워낙 흔해서 OpenStax 통계 교재도 따로 짚어 둡니다. 시험 점수의 90번째 백분위수는 내 점수와 같거나 낮은 점수가 90%라는 뜻입니다.
다른 계산기는 왜 조금 다른 백분위수를 주나요?
하나 이상의 공식이 함께 쓰이고 있고, 그 공식들이 데이터 점 위에서는 일치하지만 그 사이에서는 갈리기 때문입니다. 이 페이지는 Hyndman–Fan type 7을 씁니다. R의 quantile 함수와 NumPy의 quantile이 기본으로 쓰는 방식이고, 위치 (n − 1) × p에 선형 보간을 겁니다. OpenStax 입문 교재는 대신 i = k/100 × (n + 1)을 쓰면서 여러 공식이 나온다고 스스로 밝히고 있습니다. 어느 쪽도 틀리지 않습니다. 백분위수는 약속이고, 여기서는 어느 두 값이 쓰였는지 볼 수 있도록 두 이웃을 함께 인쇄합니다.
결과 아래에 붙는 두 수는 무엇인가요?
답이 그 사이에서 보간된 두 관측값, 즉 요청한 위치의 바로 아래와 바로 위에 있는 값입니다. 두 수가 화면에 있으면 결과가 더 이상 블랙박스가 아닙니다. 7과 9 옆의 7.6은 그 사이를 10분의 3만큼 건너간 자리로 눈에 보입니다. 백분위수가 데이터 점 위에 정확히 떨어지면 위치가 정수이고 보간할 것이 없으며, 두 줄에 같은 값이 인쇄됩니다.
0번째와 100번째 백분위수는 무엇인가요?
목록에서 가장 작은 값과 가장 큰 값이고, 특별 취급이 필요 없습니다. 위치 공식에 p = 0을 넣으면 0, 즉 첫 값이 나오고, p = 100을 넣으면 n − 1, 즉 마지막 값이 나옵니다. 0보다 작거나 100보다 큰 백분위수는 입력 필드가 받지 않고 잘라내지도 않으므로, 900 같은 오타는 조용히 최댓값으로 답해지지 않고 거부됩니다.
대신 어떤 값의 백분위 순위를 구할 수는 없나요?
이 페이지에서는 안 됩니다. 한 방향으로만 작동해 백분위수를 값으로 바꿉니다. 어떤 값이 몇 번째 백분위에 놓이는가는 자기 공식을 가진 다른 계산이고, 한 도구에서 둘 다 하려면 결과를 조건에 따라 이쪽저쪽으로 보여 줘야 하는데 결과 패널은 일부러 그렇게 되어 있지 않습니다. 순위가 필요하면 값을 정렬된 목록과 직접 견주어 보거나, 가장 흔한 네 개의 자르는 점을 얻으려면 사분위수 계산기를 쓰세요.

참고 문헌

관련 계산기