성과평가, 우리 조직에 어떻게 적용할 것인가
남의 제도를 베끼는 순간 실패한다… 규모·업무 주기·평가자 역량에 맞춰 설계하는 성과평가의 원칙
제도는 계속 바뀌는데 왜 평가는 달라지지 않는가
연말이 다가오면 경영자의 책상에는 어김없이 인사평가 개편안이 올라온다. 상대평가를 절대평가로 바꾸거나 기존의 평가등급을 없애자는 제안이 등장하고, 어느 해에는 OKR이 해법으로 거론되다가 또 다른 해에는 수시 피드백이나 새로운 성과관리 시스템이 대안으로 제시된다. 제도의 이름과 형식은 계속 바뀌지만 평가 시즌을 경험한 구성원의 반응은 크게 달라지지 않는 경우가 많으며, 평가 결과를 받아든 직원에게 남는 질문도 앞으로 무엇을 더 잘해야 하는가보다는 왜 자신과 동료의 평가등급이 달라졌는가에 집중되기 쉽다.
성과평가에 대한 이러한 불신은 특정 기업만의 문제로 보기 어렵다. 갤럽이 미국 직장인을 대상으로 조사한 자료를 보면 자신이 받는 성과평가가 더 잘하고 싶은 동기를 준다는 데 강하게 동의한 직원은 14%였고, 평가가 공정하다고 강하게 동의한 비율은 29%, 정확하다고 평가한 비율은 26%였다. 2024년 갤럽이 조사한 포춘 500대 기업 최고인사책임자 가운데 자사의 성과관리 체계가 직원의 개선 의지를 자극한다고 강하게 동의한 비율 역시 2%에 그쳤다는 점을 고려하면, 성과평가에 대한 회의는 평가를 받는 직원뿐 아니라 제도를 책임지는 경영진과 HR에서도 나타나고 있음을 알 수 있다.
문제의 출발점은 연말 평가보다 훨씬 앞에 있을 가능성이 크다. 갤럽의 미국 직원 조사에서 ‘직장에서 자신에게 무엇이 기대되는지 알고 있다’는 문항에 강하게 동의한 비율은 2015년 61%, 2020년 56%에서 2025년 47%까지 낮아졌다가 2026년 상반기에는 49%로 소폭 회복됐다. 시점별 변동은 있지만 최근에도 미국 직원의 절반가량만이 자신에게 기대되는 바를 명확하게 알고 있다는 뜻이어서, 평가기간이 끝난 뒤 결과를 측정하기 전에 조직이 무엇을 기대하는지부터 충분히 합의했는지를 점검할 필요가 있다.
이 점에서 성과평가의 문제를 평가표의 항목이나 등급 체계만으로 설명하는 것은 충분하지 않다. 구성원이 달성해야 할 결과가 무엇인지, 그 결과가 조직의 목표와 어떻게 연결되는지, 환경이 바뀌었을 때 목표를 어떤 절차로 조정할 것인지가 충분히 합의되지 않은 상태라면 아무리 정교한 평가표를 사용하더라도 결과에 대한 납득을 얻기 어렵기 때문이다. 따라서 평가제도 개편의 첫 단계는 새로운 방식을 선택하는 데 있기보다 현재 조직에서 기대 성과가 얼마나 명확하게 공유되고 있는지를 확인하는 데 두는 편이 합리적이다.
경영 인사이트
평가 제도 개편안을 검토할 때 경영자가 처음 던져야 할 질문은 상대평가와 절대평가 가운데 어느 쪽이 더 우수한가가 아니다. 먼저 우리 조직의 구성원들이 자신에게 요구되는 핵심 성과를 구체적으로 설명할 수 있는지, 그 성과가 회사의 사업 목표와 어떤 관계에 있는지 이해하고 있는지를 확인해야 하며, 이 질문에 명확하게 답하기 어렵다면 새로운 평가방식이나 시스템을 도입하기 전에 목표와 기대 수준을 정렬하는 과정부터 보완할 필요가 있다.
평가방식보다 먼저 확인해야 할 것은 공정성이다
성과평가가 실제 성과관리 도구로 기능하기 위해 무엇이 필요한지를 보여주는 자료 가운데 하나가 맥킨지의 2017년 글로벌 조사다. 맥킨지는 2017년 7월 전 세계 다양한 지역과 산업, 기업 규모에 속한 경영진 1,761명을 조사했는데, 응답 기업의 3분의 2는 조사 전 18개월 동안 성과관리 체계에 적어도 한 차례 이상의 큰 변화를 줬다고 답했다. 그럼에도 성과관리가 직원 개인의 성과와 조직 전체의 성과 모두에 긍정적인 영향을 준다고 평가한 응답자는 38%에 그쳐, 제도를 자주 바꾸는 것과 성과관리의 실질적 효과 사이에는 상당한 차이가 존재했다.
맥킨지 분석에서 특히 눈에 띄는 변수는 제도의 공정성에 대한 인식이었다. 성과관리 체계가 공정하게 운영된다고 인식한 응답자 가운데 60%는 제도가 효과적이라고 평가한 반면, 공정하다고 보지 않은 집단에서 같은 답을 한 비율은 7%에 불과했다. 여기서 말하는 공정성은 모든 구성원이 같은 결과나 보상을 받아야 한다는 의미가 아니라, 평가 목표와 기준이 합리적으로 정해지고 동일한 원칙에 따라 운영되며 그 과정에 대해 구성원이 설명을 들을 수 있는가와 관련된 절차적 공정성에 가깝다.
맥킨지는 이러한 공정성 인식과 연결된 운영 요소로 세 가지를 제시했다. 개인의 성과 목표를 사업의 우선순위와 투명하게 연결하고, 관리자가 일상적인 코칭을 수행할 수 있도록 역량을 높이며, 성과의 차이를 보상에 적절하게 반영하는 것이다. 이 세 가지를 모두 잘 운영한다고 답한 조직에서는 84%가 성과관리 체계를 효과적이라고 평가했지만 세 가지 가운데 하나도 제대로 시행하지 않는 조직에서는 그 비율이 7%에 그쳐, 세 요소를 모두 갖춘 집단이 그렇지 않은 집단보다 효과적인 성과관리 체계를 갖고 있다고 응답할 가능성이 약 12배 높았다.
세 요소 가운데 특히 관리자의 역할은 중요하게 나타났다. 맥킨지 조사에서 관리자가 직원을 효과적으로 코칭하고 육성한다고 답한 집단의 74%가 성과관리 체계를 효과적이라고 평가한 반면, 관리자가 효과적인 코치가 아니라고 본 집단에서는 그 비율이 15%였다. 다만 이 자료는 특정 제도가 성과 향상을 직접 발생시킨다는 인과관계를 입증한 실험이 아니라 조직의 운영 방식과 성과관리 효과에 대한 인식 사이의 관련성을 보여주는 조사이므로, 숫자를 그대로 모든 조직에 적용하기보다는 어떤 운영 요소를 우선적으로 점검해야 하는지를 보여주는 근거로 해석하는 것이 적절하다.
경영 인사이트
성과평가 개편을 논의할 때 평가등급을 다섯 단계에서 세 단계로 줄일 것인지, 상대평가를 절대평가로 전환할 것인지부터 논의하면 제도의 외형에 지나치게 집중할 수 있다. 그보다 구성원이 자신의 목표와 회사의 우선순위 사이의 연결을 이해하고 있는지, 관리자가 평가기간 동안 충분한 피드백과 코칭을 제공했는지, 성과의 차이가 보상과 설명 과정에 어떻게 반영되는지를 먼저 확인하는 것이 제도의 실효성을 진단하는 데 더 유용하다.
한국 조직의 현실, 강제할당을 어떻게 볼 것인가
해외 조사 결과를 한국 기업에 그대로 적용하기 위해서는 국내 평가제도의 특성도 함께 살펴봐야 한다. 한국노동연구원이 2015년 실시한 조사 결과를 바탕으로 2016년 발표한 ‘인사평가제도의 실태’는 300인 이상 사업체를 중심으로 한 501개 사업체의 평가 운영 실태를 분석했는데, 조사 대상의 67.1%가 미리 정해 놓은 비율에 따라 평가등급별 인원을 배분하는 강제할당 방식을 활용하는 것으로 나타났다. 10여 년 전 조사이고 최근 한국 기업 전체의 평가방식을 대표하는 최신 통계로 볼 수는 없지만, 국내 기업의 상대평가 관행이 어떤 방식으로 운영돼 왔는지를 이해하는 자료로서는 의미가 있다.
강제할당 방식이 오랫동안 사용돼 온 데에는 운영상의 이유가 있다. 평가자가 전반적으로 높은 점수를 부여하는 관대화 경향이나 대부분의 구성원을 중간 점수에 집중시키는 현상을 일정 부분 통제할 수 있고, 한정된 성과급 재원을 등급별로 배분해야 하는 기업에서는 전체적인 보상 규모를 관리하기에도 상대적으로 용이하기 때문이다. 평가자의 경험과 판단 기준이 부서별로 크게 다를 때 결과 분포가 지나치게 벌어지는 것을 막는 장치로 활용할 수도 있지만, 일정한 분포를 만드는 것과 개별 평가의 정확성을 확보하는 것은 서로 다른 문제라는 점은 구분할 필요가 있다.
구성원의 관점에서는 다른 문제가 발생할 수 있다. 미리 정한 비율에 맞춰 등급을 부여하면 개인이 사전에 합의한 목표를 달성했더라도 같은 평가집단 안에서 다른 구성원의 성과에 따라 자신의 등급이 달라질 수 있기 때문에, 평가 결과가 자신의 행동과 성과만으로 결정되지 않는다는 인식이 생길 수 있다. 특히 여러 구성원이 공동으로 성과를 만들어야 하는 업무에서는 개인의 상대적 순위를 강조하는 평가가 협업의 유인과 충돌할 가능성도 있으므로, 강제할당을 사용한다면 어떤 직무와 조직 단위에 어느 정도까지 적용할지를 함께 검토해야 한다.
반대로 절대평가를 선언한다고 해서 이러한 문제가 자동으로 해결되는 것은 아니다. 조직이 사전에 구체적인 기대 수준을 정하지 않았거나 평가자마다 동일한 기준을 다르게 해석하는 상황에서는 대부분의 직원에게 높은 점수가 부여되는 평가 인플레이션이 나타날 수 있고, 이후 한정된 보상 재원을 배분하는 과정에서 다시 비공식적인 순위 조정이 이루어질 수도 있다. 따라서 절대평가를 도입하려는 조직이라면 평가 기준을 구체화하는 작업과 함께 평가자 교육, 평가 근거 기록, 부서별 판단 차이를 조정하는 캘리브레이션 절차를 함께 설계하는 것이 실무적으로 중요하다.
경영 인사이트
상대평가와 절대평가 가운데 하나를 모든 기업에 적용할 수 있는 정답으로 보는 것은 위험하다. 평가자가 구체적인 기준을 안정적으로 적용하고 구성원과 기대 성과를 사전에 합의할 수 있는 조직이라면 절대평가의 활용 범위를 넓힐 수 있지만, 이러한 기반이 충분하지 않다면 명목상 제도만 절대평가로 바꾸기보다 기존 평가방식의 문제를 먼저 보완하면서 하위등급의 근거와 조정 절차를 명확하게 만드는 접근이 현실적일 수 있다.
평가 제도를 선택하기 전에 우리 조직의 조건을 읽어라
다른 기업의 성공사례를 그대로 가져오는 것이 위험한 이유는 제도의 형태만 옮길 뿐 그것이 작동했던 조건까지 함께 가져올 수는 없기 때문이다. 성과평가를 설계할 때는 조직 규모, 업무의 성과 주기, 평가자의 역량, 그리고 조직 문화와 사업 단계라는 조건을 먼저 살펴보고, 그 위에서 평가 주기와 기준, 차등의 정도를 결정하는 편이 합리적이다.
우선 조직 규모가 작을수록 정해진 등급 비율을 기계적으로 적용하는 데 신중할 필요가 있다. 예를 들어 다섯 명으로 구성된 팀에 S등급 10%, A등급 20%라는 비율을 적용하면 한 사람의 등급이 정수로 나누어지지 않기 때문에 반올림이나 조정 방식에 따라 결과가 달라질 수 있으며, 이런 상황에서는 세밀한 등급 분포를 만드는 것보다 각 구성원이 사전에 합의한 목표를 어느 정도 달성했는지와 조직 전체의 성과를 어떻게 보상에 연결할지를 설계하는 편이 더 단순하고 설명하기 쉬울 수 있다. 반대로 수백 명 규모의 조직에서는 평가자가 많아지면서 부서마다 평가 기준을 다르게 해석할 가능성이 커지므로, 일정한 가이드라인과 캘리브레이션 절차의 필요성이 커진다.
업무의 성과 주기도 평가 설계에 직접적인 영향을 준다. 월별 매출과 계약 실적이 비교적 빠르게 확인되는 영업 업무와 연구개발처럼 결과가 수년 뒤에 나타날 수 있는 업무를 같은 기간과 같은 방식으로 평가하면 각 직무의 실제 가치창출 과정을 제대로 반영하기 어렵다. 콘텐츠, 서비스 기획, 신사업처럼 결과가 일정한 시차를 두고 나타나는 업무 역시 단기 결과만 평가하기보다 약속한 실행 과정과 품질, 중간 산출물 등을 어떤 방식으로 확인할지를 함께 설계해야 하며, 환경 변화로 목표 자체가 달라졌다면 평가 전에 이를 조정할 수 있는 절차도 필요하다.
갤럽 역시 일회성 연말평가보다 주기적인 진행 점검을 강조해 왔으며, 과거 연구에서는 성과와 목표, 우선순위, 협업관계를 다시 검토하는 진행 리뷰를 최소 6개월마다 실시할 것을 권고했다. 2024년 갤럽 자료에서도 직원의 56%가 관리자와 공식적으로 성과 목표를 검토하는 빈도가 연 1회 이하라고 답한 만큼, 평가 주기를 단순히 연말 한 번으로 두기보다 업무 변화 속도에 맞춰 중간 점검을 운영하는 것이 목표와 실제 업무 사이의 괴리를 줄이는 데 도움이 될 수 있다.
세 번째 조건은 평가자의 역량이다. 2024년 갤럽 조사에서 직원들은 자신의 성과평가가 가장 흔하게 관리자의 관찰에 기반한다고 답했으며 그 비율은 67%였다. 결국 관리자에게 평가 기준을 해석할 능력이나 평소 업무를 관찰하고 기록하는 습관이 없다면 연말 평가가 최근의 기억이나 강한 인상을 남긴 사건에 영향을 받을 가능성이 커지므로, 평가 시스템을 고도화하기 전에 관리자가 구성원과 성과에 대해 정기적으로 대화하고 필요한 근거를 축적하는 방식부터 정착시킬 필요가 있다.
마지막으로 조직의 문화와 사업 단계도 평가제도와 분리해 볼 수 없다. 개인 성과가 명확하게 구분되는 업무와 여러 직무가 함께 결과를 만드는 업무에서는 필요한 차등의 수준이 다를 수 있으며, 빠르게 사업모델을 탐색하고 역할이 자주 바뀌는 성장단계의 조직과 직무와 프로세스가 비교적 안정된 조직 역시 같은 목표 설정 방식을 사용할 이유가 없다. 따라서 어떤 평가제도를 도입할 것인가를 결정하기 전에 현재의 사업단계에서 조직이 어떤 행동을 장려해야 하는지를 먼저 정의하는 것이 필요하다.
경영 인사이트
평가제도를 벤치마킹할 때 확인해야 할 것은 다른 회사가 상대평가를 사용하는지, OKR을 운영하는지가 아니라 그 제도가 어떤 조건에서 작동하고 있는가이다. 조직의 규모와 업무 주기, 관리자 역량, 협업방식과 사업단계가 다르면 같은 평가제도도 전혀 다른 효과를 낼 수 있으므로, 제도를 수입하기보다 현재 조직의 조건을 진단한 뒤 필요한 요소만 선택해 변형하는 접근이 현실적이다.
성과와 역량은 같은 질문이 아니다
많은 조직은 성과와 역량을 각각 평가한 뒤 일정한 가중치를 적용해 하나의 최종점수를 만든다. 성과 60%, 역량 40%처럼 합산하면 관리 측면에서는 간단하지만, 서로 다른 정보를 하나의 숫자로 압축하는 과정에서 중요한 차이가 사라질 수 있다. 목표 달성 수준은 높지만 새로운 역할에 필요한 역량을 아직 충분히 보여주지 못한 사람과 전문역량은 높지만 외부 환경이나 직무조건 때문에 기대했던 결과를 만들지 못한 사람이 같은 점수를 받을 수 있는데, 두 사람에게 필요한 인사조치는 같지 않기 때문이다.
이 글에서는 이러한 문제를 줄이기 위한 실무적 설계안으로 성과와 역량을 서로 다른 축에서 보는 방식을 제안한다. 성과는 사전에 합의한 결과를 어느 정도 만들어냈는지를 확인하는 영역이므로 성과급이나 단기 보상과 상대적으로 직접 연결할 수 있는 반면, 역량은 어떤 능력을 보유하고 있고 그 능력이 현재 업무에서 얼마나 발휘되고 있는지를 진단하는 정보이므로 육성, 이동배치, 역할 확대, 승진 검토와 연결해 활용하는 편이 두 정보의 성격을 구분하기 쉽다.
코리아비즈니스리뷰가 제안해 온 ‘역량가동률’ 관점 역시 이러한 구분에서 출발한다. 구성원이 어떤 역량을 가지고 있는지를 확인하는 것만으로는 충분하지 않으며, 실제 업무에서 보유 역량 가운데 얼마만큼을 사용하고 있는지를 함께 살펴봐야 한다는 접근이다. 보유한 능력에 비해 업무에서 발휘되는 수준이 낮다면 이를 곧바로 개인의 역량 부족으로 판단하기보다 직무와 강점이 맞지 않는지, 의사결정 권한이 지나치게 제한돼 있는지, 현재의 업무구조가 해당 역량을 사용할 기회를 제공하고 있는지까지 함께 진단해야 한다.
성과와 역량을 분리한다고 해서 두 정보 사이의 관계를 보지 말아야 한다는 의미는 아니다. 오히려 두 축을 별도로 유지하면 높은 역량에도 성과가 낮은 이유가 무엇인지, 현재 높은 성과가 특정 개인의 역량에서 나온 것인지 아니면 시장환경이나 일시적인 조건의 영향을 크게 받은 것인지 추가로 살펴볼 수 있으며, 이러한 차이는 보상뿐 아니라 인재배치와 후계자 육성의 판단에도 활용할 수 있다.
경영 인사이트
성과와 역량을 하나의 최종점수로 합산하는 방식은 운영이 간단하다는 장점이 있지만, 경영진이 사람에 대해 알아야 할 정보를 지나치게 압축할 수 있다. 따라서 성과는 결과와 보상의 관점에서, 역량은 육성과 배치의 관점에서 우선 해석한 뒤 필요할 경우 두 정보를 함께 검토하는 방식이 조직의 인재 문제를 더 구체적으로 파악하는 데 도움이 될 수 있다.
평가제도 개편, 처음 90일에는 무엇을 해야 하는가
성과평가를 바꾸겠다고 결정한 조직이 처음부터 등급과 보상비율, 평가양식, IT 시스템까지 한꺼번에 바꾸면 제도는 복잡해지지만 무엇 때문에 결과가 달라졌는지를 판단하기 어려워질 수 있다. 따라서 아래의 90일 도입안은 특정 연구가 효과를 보장한 표준모델이라기보다 앞에서 살펴본 목표의 명확성, 정기적인 성과 대화, 평가 근거의 축적이라는 원칙을 실제 조직에 적용하기 위해 KBR이 제안하는 최소 실행안으로 이해하는 것이 적절하다.
첫 30일에는 모든 구성원이 관리자와 핵심 목표 두세 개를 합의하고, 각각의 목표가 사업의 우선순위와 어떻게 연결되는지를 간단하게 문서화하는 데 집중한다. 이 단계에서 기존 평가등급이나 보상방식을 서둘러 바꾸기보다 직원과 관리자가 평가기간이 끝났을 때 무엇을 성과로 판단할 것인지 같은 그림을 보고 있는지를 확인해야 하며, 목표 자체가 지나치게 추상적이라면 측정 가능한 결과나 확인 가능한 산출물의 형태로 구체화할 필요가 있다.
다음 30일에는 관리자와 구성원 사이의 진행 점검을 실제 운영 과정에 넣는다. 월 1회 15분 정도의 짧은 면담을 적용할 수 있지만 여기서 월 1회라는 주기는 모든 조직에 필요한 절대적 기준이라기보다 업무 변화가 빠른 조직에서 적용해 볼 수 있는 실무안이며, 핵심은 면담 횟수 자체보다 기존 목표가 여전히 유효한지, 진행을 방해하는 요소가 무엇인지, 관리자에게 어떤 지원이 필요한지를 지속적으로 확인하는 데 있다. 연말에 한 번 결과를 확인하는 방식보다 이런 중간 점검을 두면 목표가 현실과 달라졌을 때 수정할 기회를 확보할 수 있다.
마지막 30일에는 첫 기간 동안 축적된 목표와 면담 기록을 바탕으로 실제 평가와 보상 원칙을 검토한다. 목표 달성 여부를 어느 수준까지 평가에 반영할지, 절대평가와 상대적 조정을 어떤 범위에서 사용할지, 평가자 간 판단 차이를 어떻게 조정할지를 실제 사례를 놓고 논의하면 제도의 이름을 둘러싼 추상적인 논쟁에서 벗어나 현재 조직에서 발생하는 문제를 중심으로 설계를 보완할 수 있다.
이 과정에서는 양식과 시스템을 과도하게 늘리지 않는 것도 중요하다. 초기에는 목표합의와 진행 점검에 필요한 최소한의 기록만 운영하면서 관리자가 실제로 대화를 수행하도록 만드는 편이 효과를 확인하기 쉽고, 대화 관행이 자리 잡지 않은 상태에서 새로운 성과관리 소프트웨어부터 도입하면 입력해야 할 필드만 늘어날 가능성도 있다. 무엇보다 경영진이 제도 밖에 머물지 않고 자신의 목표와 우선순위가 무엇인지 구성원에게 보여줄 때 성과관리 제도가 아래 직원만 통제하기 위한 장치가 아니라 조직 전체의 운영방식이라는 신호를 줄 수 있다.
경영 인사이트
성과평가 개편의 목적은 새로운 평가표를 만드는 데 있는 것이 아니라 조직이 기대하는 결과를 명확하게 합의하고, 그 진행 상황을 확인하며, 최종 결과를 일관된 기준으로 설명할 수 있는 운영체계를 만드는 데 있다. 처음 90일 동안 목표 합의와 정기적인 점검, 평가 근거의 축적이라는 기본 과정이 실제로 작동하는지를 확인한 뒤 등급과 보상, 시스템을 단계적으로 설계한다면 다른 기업의 제도를 그대로 복제하는 것보다 우리 조직의 조건에 맞는 성과관리 체계를 만들 가능성을 높일 수 있다.

![한 관리자가 팀원과 1대1 성과평가 면담을 진행하고 있다. 성과평가의 실효성은 평가 방식 자체보다 목표의 명확성, 지속적인 피드백, 절차적 공정성이 어떻게 운영되는지에 따라 달라질 수 있다. [사진 = KBR 자료사진]](/_next/image?url=https%3A%2F%2Fepzvqcvbpcduaglyoici.supabase.co%2Fstorage%2Fv1%2Fobject%2Fpublic%2Fnews-images%2Farticles%2F2026%2F09%2F23%2F1790123788932-image.jpg&w=1200&q=75)

