목표·성과관리 · 2026.04.13 · 조회 39 · ✓ 전문가 작성
인사 담당자들과 역량평가 이야기를 하다 보면 결국 같은 질문으로 돌아옵니다. 기준표는 분명히 있는데 왜 평가자마다 결과가 다르게 나오는지, 성과가 낮은 직원의 역량을 높게 줘도 되는 건지, 상사가 바뀌면 왜 같은 사람의 등급도 함께 바뀌는지 하는 질문들입니다.
제가 여러 조직의 평가 제도를 들여다보면서 반복적으로 확인하는 사실이 하나 있습니다. 이 문제는 평가자의 역량 부족에서 오는 게 아니라는 점입니다. 역량평가는 원래 구조적으로 해석을 요구하는 평가이고, 그 구조를 이해하지 못한 채 운영 원칙만 정교하게 만들면 왜곡은 계속 반복됩니다.
이 글에서는 역량평가가 흔들리는 근본 원인과, 실제로 왜곡을 줄여주는 세 가지 운영 장치를 정리합니다. 제도를 새로 설계하는 입장이든 기존 제도를 손보는 입장이든, 무엇부터 고쳐야 할지 판단하는 데 참고가 될 것입니다.
핵심 요약
- 역량에는 학습되는 능력(Competency)과 성과로 연결하는 실행 능력(Capability)이라는 서로 다른 층위가 있습니다.
- 역량평가가 흔들리는 가장 큰 원인은 평가자의 무능이 아니라 업적과 역량을 서로 보정하려는 심리입니다.
- 신뢰도는 정확도가 아니라 일관성, 즉 비슷한 사례에 비슷한 판단을 내리고 그것을 설명할 수 있는가에서 나옵니다.
- 업적-역량 괴리 제한과 근거 제출 의무화, 이 두 장치만 있어도 왜곡의 상당 부분을 줄일 수 있습니다.
실무에서 역량이라는 단어는 대개 하나로 뭉뚱그려 쓰입니다. 하지만 이 단어 안에는 성격이 다른 두 개념이 섞여 있고, 이걸 나누지 않으면 평가 기준부터 흔들립니다.
Competency는 학습과 훈련으로 축적되는 기초 역량입니다. 지식, 스킬, 태도처럼 교육으로 개발 가능한 자산에 가깝습니다. Capability는 그 역량을 실제 업무 상황에서 성과로 연결하는 실행 능력입니다. 맥락 판단, 우선순위 설정, 실행 완성도까지 포함하는 개념입니다.
태권도로 비유하면 품새를 정확히 익히는 과정은 Competency이고, 실전에서 상대의 움직임에 맞춰 대응하는 능력은 Capability입니다. 둘은 이어져 있지만 같지 않습니다. 그래서 활용 목적도 갈립니다. 교육과 육성 계획을 세울 때는 Competency를 보고, 평가와 보상을 결정할 때는 Capability를 봐야 합니다.
이 구분을 놓치면 벌어지는 일이 있습니다. 교육 잘 받은 사람과 성과를 잘 내는 사람을 같은 잣대로 평가하게 되는 것입니다. 개발의 언어와 평가의 언어를 분리하는 것, 이것이 역량 모델을 살아 있게 만드는 첫 번째 조건입니다.
역량평가는 태생적으로 주관성을 안고 있습니다. 같은 장면을 보고도 평가자마다 다른 해석을 내릴 수 있기 때문입니다.
행동지표는 대체로 추상적으로 서술되어 있고, 평가 근거는 상사의 관찰과 기억에 의존하는 경우가 많습니다. 같은 사례도 맥락을 어떻게 읽느냐에 따라 등급이 갈리고, 결과만이 아니라 과정과 태도까지 함께 보다 보니 평가 경계 자체가 흐려집니다.
회의에서 적극적으로 의견을 낸 직원을 예로 들어보겠습니다. 어떤 평가자는 이를 주도성으로 읽고, 어떤 평가자는 준비가 부족한 발언이 많았다고 읽습니다. 같은 사실이 전혀 다른 평가 언어로 번역되는 것입니다.
신뢰성의 기준 — 역량평가의 신뢰성은 절대적 정확도가 아니라, 비슷한 사례에 비슷한 판단이 반복되고 그 판단을 설명할 수 있는가에서 나옵니다.
그래서 저는 역량평가를 정밀 측정이 아니라 해석 기반 평가로 봐야 한다고 설명합니다. 문제는 주관성이 존재한다는 사실 자체가 아니라, 그 주관성을 통제하는 장치 없이 객관적인 척 운영할 때 생깁니다.
현장에서 반복적으로 나타나는 오류는 역량 그 자체의 문제라기보다, 업적과 역량을 서로 보정하려는 심리에서 비롯됩니다.
성과가 낮은 직원을 두고는 노력은 많이 했으니 역량만큼은 높게 주자는 유혹이 생깁니다. 반대로 성과가 높은 직원을 두고는 성과가 좋으니 역량도 당연히 높을 거라는 추정이 붙습니다. 겉으로는 인간적이고 균형 잡힌 판단처럼 보이지만, 실제로는 평가 체계를 무너뜨리는 대표적인 오류입니다.
특히 두 번째 오류가 더 흔합니다. 성과가 높다는 이유만으로 협업, 리더십, 문제해결, 기준 준수까지 전부 높게 평가하면 역량평가는 사실상 성과평가의 복사본이 됩니다. 반대로 성과가 낮은데 역량을 과도하게 높여주면, 좋은 역량이 왜 성과로 이어지지 않았는지에 대한 설명 책임이 사라집니다.
제가 평가 회의에서 늘 강조하는 질문은 성과가 좋았는가가 아닙니다. 이 사람이 보여준 행동과 판단이 실제 성과 창출에 어떻게 기여했는가입니다. 역량평가는 점수를 맞추는 작업이 아니라 인과관계를 설명하는 작업입니다.
완벽하게 객관적인 역량평가는 어렵습니다. 하지만 운영 원칙을 제대로 설계하면 왜곡을 상당히 줄일 수 있습니다. 제가 제도를 설계할 때 우선적으로 넣는 세 가지 장치는 다음과 같습니다.
업적과 역량의 등급 차이를 일정 범위 안으로 제한하는 방식은 생각보다 실용적입니다. 예를 들어 업적이 B인데 역량이 S로 나오는 조합은 원칙적으로 허용하지 않는 식입니다.
이 원칙이 중요한 이유는 단순히 균형을 맞추기 위해서가 아닙니다. 역량이 성과를 만들어내는 능력이라면, 매우 높은 역량은 최소한 일정 수준 이상의 성과로 연결될 가능성이 높아야 합니다. 역량이 정말 S 수준이라면 성과도 최소 A 수준 이상은 나오는 것이 자연스럽습니다. 그렇지 않다면 역량 정의가 잘못되었거나, 목표 설정이 왜곡되었거나, 둘 사이의 정렬이 깨졌을 가능성부터 점검해야 합니다. 업적-역량 괴리 제한은 점수를 억지로 맞추는 보정이 아니라, 평가 논리의 정합성을 확인하는 장치입니다.
성과가 낮다고 역량을 올려주는 것도, 성과가 높다고 역량을 끌어올리는 것도 모두 위험합니다. 중요한 것은 두 항목의 평균을 맞추는 게 아니라, 둘 사이의 연결을 설명할 수 있는가입니다.
그래서 평가 회의에서는 이런 질문을 던지도록 설계합니다. 이 역량이 실제 성과 창출에 어떤 영향을 줬는가, 성과가 낮았다면 어떤 제약 때문에 Capability가 결과로 이어지지 못했는가, 목표 자체가 현실적이었는가 아니면 설정이 잘못되었는가. 이 세 질문을 거치면 감정적 보정 대신 구조적 점검으로 대화가 옮겨갑니다.
역량평가는 반드시 근거 중심으로 운영해야 합니다. 추상적 인상만으로 등급을 주면 평가자는 편하지만 조직은 신뢰를 잃습니다.
실무에서는 단순한 규칙만으로도 효과가 큽니다. A 등급에는 최소 3개 이상의 구체적 근거를, S 등급에는 최소 5개 이상의 근거를 요구하고, 근거는 사건, 행동, 결과, 영향 순으로 작성하게 하는 방식입니다.
예를 들어 사건은 핵심 고객 이슈가 3일 연속 발생했다는 사실이고, 행동은 원인을 재분류하고 대응 우선순위를 재설계한 것이며, 결과는 대응 리드타임이 30퍼센트 감소한 것이고, 영향은 그 대응 방식이 팀 전체의 표준 프로세스가 된 것입니다. 이렇게 네 요소가 분리되어 있으면 짧은 서술이라도 평가 품질은 훨씬 높아집니다.
이 방식의 효과는 분명합니다. 평가자의 설명 책임이 높아지고, 같은 사람을 두고도 판단 기준이 서로 맞춰지며, 피평가자의 수용성도 함께 높아집니다.
제도를 손보기 전에 스스로 확인해볼 질문들입니다.
업적과 역량 등급이 크게 벌어지는 조합을 지금 그대로 허용하고 있는가. 역량 등급을 정할 때 성과 점수를 먼저 보고 거꾸로 맞추고 있지는 않은가. 등급 근거를 개수와 형식 없이 자유 서술로만 받고 있지는 않은가. 평가자가 바뀌면 같은 직원의 등급도 크게 달라지는 사례가 반복되고 있는가.
이 중 두세 개 이상에 그렇다고 답한다면, 새로운 지표를 추가하기 전에 지금 있는 운영 원칙부터 다시 점검하는 것이 먼저입니다.
역량평가는 본질적으로 완벽할 수 없습니다. 사람의 행동과 맥락을 다루는 이상 어느 정도의 해석은 피할 수 없습니다. 그렇다면 목표는 완벽한 객관성이 아니라 설명 가능한 일관성이어야 합니다.
제가 제도 개편을 도울 때 항상 가장 먼저 손대는 지점은 지표를 늘리는 것이 아니라 업적-역량 괴리 제한과 근거 제출 의무화, 이 두 장치입니다. 거창한 시스템 없이도 이 두 가지만 제대로 작동하면 설명할 수 없는 등급과 반복되는 형평성 논란은 눈에 띄게 줄어듭니다. 결국 중요한 것은 몇 점을 줬는가가 아니라, 왜 그 점수가 나왔는지를 일관된 언어로 설명할 수 있는가입니다.
지금 운영 중인 평가 제도에서 이 두 장치 중 하나라도 빠져 있다면, 다음 평가 시즌 전에 전문가에게 직접 질문해 보시길 권합니다. 제도 전체를 새로 짜야 하는 상황이라면 상담을 요청하셔도 좋습니다.
콜라플 님이 직접 확인하고 답변드립니다. 답변은 이메일로 알려드리며, 보통 1~2일 걸립니다.
🙏 개인정보나 민감한 내용이 아니라면 공개 질문을 부탁드립니다. 질문과 답변이 공개되면 같은 고민을 가진 분들에게도 지식과 경험이 공유됩니다.
실명이고, 회사메일일 때 답변에 정성이 더 들어갑니다.
접수된 질문과 공개된 Q&A는 운영 방침에 따라 관리자의 판단으로 사전 안내 없이 삭제(비공개 전환)될 수 있습니다.