메뉴

이력서 데이터 생성기: 채용 시스템 시험용 경력 데이터 만들기

이력서 데이터 생성기로 경력과 학력과 기술을 갖춘 시험용 이력 데이터를 만드는 방법과 채용 시스템과 문서 분석 도구를 시험할 때 확인할 항목을 정리합니다.

게시일

  • 이력서 데이터
  • 채용 시험

이력서 데이터 생성기는 채용 화면과 문서 분석 도구를 시험할 때 쓸 경력 데이터를 만들어 주는 도구입니다. 실제 지원자의 이력서를 시험에 쓰는 일은 개인정보 문제로 허용되지 않으므로, 형식과 구조가 실제와 닮은 합성 데이터가 필요합니다. 이 글에서는 시험용 경력 데이터가 실제 이력서와 무엇이 다른지, 경력 기간이 왜 서로 맞아야 하는지, 직무 이름과 기술 목록은 어떻게 다루어야 하는지, 문서 분석 도구를 시험할 때 무엇을 확인해야 하는지 차례로 살펴봅니다.

시험용 경력 데이터는 실제 이력서와 무엇이 다른가요?

실제 이력서는 한 사람의 경험을 담은 문서입니다. 회사 이름과 재직 기간과 담당 업무가 사실에 근거하고, 그 사람을 평가하는 근거 자료로 쓰입니다. 시험용 경력 데이터는 그 사실 관계가 없는 값입니다. 형식은 실제와 닮았지만 어느 사람의 경력도 아닙니다.

차이는 문서의 목적에서도 드러납니다. 실제 이력서는 읽는 사람이 판단하도록 쓰이고, 지원자가 자기 표현을 고릅니다. 시험용 데이터는 시스템이 어떻게 처리하는지를 보기 위한 입력입니다. 그래서 시험용 데이터에는 일부러 까다로운 조합이 들어갑니다. 아주 긴 회사 이름, 공백이 섞인 기간 표기, 나라가 다른 학위처럼 실제에서는 드문 값이 시험에는 자주 필요합니다.

이 차이를 잊으면 시험이 잘못된 방향으로 흐릅니다. 합성 데이터로 사람을 평가하거나 순위를 매기는 일은 시험의 목적이 아니며, 그런 용도로 쓰면 결과가 아무 의미도 갖지 않습니다.

경력 기간은 왜 서로 맞아야 하나요?

경력 데이터에서 가장 자주 문제가 되는 곳은 기간입니다. 시작한 달이 끝난 달보다 뒤에 있거나, 두 재직 기간이 같은 시기에 겹치거나, 전체 경력 연수와 개별 기간의 합이 맞지 않는 경우가 그렇습니다. 사람이 읽으면 이상하다고 느끼지만 시스템은 그대로 받아들이는 경우가 많습니다.

시스템이 이상한 값을 받아들이면 그 뒤의 계산이 모두 어긋납니다. 경력 연수를 기준으로 지원 자격을 판단하는 화면이라면 잘못된 값이 자격 판단까지 영향을 줍니다. 순위를 매기는 화면이라면 순위가 뒤집힙니다. 그래서 생성 단계에서 기간을 서로 맞추어 두는 것이 중요합니다.

기간 표기 자체도 시험 대상입니다. 년과 월을 함께 쓰는 표기, 년만 쓰는 표기, 재직 중을 뜻하는 표기가 문서마다 다르게 나타납니다. 시스템이 이 표기들을 같은 기간으로 읽는지, 읽지 못한다면 어떤 안내를 하는지를 확인해야 합니다. 기간 규칙은 경력 기간 규칙에서 더 자세히 다룹니다.

직무 이름과 기술 목록은 어떻게 다루어야 하나요?

직무 이름은 산업마다 쓰는 말이 다르고, 같은 일을 여러 이름으로 부르기도 합니다. 문서 분석 도구가 직무 이름을 인식한다면 표기가 조금만 달라도 결과가 흔들립니다. 그래서 시험용 데이터에는 한 가지 표기만 넣지 말고, 같은 직무를 다르게 부른 이름을 함께 넣어 보는 편이 좋습니다.

기술 목록도 비슷합니다. 기술 이름에는 대소문자와 표기 변형이 많고, 같은 기술을 다른 이름으로 부르는 경우도 있습니다. 분석 도구가 대소문자를 구분하지 않고 찾는지, 약어와 정식 이름을 같은 것으로 묶는지, 목록에 없는 기술을 만났을 때 어떻게 처리하는지를 확인합니다. 기술 분류는 기술 목록과 수준에 정리했습니다.

학력도 같은 원리로 다룹니다. 학위 이름과 전공 이름은 나라마다 다르고, 제도가 다른 나라의 학위를 어떻게 읽을지가 문제가 됩니다. 학위를 다루는 방식은 학력 데이터에서 다룹니다.

문서 분석 도구를 시험할 때 무엇을 확인해야 하나요?

문서 분석 도구는 사람이 쓴 문서에서 값을 뽑아 내는 프로그램입니다. 그래서 시험의 중심은 뽑아 낸 값이 원문과 맞는지, 맞지 않을 때 어떻게 표시하는지입니다. 같은 내용을 담은 문서를 여러 형식으로 만들어 넣고 결과가 같은지 비교하는 방법이 가장 기본입니다.

레이아웃이 흔들릴 때의 동작도 확인해야 합니다. 두 단으로 나뉜 문서, 표 안에 들어간 경력, 머리글과 바닥글이 있는 문서처럼 구조가 특이한 입력을 넣어 봅니다. 사람이 읽기에는 분명한 내용도 프로그램에게는 순서가 뒤섞인 입력이 되므로, 어느 정도까지 견디는지를 알아 두어야 합니다.

신뢰도 표시도 확인 대상입니다. 프로그램이 뽑아 낸 값에 확신 정도를 함께 내놓는 경우, 확신이 낮은 항목을 사람이 확인하도록 화면이 안내하는지 봅니다. 자동으로 채운 값을 사람이 반드시 확인하게 만드는 흐름인지도 중요합니다. 분석 도구용 고정 입력을 어떻게 준비할지는 문서 분석 시험 데이터에 정리했습니다.

채용 화면에서 시험해야 할 항목은 무엇인가요?

지원 화면에서는 입력 항목의 관계를 봅니다. 경력을 여러 건 입력할 수 있는지, 기간이 겹치면 경고하는지, 재직 중이라고 표시했을 때 종료일을 비워 둘 수 있는지를 확인합니다. 나라별로 다른 날짜 형식을 어떻게 받는지도 함께 봅니다.

표시 화면에서는 긴 값과 특수 문자를 봅니다. 회사 이름이 길 때 잘리지 않는지, 발음 구별 부호가 있는 이름이 깨지지 않는지, 줄바꿈이 어색하지 않은지를 확인합니다. 지원자 목록을 정렬할 때 기준이 무엇인지도 정해야 합니다.

보관과 삭제도 시험 대상입니다. 지원이 끝난 뒤 데이터를 얼마나 보관하는지, 지원자가 삭제를 요청하면 어떤 값이 지워지는지, 시험용 데이터가 그 흐름에 섞이지 않는지를 확인합니다. 화면에서 확인할 항목은 채용 양식 시험 항목에 정리했습니다.

나라별 경력 데이터를 어떻게 관리하나요?

경력 데이터는 나라별 차이가 큰 영역입니다. 날짜 표기, 학위 이름, 급여 단위와 통화, 직무 이름이 모두 다릅니다. 나라별 규칙을 코드에 흩어 놓으면 새 나라를 추가할 때 여러 곳을 고쳐야 하므로, 나라를 키로 두고 자료로 관리하는 편이 낫습니다.

급여는 특히 주의가 필요합니다. 같은 금액이라도 기간 단위가 다르면 연봉이 몇 배 차이 납니다. 통화와 기간을 함께 저장하고, 화면에 보여 줄 때 어떤 단위로 환산하는지를 명시해야 합니다. 급여 표기 규칙은 급여와 통화와 기간에서 다룹니다.

자격과 면허도 나라별로 제도가 다릅니다. 자격 이름과 발급 기관과 유효 기간이 나라마다 다르므로, 시험용 데이터에 자격을 넣을 때는 어느 나라 제도인지 함께 기록해 두어야 합니다. 자격 데이터는 자격과 면허 데이터에 정리했습니다.

나라별 이력서 형식은 어떻게 다른가요?

이력서의 구성은 나라마다 다릅니다. 어떤 나라는 사진과 나이와 혼인 상태를 넣는 관행이 있고, 어떤 나라는 차별 소지가 있어 넣지 않는 것이 원칙입니다. 같은 항목이라도 어느 나라에서는 필수이고 다른 나라에서는 넣으면 안 되는 값이 됩니다.

날짜 형식도 다릅니다. 년과 월의 순서가 나라마다 바뀌고, 월 이름을 쓰는 경우도 있습니다. 화면이 이 형식들을 어떻게 읽는지, 읽지 못했을 때 어떤 안내를 하는지를 확인해야 합니다. 서로 다른 형식이 섞여 들어온 문서는 자동 분석에서 가장 자주 실패하는 입력입니다.

경력 기술 방식도 다릅니다. 담당 업무를 문장으로 서술하는 관행이 있는 나라와 업무 항목을 짧게 나열하는 관행이 있는 나라가 있습니다. 분석 도구가 이 둘을 모두 처리하는지, 한쪽만 가정하고 있지는 않은지를 시험에 넣어 두세요. 나라별 차이는 국가별 채용 데이터에서 넓게 다룹니다.

급여와 통화 정보를 어떻게 시험하나요?

급여는 금액과 통화와 기간이 한 벌로 다루어져야 합니다. 같은 숫자라도 연봉인지 월급인지에 따라 의미가 열두 배 차이 나고, 통화가 다르면 비교 자체가 성립하지 않습니다. 시험용 데이터에는 이 세 값을 항상 함께 넣어야 합니다.

화면에서는 표시 형식을 확인합니다. 천 단위 구분 기호를 어떤 문자로 쓰는지, 소수점을 어디에 찍는지, 통화 기호를 앞에 붙이는지 뒤에 붙이는지가 나라마다 다릅니다. 같은 값이 화면에 따라 다르게 보이면 사용자는 자기 급여를 잘못 읽습니다.

범위로 입력하는 경우도 확인해야 합니다. 희망 급여를 최소와 최대로 받는 화면이라면 두 값의 순서가 뒤바뀌었을 때 경고하는지, 한쪽만 입력했을 때 어떻게 처리하는지를 봅니다. 급여 표기 규칙은 급여와 통화와 기간에 정리했습니다.

시험용 이력 데이터를 얼마나 보관해야 하나요?

채용 데이터는 다른 시험 데이터보다 보관에 주의가 필요합니다. 실제 지원자의 정보와 구조가 비슷하기 때문에, 시험용 값이 실제 지원자 데이터 사이에 섞이면 구분이 어려워집니다. 처음부터 저장 위치를 나누어 두는 편이 안전합니다.

보관 기간도 정해 두어야 합니다. 채용 절차가 끝난 뒤 지원 정보를 얼마나 두는지는 나라마다 기준이 다르고, 지원자가 삭제를 요청하는 경우의 처리도 정해져 있어야 합니다. 시험용 데이터도 같은 규칙을 따르되, 실제 데이터보다 짧게 두는 편이 관리하기 쉽습니다.

시험이 끝난 값을 지우는 시점을 정해 두면 나중에 정리가 쉬워집니다. 자동 시험이 매일 도는 환경이라면 오래된 값이 계속 쌓이므로, 주기적으로 정리하는 처리를 넣어 두세요. 보관 원칙은 채용 데이터 보관에서 다룹니다.

시험용 이력서 파일은 어떻게 준비해야 하나요?

문서 분석 도구를 시험하려면 파일 자체가 필요합니다. 같은 내용을 서로 다른 형식으로 만들어 넣고 결과가 같은지 비교하는 것이 가장 기본적인 방법입니다. 형식마다 값을 뽑아 내는 방식이 다르므로, 한 형식에서만 통과하는 처리는 다른 형식에서 곧 드러납니다.

파일의 구조도 여러 가지로 준비합니다. 한 단으로 된 문서, 두 단으로 나뉜 문서, 표 안에 경력이 들어간 문서를 만들어 두면 분석 도구가 어디까지 견디는지 알 수 있습니다. 머리글과 바닥글에 이름과 연락처가 들어간 문서도 시험해 볼 만합니다.

파일의 이름과 저장 위치도 정해 두어야 합니다. 시험용 파일이 실제 지원자가 올린 파일과 같은 곳에 섞이면 나중에 구분이 어려워집니다. 파일 이름에 시험용임을 알리는 규칙을 정하고, 시험이 끝난 파일은 정리하는 편이 안전합니다.

이력서 데이터 생성기에서 바로 만들어 보기

이력서 데이터 생성기에서 경력과 학력과 기술을 갖춘 값을 만들 수 있습니다. 만들어진 값은 지원 화면의 입력 검사와 문서 분석 도구의 인식 결과와 채용 화면의 표시 확인에 쓰고, 실제 지원자의 문서는 시험에 쓰지 않는 것이 원칙입니다. 경력 데이터의 일반 원칙은 경력 테스트 데이터 기초에 정리해 두었습니다.

여기서 만들어지는 값은 형식만 갖춘 테스트 데이터이며 어떤 사람의 경력도 아닙니다. 실존하는 회사에 다닌 기록이 없고, 실제 학위나 자격을 가리키지도 않습니다.

시험용 경력 데이터의 경계는 어디인가요?

할 수 있는 것은 형식과 흐름에 관한 확인입니다. 문서 분석의 정확도, 화면의 입력 검사와 표시, 정렬과 검색, 보관과 삭제 흐름처럼 규칙으로 정해진 것은 모두 시험할 수 있습니다. 지원자가 많을 때 화면이 어떻게 견디는지도 확인할 수 있습니다.

할 수 없는 것은 그 데이터로 사람을 평가하는 일입니다. 합성 데이터는 실제 경험이 없으므로 결과가 아무 의미도 갖지 않습니다. 평가 기능의 시험이 필요하다면 이미 알려진 정답을 가진 고정 입력을 만들어 쓰는 편이 맞습니다.

시험용 값은 시험 환경에만 두고, 실제 지원자가 제출한 문서와 같은 저장소에 넣지 마세요. 시험이 끝난 값은 남기지 않는 것이 원칙이고, 남겨야 한다면 시험용임을 알리는 표식을 붙여 두세요.

이어 읽기

인기 도구와 사용법 글