메뉴

테스트 신원 데이터란 무엇인가: 쓰이는 순간과 지켜야 할 선

테스트 신원 데이터가 무엇으로 이루어지는지, 언제 필요해지는지, 실제 사람의 정보를 시험 환경에 넣으면 무엇을 잃는지 차례로 정리합니다.

게시일

  • 테스트 데이터
  • 신원 정보

테스트 신원 데이터는 소프트웨어를 시험할 때 실제 사람 자리에 넣는 합성 신원 기록입니다. 이름과 생년월일, 주소, 연락처, 공적 번호처럼 한 사람을 설명하는 항목이 한 벌로 묶여 있어서, 화면과 저장 계층이 진짜 입력을 받은 것처럼 동작하는지 확인할 수 있습니다. 이 글에서는 이 값이 정확히 무엇으로 이루어지는지, 언제 필요해지는지, 그리고 실제 사람의 정보를 대신 넣었을 때 무엇을 잃는지 차례로 짚어 봅니다.

테스트 신원 데이터는 무엇으로 이루어지나요?

한 벌의 기록은 서로 다른 성격의 항목을 모아 놓은 것입니다. 이름과 성별은 사람 자체를 가리키고, 생년월일은 나이를 계산하는 기준이 되며, 주소와 우편번호는 지역 정보를 채웁니다. 전화번호와 이메일은 연락 수단이고, 공적 번호는 그 나라의 주민 등록 체계를 흉내 낸 형식을 가집니다.

핵심은 항목들이 따로 놀지 않는다는 점입니다. 우편번호는 그 나라의 자릿수 규칙을 따라야 하고, 전화번호의 국가 코드는 주소의 나라와 맞아야 하며, 화면에 표시되는 나이는 생년월일과 어긋나면 안 됩니다. 이런 연결을 무시한 값은 사람 눈에는 그럴듯해 보이지만, 검사 규칙을 통과하지 못하거나 반대로 너무 쉽게 통과해 진짜 오류를 가립니다.

언제 필요해지나요?

가장 흔한 자리는 가입과 주문 흐름의 자동 시험입니다. 이름, 생년월일, 주소, 연락처를 모두 요구하는 양식은 빈 값을 거부하고 형식이 어긋난 값을 거부하며, 나이 제한이 걸린 화면은 특정 생년월일을 기준으로 통과와 거절을 갈라 놓습니다. 이 갈래마다 값을 하나씩 준비해 두면 화면을 고칠 때마다 손으로 입력하지 않아도 됩니다.

두 번째는 발표와 시연입니다. 제품을 보여 주는 자리에서 실제 고객의 이름과 연락처가 화면에 뜨면, 그 순간 개인정보가 회의실 밖으로 나갑니다. 같은 모양의 합성 값으로 바꾸면 화면은 그대로인 채 위험만 사라집니다.

세 번째는 데이터가 쌓였을 때의 동작을 보는 일입니다. 목록 화면과 검색, 정렬, 쪽 나누기는 값이 얼마나 많고 긴지에 따라 다르게 동작합니다. 실제 고객 데이터를 복사해 오지 않고도 비슷한 크기의 데이터를 만들어 그 동작을 확인할 수 있습니다.

네 번째는 외부 연동 시험입니다. 결제나 신원 확인 같은 외부 서비스를 붙일 때 그 서비스가 시험용 값을 따로 제공하는 경우가 많습니다. 이때도 우리 쪽 데이터가 그 형식과 맞는지 확인할 값이 필요합니다.

실제 사람의 정보를 시험 환경에 쓰면 왜 위험한가요?

운영 환경의 데이터를 그대로 복사해 오는 습관은 편하지만 대가가 큽니다. 시험 환경은 운영 환경만큼 접근 권한이 깐깐하지 않은 경우가 많고, 개발자 컴퓨터와 교육 자료, 질문 답변용 화면 캡처까지 값이 따라다닙니다. 한 번 복사된 값은 회수하기 어렵고, 지워야 할 시점도 분명하지 않습니다.

또 하나의 문제는 데이터가 섞인 뒤에는 어느 쪽이 진짜인지 구분하기 어려워진다는 점입니다. 합성 값이라는 표식이 없으면 나중에 실제 고객에게 시험용 알림이 나가거나, 시험용 값이 운영 지표에 섞여 들어갑니다. 개인정보를 다루는 원칙과 시험 환경의 분리에 대해서는 주소 데이터와 개인정보에서 더 자세히 다룹니다.

합성 데이터로 확인할 수 있는 것과 없는 것

합성 데이터로 확인할 수 있는 것은 형식과 흐름입니다. 양식이 요구하는 항목, 저장 길이의 한계, 나이 계산, 국가별 표기 차이, 목록 화면의 동작처럼 규칙에 관한 것은 모두 시험할 수 있습니다.

반대로 확인할 수 없는 것도 분명합니다. 실제 발급 기관이 그 번호를 받아 줄지는 알 수 없고, 실제 주소로 배달이 되는지도 알 수 없습니다. 무엇보다 이 값은 실제 사람이 아니므로 본인 확인이나 실명 확인 절차를 통과하지 못합니다. 여기서 만들어지는 신원 데이터는 시험과 시연을 위한 것이며, 실제 인물을 사칭하거나 본인 확인을 통과하는 데 써서는 안 됩니다.

신원 생성기에서 직접 만들어 보기

신원 생성기에서는 국가와 행정 구역, 성별을 고르고 한 벌의 신원 기록을 바로 만들 수 있습니다. 같은 ID 키를 다시 넣으면 완전히 같은 기록이 나오므로, 한 번 만든 값을 고정된 표본처럼 두고 반복해서 쓸 수 있습니다. 항목끼리 어긋나지 않도록 같은 지역 데이터에서 함께 만들어지므로 양식 검증 시험에 그대로 넣을 수 있습니다.

생성 결과는 알고리즘이 합성한 값이며 실존하는 인물이나 주소와 무관합니다. 시험용으로만 쓰고 실제 신원 확인에는 사용하지 마세요.

항목 하나가 어긋나면 어떻게 되나요?

주소와 우편번호가 다른 나라의 것을 가리키거나 전화번호의 국가 코드가 주소와 맞지 않으면, 화면은 아무 오류 없이 값을 저장합니다. 문제는 그다음 단계에서 드러납니다. 배송비 계산이 엉뚱한 나라의 규칙을 적용하거나 목록 화면의 정렬이 기대와 다르게 나옵니다. 필드 사이의 연결을 어떻게 다룰지는 신원 데이터 일관성에서 따로 정리했습니다.

개발자를 위한 메모: 한 건의 기록을 어떻게 설계할까

  • 한 벌의 기록에는 누구를 가리키는 항목, 어디에 사는지를 나타내는 항목, 어떻게 연락하는지를 나타내는 항목이 함께 들어갑니다. 이 묶음을 하나의 단위로 다루면 일부만 갈아 끼우는 실수를 줄일 수 있습니다.
  • 항목 사이의 의존 관계를 먼저 적어 둡니다. 나라는 우편번호 형식과 전화 국가 코드와 통화 표기를 함께 정하고, 생년월일은 나이와 세대 구분을 함께 정합니다.
  • 모든 시험에 무작위 값을 쓸 필요는 없습니다. 실패를 재현해야 하는 시험에는 값을 고정하고, 목록 화면처럼 다양성이 필요한 시험에는 매번 새로 만드는 편이 맞습니다.
  • 만든 값이 시험용임을 알아볼 수 있는 표식을 남깁니다. 나중에 실제 데이터와 섞이는 사고를 막는 가장 값싼 방법입니다.
  • 값의 개수를 늘리거나 줄이는 일이 쉬운 구조를 고릅니다. 데이터가 많을 때의 동작을 확인하려면 같은 기록을 수천 번 반복해서 만들 수 있어야 합니다.

다음 단계

시험에 쓸 신원 기록이 필요하다면 신원 생성기에서 국가를 몇 개 골라 한 벌씩 만들어 보고, 양식이 요구하는 항목과 실제로 만들어지는 항목이 맞는지 비교해 보세요. 시험 환경에 실제 개인정보를 두지 않는 방법이 더 궁금하다면 합성 데이터와 익명화를 이어서 읽어 보시길 권합니다.

이어 읽기

온라인 신원·테스트 데이터 생성기 관련 글