Menu

Données de test de profil de carrière : construire des dossiers de CV

Les données de test de profil de carrière sont un dossier d'emploi synthétique couvrant les postes, la formation, les compétences et les titres. Voici ce qu'elles contiennent et pourquoi la cohérence compte.

Publié le

  • données de test
  • carrière
  • tests logiciels

Les données de test de profil de carrière sont une vie professionnelle inventée, consignée dans son intégralité. C’est un poste actuel et l’entreprise qui le sous-tend, un historique professionnel qui remonte à une décennie ou plus, une formation qui y est rattachée, un ensemble de compétences et les titres que le secteur reconnaît — le tout assemblé pour que les logiciels de recrutement puissent être exercés sur un dossier qui se lit comme celui d’un candidat ordinaire sans décrire quelqu’un qui existe.

Cet article traite de ce que contient un tel dossier, des situations qui en réclament véritablement un, des raisons pour lesquelles un vrai CV est un mauvais substitut même lorsque vous avez la permission de l’utiliser, et de l’endroit où vivent réellement les règles internes d’un dossier de carrière.

Qu’est-ce que les données de test de profil de carrière ?

C’est le pendant professionnel d’un dossier d’identité de test. Là où un dossier d’identité répond aux questions qu’un formulaire d’inscription pose, un profil de carrière répond aux questions qu’un formulaire de candidature pose : que faites-vous aujourd’hui, où avez-vous travaillé, qu’avez-vous étudié, que savez-vous faire et dans quoi avez-vous été certifié.

Le dossier n’est ni un bloc de texte ni un champ unique. C’est une petite collection de tables liées qui décrivent ensemble une vie professionnelle, et cette collection possède trois propriétés qui la rendent utilisable plutôt que simplement présente. Elle est cohérente en interne, de sorte qu’un lecteur ne peut pas surprendre deux champs en contradiction. Elle est ancrée, de sorte que l’entreprise, la qualification et le titre appartiennent tous au pays et au secteur que le dossier revendique. Et elle est synthétique, de sorte que rien n’y a été copié d’une personne et rien n’y appartient à quiconque.

Cette dernière propriété est celle que les gens sous-estiment. Un grep à la recherche de texte de substitution évident n’est pas ce qui rend les données de test sûres ; c’est la provenance qui compte.

Quand une équipe a-t-elle réellement besoin de tels dossiers ?

Six situations reviennent sans cesse. Elles semblent sans rapport, mais chacune exige des données plausibles qui aboutissent quelque part d’inoffensif.

Situation Ce qui casse sans profils générés
Test des formulaires de candidature et d’intégration Les formulaires à étapes multiples ne peuvent pas être parcourus de bout en bout, car aucun dossier ne porte chaque étape
Travaux d’import et d’analyse de CV Un analyseur auquel on donne deux fois la même chaîne ne rencontre jamais les ordres de sections qu’utilisent les vrais documents
Alimentation de bases de données de préproduction Les tables vides masquent les plans de requête, les défauts de pagination et les erreurs d’index
Démos produit et captures d’écran Les écrans qui se lisent comme du texte de substitution donnent au produit un air inachevé
Fonctions de recherche, de filtrage et de mise en correspondance La recherche enregistrée d’un recruteur ne peut être montrée comme correspondant à quoi que ce soit
Revue des accès, du périmètre et des exports Personne ne peut se voir présenter les bons champs pour un rôle sans un dossier de cette forme

Le fil conducteur est que chacune de ces situations a besoin de données qui ressemblent à ce que le système finira par recevoir. Un seul dossier n’affirmant rien en particulier ne suffit à aucune d’entre elles.

Pourquoi copier de vrais CV est-il la mauvaise décision ?

Parce qu’un CV est une donnée personnelle à la portée exceptionnellement longue. Il porte un nom, un historique professionnel, une formation, des coordonnées et souvent une prétention salariale — et le déplacer dans un environnement de développement en crée une seconde copie à l’endroit où les contrôles sont les plus faibles.

Deux coûts en découlent. Le premier tombe sous le régime de protection des données qui vous gouverne, puisque les données ont été collectées pour une décision de recrutement et servent désormais une finalité différente. Le second est plus discret et purement opérationnel. La copie se répand : dans les sauvegardes, dans les journaux de requêtes, dans les exports CSV sur des ordinateurs portables, dans les captures d’écran collées dans des tickets, dans n’importe quel outil d’analyse vers lequel quelqu’un a pointé la base pendant une semaine. Supprimer la ligne source n’atteint aucune de ces copies, et aucune d’elles n’est auditée.

Il y a aussi un coût technique. Une poignée de CV empruntés ne peut jamais vous montrer qu’une poignée de formes, et les populations réelles de candidats sont pleines de formes qu’un petit échantillon manque — des interruptions qui demandent une explication, des temps partiels qui se chevauchent, des diplômes obtenus longtemps après le premier emploi et des candidats sans aucune qualification formelle. Parce que ces dossiers n’ont jamais appartenu à personne, ils peuvent être générés sur toute cette étendue de façon délibérée.

Que contient un dossier de profil de carrière ?

Sur ce site, le générateur de profil de carrière construit tout le profil d’un coup plutôt que champ par champ, et la clé d’identité qui le relie est la même que celle qu’utilise la page d’identité.

  1. Poste actuel — l’intitulé occupé aujourd’hui, l’entreprise et le total d’années d’expérience qui découle de l’historique ci-dessous.
  2. Historique professionnel — chaque poste passé sous forme d’intitulé, d’entreprise et d’un mois de début et de fin, l’extrémité ouverte portant le mot Present au lieu d’une date.
  3. Formation — établissement, qualification, domaine d’études et année d’obtention du diplôme, la qualification la plus élevée en tête.
  4. Compétences — les aptitudes qu’un lecteur attendrait de ce poste, étiquetées plutôt que notées.
  5. Certifications — les titres réellement courants dans ce secteur et ce pays, chacun avec l’organisme qui le délivre.
  6. Salaire — un champ facultatif, et le seul qui est habituellement omis volontairement d’un dossier de test.

Deux propriétés méritent d’être comprises avant de vous appuyer sur le résultat. La première est que certains champs sont dérivés plutôt qu’indépendants : les années d’expérience découlent des dates, l’année d’obtention du diplôme contraint le moment où le premier poste peut commencer, et le poste actuel apparaît à la fois en haut de la page et comme l’entrée la plus récente de l’historique professionnel. La seconde est la reproductibilité — la même clé d’identité produit le même profil, ce qui permet à un test automatisé de vérifier une valeur précise au lieu de simplement contrôler que quelque chose est arrivé.

Pourquoi le dossier doit-il rester cohérent entre les champs ?

Parce qu’un dossier de carrière est surtout un ensemble de relations, et qu’un défaut dans une relation est invisible pour un test qui n’inspecte que des valeurs.

Chaque champ peut sembler parfaitement raisonnable pris isolément alors que la collection est absurde. L’année d’obtention du diplôme peut être plausible et le premier emploi commencer avant elle. Les deux postes peuvent porter des dates sensées et se chevaucher sur les mêmes mois à temps plein. Le poste actuel peut se lire correctement et porter une date de fin, ce qui affirme que quelqu’un qui travaille ici a déjà quitté l’entreprise. L’expérience totale peut être un chiffre rond qui contredit les dates situées juste en dessous.

Rien de tout cela ne lève d’exception. Un analyseur lira sans broncher une plage de dates inversée dans la base de données, et un formulaire enregistrera sans broncher une entrée de formation terminée après la première fiche de paie. Le défaut refait surface des semaines plus tard, dans un rapport auquel personne ne fait confiance, et le diagnostic habituel est que les données de test étaient erronées — ce qui n’est qu’à moitié vrai. Le test vérifiait des valeurs et les données étaient erronées quant aux relations, et le test n’avait jamais été écrit pour s’en apercevoir.

Un dossier cohérent vaut donc plus qu’un grand tas de dossiers qui ne le sont pas. Un profil satisfaisant chaque règle exerce davantage la mécanique qu’un millier de lignes qui la violent, parce que des données incohérentes sautent les chemins de code intéressants au lieu de les tester.

Pour les développeurs : concevoir le dossier et ses dépendances

Modélisez le profil comme un petit graphe de dossiers avec des dépendances, et non comme une ligne plate de colonnes indépendantes.

Traitez un poste comme une entrée d’emploi portant une date de début et une date de fin où la fin peut être réellement absente, et dérivez tout le reste — la durée, l’expérience totale, l’ordre — de ces dates plutôt que de le stocker à côté d’elles. Stockez l’entrée de formation comme une date d’obtention et dérivez-en l’année d’obtention ; dès que l’année est stockée deux fois, les deux copies seront en désaccord. Stockez un salaire comme un montant accompagné d’un code de devise et d’une période de paie, jamais comme un nombre nu. Là où un champ ne peut pas exister pour un pays et un secteur donnés, laissez-le absent plutôt que de le remplir avec une chaîne plausible, car un champ vide et un champ faux échouent à des endroits complètement différents.

Décidez ensuite l’ordre de génération, car l’ordre est la contrainte. Le pays et le secteur d’abord, puisqu’ils déterminent quels intitulés, compétences et titres sont plausibles. Le poste et le niveau hiérarchique ensuite. La formation appariée au poste plutôt que tirée au hasard. Les compétences et les titres filtrés par les deux mêmes choix. Un générateur plat qui tire chaque champ indépendamment produira un dossier dont les parties sont en désaccord bien plus souvent que l’intuition ne le suggère.

Pour les fixtures, figez le profil que vous vérifiez et régénérez sur la clé plutôt que de retirer au hasard à chaque exécution. Et concevez le dossier de telle sorte qu’il ne puisse jamais être pris pour une personne réelle : des noms d’entreprises jetables, des établissements fictifs et une note livrée avec l’export disant en termes clairs que l’ensemble est synthétique, qu’il existe pour les tests logiciels, les démos de formulaires et l’alimentation de données, et qu’il ne doit pas servir à usurper l’historique professionnel, les qualifications ou les titres de quiconque.

Étapes suivantes

Prenez le plus long formulaire de votre produit qui recueille un parcours et remplissez-le avec exactement un profil généré plutôt qu’avec du texte de substitution, puis soumettez-le et lisez ce qui revient. Cherchez précisément les relations plutôt que les valeurs : le premier poste commence-t-il après l’année d’obtention du diplôme, les entrées s’enchaînent-elles sans se chevaucher, et le poste actuel reste-t-il à extrémité ouverte. Un export qui ne semble correct que champ par champ n’est pas encore des données de test. Les articles sur les règles de chronologie et les fixtures d’analyse décomposent les deux parties les plus difficiles de ce contrôle.

Continuer la lecture

Articles sur Générateur de CV et de données d'emploi fictifs