L'extraction de données de paiequi comprend le sens.
Chaque employeur met en page ses fiches de salaire différemment, et la même valeur se cache derrière des mots différents : Bruttolohn, Lohn, salario, gross pay. MiruIQ extrait le salaire brut par le sens, avec des schémas sémantiques : une seule définition de champ couvre tous les émetteurs.
Normalisez fiches de salaire et documents RH de n'importe quel émetteur dans un schéma unique, en extrayant par le sens plutôt que par la position.
Les mêmes données, mille mises en page.
Le traitement des documents de paie casse les outils à modèles par construction : chaque émetteur a sa propre mise en page, et les mises en page changent sans préavis. Chaque variation exige une maintenance de modèle, et chaque retard de maintenance entraîne des corrections manuelles.
Le problème plus profond est le vocabulaire. Le salaire brut apparaît sous une douzaine de noms selon les émetteurs et les langues. L'extraction par position ne peut pas savoir qu'il s'agit du même champ ; l'extraction par le sens, si.
La normalisation, étape par étape.
D'une boîte RH hétérogène à un schéma unique et cohérent.
1. Ingestion
Fiches de salaire et documents RH arrivent par dépôt, e-mail ou API, tous formats d'employeurs confondus.
2. Classification
Optionnel : reconnaître d'abord l'émetteur et le type de document, utile quand des types différents exigent des schémas différents.
3. Normalisation
Les schémas sémantiques extraient par le sens : le salaire brut (gross pay) est un seul champ, que le document dise Bruttolohn, Lohn ou salario.
4. Validation
Les champs clés sont contrôlés : les chiffres qui doivent tomber juste sont recalculés, et les extractions à faible confiance partent en revue humaine.
5. Livraison
Les enregistrements normalisés alimentent vos systèmes RH et de paie dans une structure unique et cohérente.
Ce qui change pour les équipes RH.
Zéro maintenance de modèles
Nouvel émetteur, nouvelle mise en page, même schéma : rien à construire ni à maintenir par employeur.
Une vérification plus rapide
L'onboarding et la vérification des salaires n'attendent plus la lecture et la ressaisie manuelles.
Une couverture qui s'étend
L'automatisation couvre tous les émetteurs dès le premier jour, au lieu des dix principaux pour lesquels vous aviez construit des modèles.
Les chiffres sur lesquels juger le système.
Suivez la qualité de la normalisation, pas seulement le débit.
Taux d'exceptions
La part des documents avec des champs manquants ou à faible confiance qui nécessitent un relecteur.
Taux de retraitement
Les documents retraités après une correction : votre signal de lacunes dans le schéma.
Délai jusqu'au premier résultat
De la réception à la sortie normalisée, par document et par nouvel émetteur.
L'extraction de données de paie en questions
Ce que demandent le plus souvent les équipes RH et paie.
Vous définissez une fois les champs dont vous avez besoin (le salaire brut ou gross pay, le net, l'employeur, la période) et MiruIQ les extrait par le sens plutôt que par la position. Le même schéma couvre tous les émetteurs et toutes les langues : Bruttolohn, Lohn et salario atterrissent tous dans le champ gross pay, celui du salaire brut. Il n'y a aucun modèle par employeur, car l'extraction n'est pas préentraînée sur des mises en page.
Non. La maintenance de modèles est exactement ce que ce workflow élimine : l'extraction est générique et pilotée par schéma, si bien qu'une fiche de salaire d'un employeur jamais vu se traite comme celle d'un employeur connu. Les tableaux de paie complexes sont pris en charge, y compris les notes de bas de page qui changent la lecture des valeurs.
La livraison se configure par pipeline : webhook vers votre système RH, insertion directe en base de données, S3 ou récupération par API. Les données sortent dans votre schéma : le système destinataire reçoit une structure unique et cohérente, quelle que soit l'apparence des documents sources. Et le pipeline entier peut tourner on-premise ou en hébergement suisse.
Voyez le résultat sur vos propres documents.
L'essai gratuit de 14 jours couvre 200 documents : de quoi définir vos schémas, traiter de vrais fichiers et mesurer les résultats avant le moindre appel commercial.
