tawk.to
Se connecter
Toutes les offres d’emploi
IngénierieFull-TimeBangsar South, MY

Responsable technique — identité et intelligence des données

Pilotez la conception et la livraison d’une nouvelle verticale produit — résolution de l’identité des visiteurs et enrichissement des données — bâtie sur la plateforme d’engagement client de tawk.to. Un projet de zéro à un, en collaboration directe avec le CTO.

Présentation du poste

Nous recherchons un responsable technique pour diriger la conception et la livraison d’un nouveau secteur de produits : la résolution de l’identité des visiteurs et l’enrichissement des données, construit sur la plateforme d’engagement client de tawk.to. Cette personne prendra en charge la vision technique et la réalisation d’un graphe d’identité en temps réel exploitant des milliards d’interactions sur des millions de sites web équipés de tawk.to afin d’identifier, de résoudre et d’enrichir les visiteurs anonymes — transformant « visiteur inconnu de Denver » en « Sarah Chen, VP RevOps chez Acme Corp, qui consulte votre page de tarifs pour la troisième fois cette semaine ». Il s’agit d’une création de zéro. Vous concevrez l’architecture du graphe d’identité, sélectionnerez et intégrerez des fournisseurs de données tiers, définirez le modèle de données et livrerez le MVP. Vous travaillerez directement avec le CTO et collaborerez avec les équipes de toute la plateforme pour relier les signaux d’identité de nos produits Chat, Scheduler et Form Builder dans un système de résolution unifié. Si vous avez créé des systèmes de résolution d’identité, travaillé dans une infrastructure de données AdTech ou MarTech, ou conçu des pipelines d’enrichissement à grande échelle, ce poste est pour vous.

Ce que vous allez construire

  • Un graphe d’identité intersites qui relie les empreintes numériques des navigateurs, les cookies, les adresses IP et les coordonnées fournies par les utilisateurs (via le chat, les réservations dans le planificateur et les formulaires envoyés) afin de créer des profils unifiés de personnes et d’entreprises sur des millions de propriétés.
  • Un moteur de résolution en temps réel qui identifie les visiteurs en quelques millisecondes après le chargement de la page grâce à un algorithme en cascade : correspondance de cookie → correspondance d’empreinte → recherche de l’entreprise par IP → fournisseurs d’identité tiers.
  • Un service d’enrichissement en cascade qui enchaîne plusieurs fournisseurs de données externes (People Data Labs, Apollo, Hunter, Proxycurl, IPinfo et d’autres) afin de compléter l’intitulé du poste, le profil LinkedIn, le numéro de téléphone, les données firmographiques et technographiques de l’entreprise et les informations de financement — avec des disjoncteurs, une mise en cache et un séquençage optimisé selon les coûts.
  • Une couche de facturation à l’usage prenant en charge plusieurs niveaux de forfaits payants (enrichissement manuel, désanonymisation en temps réel, suite complète d’intelligence avec score d’intention, alertes et envoi vers le CRM).
  • Une couche d’action et de diffusion comprenant des alertes Slack/webhook en temps réel, des intégrations CRM (HubSpot, Salesforce, Pipedrive), un score d’intention et des déclencheurs automatiques de campagnes.

Architecture système et livraison

  • Concevoir et mettre en œuvre le service de résolution d’identité au sein de notre plateforme de microservices existante, en suivant les principes d’architecture propre et de conception pilotée par le domaine.
  • Prendre en charge le modèle de données : nœuds d’identité (profils de personnes/entreprises), sessions des visiteurs (activité des visites par site) et ingestion des signaux bruts. Choisir et défendre les technologies de stockage et de requête adaptées à chaque charge de travail.
  • Concevoir la stratégie d’empreinte numérique et de collecte des signaux pour le widget côté client.

Intégration des fournisseurs de données

  • Évaluer, négocier et intégrer des API tierces d’enrichissement et de résolution d’identité (People Data Labs, Apollo, Hunter, Proxycurl, IPinfo, Demandbase, FingerprintJS et d’autres).
  • Mettre en œuvre le modèle d’orchestration en cascade avec des disjoncteurs au niveau des fournisseurs, un séquençage de repli, une mise en cache des réponses (basée sur le TTL) et un suivi des coûts.
  • Surveiller la précision des fournisseurs, les taux de correspondance et le coût par enrichissement afin d’optimiser continuellement l’ordre de la cascade.

Scale et performances

  • Concevoir pour la résolution en temps réel — le système doit renvoyer les données d’identité assez vite pour être utile tant que le visiteur se trouve encore sur la page.
  • Concevoir le pipeline d’ingestion des signaux pour traiter à grande échelle des flux d’événements à haut débit.
  • Mettre en œuvre des stratégies intelligentes de mise en cache et de déduplication afin de réduire les coûts des API externes tout en maximisant l’actualité des données.
  • Évaluer et éventuellement introduire des entrepôts de données analytiques (ClickHouse, BigQuery ou similaires) pour les requêtes à haut volume : score d’intention, agrégation de l’activité des visiteurs et analyse de graphes.

Confidentialité et conformité

  • Concevoir le cadre de consentement et de refus pour la résolution d’identité intersites (intérêt légitime du GDPR pour les données B2B au niveau de l’entreprise, mécanismes de consentement pour les données au niveau individuel).
  • Mettre en œuvre les politiques de conservation des données, les parcours de refus et la journalisation des audits.
  • Examiner les conditions de licence des données des fournisseurs tiers et garantir une utilisation conforme des données enrichies sur l’ensemble du réseau.

Leadership technique

  • Définir le plan de création du MVP par phases et piloter sa réalisation avec une petite équipe d’ingénierie.
  • Définir des stratégies de test de la précision de la résolution d’identité (taux de correspondance, taux de faux positifs, taux de complétude de l’enrichissement).
  • Collaborer avec les ingénieurs front-end sur le tableau de bord de surveillance et l’UI d’enrichissement.
  • Travailler avec l’équipe plateforme afin d’exposer les capacités d’identité et d’enrichissement aux services internes et aux workflows assistés par l’AI.

Qualifications requises

  • Expérience : plus de 8 ans en ingénierie back-end, dont au moins 2 à 3 ans consacrés à la création de systèmes à forte intensité de données impliquant la résolution d’identité, des pipelines d’enrichissement, le suivi intersites ou un travail similaire sur des plateformes de données.
  • Connaissance du domaine : expérience pratique d’au moins certains des éléments suivants : empreintes numériques de navigateur, résolution inversée de l’IP vers l’entreprise, graphes d’identité, API de fournisseurs de données tiers (Clearbit, PDL, Apollo, ZoomInfo, FullContact ou similaires), ou infrastructures de données AdTech/MarTech.
  • Modélisation des données : forte intuition pour concevoir des modèles de données adaptés aussi bien aux recherches en temps réel qu’aux requêtes analytiques. Expérience des structures de données de type graphe et des stratégies d’indexation à forte cardinalité, quelle que soit la technologie de base de données utilisée.
  • Intégration d’API : expérience démontrée dans l’intégration, l’orchestration et la gestion de plusieurs API tierces avec limitation du débit, disjoncteurs, mise en cache et optimisation des coûts.
  • Architecture : capacité à concevoir des systèmes conciliant performances en temps réel et maîtrise des coûts. Expérience des stratégies de mise en cache, de l’invalidation basée sur le TTL et des modèles en cascade/de repli.
  • Sensibilisation à la confidentialité : compréhension du GDPR, du CCPA et du cadre de conformité relatif à l’enrichissement des données B2B et à l’identification des visiteurs.

Qualifications souhaitées

  • Expérience dans une entreprise spécialisée dans l’identification des visiteurs, l’intelligence commerciale ou l’enrichissement des données (Clearbit, 6sense, Demandbase, ZoomInfo, RB2B, Warmly, Clay, FullContact ou similaire).
  • Expérience des bases de données analytiques/OLAP (ClickHouse, BigQuery ou similaires) pour les charges d’agrégation à haut volume.
  • Expérience de la collecte de signaux côté navigateur (FingerprintJS, empreinte canvas, empreinte WebGL).
  • Expérience dans la conception de systèmes de facturation à l’usage (mesure des crédits, tarification par niveaux, suivi des dépassements).
  • Connaissance de TypeScript/Node.js, des architectures pilotées par les événements (Kafka ou similaire) et des bases de données NoSQL.
  • Expérience en ingénierie ETL/pipelines de données ou au sein d’équipes de plateforme de données.

Pourquoi ce poste est important

Le widget de chat tawk.to est déployé sur des millions de sites web et génère des milliards d’interactions avec les visiteurs. Aucune autre entreprise du secteur de l’identification des visiteurs ne bénéficie d’un tel avantage en matière de données propriétaires : nos concurrents doivent convaincre leurs clients d’installer un nouveau pixel, tandis que notre widget est déjà en place. Vous construirez le système qui transformera cet actif de données latent en une nouvelle gamme de produits et un important moteur de revenus.

Ce que nous proposons

  • Salaire compétitif avec primes liées aux performances.
  • Possibilité de concevoir et de prendre en charge un produit créé de zéro ayant un impact commercial significatif.
  • Collaboration directe avec le CTO sur la stratégie produit et l’orientation technique.
  • Un environnement de travail collaboratif et dynamique qui valorise l’innovation et la transparence
· Vous hésitez encore ?

Des questions ? avant de postuler ?

Pourquoi ne pas discuter avec nous ? Un membre de notre équipe vous présentera le produit et vous en dira plus sur l’entreprise.