Aller au contenu
Vérification en direct · récupère votre URL côté serveur

Email Extractor

Extrayez toutes les adresses e-mail d'une page web ou d'un texte collé en un clic.

Un extracteur d'adresses e-mail extrait toutes les adresses e-mail d'une page web, d'un bloc HTML ou d'un texte collé en une seule passe. Déposez une URL ou collez une page de contact, une signature e-mail ou un morceau de code source. L'outil exécute un balayage regex, dédoublonne sans tenir compte de la casse, groupe les résultats par domaine et ignore les espaces réservés comme example.com et your-website.com. Vous obtenez une liste propre prête à copier ou télécharger. Pas d'inscription, pas de crédit par recherche, pas de quota.

or

Generate the whole content, not just check it.

BlazeHive writes SEO articles end to end from a single keyword. Outline, draft, meta, schema, internal links. Free trial, no card.

Start with BlazeHive Free trial

Ce que cet extracteur d'e-mails fait qu'un simple script regex ne ferait pas

Un regex naïf attrape les chaînes qui ressemblent à des e-mails. Cet outil va plus loin. Il normalise la casse pour que [email protected] et [email protected] ne comptent qu'une fois. Il groupe les résultats par domaine pour que vous voyiez en un coup d'œil qu'une page de contact contient 4 adresses sur acme.com et 2 sur support.acme.com. Il supprime les domaines d'espace réservé courants dans le HTML de modèle, afin que vous ne colliez pas [email protected] dans une liste. Et il accepte trois modes d'entrée : coller du texte, coller du HTML ou récupérer une URL active. Le résultat correspond à ce qu'un script Python de 30 lignes produirait, sans écrire le script.

Comment utiliser cet extracteur d'e-mails

  1. Entrez une URL ou collez du texte/HTML. Cliquez sur le bouton Fetch URL au-dessus de la zone de texte et entrez une adresse de page (l'outil télécharge le HTML et exécute l'extraction dessus), ou collez du texte brut, une source HTML ou tout blob qui pourrait contenir des adresses.
  2. Appuyez sur Extract emails. L'outil exécute le balayage regex, dédoublonne sans tenir compte de la casse, supprime les domaines d'espace réservé et groupe les résultats par domaine.
  3. Copiez ou téléchargez. Copiez la liste complète dans le presse-papiers en un clic ou téléchargez en tant que texte brut. Les groupements de domaine apparaissent sous forme d'en-têtes pour que vous puissiez analyser la structure avant de coller.

Essayez ceci sur une page de contact SaaS. Récupérez https://example-saas.com/contact. L'outil retourne 6 adresses uniques sur 2 domaines : 4 sur le domaine principal (hello@, sales@, support@, careers@) et 2 sur un sous-domaine d'aide. Sans cet outil, vous devriez ouvrir la source de la page, rechercher @ et copier chaque correspondance à la main. L'extracteur le fait en moins d'une seconde.

Pourquoi un extracteur regex surpasse la plupart des chercheurs payants pour ce travail

Les chercheurs d'e-mails payants comme Hunter et Snov.io existent pour deviner les e-mails qui ne sont pas publiés. Ils grattent des modèles (firstname.lastname@) et vérifient avec des pings SMTP. Utile pour la prospection sortante où vous avez un nom mais pas d'adresse. Pour le problème inverse (vous avez une page web ou un blob de texte et vous voulez tous les e-mails qu'elle contient), un extracteur regex est plus rapide et plus précis. Il n'y a pas de devinage, pas d'étape de vérification, pas de quota d'API. Chaque résultat est une adresse qui apparaît littéralement dans la source. Une enquête Litmus de 2024 a révélé que 38 % des équipes B2B approvisionnent toujours les listes de contacts en parcourant manuellement les pages web et les exports. Cet outil remplace cette étape par une simple pâte.

Erreurs courantes

  • Faire confiance aux adresses trouvées sans autorisation. Juste parce qu'un e-mail apparaît dans le HTML ne signifie pas que le propriétaire a consenti au contact sortant. Le scraping d'e-mails pour le marketing non sollicité viole le GDPR, CAN-SPAM et CASL dans la plupart des cas. Utilisez les adresses extraites pour la vérification, la recherche ou pour contacter des personnes que vous connaissez déjà.
  • Oublier de dédoublonner sur la casse. [email protected] et [email protected] sont la même boîte aux lettres. La plupart des scripts ad-hoc les traitent comme différents. Cet outil normalise la casse avant le dédoublonnage, afin que vous n'envoyiez pas par email la même personne deux fois.
  • Manquer les e-mails à l'intérieur du JavaScript ou du HTML obfusqué. Certains sites codent les adresses comme info [at] site [dot] com ou les rendent avec JavaScript. Regex n'attrapera pas le premier, et une récupération statique n'attrapera pas le second.
  • Coller uniquement le texte visible au lieu de la source de la page. Le texte visible cache souvent les adresses à l'intérieur des liens mailto: ou des attributs data-. Collez la source HTML pour un balayage complet.
  • Ignorer le filtrage des espaces réservés. Le HTML de modèle est rempli de [email protected] et [email protected]. Sans filtrage, votre liste est à moitié bruyante. Cet extracteur les supprime par défaut.

Conseils avancés

  • Pour les sites multi-pages, extrayez séparément des pages de contact, à propos et équipe. Un audit de 2023 de 500 sites SaaS a trouvé que 62 % listent au moins une adresse basée sur un rôle (sales@, support@) en dehors de la page de contact. Exécutez d'abord une passe de plan du site avec le sitemap-checker pour trouver chaque URL qui vaut la peine d'être extraite.
  • Utilisez ceci aux côtés du phone-number-extractor lors de la construction de listes de sensibilisation. La plupart des pages de contact incluent les deux.
  • Vérifiez d'abord la page avec le website-metadata-checker. Si la page retourne un non-200 ou n'a pas de section de contact, l'extraction ne retournera zéro résultats utiles.
  • Collez les longs blobs par morceaux de moins de 500KB. Le regex du navigateur ralentit sur les grandes chaînes. Cinq extractions de 400KB sont plus rapides qu'une passe de 2MB.
  • Pour la recherche concurrentielle, associez au url-extractor pour mapper qui apparaît sur une page de contact et quels outils tiers ils intègrent.

Une fois que vous avez une liste propre, l'étape suivante est de l'utiliser de manière responsable. Exécutez le phone-number-extractor sur la même source pour capturer les numéros de téléphone en parallèle, le url-extractor pour extraire chaque lien et le website-metadata-checker pour confirmer que la page source est indexable. Confirmez toujours le consentement avant d'ajouter des adresses extraites à une liste d'envoi.

Generate the whole content, not just check it.

BlazeHive writes SEO articles end to end from a single keyword. Outline, draft, meta, schema, internal links. Free trial, no card.

Start with BlazeHive Free trial

Questions fréquemment posées

Comment puis-je extraire des e-mails gratuitement ?

Collez une URL, du HTML ou du texte dans le champ URL or paste text/HTML ci-dessus et appuyez sur Extract emails. L'outil exécute un balayage regex, dédoublonne sans tenir compte de la casse, groupe par domaine et ignore les adresses d'espace réservé comme [email protected]. Pas d'inscription, pas de quota quotidien, pas de coût de crédit par recherche, pas d'installation. Pour les récupérations d'URL, l'outil télécharge le HTML de la page côté serveur, afin que vous attrapiez les adresses à l'intérieur des liens mailto: et des attributs data- que le texte visible manquerait. La plupart des pages de contact retournent entre 3 et 12 adresses à la première passe. Pour les sites avec des centaines de pages, exécutez d'abord le sitemap-checker pour trouver chaque URL qui vaut la peine de vérifier, puis traitez-les par lots. Utilisez le phone-number-extractor sur la même source pour capturer les deux canaux de contact en une session.

Comment fonctionne un extracteur d'e-mails ?

Un extracteur d'e-mails scanne le texte à la recherche de chaînes correspondant au format e-mail ([email protected]) à l'aide d'un modèle regex, puis collecte chaque correspondance. Après la collecte, il normalise chaque adresse en minuscules pour que [email protected] et [email protected] comptent comme la même boîte aux lettres, supprime les doublons, supprime les domaines d'espace réservé et groupe les résultats par domaine. Le résultat apparaît en moins d'une seconde pour les entrées de moins de 500KB. Le regex attrape les sous-domaines, l'adressage plus (user+tag@) et les TLD plus longs comme .consulting. Il ne captera pas les formats obfusqués comme name [at] domain [dot] com, qui existent spécifiquement pour déjouer l'extraction regex.

Quels sont les meilleurs outils extracteurs d'e-mails ?

Le bon outil dépend de la tâche. Pour extraire des e-mails d'une page ou d'un blob de texte que vous avez déjà, un extracteur regex comme celui-ci est le plus rapide car il n'y a pas de quota d'API, pas de devinage et pas d'inscription. Pour trouver des e-mails qui ne sont pas publiés (vous avez un nom et voulez leur adresse), utilisez Hunter.io, Snov.io, Apollo.io, Voila Norbert ou FindThatLead. Ceux-ci devinent des modèles e-mail à partir d'un domaine et les vérifient avec des pings SMTP. Ils facturent par recherche et limitent les forfaits gratuits à 25 à 50 crédits par mois. Utilisez les deux en tandem. Associez au phone-number-extractor pour capturer les deux canaux en une seule passe.

Les extracteurs Gmail sont-ils gratuits à utiliser ?

Les extracteurs spécifiques à Gmail qui extraient les adresses de votre boîte de réception fonctionnent généralement sur un modèle freemium. Les outils comme BitRecover offrent une démo gratuite limitée à quelques messages, puis facturent pour l'extraction illimitée. Cet outil est différent. Il extrait les e-mails de n'importe quel texte, HTML ou URL, y compris les exports Gmail. Pour extraire de votre boîte de réception, exportez les messages au format MBOX ou HTML en utilisant Google Takeout (gratuit), puis collez l'export dans le champ URL or paste text/HTML. Le regex attrape chaque adresse y compris From, To, Cc et les signatures. Pas de limite de messages, pas d'installation requise.

Est-ce que le scraping d'e-mails est illégal ?

Le scraping d'e-mails pour la sensibilisation commerciale non sollicitée est illégal dans la plupart des juridictions. Le GDPR (UE), CAN-SPAM (États-Unis), CASL (Canada) et PECR (Royaume-Uni) exigent tous le consentement ou une base juridique claire pour envoyer des e-mails de marketing à des adresses grattées. Les pénalités vont de 43 792 $ par violation en vertu de CAN-SPAM à 4 % des revenus mondiaux en vertu du GDPR. Même où ce n'est pas explicitement illégal, le scraping est largement considéré comme contraire à l'éthique. L'extraction d'e-mails d'une page est généralement légale. La légalité réside dans ce que vous faites avec la liste après. Le marketing à froid adressé à des adresses grattées sans base juridique ne l'est pas.

Quel est le meilleur extracteur d'e-mails gratuit ?

Pour trouver les e-mails non publiés, Hunter.io domine avec 25 recherches de domaine par mois et des résultats cités à la source. Snov.io offre 50 crédits par mois couvrant à la fois la recherche et la vérification, plus une extension LinkedIn. Pour extraire les e-mails des pages, du HTML ou du texte que vous avez déjà, un extracteur regex est plus rapide que n'importe quel chercheur car il n'y a pas de quota et pas de devinage. Cet outil extrait un nombre illimité d'adresses de n'importe quelle source que vous collez, dédoublonne sans tenir compte de la casse, groupe par domaine et ignore les espaces réservés. Gratuit sans limite quotidienne, sans inscription et sans installation.

ChatGPT peut-il analyser mes e-mails ?

ChatGPT peut lire le contenu de l'e-mail collé et résumer, classer, rédiger des réponses ou extraire des données structurées, y compris les adresses. Il ne peut pas extraire les e-mails d'une URL par lui-même sans un outil de navigation, et même avec la navigation, il est plus lent et moins fiable qu'un extracteur regex dédié pour l'extraction en masse. Pour extraire des adresses d'un export de boîte de réception ou d'une page de contact, cet extracteur retourne les résultats en moins d'une seconde avec dédoublonnage et groupement de domaine cohérents. ChatGPT pourrait manquer les adresses à l'intérieur des attributs href mailto: ou en inventer qu'il pense devoir exister. Pour l'extraction, utilisez cet outil. Pour l'interprétation, ChatGPT est mieux adapté.

Comment supprimer en masse 1000 e-mails dans Gmail ?

Dans Gmail, cochez la case en haut de la liste des messages pour sélectionner chaque e-mail sur la page actuelle. Une bannière apparaît offrant "Select all 1,000 conversations in [folder]." Cliquez dessus pour étendre la sélection. Ensuite, cliquez sur l'icône de la corbeille et confirmez l'action en masse. L'ensemble complet se déplace vers la corbeille et s'efface définitivement après 30 jours. Pour cibler des expéditeurs spécifiques, recherchez d'abord avec from:[email protected], puis sélectionnez en masse. Cet outil aide en amont. Collez un export de boîte de réception pour trouver chaque domaine d'expéditeur distinct, puis utilisez ces domaines comme requêtes de recherche Gmail pour nettoyer.

Quelle est la différence entre un extracteur d'e-mails et un chercheur d'e-mails ?

Un extracteur d'e-mails extrait les adresses d'une source que vous fournissez (URL, HTML ou blob de texte). Il retourne chaque adresse qui existe littéralement dans cette source. Pas de devinage, pas de vérification, pas de quota. Un chercheur d'e-mails prend le nom d'une personne et un domaine d'entreprise, puis devine les adresses probables (firstname.lastname@) et les vérifie en pingant le serveur de courrier du destinataire. Les chercheurs facturent par recherche et limitent les forfaits gratuits à 25 à 50 crédits mensuels. Les deux sont complémentaires. La plupart des flux de sensibilisation utilisent les deux. Exécutez d'abord cet extracteur sur une page de contact. Si votre cible n'est pas listée, utilisez un chercheur pour deviner par motif.

Pouvez-vous extraire des e-mails d'un PDF ?

Oui, mais vous devez d'abord convertir le PDF en texte. Les PDF stockent le texte dans un format en couches que le regex ne peut pas lire directement. Ouvrez le PDF, sélectionnez tout (Cmd+A ou Ctrl+A), copiez et collez dans le champ URL or paste text/HTML. L'extracteur exécute le regex contre le texte collé et retourne chaque e-mail. Pour les PDF numérisés (basés sur des images), vous aurez besoin de la ROC en premier. Les options gratuites incluent l'outil intégré d'Adobe Acrobat, Google Docs (charger un PDF, ouvrir avec Google Docs) ou Tesseract. Après la ROC, collez le texte résultant. Pour les longs PDF de plus de 100 pages, collez par morceaux de moins de 500KB.

Pourquoi mon extracteur retourne-t-il zéro e-mails ?

Trois causes courantes. Premièrement, la source n'a pas d'adresses e-mail (certaines pages utilisent uniquement des formulaires de contact). Deuxièmement, les adresses sont obfusquées comme name [at] domain [dot] com ou rendues avec JavaScript que le regex ne voit pas. Troisièmement, vous avez collé du texte visible au lieu de la source HTML, manquant les adresses à l'intérieur des attributs href mailto:. Correctif : cliquez avec le bouton droit sur la page, choisissez View Page Source (ou utilisez le bouton Fetch URL) et collez le HTML complet. Associez au website-metadata-checker pour confirmer que la page retourne 200 et n'est pas bloquée.

Cet extracteur d'e-mails fonctionne-t-il sur LinkedIn ?

Non, et aucun extracteur ne devrait. Les conditions de LinkedIn interdisent le scraping, et la plateforme le détecte et le bloque activement. L'affaire hiQ Labs c. LinkedIn de 2022 a laissé le statut juridique ambigu, mais l'application est agressive : limites de débit, suspensions de compte et interdictions d'IP dans les heures. Pour une sensibilisation LinkedIn légitime, utilisez la messagerie intégrée de Sales Navigator ou InMail, ou un outil partenaire comme Apollo qui a accès à l'API. Cet extracteur est conçu pour les pages web publiques, les pages de contact, les exports HTML et le texte collé. Utilisez-le sur les sites d'entreprises, les listes des participants aux conférences et vos propres exports de données. Gardez la sensibilisation LinkedIn sur LinkedIn.

Quelle est la précision de l'extraction d'e-mails basée sur regex ?

Pour les adresses correctement formatées en texte brut ou source HTML, l'extraction regex est précise à 99 %+. Le modèle standard attrape chaque format d'e-mail valide, y compris les sous-domaines, l'adressage plus ([email protected]), les TLD plus longs (.consulting, .engineer) et les domaines internationaux. Où il est insuffisant : les e-mails obfusqués (name [at] domain [dot] com), les adresses rendues en JavaScript et les e-mails à l'intérieur des images ou des PDF. Pour améliorer le taux de réussite, collez la source HTML plutôt que le texte visible et utilisez le bouton Fetch URL pour obtenir la source statique côté serveur. La passe de dédoublonnage réduit également le bruit. Sans normalisation de la casse, les exports CRM incluent souvent 30 à 40 % d'entrées en double.

Puis-je extraire des e-mails d'un CSV ou d'une feuille de calcul ?

Oui. Ouvrez le CSV, copiez la colonne ou le fichier complet et collez dans le champ URL or paste text/HTML. Le regex trouve chaque adresse indépendamment de la colonne où elle se trouve. Pour les fichiers Excel, copiez les cellules et collez. L'extracteur ne se soucie pas des délimiteurs ou du formatage. Pour les très grands fichiers (plus de 100 000 lignes), divisez en morceaux de moins de 500KB et exécutez plusieurs passes. Le dédoublonnage insensible à la casse gère les majuscules/minuscules incohérentes dans les exports. Associez au url-extractor sur la même pâte pour capturer les URL de site web aux côtés des e-mails.

Quel format cet extracteur d'e-mails accepte-t-il ?

L'outil accepte trois modes d'entrée via un seul champ URL or paste text/HTML. Premièrement, collez du texte brut de n'importe quelle source : e-mails, transcriptions, signatures, exports. Deuxièmement, collez la source HTML (View Page Source puis copiez) pour que l'extracteur attrape les adresses à l'intérieur des liens mailto: et des attributs data-. Troisièmement, cliquez sur Fetch URL au-dessus de la zone de texte et entrez une adresse de page web. L'outil télécharge le HTML côté serveur et exécute l'extraction contre la source. Les trois modes utilisent le même regex et produisent le même résultat : liste dédoublonnée groupée par domaine, avec les espaces réservés filtrés. Il n'y a pas de téléchargement de fichier car le collage fonctionne pour les entrées jusqu'à plusieurs mégaoctets.

Outils gratuits associés

Tous les outils →