FAQ

Questions fréquentes

Vous ne trouvez pas votre réponse ? Écrivez-nous, nous répondons rapidement.

Qu'est-ce que le web scraping ?

C'est l'extraction automatique d'informations publiées sur des sites web, transformées en données structurées et exploitables : un fichier, une base ou une API. Là où une personne recopierait les annonces une par une, un programme le fait en continu, sans erreur de recopie et à la fréquence voulue.

À quoi servent concrètement les données collectées ?

À décider sur des faits plutôt qu'au ressenti : suivre les prix d'un marché, repérer des prospects, alimenter un comparateur ou un tableau de bord, mesurer la concurrence, ou détecter une opportunité dès sa publication.

Quels types de données pouvez-vous collecter ?

Des données accessibles publiquement sur le web : prix et catalogues e-commerce, annonces immobilières, annuaires et leads B2B, actualités, et bien d'autres selon votre besoin.

Sous quel format livrez-vous les données ?

Au choix : fichier CSV ou Excel, API REST, base de données livrée, ou tableau de bord. Nous adaptons le format à vos outils.

Le scraping est-il légal ?

Nous collectons des données accessibles publiquement et maîtrisons la charge sur les sites consultés. Nous vous conseillons sur le cadre applicable à votre projet ; la responsabilité des finalités d'usage vous revient.

Que se passe-t-il si un site change et casse la collecte ?

Nous remettons l'extracteur à niveau. Selon votre formule, cette intervention est cadrée par contrat.

Les proxies sont-ils inclus ?

Non. Les proxies ne sont pas inclus dans l'abonnement et restent à votre charge.

Pouvez-vous gérer de gros volumes ?

Oui, de quelques milliers à plusieurs millions d'enregistrements, en ponctuel comme en continu.

Travaillez-vous à distance ?

Oui. Nous accompagnons des clients partout en France, et au-delà.

Comment démarre un projet ?

Par un cadrage des sources, des données et du format souhaité, suivi d'un devis clair et adapté.

Sur quels sites pouvez-vous collecter ?

Sur les sites publics de votre secteur, quels qu'ils soient. Nous intervenons couramment sur leboncoin, SeLoger, Bien'ici, PAP, Amazon, Google Maps, PagesJaunes, Indeed, Airbnb, Booking, Tripadvisor et LinkedIn, mais la liste n'a rien de limitatif.

Puis-je demander un site qui ne figure pas dans votre liste ?

Oui. Chaque extracteur est développé sur mesure pour les sources que vous indiquez : la liste affichée sur le site n'est qu'un échantillon des demandes les plus fréquentes.

À quelle fréquence les données sont-elles mises à jour ?

De la collecte ponctuelle au passage continu, selon votre besoin. La fréquence se décide au cadrage, en fonction du rythme auquel la source évolue et de l'usage que vous faites des données.

Combien de temps faut-il pour obtenir une première livraison ?

Cela dépend du nombre de sources, de leur complexité et des protections en place. Le cadrage sert précisément à cela : vous connaissez le délai avant que le développement démarre.

Comment gérez-vous les protections anti-bot ?

Proxies rotatifs, gestion des captchas, furtivité et cadence maîtrisée. L'objectif n'est pas de forcer le passage mais de tenir dans la durée sans surcharger les sites consultés.

Collectez-vous des données derrière un compte ou un mot de passe ?

Non. Nous nous en tenons aux données accessibles publiquement, sans authentification ni contournement d'accès réservé.

Les données collectées contiennent-elles des données personnelles ?

Cela dépend des sources. Lorsqu'une collecte peut en contenir, nous en discutons au cadrage : les champs concernés peuvent être écartés dès l'extraction. Vous restez responsable, au sens du RGPD, de l'usage que vous faites des données livrées.

Comment la qualité des données est-elle contrôlée ?

Un contrôle qualité est appliqué en sortie de collecte : complétude des champs, cohérence des formats et détection des valeurs manquantes ou aberrantes, avant livraison.

Que comprend l'abonnement d'hébergement ?

L'hébergement de votre solution de collecte, son maintien en condition opérationnelle, les mises à jour et la surveillance. Les proxies restent à votre charge.

Combien coûte une collecte ?

L'hébergement démarre à 150 € par mois. Le scraping à la demande et l'infrastructure construite chez vous se chiffrent sur devis, selon les sources, le volume et la fréquence.

Puis-je internaliser la collecte plus tard ?

Oui, c'est l'objet de l'offre Infrastructure chez vous : nous construisons la chaîne de collecte complète dans votre environnement, sur site ou dans votre cloud, puis nous vous la transférons.

À qui appartiennent les données collectées ?

Elles vous sont livrées dans le format convenu et vous en disposez pour votre activité. Les modalités précises figurent au contrat.

Peut-on obtenir un historique des données ?

Une collecte capture ce qui est publié au moment du passage. Un historique se construit donc en programmant des passages réguliers, dont les résultats sont conservés et horodatés.

Que se passe-t-il après la livraison ?

Selon la formule retenue : maintenance, surveillance et évolutions pour que la collecte reste fiable dans le temps, ou remise complète si vous reprenez la main.

Vous n'avez pas trouvé votre réponse ?

Posez votre question directement, nous répondons généralement sous un jour ouvré.

Poser une question

Parlons de votre projet de données

Décrivez-nous votre besoin (sources, volume, fréquence, format) et nous revenons vers vous rapidement.