Un flux de données est un fichier structuré (généralement XML, CSV ou JSON) qui organise les enregistrements de produits ou de contenu d'un marchand en lignes de champs standardisés. Ce flux est mis à jour régulièrement afin que chaque système en aval lise les mêmes informations à jour, évitant ainsi une saisie manuelle. Il sert d'interface entre les systèmes internes de l'entreprise et les plateformes externes qui ont besoin de données produits, faisant office de couche de traduction. Les flux de données constituent la matière première des formats spécifiques à chaque canal, notamment le flux de produits utilisé par Google Shopping ou Meta.
Pourquoi un flux de données est important pour la gestion des flux
Un flux de données est essentiel car il constitue le point unique où les incohérences dans les données commerciales sous-jacentes sont détectées et corrigées avant leur diffusion sur les plateformes de vente. Les systèmes sources, tels qu'un ERP ou un PIM, stockent souvent les informations produits de manière incohérente : différentes équipes saisissent les tailles, les catégories ou les descriptions de façon légèrement différente. Le flux de données sert de point de contrôle où ces variations sont soit repérées et corrigées, soit directement transmises à la marketplace. Les plateformes de gestion des flux utilisent cette étape pour normaliser les données et enrichir les enregistrements avec des métadonnées . Il est bien plus économique de corriger ces erreurs une seule fois, au niveau du flux de données, que de les rechercher individuellement sur chaque canal de vente. Les détaillants qui négligent cette étape en subissent généralement les conséquences plus tard, sous la forme de fiches produits refusées ou d'un référencement moins bon.
Fonctionnement d'un flux de données
Un flux de données est généré en extrayant les fiches produits de leur emplacement de stockage, en associant chaque champ interne au schéma attendu par la destination, et en exportant le résultat sous forme de fichier ou de point de terminaison pouvant être récupéré à intervalles réguliers. C'est également lors de cette étape de génération que s'effectuent les transformations : conversion des unités, association des noms de catégories à la taxonomie du canal, enrichissement des champs manquants et suppression des doublons et des articles obsolètes. Étant donné que le même flux de données sous-jacent alimente souvent plusieurs sorties spécifiques à chaque canal (flux au format Google, flux au format Meta, flux pour réseau d'affiliation), un nettoyage initial du flux de données de base garantit la même précision pour tous les flux produits en aval , évitant ainsi des corrections individuelles.
Exemple : Une ligne de flux de données en XML
<item>
<g:id>SKU-40217</g:id>
<title>Ceramic Pour-Over Coffee Dripper - Matte White</title>
<link>https://example-shop.com/products/ceramic-pour-over-dripper</link>
<g:price>28.50 USD</g:price>
<g:availability>in stock</g:availability>
<g:gtin>00812345678903</g:gtin>
<g:brand>Kettle & Ash</g:brand>
<g:product_type>Home > Kitchen > Coffee & Tea</g:product_type>
</item>
Chaque champ ici reflète une décision prise en amont dans le flux de données : g:product_type reflète une cartographie des catégories appliquée lors de la normalisation, g:gtin reflète un champ de métadonnées extrait d'une base de données produit, et la présence de chaque attribut requis reflète une étape de validation qui a été exécutée avant que cet enregistrement ne soit autorisé dans le résultat final.
Concepts associés
Un flux de données est rarement prêt à l'emploi ; il nécessite généralement une normalisation pour uniformiser les valeurs et métadonnées incohérentes et renseigner les attributs descriptifs sur lesquels un canal est réellement classé avant de pouvoir être utilisé comme flux de produits spécifique à ce canal. Pour une description détaillée, champ par champ, du contenu d'un flux de données bien structuré, consultez notre guide sur les paramètres standard des flux de produits XML.