{"allowedRenditionsWidth":["320","480","640","768","960","1200","1440","1920"],"templateName":"base-page-template54","cssClassNames":"page basicpage summit-page","description":"Découvrez ce qu’est le feature engineering (ou ingénierie des caractéristiques), pourquoi il est essentiel en machine learning et quelles techniques améliorent la précision, la généralisation et la fiabilité en production des modèles.","language":"fr","title":"Feature engineering : techniques, processus et exemples | Snowflake","analyticsPageType":"homepage","analyticsCategory":"general","analyticsSubCategory":"","excludeFromAnalytics":false,"isPasswordProtected":false,"analyticsContentTags":[],"analyticsEnabled":true,"coveoConfig":{"pipeline":"snowflake.com","apiKey":"xx335921a6-2a0a-40f2-a167-e390b4766c3d","organizationId":"snowflakecomputingproduction8neljofn","searchHub":"snowflake.com"},"analyticsDebugMode":false,"analyticsData":{"excludeFromAnalytics":false,"subCategory":"","pageType":"homepage","templateName":"base-page-template54","siteName":"snowflake","pageUrl":"/content/snowflake-site/global/fr/artificial-intelligence/machine-learning/feature-engineering","language":"fr","category":"general","pageName":"Feature engineering : les décisions qui déterminent la qualité d’un modèle de ML","contentTags":[]},":type":"snowflake-site/components/structure/page",":mappedPath":"/fr/artificial-intelligence/machine-learning/feature-engineering/",":items":{"root":{"columnCount":12,"gridClassNames":"aem-Grid aem-Grid--12 aem-Grid--default--12","columnClassNames":{"markup_editor_928258845":"aem-GridColumn aem-GridColumn--default--12","experiencefragment-banner":"aem-GridColumn aem-GridColumn--default--12","experiencefragment-header":"aem-GridColumn aem-GridColumn--default--12","responsivegrid":"aem-GridColumn aem-GridColumn--default--12","markup_editor_597730182":"aem-GridColumn aem-GridColumn--default--12","experiencefragment-footer":"aem-GridColumn aem-GridColumn--default--12","experiencefragment":"aem-GridColumn aem-GridColumn--default--12","modal_container":"aem-GridColumn aem-GridColumn--default--12","markup_editor":"aem-GridColumn aem-GridColumn--default--12"},":items":{"experiencefragment-banner":{"id":"experiencefragment-a6936d3a65","localizedFragmentVariationPath":"/content/experience-fragments/snowflake-site/language-masters/fr/site/pushdown-banner/master/jcr:content","configured":true,"xfModelPath":"/content/experience-fragments/snowflake-site/language-masters/fr/site/pushdown-banner/master.xfmodel.json?callerPage=/content/snowflake-site/global/fr/artificial-intelligence/machine-learning/feature-engineering",":type":"snowflake-site/components/experiencefragment"},"experiencefragment-header":{"id":"experiencefragment-8790a0ca8f","localizedFragmentVariationPath":"/content/experience-fragments/snowflake-site/language-masters/fr/site/mega-nav-header/master/jcr:content","configured":true,"xfModelPath":"/content/experience-fragments/snowflake-site/language-masters/fr/site/mega-nav-header/master.xfmodel.json?callerPage=/content/snowflake-site/global/fr/artificial-intelligence/machine-learning/feature-engineering",":type":"snowflake-site/components/experiencefragment"},"responsivegrid":{"columnCount":12,"gridClassNames":"aem-Grid aem-Grid--12 aem-Grid--default--12","columnClassNames":{"flexible_column_cont_939100716":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_1158003461":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_663228916":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_912630531":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_1398138236":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_1786318617":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_1467213961":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_1377146023":"aem-GridColumn aem-GridColumn--default--12"},":items":{"flexible_column_cont":{"id":"flexible-column-container-cee479dc11","propertiesId":"hub-hero-breadcrumbs","type":"1-column","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"small","bottomPadding":"none","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"propertiesCSSClasses":"page-section","backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"container-b118e8148a",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"breadcrumb":{"id":"breadcrumb-b1d2515e2a","items":[{"id":"breadcrumb-b1d2515e2a-item-8fdfff6b6b","link":{"valid":true,"url":"/fr/artificial-intelligence/"},"active":false,"current":false,"title":"Intelligence artificielle",":type":"snowflake-site/components/structure/page","appliedCssClassNames":"summit-page"},{"id":"breadcrumb-b1d2515e2a-item-93eeea960a","link":{"valid":true,"url":"/fr/artificial-intelligence/machine-learning/"},"active":false,"current":false,"title":"Machine learning",":type":"snowflake-site/components/structure/page","appliedCssClassNames":"summit-page"},{"id":"breadcrumb-b1d2515e2a-item-48cf16b393","link":{"valid":true,"url":"/fr/artificial-intelligence/machine-learning/feature-engineering/"},"active":true,"current":true,"title":"Feature Engineering",":type":"snowflake-site/components/structure/page","appliedCssClassNames":"summit-page"}],":type":"snowflake-site/components/breadcrumb"}},":itemsOrder":["breadcrumb"]},"isBlogPage":false,"isActiveTOC":false,":type":"snowflake-site/components/flexible-column-container","appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_939100716":{"id":"flexible-column-container-de9741769f","propertiesId":"hub-hero","type":"2-column-even","alignColumns":"center","containerMaxWidth":"extra-large","topPadding":"extra-small","bottomPadding":"extra-small","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"propertiesCSSClasses":"page-section","backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"container-fb76698a06",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"title_v2":{"id":"title-v2-63d5f74b23","additionalClasses":"hub-hero__headline","type":"heading1","lines":["Feature engineering : les décisions qui façonnent la qualité d’un modèle de ML"],":type":"snowflake-site/components/title-v2","appliedCssClassNames":"left-alignment"},"text":{"id":"text-66a75bb87f","additionalClasses":"hub-hero__subheadline","text":"\u003Cp\u003ELe feature engineering transforme les données brutes en signaux qu’un modèle de machine learning peut réellement exploiter. Cet article explique pourquoi ces choix de représentation déterminent la précision des modèles, leur capacité de généralisation et leur fiabilité en production.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"},"container":{"additionalClasses":"hub-hero__authors","layout":"RESPONSIVE_GRID","columnCount":12,"gridClassNames":"aem-Grid aem-Grid--12 aem-Grid--default--12","columnClassNames":{"content_chip_copy":"aem-GridColumn aem-GridColumn--default--12","content_chip":"aem-GridColumn aem-GridColumn--default--12"},"id":"container-5694f1c6e1",":type":"snowflake-site/components/container",":items":{"content_chip":{"id":"content-chip-75785a799e","cta":{"id":"cta","showOutboundIcon":false,"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_INTERNAL","text":"Lire la biographie"},"image":{"id":"image","height":"800","src":"https://www.snowflake.com/adobe/dynamicmedia/deliver/dm-aid--a7e9fdff-6f08-4edc-9cd1-e213bb234aaa/laurie-macpherson.jpg?preferwebp=true&quality=85","alt":"Laurie MacPherson","lazyEnabled":true,"width":"800",":type":"snowflake-site/components/image"},"headline":{"id":"title","type":"heading5","lines":["Laurie MacPherson","Technical Writer, Snowflake"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip"},"content_chip_copy":{"id":"content-chip-5946b0ff12","cta":{"id":"cta","showOutboundIcon":false,"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_INTERNAL","text":"Lire la biographie"},"image":{"id":"image","height":"709","src":"https://www.snowflake.com/adobe/dynamicmedia/deliver/dm-aid--9ad7a3c0-e23e-4370-bc36-f59a5fe02eff/img-1817.jpg?preferwebp=true&quality=85","alt":"David Gaule","lazyEnabled":true,"width":"709",":type":"snowflake-site/components/image"},"headline":{"id":"title","type":"heading5","lines":["Tracy Kabuya","Contributrice locale, Snowflake"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip"}},":itemsOrder":["content_chip","content_chip_copy"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-small"}},":itemsOrder":["title_v2","text","container"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-extra-small"},"flexible_column_content_container_2":{"additionalClasses":"hub-hero__video-column","layout":"SIMPLE","id":"container-504647d6d4",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"youtube":{"id":"embed-d2b5ee10ec","youtubeVideoId":"-HWNc-Hd90U","layout":"responsive","youtubeAspectRatio":"56.25","youtubeAutoPlay":false,"youtubeLoop":false,"youtubeMute":false,"youtubePlaysInline":false,"youtubeRel":false,"embeddableResourceType":"core/wcm/components/embed/v1/embed/embeddable/youtube","type":"EMBEDDABLE",":type":"snowflake-site/components/youtube"}},":itemsOrder":["youtube"]},"isBlogPage":false,"isActiveTOC":false,":type":"snowflake-site/components/flexible-column-container","appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_1398138236":{"id":"flexible-column-container-c7e454d22e","propertiesId":"hub-hero-related-topics","type":"1-column","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"extra-small","bottomPadding":"medium","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"propertiesCSSClasses":"page-section","backgroundImageOption":"none","flexible_column_content_container_1":{"additionalClasses":"related-topics-outer-container border-top","layout":"SIMPLE","id":"container-9f48843517",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"text_894059747":{"id":"text-b9088f1569","additionalClasses":"seo-hub-hero__related-topic-label","text":"\u003Cp\u003ESujets liés au Machine Learning :\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"},"text":{"id":"text-4823a2256c","additionalClasses":"related-topics ","text":"\u003Cul\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/en/artificial-intelligence/machine-learning/automl/\"\u003EAutoML\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/fr/artificial-intelligence/machine-learning/deep-learning/\"\u003EDeep learning\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/en/artificial-intelligence/machine-learning/frameworks/\"\u003EFrameworks ML\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/fr/artificial-intelligence/machine-learning/inference/\"\u003EInférence\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/en/artificial-intelligence/machine-learning/models/\"\u003EModèles de ML\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/fr/artificial-intelligence/machine-learning/mlops/\"\u003EMLOps\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/en/artificial-intelligence/machine-learning/neural-network/\"\u003ERéseaux neuronaux\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/fr/artificial-intelligence/machine-learning/reinforcement-learning/\"\u003EApprentissage par renforcement\u003C/a\u003E\u003C/li\u003E\n\u003C/ul\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-small"}},":itemsOrder":["text_894059747","text"]},"isBlogPage":false,"isActiveTOC":false,":type":"snowflake-site/components/flexible-column-container","appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_663228916":{"id":"flexible-column-container-735277eb5a","propertiesId":"hub-body","type":"2-column-60-40","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"medium","bottomPadding":"medium","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"propertiesCSSClasses":"page-section","backgroundImageOption":"none","flexible_column_content_container_1":{"additionalClasses":"longform-content","layout":"SIMPLE","id":"hub-body-content",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"callout__0":{"id":"text-50602c1fd1","additionalClasses":"callout callout--general","text":"\u003Cp\u003E\u003Cstrong\u003EDÉFINITION DU FEATURE ENGINEERING\u003C/strong\u003E\u003C/p\u003E\n\u003Cp\u003ELe feature engineering consiste à créer, transformer et sélectionner des entrées de modèle à partir de données brutes, afin qu’un modèle de machine learning puisse détecter des schémas utiles et produire de meilleures prédictions.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"},"text__0":{"id":"text-942fc80728","text":"\u003Cp\u003EUn lundi matin, un nouveau modèle de machine learning passe en production. À l’heure du déjeuner, les analystes croulent sous les faux positifs. Des cas prioritaires passent inaperçus, des cas courants sont remontés et personne n’arrive à expliquer pourquoi la performance du modèle en conditions réelles s’écarte autant de ses résultats de validation.\u003C/p\u003E\n\u003Cp\u003ELe problème ne vient pas forcément de l’algorithme. Peut-être tient-il à la manière dont les données ont été représentées. Peut-être que les montants de transaction ont été utilisés comme valeurs brutes, sans que le modèle voie à quel point un achat était inhabituel pour ce client précis. Ou peut-être que les catégories ont été encodées d’une manière qui a introduit des relations trompeuses. Le modèle a peut-être été entraîné sur des données exactes, mais les signaux contenus dans ces données n’ont pas été correctement traduits.\u003C/p\u003E\n\u003Cp\u003EC’est précisément le rôle du feature engineering : transformer les données brutes en entrées qu’un modèle de machine learning peut réellement exploiter. Il englobe des tâches classiques de préparation des données, comme le traitement des valeurs manquantes, l’encodage des catégories et la mise à l’échelle des champs numériques. Mais il implique aussi des choix de représentation plus profonds sur ce que le modèle doit savoir, et sous quelle forme. Ces choix déterminent la quantité de signal utile qui parvient au modèle, ainsi que son niveau de performance face à des données réelles.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_what-is-feature-engineering":{"id":"title-v2-daedcdb913","additionalClasses":"anchor-title anchor-title--what-is-feature-engineering","type":"heading2","lines":["Qu’est-ce que le feature engineering ?"],":type":"snowflake-site/components/title-v2"},"text_what-is-feature-engineering_0":{"id":"text-a7c6b11b01","text":"\u003Cp\u003ELe feature engineering consiste à utiliser l’expertise métier pour créer, transformer et sélectionner des variables d’entrée, appelées features, à partir de données brutes, afin qu’un modèle de machine learning puisse produire des prédictions plus précises.\u003C/p\u003E\n\u003Cp\u003EUne feature peut être une colonne source utilisée directement, comme le montant d’une transaction ou l’ancienneté d’un compte en jours. Elle peut aussi être dérivée, comme la valeur moyenne des commandes d’un client au cours des 90 derniers jours, le nombre de tentatives d’authentification échouées au cours de la dernière heure, ou un ratio entre deux mesures qui, prises isolément, en disent moins qu’ensemble.\u003C/p\u003E\n\u003Cp\u003ELe feature engineering se situe entre les données brutes et l’entraînement du modèle. Les équipes extraient des signaux des systèmes sources, les transforment en entrées prêtes pour le modèle, évaluent ceux qui améliorent la performance de validation, puis intègrent la logique approuvée dans des pipelines de features ou dans un \u003Ca href=\"https://www.snowflake.com/en/fundamentals/feature-store/\"\u003Efeature store\u003C/a\u003E afin de la réutiliser. Choisir les features dont un modèle a besoin, c’est aussi définir ce que le modèle doit comprendre du domaine.\u003C/p\u003E\n\u003Cp\u003ELe feature engineering exige une collaboration entre data scientists, data engineers et experts métier, car il encode dans le modèle la compréhension que l’équipe a de l’enjeu business. Bien exécuté, il compte parmi les activités à plus fort effet de levier dans le cycle de vie du \u003Ca href=\"https://www.snowflake.com/fr/artificial-intelligence/machine-learning/\"\u003Emachine learning\u003C/a\u003E.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_why-feature-engineering-matters-for-model-accuracy-and-generalization":{"id":"title-v2-33ca1e1a5a","additionalClasses":"anchor-title anchor-title--why-feature-engineering-matters-for-model-accuracy-and-generalization","type":"heading2","lines":["Pourquoi le feature engineering est essentiel à la précision et à la généralisation des modèles"],":type":"snowflake-site/components/title-v2"},"text_why-feature-engineering-matters-for-model-accuracy-and-generalization_0":{"id":"text-c50addfa5f","text":"\u003Cp\u003ELa qualité d’un modèle est limitée par ses entrées. Aucun choix d’algorithme, aucun réglage d’hyperparamètres ni aucune puissance de calcul ne fera réapparaître un signal qui n’était pas présent dès le départ dans le jeu de features. C’est avec le feature engineering que ce plafond se fixe, et c’est aussi là que les équipes contrôlent plus directement la qualité du modèle qu’à presque tout autre moment du cycle de vie du ML.\u003C/p\u003E\n\u003Cp\u003ECe plafond se joue notamment dans la représentation. Les mêmes données sous-jacentes, exprimées autrement, donnent au modèle une lecture fondamentalement différente du problème. Prenons un modèle d’attrition bâti sur des données d’utilisation des produits. Le nombre brut de connexions sur les 30 derniers jours indique au modèle le niveau d’activité d’un client. Mais ce qui prédit vraiment l’attrition, c’est souvent l’évolution de cette activité : un client qui se connecte deux fois moins souvent qu’il y a 60 jours n’est pas dans la même situation qu’un client qui s’est toujours connecté à ce rythme. Les données sous-jacentes sont les mêmes. Exprimées sous forme de tendance plutôt que de simple comptage, elles portent un signal que la valeur brute seule ne révèle pas.\u003C/p\u003E\n\u003Cp\u003EL’article fondateur de Pedro Domingos, \u003Ca href=\"https://homes.cs.washington.edu/~pedrod/papers/cacm12.pdf\" target=\"_blank\"\u003EA Few Useful Things to Know About Machine Learning,\u003C/a\u003E présente la représentation comme l’un des problèmes centraux du machine learning. Le constat reste valable : si les features disponibles ne capturent pas la structure du problème, l’algorithme dispose de moins d’informations, quel que soit son réglage.\u003C/p\u003E\n\u003Cp\u003ELe feature engineering influe aussi sur la généralisation. Un modèle entraîné sur des features qui reflètent des motifs réels et durables dans les données a plus de chances de produire des prédictions précises lorsqu’il rencontre de nouveaux clients, de nouveaux produits ou un environnement opérationnel différent. Un modèle entraîné sur des features qui se trouvent corrélées à la cible pendant la période d’entraînement, mais pour des raisons fortuites, se dégradera plus vite en production.\u003C/p\u003E\n\u003Cp\u003E\u003Cem\u003ERegardez cette vidéo pour découvrir comment simplifier le feature engineering avec le ML agentique :\u003C/em\u003E\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"yt_why-feature-engineering-matters-for-model-accuracy-and-generalization_0":{"id":"embed-420da241df","youtubeVideoId":"zARMUTv_H5Y","layout":"responsive","youtubeAspectRatio":"56.25","youtubeAutoPlay":false,"youtubeLoop":false,"youtubeMute":false,"youtubePlaysInline":false,"youtubeRel":false,"embeddableResourceType":"core/wcm/components/embed/v1/embed/embeddable/youtube","type":"EMBEDDABLE",":type":"snowflake-site/components/youtube"},"title_the-feature-engineering-process":{"id":"title-v2-5d1b88b229","additionalClasses":"anchor-title anchor-title--the-feature-engineering-process","type":"heading2","lines":["Le processus de feature engineering"],":type":"snowflake-site/components/title-v2"},"text_the-feature-engineering-process_0":{"id":"text-5401bd3358","text":"\u003Cp\u003ELe feature engineering part généralement du problème de prédiction, puis remonte jusqu’aux données. Une équipe qui construit une prévision de la demande a besoin de signaux différents de ceux d’une équipe qui classe des tickets de support, par exemple, même si les deux utilisent des données client, produit et de séries temporelles.\u003C/p\u003E\r\n\u003Cp\u003EUn processus efficace comprend généralement les étapes suivantes&nbsp;:\u003C/p\u003E\r\n\u003Col\u003E\r\n\u003Cli\u003E\u003Cb\u003Ecomprendre les données et le problème&nbsp;:\u003C/b\u003E définissez la cible de prédiction, la décision que le modèle soutiendra et les contraintes liées à la latence, à l’explicabilité et à l’accès aux données.\u003C/li\u003E\r\n\u003Cli\u003E\u003Cb\u003EExplorer et analyser les données brutes&nbsp;:\u003C/b\u003E examinez les distributions, les valeurs manquantes, les anomalies, les corrélations, la cardinalité des catégories et les schémas temporels.\u003C/li\u003E\r\n\u003Cli\u003E\u003Cb\u003ECréer et transformer des features&nbsp;:\u003C/b\u003E dérivez des mesures comme des ratios, des fenêtres glissantes, des comptages, des indicateurs, des interactions et des valeurs normalisées.\u003C/li\u003E\r\n\u003Cli\u003E\u003Cb\u003EÉvaluer la pertinence des features&nbsp;:\u003C/b\u003E utilisez des tests statistiques, des mesures d’importance fondées sur le modèle, une revue par des experts métier et les résultats de validation pour identifier les features qui portent un signal utile.\u003C/li\u003E\r\n\u003Cli\u003E\u003Cb\u003EValider par les performances du modèle&nbsp;:\u003C/b\u003E entraînez et testez des modèles au moyen d’expériences contrôlées, en surveillant les fuites d’informations, le surapprentissage et la dérive entre les données d’entraînement et les données de production.\u003C/li\u003E\r\n\u003C/ol\u003E\r\n\u003Cp\u003ELe processus est itératif. Un data scientist peut dériver des ratios, des comptages, des agrégats glissants, des features de décalage, des indicateurs, des encodages catégoriels ou des termes d’interaction, puis tester si ces entrées améliorent la performance sur des données mises de côté. Certaines features se révèlent utiles immédiatement. D’autres sont écartées parce qu’elles provoquent une fuite d’informations liée à la feature, varient trop d’une période à l’autre ou dépendent de données indisponibles au moment de \u003Ca href=\"https://www.snowflake.com/fr/artificial-intelligence/machine-learning/inference/\"\u003El’inférence\u003C/a\u003E.\u003C/p\u003E\r\n\u003Cp\u003ELe processus exige de la rigueur, car la logique des features peut se disperser et diverger. Un calcul testé dans un notebook, reformulé dans un pipeline d’entraînement puis réécrit une troisième fois pour un service de scoring en temps réel peut produire trois valeurs légèrement différentes pour le même concept sous-jacent. Les pipelines de features reproductibles et les feature stores existent pour prévenir ce type de dérive, en conservant les définitions utilisées pendant l’entraînement et en les rendant disponibles de façon cohérente pour l’inférence en batch ou en temps réel.\u003C/p\u003E\r\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_feature-engineering-techniques":{"id":"title-v2-ffe9a9e7e9","additionalClasses":"anchor-title anchor-title--feature-engineering-techniques","type":"heading2","lines":["Techniques de feature engineering"],":type":"snowflake-site/components/title-v2"},"text_feature-engineering-techniques_0":{"id":"text-4bdc72940d","text":"\u003Cp\u003ELe feature engineering s’appuie sur un large éventail de techniques. Certaines préparent les données brutes à la modélisation. D’autres construisent de nouveaux signaux à partir de champs existants. La bonne combinaison dépend du type de données, de la famille de modèles et de la décision que le modèle doit soutenir.\u003C/p\u003E\n\u003Ch3\u003EImputation et traitement des anomalies\u003C/h3\u003E\n\u003Cp\u003ELes valeurs manquantes doivent être interprétées avant d’être traitées. Un champ vide peut indiquer qu’une valeur était inconnue, facultative, retenue, indisponible au moment de la collecte ou réellement absente. L’imputation comble les lacunes au moyen de méthodes comme la moyenne, la médiane, le mode, des valeurs constantes ou des estimations fondées sur le modèle. Dans de nombreux cas, les équipes ajoutent aussi un indicateur binaire de valeur manquante, ce qui permet au modèle d’apprendre si l’absence d’une valeur apporte elle-même de l’information, et c’est souvent le cas.\u003C/p\u003E\n\u003Cp\u003ELes anomalies exigent elles aussi du discernement. Une transaction exceptionnellement élevée peut correspondre à une fraude, à un achat légitime d’entreprise ou à une erreur de saisie des données. Les équipes peuvent plafonner les valeurs à un seuil, appliquer une transformation qui réduit l’asymétrie, supprimer les enregistrements manifestement erronés ou conserver les valeurs extrêmes lorsqu’elles reflètent un comportement significatif que le modèle doit détecter. Le traitement des anomalies est un choix de représentation, car il définit la version de la réalité sur laquelle le modèle s’entraîne.\u003C/p\u003E\n\u003Ch3\u003EMise à l’échelle et normalisation\u003C/h3\u003E\n\u003Cp\u003ELa mise à l’échelle ajuste la plage des features numériques afin que les écarts de grandeur ne créent pas de différences artificielles dans le comportement du modèle. La mise à l’échelle min‑max projette les valeurs dans un intervalle fixe. La standardisation par Z‑score exprime les valeurs par rapport à la moyenne et à l’écart type de la distribution. La mise à l’échelle robuste s’appuie sur la médiane et l’écart interquartile, une approche moins sensible aux anomalies que les méthodes fondées sur la moyenne.\u003C/p\u003E\n\u003Cp\u003ELa sensibilité à la mise à l’échelle varie selon le type de modèle. Les modèles linéaires, les réseaux neuronaux et les algorithmes fondés sur la distance sont davantage affectés par des features qui ne sont pas mises à l’échelle. Les modèles fondés sur des arbres de décision sont généralement moins sensibles, même si les équipes peuvent standardiser le prétraitement lorsque le même ensemble de features alimente plusieurs modèles ou systèmes en aval.\u003C/p\u003E\n\u003Ch3\u003EEncodage des variables catégorielles\u003C/h3\u003E\n\u003Cp\u003ELa plupart des modèles de ML exigent que les valeurs catégorielles soient exprimées sous forme numérique. L’encodage one‑hot crée une colonne d’indicateur binaire pour chaque catégorie, une approche simple lorsque la cardinalité est faible. L’encodage ordinal préserve un ordre porteur de sens, par exemple faible, moyen et élevé. L’encodage des étiquettes (label encoding) attribue des identifiants entiers aux catégories, mais peut suggérer par inadvertance un ordre qui n’existe pas.\u003C/p\u003E\n\u003Cp\u003ELes champs à forte cardinalité, tels que les identifiants de marchands, les SKU produits ou les codes géographiques, demandent plus d’attention. Une catégorie qui compte des milliers de niveaux rend l’encodage one‑hot impraticable. L’encodage par la cible (target encoding) et l’encodage par la moyenne (mean encoding) peuvent aider en remplaçant les étiquettes de catégories par des statistiques dérivées de la cible de prédiction. En revanche, ces approches nécessitent une validation rigoureuse afin d’éviter toute fuite de données provenant du jeu de données de validation.\u003C/p\u003E\n\u003Ch3\u003ETransformation, regroupement en intervalles et discrétisation\u003C/h3\u003E\n\u003Cp\u003ELes transformations ajustent la distribution d’une feature ou sa relation avec la cible. Une transformation logarithmique peut réduire l’influence des valeurs situées dans la longue traîne d’une distribution, comme le chiffre d’affaires, la durée des sessions ou le solde d’un compte. \u003Ca href=\"https://www.statisticshowto.com/probability-and-statistics/normal-distributions/box-cox-transformation/\" target=\"_blank\"\u003EBox-Cox\u003C/a\u003E et les transformations associées peuvent rendre les features numériques plus adaptées aux modèles qui reposent sur des hypothèses de distribution, même si Box-Cox exige des valeurs strictement positives.\u003C/p\u003E\n\u003Cp\u003E\u003Ca href=\"https://developers.google.com/machine-learning/crash-course/numerical-data/binning\" target=\"_blank\"\u003ELe regroupement en intervalles\u003C/a\u003E (binning) regroupe les valeurs continues en intervalles discrets. Un modèle peut recevoir des tranches d’âge au lieu de l’âge brut, des tranches d’ancienneté au lieu du nombre exact de jours depuis l’inscription, ou des niveaux de dépenses au lieu des montants de transaction. Le regroupement en intervalles peut rendre certains schémas plus faciles à apprendre et, dans les contextes réglementés, plus simples à expliquer. Lorsque des seuils de domaine comptent déjà, par exemple des seuils réglementaires, des limites de niveaux de produit ou des plages cliniques, les intervalles qui s’y alignent produisent souvent des features plus pertinentes que les valeurs numériques brutes.\u003C/p\u003E\n\u003Ch3\u003ECréation de features\u003C/h3\u003E\n\u003Cp\u003ELa création de features est l’étape où la connaissance du domaine produit l’impact le plus direct. Pour la prévision de la demande, un retailer peut avoir besoin de features sur le rythme récent des ventes, le niveau des stocks, le calendrier des promotions et la proximité d’événements locaux. Un modèle de sécurité peut avoir besoin de la fréquence des échecs de connexion, de scores de nouveauté des appareils, d’indicateurs de déplacement impossible et d’écarts comportementaux par rapport à la référence propre au compte. Un modèle de santé client peut avoir besoin des tendances d’engagement produit, des schémas d’interactions avec le support et des changements de statut contractuel.\u003C/p\u003E\n\u003Cp\u003ELe croisement de features combine des champs pour capturer les interactions : catégorie de produit par région, segmentation client par canal, type d’appareil par moment de la journée. Les features polynomiales aident certaines familles de modèles à représenter des relations non linéaires. Les features temporelles extraient la structure des horodatages : heure de la journée, jour de la semaine, temps écoulé depuis le dernier événement, moyennes glissantes, valeurs décalées et encodages cycliques pour les schémas récurrents.\u003C/p\u003E\n\u003Ch3\u003ERéduction de la dimensionnalité\u003C/h3\u003E\n\u003Cp\u003ELorsqu’un jeu de données est vaste, bruité ou fortement corrélé, les méthodes de réduction de la dimensionnalité peuvent condenser l’espace des features tout en préservant les informations utiles. L’analyse en composantes principales projette des features numériques corrélées dans un ensemble plus restreint de composantes. Les autoencodeurs et méthodes similaires peuvent apprendre des représentations compactes à partir d’entrées plus complexes.\u003C/p\u003E\n\u003Cp\u003ELe compromis se joue sur l’interprétabilité. Une représentation réduite peut améliorer l’efficacité du modèle et parfois sa performance, mais les composantes obtenues peuvent ne correspondre à rien qu’un expert métier puisse interpréter. Pour les cas d’usage à fort enjeu ou réglementés, cette perte de transparence a des conséquences réelles, et les équipes doivent mettre en balance le bénéfice obtenu et ce qu’elles abandonnent.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"callout_feature-engineering-techniques_0":{"id":"text-d062f7cfae","additionalClasses":"callout callout--warning","text":"\u003Cp\u003E\u003Cstrong\u003EPIÈGE COURANT\u003C/strong\u003E\u003C/p\u003E\n\u003Cp\u003ELe feature engineering ne doit pas être traité comme une simple étape mécanique de prétraitement. Le traitement des valeurs manquantes, l’encodage des catégories ou la création de moyennes glissantes impliquent tous des décisions importantes qui exigent du discernement.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"},"title_feature-engineering-vs-feature-selection-vs-feature-extraction-vs-feature-stores":{"id":"title-v2-e674fb5aa8","additionalClasses":"anchor-title anchor-title--feature-engineering-vs-feature-selection-vs-feature-extraction-vs-feature-stores","type":"heading2","lines":["Feature engineering vs. sélection de features vs. extraction de features vs. feature stores"],":type":"snowflake-site/components/title-v2"},"text_feature-engineering-vs-feature-selection-vs-feature-extraction-vs-feature-stores_0":{"id":"text-5b470d0ccc","text":"\u003Cp\u003ECes termes apparaissent souvent ensemble, car ils sont très proches dans le workflow de ML. Voici un bref aperçu de chacun.\u003C/p\u003E\n\u003Ch3\u003EFeature engineering\u003C/h3\u003E\n\u003Cp\u003ELe feature engineering désigne la pratique générale qui consiste à préparer les entrées d’un modèle à partir de données brutes. Il englobe la création de features, la transformation des valeurs, la gestion des données manquantes, l’encodage des catégories, l’application de la réduction de dimensionnalité et l’identification des features à utiliser pour l’entraînement. Les autres activités ci-dessous sont des sous-ensembles de ce travail plus large, ou viennent le compléter.\u003C/p\u003E\n\u003Ch3\u003ESélection de features\u003C/h3\u003E\n\u003Cp\u003ELa sélection de features détermine quelles features de l’ensemble disponible doivent entrer dans le modèle. Les équipes écartent les features redondantes, instables, faiblement corrélées à la cible, difficiles à expliquer en production ou indisponibles au moment de l’inférence.\u003C/p\u003E\n\u003Cp\u003ELa sélection peut réduire le surapprentissage et améliorer l’efficacité du modèle. Elle présente aussi des avantages opérationnels. Un modèle fondé sur un nombre restreint de features dont le comportement est stable et bien compris est généralement plus facile à surveiller en production et à auditer qu’un modèle qui s’appuie sur de nombreuses entrées peu informatives ou redondantes. Parmi les approches courantes figurent les méthodes de filtrage statistique, les méthodes wrapper qui évaluent des sous-ensembles de features par rapport à la performance du modèle, et les méthodes intégrées qui s’appuient sur les mécanismes internes du modèle, comme les coefficients de régularisation et les scores d’importance fondés sur les arbres de décision, pour identifier les features qui pèsent réellement.\u003C/p\u003E\n\u003Ch3\u003EExtraction de features\u003C/h3\u003E\n\u003Cp\u003EL’extraction de features fait émerger une structure à partir de données brutes ou complexes. Un horodatage peut fournir le jour de la semaine, le mois ou le temps écoulé depuis un événement de référence. Un champ de texte libre peut produire des fréquences de termes, des scores d’opinion ou des représentations vectorielles denses (embeddings, ou parfois plongements). Un modèle d’image peut extraire des contours, des textures ou des représentations apprises à partir de couches intermédiaires du réseau.\u003C/p\u003E\n\u003Cp\u003EEn pratique, l’extraction recoupe largement la création de features. La distinction tient surtout à l’angle d’approche : l’extraction vise à faire émerger une structure des entrées brutes, tandis que le feature engineering couvre le workflow plus large de préparation de ces entrées pour la modélisation.\u003C/p\u003E\n\u003Ch3\u003EFeature stores\u003C/h3\u003E\n\u003Cp\u003EUn feature store est un référentiel géré pour les définitions de features, les valeurs de features calculées et les métadonnées associées. Il aide les équipes à réutiliser les features entre projets, à réduire la logique de pipeline dupliquée et à maintenir des définitions de features homogènes entre l’entraînement et l’inférence.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_data-augmentation":{"id":"title-v2-aaae7fd062","additionalClasses":"anchor-title anchor-title--data-augmentation","type":"heading2","lines":["Augmentation des données"],":type":"snowflake-site/components/title-v2"},"text_data-augmentation_0":{"id":"text-3f2b2a670b","text":"\u003Cp\u003EL’augmentation des données élargit les données d’entraînement en générant des versions modifiées d’exemples existants. Elle est surtout utilisée en vision par ordinateur et en traitement du langage naturel, où certaines modifications peuvent accroître la diversité de l’ensemble d’entraînement sans changer l’étiquetage.\u003C/p\u003E\n\u003Cp\u003EPour les images, l’augmentation peut inclure des retournements, des rotations, des recadrages, des ajustements de luminosité ou de légères translations. Pour le texte, elle peut inclure la substitution de synonymes, la paraphrase ou des perturbations contrôlées. Pour les données tabulaires présentant un déséquilibre de classes, des techniques comme \u003Ca href=\"https://www.jair.org/index.php/jair/article/view/10302\" target=\"_blank\"\u003ESMOTE\u003C/a\u003E génèrent des exemples synthétiques pour les classes sous-représentées.\u003C/p\u003E\n\u003Cp\u003ELa question clé, dans toute décision d’augmentation, est de savoir si l’exemple modifié représente toujours la même chose. Faire pivoter l’image d’un produit peut préserver le label dans une tâche de classification e-commerce. Dans un modèle de détection des défauts pour le secteur de l’industrie, l’orientation peut porter une information sur le type de défaut. L’augmentation est utile lorsqu’elle reflète une variation face à laquelle le modèle doit rester robuste ; elle devient contre-productive lorsqu’elle détruit le signal.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_embeddings":{"id":"title-v2-281172f888","additionalClasses":"anchor-title anchor-title--embeddings","type":"heading2","lines":["Embeddings"],":type":"snowflake-site/components/title-v2"},"text_embeddings_0":{"id":"text-c711066bbb","text":"\u003Cp\u003ELes embeddings sont des représentations vectorielles denses qui encodent les relations dans les données. Ils sont courants dans les workflows de texte, d’image, de recommandation et de catégories à forte cardinalité, lorsque les valeurs brutes exigent une forme numérique plus riche que ce que les schémas d’encodage peuvent fournir.\u003C/p\u003E\n\u003Cp\u003EPar exemple, un ID produit a peu de signification intrinsèque en tant qu’entier brut, mais un embedding peut positionner ce produit près de produits similaires en fonction des descriptions, des comportements d’achat conjoint, des attributs visuels ou des habitudes de navigation. Un embedding de texte peut placer des expressions sémantiquement liées à proximité les unes des autres dans l’espace vectoriel, ce qui le rend utile pour la recherche, la classification, la recommandation et la \u003Ca href=\"https://www.snowflake.com/fr/fundamentals/rag/\"\u003Egénération augmentée de récupération\u003C/a\u003E (RAG).\u003C/p\u003E\n\u003Cp\u003ELes embeddings occupent une place intéressante par rapport au feature engineering. Ils peuvent servir de features apprises, transmises aux modèles en aval, au même titre que les features conçues manuellement. Ils représentent aussi un autre mode de développement de features : les représentations y sont apprises à partir de grands ensembles de données, plutôt que définies par une analyse métier. En pratique, de nombreux systèmes de ML en production combinent les deux : des embeddings appris pour les features de contenu ou d’identité, et des features conçues pour les signaux comportementaux, temporels et contextuels.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_automated-feature-engineering":{"id":"title-v2-9452c1efb4","additionalClasses":"anchor-title anchor-title--automated-feature-engineering","type":"heading2","lines":["Feature engineering automatisé"],":type":"snowflake-site/components/title-v2"},"text_automated-feature-engineering_0":{"id":"text-6bcd4c8acc","text":"\u003Cp\u003ELe feature engineering automatisé utilise des logiciels pour générer et mettre à l’échelle des features candidates à partir de données brutes. Des outils comme Featuretools utilisent des méthodes, notamment Deep Feature Synthesis, pour créer systématiquement des features dans des tables liées. Les systèmes AutoML peuvent générer des transformations, des encodages et des features d’interaction dans le cadre d’un workflow plus large de développement de modèles.\u003C/p\u003E\n\u003Cp\u003EL’automatisation est particulièrement utile lorsque l’espace de recherche est vaste ou que les transformations candidates sont répétitives. Un système peut générer des agrégats glissants, des champs dérivés de dates, des encodages catégoriels et des synthèses au niveau des tables plus vite qu’une équipe ne peut écrire chaque feature manuellement.\u003C/p\u003E\n\u003Cp\u003ELa connaissance du domaine doit toutefois continuer à gouverner le travail : la revue experte, la validation et la gouvernance déterminent quelles features peuvent être utilisées.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_feature-engineering-on-snowflake":{"id":"title-v2-16ec732272","additionalClasses":"anchor-title anchor-title--feature-engineering-on-snowflake","type":"heading2","lines":["Feature engineering sur Snowflake"],":type":"snowflake-site/components/title-v2"},"text_feature-engineering-on-snowflake_0":{"id":"text-898a4d2424","text":"\u003Cp\u003ELe feature engineering en production ne se résume pas au code de transformation. Les équipes ont besoin d’un accès gouverné aux données source, d’une capacité de traitement évolutive pour les grands ensembles de données, de définitions de features réutilisables, d’une fraîcheur fiable des features et d’un chemin clair entre les données d’entraînement et le modèle déployé.\u003C/p\u003E\r\n\u003Cp\u003ESnowflake prend en charge ce workflow avec \u003Ca href=\"https://www.snowflake.com/fr/product/features/end-to-end-ml-workflows/\"\u003ESnowflake ML\u003C/a\u003E, un ensemble intégré de fonctionnalités de ML de bout en bout reposant sur des données gouvernées, qui couvre le feature engineering, l’entraînement des modèles et l’inférence.\u003C/p\u003E\r\n\u003Cp\u003EAvec \u003Ca href=\"https://www.snowflake.com/fr/product/features/snowpark/\"\u003ESnowpark\u003C/a\u003E, les équipes peuvent écrire des transformations de features en Python ou SQL et les exécuter au plus près des données, sans les déplacer vers un environnement externe. Le \u003Ca href=\"https://docs.snowflake.com/fr/developer-guide/snowflake-ml/feature-store/overview\"\u003ESnowflake Feature Store\u003C/a\u003E fournit des définitions de features et des vues de fonctionnalités (ou feature views) gérées, ce qui permet aux équipes de créer, matérialiser, récupérer et gérer des pipelines de features dans Snowflake. Les feature views peuvent encapsuler des pipelines Python ou SQL qui transforment les données brutes en features prêtes pour le modèle, et les feature views gérées par Snowflake peuvent s’actualiser automatiquement selon un calendrier défini.\u003C/p\u003E\r\n\u003Cp\u003ELes Dynamic Tables prennent en charge les pipelines de features incrémentaux lorsque les transformations définies en SQL doivent rester à jour. Snowflake gère les Dynamic Tables comme un pipeline, suit les dépendances et coordonne les actualisations afin que les tables en aval reflètent un instantané concordant de leurs entrées. Les Dynamic Tables prennent également en charge le délai cible, qui spécifie le niveau de fraîcheur attendu des données, ainsi que l’actualisation incrémentielle pour les modèles de transformation pris en charge.\u003C/p\u003E\r\n\u003Cp\u003EPour le ML en production, le Snowflake Feature Store peut être utilisé avec le \u003Ca href=\"https://docs.snowflake.com/fr/developer-guide/snowflake-ml/model-registry/overview\"\u003ERegistre des modèle de Snowflake\u003C/a\u003E. Le registre stocke et gère les versions, les métriques et les métadonnées des modèles&nbsp;; prend en charge l’inférence via Python, SQL ou des points de terminaison d’API REST&nbsp;; et gère l’accès aux modèles via le \u003Ca href=\"https://www.snowflake.com/en/data-governance/data-security/rbac/\"\u003Econtrôle d’accès basé sur les rôles\u003C/a\u003E (RBAC).\u003C/p\u003E\r\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_feature-engineering-is-foundational-to-reliable-ml-models":{"id":"title-v2-4654445020","additionalClasses":"anchor-title anchor-title--feature-engineering-is-foundational-to-reliable-ml-models","type":"heading2","lines":["Le feature engineering, socle de modèles de ML fiables"],":type":"snowflake-site/components/title-v2"},"text_feature-engineering-is-foundational-to-reliable-ml-models_0":{"id":"text-2f69075da6","text":"\u003Cp\u003EOn présente parfois le feature engineering comme un travail de préparation réalisé avant le vrai début de la modélisation. Mais cette vision sous-estime son importance, ainsi que ce qu’il recouvre vraiment. Chaque décision sur la manière de représenter une variable, de traiter une valeur manquante, d’encoder une catégorie ou de construire une feature de décalage détermine ce que le modèle peut comprendre du domaine dans lequel il opère.\u003C/p\u003E\n\u003Cp\u003EÀ l’échelle de la production, les décisions de représentation se multiplient. Les features sont réutilisées entre les modèles, reconstruites par différentes équipes et recalculées dans différents environnements. Maintenir ces définitions homogènes, de l’exploration à l’entraînement puis à l’inférence, a un impact direct sur la qualité du modèle.\u003C/p\u003E\n\u003Cp\u003EC’est pourquoi le feature engineering et le \u003Ca href=\"https://www.snowflake.com/fr/artificial-intelligence/machine-learning/mlops/\"\u003EMLOps\u003C/a\u003E sont étroitement liés. Le feature engineering détermine à partir de quoi le modèle apprend, tandis que le MLOps aide à garantir que ces définitions de features restent homogènes, observables et fiables lorsque les modèles passent du développement à la production.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"callout_feature-engineering-is-foundational-to-reliable-ml-models_0":{"id":"text-8a149256f9","additionalClasses":"callout callout--general","text":"\u003Cp\u003E\u003Cstrong\u003EÀ RETENIR\u003C/strong\u003E\u003C/p\u003E\n\u003Cp\u003ELe feature engineering est l’une des décisions à plus fort impact en machine learning, car il détermine ce que le modèle est réellement capable de « voir » dans les données. Des features solides encodent la connaissance métier, améliorent la qualité des prédictions et aident les modèles à mieux tenir en production.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"}},":itemsOrder":["callout__0","text__0","title_what-is-feature-engineering","text_what-is-feature-engineering_0","title_why-feature-engineering-matters-for-model-accuracy-and-generalization","text_why-feature-engineering-matters-for-model-accuracy-and-generalization_0","yt_why-feature-engineering-matters-for-model-accuracy-and-generalization_0","title_the-feature-engineering-process","text_the-feature-engineering-process_0","title_feature-engineering-techniques","text_feature-engineering-techniques_0","callout_feature-engineering-techniques_0","title_feature-engineering-vs-feature-selection-vs-feature-extraction-vs-feature-stores","text_feature-engineering-vs-feature-selection-vs-feature-extraction-vs-feature-stores_0","title_data-augmentation","text_data-augmentation_0","title_embeddings","text_embeddings_0","title_automated-feature-engineering","text_automated-feature-engineering_0","title_feature-engineering-on-snowflake","text_feature-engineering-on-snowflake_0","title_feature-engineering-is-foundational-to-reliable-ml-models","text_feature-engineering-is-foundational-to-reliable-ml-models_0","callout_feature-engineering-is-foundational-to-reliable-ml-models_0"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-medium"},"flexible_column_content_container_2":{"additionalClasses":"hub-sidebar","layout":"SIMPLE","id":"hub-body-aside",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"container":{"additionalClasses":"sticky-sidebar","layout":"RESPONSIVE_GRID","columnCount":12,"gridClassNames":"aem-Grid aem-Grid--12 aem-Grid--default--12","columnClassNames":{"text_943981956_copy_":"aem-GridColumn aem-GridColumn--default--12","text_copy":"aem-GridColumn aem-GridColumn--default--12"},"id":"container-f879aac44c",":type":"snowflake-site/components/container",":items":{"text_943981956_copy_":{"id":"text-aa65a47bff","additionalClasses":"eyebrow-text","text":"\u003Cp\u003EDans ce guide\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular"},"text_copy":{"id":"text-0df59ff566","additionalClasses":"page-toc","text":"\u003Cul\u003E\u003Cli data-anchor=\"what-is-feature-engineering\"\u003EQu’est-ce que le feature engineering ?\u003C/li\u003E\u003Cli data-anchor=\"why-feature-engineering-matters-for-model-accuracy-and-generalization\"\u003EPourquoi le feature engineering est essentiel à la précision et à la généralisation des modèles\u003C/li\u003E\u003Cli data-anchor=\"the-feature-engineering-process\"\u003ELe processus de feature engineering\u003C/li\u003E\u003Cli data-anchor=\"feature-engineering-techniques\"\u003ETechniques de feature engineering\u003C/li\u003E\u003Cli data-anchor=\"feature-engineering-vs-feature-selection-vs-feature-extraction-vs-feature-stores\"\u003EFeature engineering vs. sélection de features vs. extraction de features vs. feature stores\u003C/li\u003E\u003Cli data-anchor=\"data-augmentation\"\u003EAugmentation des données\u003C/li\u003E\u003Cli data-anchor=\"embeddings\"\u003EEmbeddings\u003C/li\u003E\u003Cli data-anchor=\"automated-feature-engineering\"\u003EFeature engineering automatisé\u003C/li\u003E\u003Cli data-anchor=\"feature-engineering-on-snowflake\"\u003EFeature engineering sur Snowflake\u003C/li\u003E\u003Cli data-anchor=\"feature-engineering-is-foundational-to-reliable-ml-models\"\u003ELe feature engineering, socle de modèles de ML fiables\u003C/li\u003E\u003C/ul\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-small text-color-text-05"}},":itemsOrder":["text_943981956_copy_","text_copy"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-medium"}},":itemsOrder":["container"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-small"},"isBlogPage":false,"isActiveTOC":false,":type":"snowflake-site/components/flexible-column-container"},"flexible_column_cont_1786318617":{"id":"flexible-column-container-baa38d7bdd","propertiesId":"hub-faq","type":"2-column-40-60","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"large","bottomPadding":"large","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"hub-faq-intro",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"title_v2_copy":{"id":"title-v2-01550f8d36","additionalClasses":"hub-faq__headline","type":"heading2","lines":["Foire aux questions"],":type":"snowflake-site/components/title-v2","appliedCssClassNames":"left-alignment"},"text_copy":{"id":"text-05fd1186bd","additionalClasses":"hub-faq__subheadline","text":"\u003Cp\u003ELes réponses des experts Snowflake à vos questions les plus fréquentes sur le feature engineering.\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"}},":itemsOrder":["title_v2_copy","text_copy"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-extra-small"},"flexible_column_content_container_2":{"layout":"SIMPLE","id":"hub-faq-accordions",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"simple_snowflake_acc":{"id":"simple-snowflake-accordion-85a989ecb0","additionalClasses":"seo-hub__faqs","showDivider":false,"accordionItemsList":[{"title":"Quelle est la différence entre le feature engineering et la sélection de features ?","richText":"\u003Cp\u003ELe feature engineering est le processus plus large qui consiste à créer, transformer et préparer les entrées des modèles à partir de données brutes. La sélection de features fait partie de ce processus. Elle identifie les features à inclure dans le modèle en fonction de leur pertinence, de leur stabilité, de leur redondance, de leur performance et de leur disponibilité au moment de l’inférence.\u003C/p\u003E\r\n"},{"title":"Quelle est la différence entre le feature engineering et l’extraction de features ?","richText":"\u003Cp\u003EL’extraction de features dérive des signaux utiles à partir de données brutes ou complexes, par exemple en extrayant des éléments de date d’un horodatage, des termes d’un texte ou des vecteurs appris à partir d’images. Le feature engineering inclut l’extraction de features, puis ajoute d’autres travaux comme l’imputation, la mise à l’échelle, l’encodage, la transformation, la création de features et la sélection de features.\u003C/p\u003E\r\n"},{"title":"Le feature engineering reste-t-il pertinent avec le deep learning ?","richText":"\u003Cp\u003EOui. \u003Ca href=\"https://www.snowflake.com/fr/artificial-intelligence/machine-learning/deep-learning/\"\u003ELe deep learning\u003C/a\u003E peut apprendre des représentations directement à partir des données, en particulier pour les images, l’audio et le texte, ce qui réduit, dans certains cas, le recours à l’ingénierie manuelle des features. Le feature engineering reste essentiel pour le ML tabulaire, les pipelines de données en production, la cohérence entre les phases d'entraînement et d'exploitation (inférence), la qualité des données et la conception d’entrées qui reflètent le véritable problème de prédiction.\u003C/p\u003E\r\n"},{"title":"Qu’est-ce que le feature engineering automatisé ?","richText":"\u003Cp\u003ELe feature engineering automatisé utilise des logiciels pour générer des features candidates, comme des agrégations, des features dérivées de dates, des encodages catégoriels ou des features d’interaction. Il peut accélérer l’exploration et réduire les tâches répétitives, même si les équipes doivent toujours s’appuyer sur leur jugement métier pour évaluer si les features générées sont significatives, valides et disponibles au moment où le modèle s’exécute.\u003C/p\u003E\r\n"},{"title":"Qu’est-ce qu’un feature store et quel est son lien avec le feature engineering ?","richText":"\u003Cp\u003EUn feature store est un référentiel géré pour les définitions de features, les valeurs de features et les métadonnées associées. Il aide les équipes à réutiliser les features conçues sur plusieurs modèles, à maintenir la cohérence entre la logique d’entraînement et l’inférence, à gérer l’acutalisation des features et à limiter la duplication de pipelines de features. En ML de production, le feature store sert souvent de couche opérationnelle au feature engineering.\u003C/p\u003E\r\n"}],":type":"snowflake-site/components/simple-snowflake-accordion"}},":itemsOrder":["simple_snowflake_acc"]},"isBlogPage":false,"isActiveTOC":false,":type":"snowflake-site/components/flexible-column-container","appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_1467213961":{"id":"flexible-column-container-d372078834","propertiesId":"hub-explore-resources-header","type":"1-column","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"large","bottomPadding":"none","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"container-5e0841ce3d",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"title_v2":{"id":"title-v2-36ecdee91d","additionalClasses":"hub-explore-resources-header__headline","type":"heading2","lines":["Explorez les ressources sur l’IA"],":type":"snowflake-site/components/title-v2","appliedCssClassNames":"left-alignment"}},":itemsOrder":["title_v2"]},"isBlogPage":false,"isActiveTOC":false,":type":"snowflake-site/components/flexible-column-container","appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_912630531":{"id":"flexible-column-container-5189d35824","propertiesId":"hub-explore-resources-grid","type":"1-column","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"small","bottomPadding":"large","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"hub-explore-resources-grid-inner",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"resource_chip_0":{"id":"content-chip-f821667ae9","tagText":"GUIDE","tagColor":"#71D3DC","cta":{"id":"cta","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/en/developers/guides/advanced-guide-to-snowflake-feature-store/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"Lire la suite"},"headline":{"id":"title-v2-1cb08880a0","type":"heading5","lines":["Guide avancé du Snowflake Feature Store"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip","appliedCssClassNames":"snowflake-content-chip-white-bg"},"resource_chip_1":{"id":"content-chip-2d3fa68379","tagText":"GUIDE","tagColor":"#71D3DC","cta":{"id":"cta","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/en/developers/guides/intro-to-feature-store/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"Lire la suite"},"headline":{"id":"title-v2-4f6a613a46","type":"heading5","lines":["Introduction au Snowflake Feature Store avec Snowflake Notebooks"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip","appliedCssClassNames":"snowflake-content-chip-white-bg"},"resource_chip_2":{"id":"content-chip-6a194d81bf","tagText":"BLOG","tagColor":"#71D3DC","cta":{"id":"cta","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/en/blog/agentic-ml-snowflake-predictive-insights/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"Lire la suite"},"headline":{"id":"title-v2-73169dd47e","type":"heading5","lines":["Automatisez le parcours des données vers les insights prédictifs avec le ML agentique dans Snowflake"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip","appliedCssClassNames":"snowflake-content-chip-white-bg"},"resource_chip_3":{"id":"content-chip-f4b7601787","tagText":"BLOG","tagColor":"#71D3DC","cta":{"id":"cta","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/en/blog/build-manage-production-ml-snowflake-feature-store/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"Lire la suite"},"headline":{"id":"title-v2-f69b1f3908","type":"heading5","lines":["Créez et gérez des features ML pour des pipelines prêts pour la production avec le Snowflake Feature Store"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip","appliedCssClassNames":"snowflake-content-chip-white-bg"}},":itemsOrder":["resource_chip_0","resource_chip_1","resource_chip_2","resource_chip_3"]},"isBlogPage":false,"isActiveTOC":false,":type":"snowflake-site/components/flexible-column-container","appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_1158003461":{"id":"flexible-column-container-3a55a60a69","propertiesId":"hub-explore-topics-header","type":"1-column","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"large","bottomPadding":"none","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"container-15d08318d9",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"title_v2_copy_copy":{"id":"title-v2-400edce95e","additionalClasses":"hub-explore-topics-header__headline","type":"heading2","lines":["Explorez les sujets liés à l’IA"],":type":"snowflake-site/components/title-v2","appliedCssClassNames":"left-alignment"},"text_copy_copy":{"id":"text-c8d55f0f83","additionalClasses":"hub-explore-topics-header__subheadline","text":"\u003Cp\u003EUne analyse approfondie de chaque aspect de l’intelligence artificielle\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"}},":itemsOrder":["title_v2_copy_copy","text_copy_copy"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-extra-small"},"isBlogPage":false,"isActiveTOC":false,":type":"snowflake-site/components/flexible-column-container","appliedCssClassNames":"snowflake-flexible-column-container-white-bg"},"flexible_column_cont_1377146023":{"id":"flexible-column-container-35288e7c0a","propertiesId":"hub-explore-topics-grid","type":"3-column-even","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"small","bottomPadding":"large","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"container-a1518d9031",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"card_v2_copy_copy":{"id":"card-v2-3c938e4f42","configurationStatus":{"configured":true,"message":""},":type":"snowflake-site/components/card-v2","title":{"id":"title","type":"heading4","lines":["Intelligence artificielle"],":type":"snowflake-site/components/title-v2"},"button":{"id":"button","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/fr/artificial-intelligence/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"En savoir plus"},"type":"content-card","text":{"id":"text","text":"\u003Cp\u003EGuide pratique de l’IA d’entreprise : comment elle fonctionne, où elle va et ce qu’elle signifie pour votre entreprise.\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text"},"layoutStyle":"vertical"}},":itemsOrder":["card_v2_copy_copy"]},"flexible_column_content_container_2":{"layout":"SIMPLE","id":"container-26ba682489",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"card_v2_98028754":{"id":"card-v2-21b3a47bf4","configurationStatus":{"configured":true,"message":""},":type":"snowflake-site/components/card-v2","title":{"id":"title","type":"heading4","lines":["Gouvernance de l’IA"],":type":"snowflake-site/components/title-v2"},"button":{"id":"button","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/fr/artificial-intelligence/ai-governance/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"En savoir plus"},"type":"content-card","text":{"id":"text","text":"\u003Cp\u003EFrameworks, politiques et modèles de supervision pour la gestion des risques liés à l’IA, la responsabilisation, la conformité et le contrôle opérationnel.\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text"},"layoutStyle":"vertical"}},":itemsOrder":["card_v2_98028754"]},"flexible_column_content_container_3":{"layout":"SIMPLE","id":"container-1ca814fbb8",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"card_v2_copy":{"id":"card-v2-aac01d111c","configurationStatus":{"configured":true,"message":""},":type":"snowflake-site/components/card-v2","title":{"id":"title","type":"heading4","lines":["Éthique de l’IA"],":type":"snowflake-site/components/title-v2"},"button":{"id":"button","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/fr/artificial-intelligence/ai-governance/ai-ethics/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"En savoir plus"},"type":"content-card","text":{"id":"text","text":"\u003Cp\u003EPrincipes fondamentaux (équité, responsabilité, contrôle humain) pour guider une utilisation responsable de l’IA.\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text"},"layoutStyle":"vertical"}},":itemsOrder":["card_v2_copy"]},"isBlogPage":false,"isActiveTOC":false,":type":"snowflake-site/components/flexible-column-container","appliedCssClassNames":"snowflake-flexible-column-container-white-bg"}},":itemsOrder":["flexible_column_cont","flexible_column_cont_939100716","flexible_column_cont_1398138236","flexible_column_cont_663228916","flexible_column_cont_1786318617","flexible_column_cont_1467213961","flexible_column_cont_912630531","flexible_column_cont_1158003461","flexible_column_cont_1377146023"],":type":"wcm/foundation/components/responsivegrid"},"modal_container":{"layout":"SIMPLE","id":"container-9a8e671ac1",":type":"snowflake-site/components/modal/modal-container",":items":{},":itemsOrder":[]},"markup_editor_928258845":{"id":"markup-editor-82c0b99fbe","title":" ","cssContent":".snowflake-flexible-column-container-gray-10-bg\u003E.snowflake-flexible-column-container{background-color:var(--ui-background-05) !important}.text-size-regular:has(.seo-hub-hero__related-topic-label){display:flex;align-items:center}.hub-hero__headline span{text-transform:none !important}.hub-hero__subheadline p{max-width:70ch;margin-top:8px}.hub-hero__authors \u003E .container \u003E .cmp-container \u003E .aem-container{display:flex;flex-direction:row}.hub-hero__authors \u003E .container \u003E .cmp-container \u003E .aem-container \u003E div{width:auto !important;margin:24px 48px 0 0 !important}.hub-hero__authors .heading-5-v2{gap:var(--spacing-00)}.hub-hero__authors .snowflake-content-chip-button{display:none !important}.hub-hero__authors .snowflake-person-chip-content .body-2,.hub-hero__authors .snowflake-content-chip-content .snowflake-title-v2-line{font-size:16px !important;line-height:20px !important;font-family:\"Lato\",sans-serif !important;color:#000 !important;font-weight:600 !important}.hub-hero__authors .snowflake-person-chip-content .body-3,.hub-hero__authors .snowflake-content-chip-content .snowflake-title-v2-line:not(:first-child){font-weight:400 !important;color:var(--text-05) !important;font-size:16px !important}.hub-hero__authors .snowflake-image-container img{aspect-ratio:1 !important;border-radius:100%;overflow:hidden}.hub-hero__authors .snowflake-person-chip-avatar{width:56px;height:56px}.hub-hero__authors .snowflake-content-chip{align-items:center;display:inline-flex}.hub-hero__authors .snowflake-content-chip-image{max-width:56px;line-height:0;margin-right:var(--spacing-03)}.hub-hero__authors .snowflake-person-chip-inner-horizontal{gap:var(--spacing-03)}@media screen and (min-width:1367px){.hub-hero__headline .heading-1-v2{font-size:48px;line-height:44px}}#hub-explore-resources-grid-inner\u003E.container\u003E.cmp-container\u003E.aem-container{display:flex;flex-direction:row;flex-wrap:wrap;gap:24px}#hub-explore-resources-grid-inner\u003E.container\u003E.cmp-container\u003E.aem-container::before,#hub-explore-resources-grid-inner\u003E.container\u003E.cmp-container\u003E.aem-container::after{display:none}#hub-explore-resources-grid-inner\u003E.container\u003E.cmp-container\u003E.aem-container\u003Ediv{width:calc(25% - 18px)}.text-color-text-05 .snowflake-text h2,.text-color-text-05.cq-Editable-dom h2,.text-color-text-05 .snowflake-text h3,.text-color-text-05.cq-Editable-dom h3,.text-color-text-05 .snowflake-text h4,.text-color-text-05.cq-Editable-dom h4,.text-color-text-05 .snowflake-text h5,.text-color-text-05.cq-Editable-dom h5,.text-color-text-05 .snowflake-text h6,.text-color-text-05.cq-Editable-dom h6{color:#000 !important}","isGSAPEnabled":false,":type":"snowflake-site/components/markup-editor"},"markup_editor_597730182":{"id":"markup-editor-6eba0fc239","title":" ","cssContent":".sf-copy-markdown [data-copy-md]{display:inline-flex;align-items:center;gap:6px;padding:8px 16px;font-family:'Texta',sans-serif;text-transform:uppercase;font-weight:800 !important;font-size:14px;font-weight:500;color:#11567f;background:#f0faff;border:1px solid #b8e6f9;border-radius:24px;cursor:pointer;transition:background .2s ease,border-color .2s ease,color .2s ease}.sf-copy-markdown [data-copy-md]:hover{background:#ddf3fc;border-color:#29b5e8}.sf-copy-markdown [data-copy-md][data-copied=\"1\"]{color:#0f7b3e;background:#ecfdf5;border-color:#6ee7a0;pointer-events:none}.sf-copy-markdown [data-copy-md] svg{flex-shrink:0}.longform-conten .snowflake-content-chip-white-bg .snowflake-content-chip{box-shadow:0 0 24px 4px rgba(0,0,0,.02),0 4px 8px 0 rgba(0,0,0,.04);flex-direction:row-reverse;align-items:center}.longform-conten .snowflake-content-chip-button{display:none}.longform-conten .snowflake-content-chip-image__inner{aspect-ratio:5 / 3;display:flex;justify-content:center;align-items:center;background-color:var(--ui-01);border-radius:4px}.longform-conten .snowflake-content-chip-image{margin-right:0;margin-left:48px}.longform-conten .snowflake-content-chip-image img{width:50%;border-radius:0 !important;object-fit:contain}.longform-content .black-blue-text-color .snowflake-title-v2-line:not(:first-child){font-size:14px !important;font-weight:400 !important;color:rgba(0,0,0,.6) !important;margin-top:8px !important}.page-toc ul li:first-child{padding-top:0 !important}.page-toc ul li:last-child{padding-bottom:0 !important}.seo-hub__top-bar \u003E .container \u003E .cmp-container \u003E .aem-container \u003E div:first-child{flex-grow:1}.sf-copy-markdown{margin-top:40px !important}.page-toc ul{margin-top:16px !important}.seo-hub__top-bar \u003E .container \u003E .cmp-container \u003E .aem-container{display:flex;justify-content:space-between}.sf-copy-markdown{}.callout.snowflake-text p:not(:first-child){margin-top:var(--spacing-01)}.callout \u003E span \u003E p:first-child \u003E strong,.callout \u003E span \u003E p:first-child \u003E b{text-transform:uppercase;font-family:'Texta',sans-serif;font-size:16px !important;color:var(--ui-01) !important}.seo-hub-hero__subheadline p{max-width:50ch}.tag-group ul{list-style-type:none;padding:0;margin:0;display:flex;flex-direction:row;row-gap:12px;column-gap:8px;align-items:center;flex-wrap:wrap}.tag-group ul li:first-child{flex-shrink:0}.tag-group ul li a{display:inline-block;padding:2px 12px;border-radius:48px;background-color:#ededed;color:#666;font-size:14px !important}@media screen and (min-width:1367px){.seo-hub-hero__headline span.snowflake-title-v2-line{font-size:56px !important}}.callout.snowflake-text p:not(:first-child){margin-top:var(--spacing-01)}.callout \u003E span \u003E p:first-child \u003E b{text-transform:uppercase;font-family:'Texta',sans-serif;font-size:16px !important;color:var(--ui-01) !important}.seo-hub-hero__subheadline p{max-width:80ch}#hero:has(.snowflake-youtube-lite) .seo-hub-hero__subheadline p{max-width:50ch}.tag-group ul{list-style-type:none;padding:0;margin:0;display:flex;flex-direction:row;row-gap:12px;column-gap:8px;align-items:center;flex-wrap:wrap}.tag-group ul li:first-child{width:100%;flex-shrink:0}.tag-group ul li a{display:inline-block;padding:2px 12px;border-radius:48px;background-color:#ededed;color:#666;font-size:14px !important}@media screen and (min-width:1367px){.seo-hub-hero__headline span.snowflake-title-v2-line{font-size:56px !important}}","isGSAPEnabled":false,":type":"snowflake-site/components/markup-editor"},"markup_editor":{"id":"markup-editor-9259dade12","title":" ","cssContent":"div.snowflake-breadcrumb a.snowflake-breadcrumb-item,.snowflake-breadcrumb div.snowflake-breadcrumb-item{text-transform:none;font-weight:500}.snowflake-breadcrumb svg{display:none !important}.snowflake-breadcrumb a:has(svg)::after{content:'/';margin:0 12px;color:#666}.hub-sidebar{padding:0 40px}.sticky-sidebar{max-width:340px;margin-left:auto}.page-toc ul{list-style-type:none;padding:0}.page-toc li{padding:8px 16px;border-left:4px solid var(--ui-01);cursor:pointer;transition:300ms ease all}.page-toc li:hover{color:var(--ui-01);border-color:#7fd3f1;transition:300ms ease all}.callout,.customer-card{background-color:#eef9fd;border-left:4px solid var(--ui-01);padding:24px 24px 24px 32px;border-radius:4px}.logo-container{max-width:180px}.longform-content li{margin-top:1rem !important}div.longform-content p{max-width:80ch}.bolder .snowflake-title-v2-line{font-weight:900 !important}.border-top\u003Ediv{border-top:1px solid #ccc;padding-top:48px}.related-topics ul{list-style-type:none;padding:0;margin:0;display:flex;gap:8px;flex-wrap:wrap}.related-topics li{display:inline-block;border:1px solid #ccc;padding:4px 12px;border-radius:24px}div.longform-content .snowflake-text h2,div.longform-content .snowflake-text .heading-2-v2,div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-title-v2 .heading-3-v2,div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-title-v2 .heading-4-v2,div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-title-v2 .heading-5-v2,div.longform-content .snowflake-text h6,div.longform-content .snowflake-title-v2 .heading-6-v2,div.longform-content .snowflake-text .heading-6-v2{text-transform:none !important}div.longform-content .snowflake-text h2,div.longform-content .snowflake-text .heading-2-v2,div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-text h6,div.longform-content .snowflake-text .heading-6-v2{margin-top:1.5rem !important;line-height:1.1 !important}div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-title-v2 .heading-3-v2,div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-title-v2 .heading-4-v2,div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-title-v2 .heading-5-v2,div.longform-content .snowflake-text h6,div.longform-content .snowflake-text .heading-6-v2,div.longform-content .snowflake-title-v2 .heading-6-v2{font-family:Lato,sans-serif !important;font-weight:800 !important}div.longform-content .snowflake-text h2,div.longform-content .snowflake-text .heading-2-v2,div.longform-content .snowflake-title-v2 .heading-2-v2{text-transform:none !important;font-size:28px !important}div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-title-v2 .heading-3-v2{font-size:22px !important}div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-title-v2 .heading-4-v2{font-size:18px !important}div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-title-v2 .heading-5-v2{font-size:16px !important}div.longform-content .snowflake-text h6,div.longform-content .snowflake-text .heading-6-v2,div.longform-content .snowflake-title-v2 .heading-6-v2{font-size:14px !important}@media screen and (min-width:992px){div.longform-content .snowflake-text h2,div.longform-content .snowflake-text .heading-2-v2,div.longform-content .snowflake-title-v2 .heading-2-v2{font-size:38px !important}div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-title-v2 .heading-3-v2{font-size:26px !important}div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-title-v2 .heading-4-v2{font-size:22px !important}div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-title-v2 .heading-5-v2{font-size:18px !important}div.longform-content .snowflake-text h6,div.longform-content .snowflake-text .heading-6-v2,div.longform-content .snowflake-title-v2 .heading-6-v2{font-size:16px !important}}.sticky-sidebar .page-toc li.is-active{font-weight:600;color:var(--snow-blue,#29b5e8)}.sticky-sidebar .page-toc li[data-anchor]{cursor:pointer}.longform-content table{margin-top:24px;margin-bottom:24px;width:100%;background-color:var(--ui-background-01);border-collapse:collapse;border:2px solid var(--ui-background-09);font-family:'Lato',sans-serif;color:var(--ui-background-09)}.longform-content table thead{background-color:var(--ui-01)}.longform-content th,.longform-content td{min-width:120px;border:2px solid var(--ui-background-09);padding:var(--spacing-01)}.longform-content ol{margin-top:0 !important}.longform-content ol li{margin-bottom:1rem !important}.longform-content ul li{margin:0;padding:0 0 0 32px;position:relative}.longform-content ul{list-style-type:none}.longform-content ul li::before{content:\"\";display:block;border-radius:100%;background:#29b5e8;width:18px;height:18px;position:absolute;top:4px;left:0;border:5px solid #e5f2f7;box-sizing:border-box}.seo-customer.snowflake-card-v2-advanced-horizontal .snowflake-card-v2-advanced-image-container{max-width:200px}.seo-customer.snowflake-card-v2-advanced-horizontal .snowflake-card-v2-advanced-image-container img{object-fit:contain}.related-topics-outer-container \u003E .container \u003E .cmp-container \u003E .aem-container{display:flex;flex-direction:row}.related-topics-outer-container \u003E .container \u003E .cmp-container \u003E .aem-container \u003E div{width:auto !important;margin:0 !important}.related-topics-outer-container \u003E .container \u003E .cmp-container \u003E .aem-container \u003E div:first-child{margin-right:16px !important;flex-shrink:0}","jsContent":"(function(){var OFFSET=100;if(window.gsap&&window.ScrollTrigger){gsap.registerPlugin(ScrollTrigger);var sidebar=document.querySelector('.sticky-sidebar');var body=document.querySelector('.longform-content');if(sidebar&&body){ScrollTrigger.create({trigger:sidebar,start:'top 100px',endTrigger:body,end:'bottom bottom',pin:sidebar,pinSpacing:false});}}document.addEventListener('click',function(e){var li=e.target.closest('li[data-anchor]');if(!li)return;var slug=li.getAttribute('data-anchor');var heading=document.querySelector('.anchor-title--'+CSS.escape(slug));if(!heading)return;e.preventDefault();var top=heading.getBoundingClientRect().top+window.pageYOffset-OFFSET;window.scrollTo({top:top,behavior:'smooth'});history.replaceState(null,'','#'+slug);},false);var headings=document.querySelectorAll('[class*=\"anchor-title--\"]');if(headings.length&&'IntersectionObserver'in window){var io=new IntersectionObserver(function(entries){entries.forEach(function(entry){if(!entry.isIntersecting)return;var cls=Array.from(entry.target.classList).find(function(c){return c.indexOf('anchor-title--')===0;});if(!cls)return;var slug=cls.replace('anchor-title--','');document.querySelectorAll('li[data-anchor]').forEach(function(li){li.classList.toggle('is-active',li.getAttribute('data-anchor')===slug);});});},{rootMargin:'-20% 0px -70% 0px',threshold:0});headings.forEach(function(h){io.observe(h);});}})();","isGSAPEnabled":true,":type":"snowflake-site/components/markup-editor"},"experiencefragment-footer":{"id":"experiencefragment-1ac72b9393","localizedFragmentVariationPath":"/content/experience-fragments/snowflake-site/language-masters/fr/site/footer/master/jcr:content","configured":true,"xfModelPath":"/content/experience-fragments/snowflake-site/language-masters/fr/site/footer/master.xfmodel.json?callerPage=/content/snowflake-site/global/fr/artificial-intelligence/machine-learning/feature-engineering",":type":"snowflake-site/components/experiencefragment"},"experiencefragment":{"id":"experiencefragment-15582389c4","localizedFragmentVariationPath":"/content/experience-fragments/snowflake-site/language-masters/fr/site/footer-legal-disclaimers/master/jcr:content","configured":true,"xfModelPath":"/content/experience-fragments/snowflake-site/language-masters/fr/site/footer-legal-disclaimers/master.xfmodel.json?callerPage=/content/snowflake-site/global/fr/artificial-intelligence/machine-learning/feature-engineering",":type":"snowflake-site/components/experiencefragment"}},":itemsOrder":["experiencefragment-banner","experiencefragment-header","responsivegrid","modal_container","markup_editor_928258845","markup_editor_597730182","markup_editor","experiencefragment-footer","experiencefragment"],":type":"wcm/foundation/components/responsivegrid"}},":itemsOrder":["root"],":hierarchyType":"page",":path":"/content/snowflake-site/global/fr/artificial-intelligence/machine-learning/feature-engineering","locale":"fr"}
  