{"allowedRenditionsWidth":["320","480","640","768","960","1200","1440","1920"],"templateName":"base-page-template54","cssClassNames":"page basicpage summit-page","language":"de","description":"Die Inferenz beim maschinellen Lernen wendet Modelle auf neue Daten an. Lernen Sie Inferenz vs. Training, Batch-/Echtzeit-Typen und die Optimierung kennen.","title":"Inferenz beim maschinellen Lernen: Typen und Optimierung","analyticsPageType":"homepage","analyticsCategory":"general","analyticsSubCategory":"","excludeFromAnalytics":false,"analyticsContentTags":[],"analyticsEnabled":true,"isPasswordProtected":false,"coveoConfig":{"apiKey":"xx335921a6-2a0a-40f2-a167-e390b4766c3d","pipeline":"snowflake.com","searchHub":"snowflake.com","organizationId":"snowflakecomputingproduction8neljofn"},"analyticsDebugMode":false,"analyticsData":{"excludeFromAnalytics":false,"subCategory":"","pageType":"homepage","templateName":"base-page-template54","siteName":"snowflake","pageUrl":"/content/snowflake-site/global/de/artificial-intelligence/machine-learning/inference","language":"de","category":"general","pageName":"Inferenz beim maschinellen Lernen: Wie trainierte Modelle Mehrwert in der Produktion generieren","contentTags":[]},":mappedPath":"/de/artificial-intelligence/machine-learning/inference/",":type":"snowflake-site/components/structure/page",":items":{"root":{"columnCount":12,"columnClassNames":{"markup_editor_928258845":"aem-GridColumn aem-GridColumn--default--12","experiencefragment-banner":"aem-GridColumn aem-GridColumn--default--12","experiencefragment-header":"aem-GridColumn aem-GridColumn--default--12","responsivegrid":"aem-GridColumn aem-GridColumn--default--12","markup_editor_597730182":"aem-GridColumn aem-GridColumn--default--12","experiencefragment-footer":"aem-GridColumn aem-GridColumn--default--12","experiencefragment":"aem-GridColumn aem-GridColumn--default--12","modal_container":"aem-GridColumn aem-GridColumn--default--12","markup_editor":"aem-GridColumn aem-GridColumn--default--12"},"gridClassNames":"aem-Grid aem-Grid--12 aem-Grid--default--12",":items":{"experiencefragment-banner":{"id":"experiencefragment-07229a88c3","localizedFragmentVariationPath":"/content/experience-fragments/snowflake-site/language-masters/de/site/pushdown-banner/master/jcr:content","configured":true,"xfModelPath":"/content/experience-fragments/snowflake-site/language-masters/de/site/pushdown-banner/master.xfmodel.json?callerPage=/content/snowflake-site/global/de/artificial-intelligence/machine-learning/inference",":type":"snowflake-site/components/experiencefragment"},"experiencefragment-header":{"id":"experiencefragment-3233ae7c96","localizedFragmentVariationPath":"/content/experience-fragments/snowflake-site/language-masters/de/site/mega-nav-header/master/jcr:content","configured":true,"xfModelPath":"/content/experience-fragments/snowflake-site/language-masters/de/site/mega-nav-header/master.xfmodel.json?callerPage=/content/snowflake-site/global/de/artificial-intelligence/machine-learning/inference",":type":"snowflake-site/components/experiencefragment"},"responsivegrid":{"columnCount":12,"columnClassNames":{"flexible_column_cont_939100716":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_663228916":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_912630531":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_1336760939":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_1786318617":"aem-GridColumn aem-GridColumn--default--12","flexible_column_cont_1467213961":"aem-GridColumn aem-GridColumn--default--12"},"gridClassNames":"aem-Grid aem-Grid--12 aem-Grid--default--12",":items":{"flexible_column_cont":{"id":"flexible-column-container-47417da150","propertiesId":"hub-hero-breadcrumbs","type":"1-column","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"small","bottomPadding":"none","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"propertiesCSSClasses":"page-section","backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"container-5c4821c3ad",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"breadcrumb":{"id":"breadcrumb-7467286f27","items":[{"id":"breadcrumb-7467286f27-item-b4dc78da23","link":{"valid":true,"url":"/de/artificial-intelligence/"},"active":false,"current":false,"title":"Künstliche Intelligenz",":type":"snowflake-site/components/structure/page","appliedCssClassNames":"summit-page"},{"id":"breadcrumb-7467286f27-item-1b882f3034","link":{"valid":true,"url":"/de/artificial-intelligence/machine-learning/"},"active":false,"current":false,"title":"Machine Learning",":type":"snowflake-site/components/structure/page","appliedCssClassNames":"summit-page"},{"id":"breadcrumb-7467286f27-item-c6fdcb7f4b","link":{"valid":true,"url":"/de/artificial-intelligence/machine-learning/inference/"},"active":true,"current":true,"title":"Inferenz",":type":"snowflake-site/components/structure/page","appliedCssClassNames":"summit-page"}],":type":"snowflake-site/components/breadcrumb"}},":itemsOrder":["breadcrumb"]},":type":"snowflake-site/components/flexible-column-container","isBlogPage":false,"isActiveTOC":false,"appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_939100716":{"id":"flexible-column-container-7b61779dd1","propertiesId":"hub-hero","type":"2-column-even","alignColumns":"center","containerMaxWidth":"extra-large","topPadding":"extra-small","bottomPadding":"extra-small","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"propertiesCSSClasses":"page-section","backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"container-32ce1a1ca9",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"title_v2":{"id":"title-v2-0589114a7c","additionalClasses":"hub-hero__headline","type":"heading1","lines":["Inferenz beim maschinellen Lernen Wie trainierte Modelle Mehrwert in der Produktion generieren"],":type":"snowflake-site/components/title-v2","appliedCssClassNames":"left-alignment"},"text":{"id":"text-f26b001c04","additionalClasses":"hub-hero__subheadline","text":"\u003Cp\u003EBei der Machine-Learning-Inferenz fangen Modelle an, in der Produktion einen Mehrwert zu schaffen: Sie verwandeln neue Daten in Prognosen, Scores, Klassifizierungen, Einbettungen oder generierte Ergebnisse, die nachgelagerte Systeme nutzen können. Doch zuverlässige Inferenz hängt nicht nur vom Modell selbst ab: Teams brauchen auch den richtigen Datenpfad, die richtige Laufzeitarchitektur, Performance-Kontrollen und Governance-Praktiken.\u003C/p\u003E\r\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"},"container":{"additionalClasses":"hub-hero__authors","layout":"RESPONSIVE_GRID","columnCount":12,"columnClassNames":{"content_chip_copy":"aem-GridColumn aem-GridColumn--default--12","content_chip":"aem-GridColumn aem-GridColumn--default--12"},"gridClassNames":"aem-Grid aem-Grid--12 aem-Grid--default--12","id":"container-af8a5995fc",":type":"snowflake-site/components/container",":items":{"content_chip":{"id":"content-chip-f7767ac3d3","cta":{"id":"cta","showOutboundIcon":false,"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_INTERNAL","text":"Biografie lesen"},"image":{"id":"image","height":"800","lazyEnabled":true,"src":"https://www.snowflake.com/adobe/dynamicmedia/deliver/dm-aid--a7e9fdff-6f08-4edc-9cd1-e213bb234aaa/laurie-macpherson.jpg?quality=85&preferwebp=true","alt":"Laurie MacPherson","width":"800",":type":"snowflake-site/components/image"},"headline":{"id":"title","type":"heading5","lines":["Laurie MacPherson","Technical Writer, Snowflake"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip"},"content_chip_copy":{"id":"content-chip-1c7885b18a","cta":{"id":"cta","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/en/blog/authors/gulnaz-sharipova/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"Biografie lesen"},"image":{"id":"image","height":"512","lazyEnabled":true,"src":"https://www.snowflake.com/adobe/dynamicmedia/deliver/dm-aid--f7c921fe-d10f-4d90-ac38-c79aff7cf132/gulnaz-photo.jpg?quality=85&preferwebp=true","alt":"Gulnaz Sharipova","width":"512",":type":"snowflake-site/components/image"},"headline":{"id":"title","type":"heading5","lines":["Gulnaz Sharipova","Lokale Redakteurin, Snowflake"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip"}},":itemsOrder":["content_chip","content_chip_copy"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-small"}},":itemsOrder":["title_v2","text","container"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-extra-small"},"flexible_column_content_container_2":{"additionalClasses":"hub-hero__video-column","layout":"SIMPLE","id":"container-45ab6f0280",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"youtube":{"id":"embed-49640bd9d1","youtubeVideoId":"-HWNc-Hd90U","layout":"responsive","youtubeAspectRatio":"56.25","youtubeAutoPlay":false,"youtubeLoop":false,"youtubeMute":false,"youtubePlaysInline":false,"youtubeRel":false,"embeddableResourceType":"core/wcm/components/embed/v1/embed/embeddable/youtube","type":"EMBEDDABLE",":type":"snowflake-site/components/youtube"}},":itemsOrder":["youtube"]},":type":"snowflake-site/components/flexible-column-container","isBlogPage":false,"isActiveTOC":false,"appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_1336760939":{"id":"flexible-column-container-cb744640c4","propertiesId":"hub-hero-related-topics","type":"1-column","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"extra-small","bottomPadding":"medium","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"propertiesCSSClasses":"page-section","backgroundImageOption":"none","flexible_column_content_container_1":{"additionalClasses":"related-topics-outer-container border-top","layout":"SIMPLE","id":"container-fd694140f0",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"text":{"id":"text-5e83d2dbd3","additionalClasses":"seo-hub-hero__related-topic-label","text":"\u003Cp\u003EThemen rund um maschinelles Lernen:\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"},"text_694412536":{"id":"text-f79a620a1b","additionalClasses":"related-topics","text":"\u003Cul\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/en/artificial-intelligence/machine-learning/automl/\"\u003EAutoML\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/de/artificial-intelligence/machine-learning/deep-learning/\"\u003EDeep Learning\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/de/artificial-intelligence/machine-learning/feature-engineering/\"\u003EFeature Engineering\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/en/artificial-intelligence/machine-learning/frameworks/\"\u003EML-Frameworks\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/en/artificial-intelligence/machine-learning/models/\"\u003EML-Modelle\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/de/artificial-intelligence/machine-learning/mlops/\"\u003EMLOps\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/en/artificial-intelligence/machine-learning/neural-network/\"\u003ENeuronale Netze\u003C/a\u003E\u003C/li\u003E\n\u003Cli\u003E\u003Ca href=\"https://www.snowflake.com/de/artificial-intelligence/machine-learning/reinforcement-learning/\"\u003EReinforcement Learning\u003C/a\u003E\u003C/li\u003E\n\u003C/ul\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-small"}},":itemsOrder":["text","text_694412536"]},":type":"snowflake-site/components/flexible-column-container","isBlogPage":false,"isActiveTOC":false,"appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_663228916":{"id":"flexible-column-container-67a28a5935","propertiesId":"hub-body","type":"2-column-60-40","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"medium","bottomPadding":"medium","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"propertiesCSSClasses":"page-section","backgroundImageOption":"none","flexible_column_content_container_1":{"additionalClasses":"longform-content","layout":"SIMPLE","id":"hub-body-content",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"callout__0":{"id":"text-7423c91ae4","additionalClasses":"callout callout--general","text":"\u003Cp\u003E\u003Cb\u003EML-INFERENZ DEFINIERT\u003C/b\u003E\u003C/p\u003E\r\n\u003Cp\u003EDie Inferenz beim maschinellen Lernen (Machine-Learning-Inferenz) ist der Prozess, bei dem ein trainiertes Modell auf Produktionszeitdaten angewendet wird, um einen verwertbaren Output zu generieren, wie z. B. eine Prognose, Klassifizierung, Punktzahl, Einbettung, ein extrahiertes Feld oder eine generierte Antwort.\u003C/p\u003E\r\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"},"text__0":{"id":"text-d5cc1b62d6","text":"\u003Cp\u003EWenn eine neue Anforderung eine Produktionsapplikation erreicht, hat ein ML-Modell möglicherweise nur Sekunden Zeit, den neuesten Kontext zu bewerten, ein Ergebnis zu erstellen und es an das System zurückzugeben, das entscheidet, was als Nächstes passiert.\u003C/p\u003E\n\u003Cp\u003EDieser Moment ist Inferenz: der Prozess, in dem ein trainiertes Modell auf Live-Daten angewendet wird, damit die Anwendung handeln kann. In der Produktion hängt die Inferenz vom gesamten Laufzeitpfad ab. Wenn ein Teil dieses Pfads ausbricht, verlangsamt wird oder von der während des Trainings verwendeten Logik abweicht, kann die Vorhersage zu spät eintreffen oder zu sehr von der Realität abweichen, um nützlich zu sein.\u003C/p\u003E\n\u003Cp\u003ETrace Smith, Senior AI/ML Architect, Applied Field Engineering bei Snowflake, erklärt, warum die Herausforderung der Zuverlässigkeit mehr als nur schnell ist: „Bei Echtzeit-ML-Anwendungen wie Betrugserkennung und vorausschauender Wartung erregen Latenz und Skalierbarkeit Aufmerksamkeit. Doch Konsistenz ist das, was die Produktion oft unterbricht. Die Vereinheitlichung von Transformationen, Funktionslogik und Service verhindert schiefe Trainingsergebnisse und sorgt für zuverlässige Prognosen in großem Umfang.“\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_what-is-machine-learning-inference":{"id":"title-v2-c7d7087113","additionalClasses":"anchor-title anchor-title--what-is-machine-learning-inference","type":"heading2","lines":["Was ist Inferenz beim maschinellen Lernen?"],":type":"snowflake-site/components/title-v2"},"text_what-is-machine-learning-inference_0":{"id":"text-bb7ee04ff7","text":"\u003Cp\u003EDie Inferenz beim maschinellen Lernen ist der Prozess, bei dem ein trainiertes Modell verwendet wird, um eine Ausgabe aus neuen, ungesehenen Eingabedaten zu generieren. Die Ausgabe kann je nach Modell und Aufgabe eine Prognose, Wahrscheinlichkeitsbewertung, Klassifizierung, Einbettung, generierte Antwort oder extrahiertes Feld sein.\u003C/p\u003E\n\u003Cp\u003EEine Inferenz-Pipeline befindet sich in der Regel zwischen den Quelldaten und dem \u003Ca href=\"https://www.snowflake.com/de/artificial-intelligence/machine-learning/\"\u003EML-\u003C/a\u003ESystem, das das Ergebnis nutzt. Es ruft die erforderlichen Features ab, wandelt die Eingabe in das vom Modell erwartete Format um, führt Modellbewertungen durch, wandelt die Rohausgabe in eine brauchbare Form um und liefert diese Ausgabe an eine Tabelle, Anwendung, einen Inferenzendpunkt oder einen nachgelagerten Prozess.\u003C/p\u003E\n\u003Ctable\u003E\u003Cthead\u003E\u003Ctr\u003E\u003Cth\u003ESchritt der Inferenz-Pipeline\u003C/th\u003E\u003Cth\u003EWas passiert\u003C/th\u003E\u003C/tr\u003E\n\u003C/thead\u003E\n\u003Ctbody\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EFeature Retrieval\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EDas System sammelt die Spalten, Dateien, Ereignisse oder abgeleiteten Merkmale, die das Modell benötigt\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EInputvorverarbeitung\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003ERoheingaben werden bereinigt, umgewandelt, tokenisiert, angepasst oder codiert, sodass sie dem Format entsprechen, das während des Trainings verwendet wird\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EModellbewertung\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EDas Modell wendet gelernte Muster auf die vorbereitete Eingabe an und generiert eine Prognose-, Score-, Label-, Einbettungs- oder Textausgabe\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EAusgabenachverarbeitung\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EDer Rohmodell-Output wird in eine verwertbare Form umgewandelt, wie z. B. eine Rangliste, einen Konfidenzwert, eine Unternehmenskategorie oder eine strukturierte Reaktion\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EAntwortbereitstellung\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EDie Ausgabe wird in eine Tabelle geschrieben, über einen Endpunkt zurückgegeben, an eine Anwendung gesendet oder an einen anderen Workflow übergeben\u003C/td\u003E\u003C/tr\u003E\n\u003C/tbody\u003E\u003C/table\u003E\n\u003Cp\u003EDie Sequenz klingt einfach, aber die Inferenz-Pipeline muss die Erwartungen des Modells aus dem Training bewahren. Wenn beispielsweise ein Feature zum Inferenzzeitpunkt anders berechnet wird, kann dieselbe Spalte ein anderes Geschäftskonzept repräsentieren als im Training. Wenn die Vorverarbeitung nicht einheitlich angewendet wird, erhält das Modell möglicherweise Werte in einem anderen Format, in einem anderen Maßstab oder in einer anderen Verteilung als die, aus denen es gelernt hat. In der Produktion muss die Inferenz den umgebenden Datenpfad konstant genug halten, damit die Ausgabe zuverlässig bleibt.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_inference-vs-training":{"id":"title-v2-41e007d4ca","additionalClasses":"anchor-title anchor-title--inference-vs-training","type":"heading2","lines":["Inferenz vs. Training"],":type":"snowflake-site/components/title-v2"},"text_inference-vs-training_0":{"id":"text-d96c143aa3","text":"\u003Cp\u003EBeim \u003Cstrong\u003ETraining\u003C/strong\u003E lernt ein Modell: Es passt interne Parameter (Gewichtungen) an, sodass das Modell Muster aus Trainingsdaten erfasst, bei denen es sich in der Regel um gelabelte historische Daten für überwachtes Lernen handelt. Sie ist in der Regel rechenintensiv und wird oft periodisch ausgeführt: wenn neue Daten verfügbar werden, wenn sich die Performance verschlechtert oder wenn sich das Prognoseziel ändert.\u003C/p\u003E\n\u003Cp\u003E\u003Cstrong\u003EInferenz\u003C/strong\u003E folgt, wenn das Modell auf neue Eingaben angewendet wird. Produktionsinferenz wiederholt sich über Anfragen, Zeilen, Ereignisse, Dateien oder Prompts hinweg.\u003C/p\u003E\n\u003Cp\u003EDie Unterschiede bei den Infrastrukturanforderungen sind erheblich. Das Training ist in der Regel rechenintensiv, aber begrenzt – ein Job beginnt, läuft möglicherweise über Stunden und endet dann. Die Inferenz ist kontinuierlich und latenzempfindlich. Bei einem Betrugsmodell kann beispielsweise das Zeitfenster zwischen Transaktionsanbahnung und Autorisierung in Millisekunden gemessen werden.\u003C/p\u003E\n\u003Cp\u003EKosten folgen einer ähnlichen Asymmetrie. Ein großes Modell zu trainieren, kann erhebliche Rechenressourcen erfordern, aber es ist ein einmaliger oder periodischer Aufwand. Inferenz läuft über die gesamte Lebensdauer des Modells, oft in hohem Volumen.\u003C/p\u003E\n\u003Cp\u003EEin Modell, das bei der Offline-Bewertung gut abschneidet, kann in der Produktion immer noch schlecht abschneiden, wenn die Inferenz-Pipeline veraltete Inputs liefert, Latenzbudgets überschreitet oder Ausgaben in einem Format erzeugt, das nachgelagerte Systeme nicht parsen können. Modellqualität und Inferenzqualität sind verwandte, aber separate Probleme.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_types-of-machine-learning-inference":{"id":"title-v2-b306cf25e5","additionalClasses":"anchor-title anchor-title--types-of-machine-learning-inference","type":"heading2","lines":["Arten von Inferenz beim maschinellen Lernen"],":type":"snowflake-site/components/title-v2"},"text_types-of-machine-learning-inference_0":{"id":"text-2a539ca465","text":"\u003Cp\u003EDie wichtigsten Arten der maschinellen Lerninferenz spiegeln unterschiedliche Timing- und Bereitstellungsanforderungen wider. Bei der Entscheidung, welcher Typ verwendet werden soll, sollten Teams nicht nur berücksichtigen, wie das Modell eine Prognose generiert, sondern auch, wann die Ausgabe benötigt wird und wo das Modell ausgeführt werden kann.\u003C/p\u003E\r\n\u003Ch3\u003EBatch-Inferenz\u003C/h3\u003E\r\n\u003Cp\u003EBatch-Inferenz bewertet viele Datensätze auf einmal, normalerweise nach einem Zeitplan oder als Teil einer definierten Daten-Pipeline. Sie ist besonders nützlich, wenn Prognosen erstellt werden können, bevor sie benötigt werden, z. B. indem Kundenergebnisse über Nacht aktualisiert, Produktdaten vor einer Katalogaktualisierung angereichert oder Prognosen erstellt werden, bevor die Planungsworkflows beginnen.\u003C/p\u003E\r\n\u003Cp\u003EDie wichtigsten Anforderungen sind Durchsatz, Auftragszuverlässigkeit und Output-Handling. Das System muss das erwartete Datenvolumen verarbeiten, innerhalb des verfügbaren Zeitfensters vervollständigen und Ergebnisse dort schreiben, wo nachgelagerte Analysen, Anwendungen oder operative Teams sie nutzen können.\u003C/p\u003E\r\n\u003Cp\u003EBatch-Inferenz eignet sich oft gut für Workflows, bei denen die Prognoseausgabe selbst ein Daten-Asset ist. Ein Abwanderungsscore, eine Empfehlungstabelle, eine Bedarfsprognose oder ein Ergebnis einer Dokumentenklassifizierung müssen möglicherweise gespeichert, mit anderen Daten verknüpft und für Berichts-, Planungs- oder Anwendungsworkflows wiederverwendet werden.\u003C/p\u003E\r\n\u003Ch3\u003EEchtzeit- oder Online-Inferenz\u003C/h3\u003E\r\n\u003Cp\u003EEchtzeit-Inferenz, auch Online-Inferenz genannt, generiert eine Prognose als Reaktion auf eine Anfrage. Eine Applikation sendet Eingaben an einen Inferenzendpunkt, das Modell bewertet diese Eingabe und die Applikation erhält eine Antwort.\u003C/p\u003E\r\n\u003Cp\u003EOnline-Inferenz wird in der Regel verwendet, wenn die Prognose eine sofortige Interaktion oder Entscheidung beeinflusst. Die Betrugserkennung bei der Zahlungsautorisierung, das Content-Ranking während einer aktiven Sitzung und die Next-Best-Action-Prompts in einem Live-Gespräch – all das hängt von Prognosen ab, die vor dem Zeitpunkt eintreffen werden.\u003C/p\u003E\r\n\u003Cp\u003EEchtzeit-Inferenz hängt von der Infrastruktur des Modells ab, die ein Modell laden, Anfragen annehmen, Bewertungen durchführen und Reaktionen innerhalb des Latenzbudgets der Anwendung zurückgeben kann. Sie muss die Latenz pro Anforderung, Parallelität, das Kaltstartverhalten und die Service-Level-Ziele verwalten, da das nutzende System auf das Ergebnis wartet.\u003C/p\u003E\r\n\u003Cp\u003EDiese Art der Inferenz erhöht auch den Druck auf die Verfügbarkeit von Features. Wenn das Modell vom aktuellen Benutzerverhalten, Bestandsstatus oder Transaktionskontext abhängt, benötigt die Inferenz-Pipeline einen zuverlässigen Pfad, um diese Eingaben schnell und einheitlich abzurufen.\u003C/p\u003E\r\n\u003Ch3\u003EStreaming-Inferenz\u003C/h3\u003E\r\n\u003Cp\u003EStreaming-Inferenz bewertet Daten kontinuierlich, sobald Ereignisse eintreffen, ohne auf einen geplanten Batch oder eine synchrone Anforderung zu warten. Das Modell verarbeitet einen Strom von Eingaben wie Sensormesswerten, Protokollereignissen oder Clickstream-Daten und erzeugt Ausgaben, die nahezu in Echtzeit in nachgelagerte Systeme fließen.\u003C/p\u003E\r\n\u003Cp\u003EStreaming-Inferenz liegt oft in der Nähe von Betriebsüberwachung, Risikobewertung und Warning-Workflows. Die Modellausgabe kann ein Ereignis weiterleiten, einen Wert aktualisieren, eine Überprüfung auslösen oder einem nachgelagerten System, das den Stream bereits verarbeitet, Kontext hinzufügen. Die Pipeline für die Streaming-Inferenz muss die Ereignisverarbeitung, die Funktionsaktualisierung und die Ausgabebereitstellung koordinieren.\u003C/p\u003E\r\n\u003Ch3\u003EEdge-Inferenz\u003C/h3\u003E\r\n\u003Cp\u003EEdge-Inferenz führt das Modell auf einem Gerät oder einem lokalen System aus und nicht in einer zentralen Umgebung. Diese Art von Inferenz ist häufig, wenn Latenz, Konnektivität, Datenschutz oder Datenübertragungsbeschränkungen eine zentrale Inferenz unpraktisch machen. Edge-Inferenz ist in Umgebungen üblich, in denen die Vorhersage in der Nähe der Datenquelle erfolgen muss, wie z. B. bei mobilen Anwendungen, Sensoren, Fahrzeugen, Kameras oder Industriesystemen.\u003C/p\u003E\r\n\u003Cp\u003EDie Einschränkung ist, dass Edge-Umgebungen über begrenzte Rechenressourcen, Speicher und Leistung verfügen. Modelle müssen in der Regel komprimiert werden – durch Quantifizierung, Pruning oder Wissensdestillation –, bevor sie zuverlässig innerhalb der Grenzen des Geräts ausgeführt werden können.\u003C/p\u003E\r\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"callout_types-of-machine-learning-inference_0":{"id":"text-24d4c7175e","additionalClasses":"callout callout--warning","text":"\u003Cp\u003E\u003Cstrong\u003EHÄUFIGER FALLSTRICK\u003C/strong\u003E\u003C/p\u003E\n\u003Cp\u003EDie Teams sollten nicht davon ausgehen, dass ein Modell, das offline eine gute Leistung bringt, in der Produktion gut funktioniert. Veraltete Eingaben, inkonsistente Funktionslogik, Latenzprobleme oder unbrauchbare Ausgabeformate können die Inferenz beeinträchtigen, selbst wenn das Modell selbst stark ist.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"},"title_inference-metrics-to-track-in-production":{"id":"title-v2-e05139d97c","additionalClasses":"anchor-title anchor-title--inference-metrics-to-track-in-production","type":"heading2","lines":["Inferenzmetriken in der Produktion nachverfolgen"],":type":"snowflake-site/components/title-v2"},"text_inference-metrics-to-track-in-production_0":{"id":"text-5108535898","text":"\u003Cp\u003ESobald ein Modell in Produktion geht, benötigen Teams Kennzahlen, die sowohl das Modellverhalten als auch das Laufzeitverhalten beschreiben. Genauigkeit, Präzision, Erinnerung und andere Qualitätsmaße für Modelle haben ihren Platz, aber sie können nicht zeigen, ob die Inferenz-Pipeline ihr Latenzziel erreicht, das benötigte Volumen verarbeitet oder Ergebnisse zu nachhaltigen Kosten liefert.\u003C/p\u003E\n\u003Cp\u003EDie zu messenden Kennzahlen hängen vom Inferenzmuster ab. Batch-Aufträge erfordern in der Regel Durchsatz, Fertigstellungszeit und Kosten pro Prognose. Online-Inferenz betont Latenz, Fehlerquote und Kaltstartverhalten. LLM-Inferenz fügt Maßnahmen auf Token-Ebene hinzu, da Ausgabelänge, Generierungsgeschwindigkeit und Kontextgröße sich direkt auf Latenz und Kosten auswirken.\u003C/p\u003E\n\u003Ctable\u003E\u003Cthead\u003E\u003Ctr\u003E\u003Cth\u003EMetrik\u003C/th\u003E\u003Cth\u003EWas sie misst\u003C/th\u003E\u003Cth\u003EWarum Teams es verfolgen\u003C/th\u003E\u003C/tr\u003E\n\u003C/thead\u003E\n\u003Ctbody\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003ELatenz\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EZeit vom Input bis zum verwertbaren Output\u003C/td\u003E\u003Ctd\u003EZeigt an, ob die Inferenz-Pipeline innerhalb des erforderlichen Fensters des Workflows reagiert.\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EDurchsatz\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EAnzahl der in einem definierten Intervall abgeschlossenen Prognosen\u003C/td\u003E\u003Ctd\u003EHilft bei der Dimensionierung der Rechenressourcen für Batch-Aufträge, Streaming-Pipelines und Endpunkte mit hohem Volumen\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EZeit für die Auftragsabwicklung\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EGesamtzeitaufwand für das Beenden eines Batch-Inferenzauftrags\u003C/td\u003E\u003Ctd\u003EZeigt, ob die geplante Bewertung vor nachgelagerten Workflows vom Ergebnis abhängt\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EKosten pro Prognose\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EGesamtinferenzkosten dividiert durch Prognosevolumen\u003C/td\u003E\u003Ctd\u003EZeigt, ob Modellgröße, Hardwareauswahl und Anforderungsmuster nachhaltig sind\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EAktualität von Features\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EAlter der zum Zeitpunkt der Bewertung verwendeten Daten\u003C/td\u003E\u003Ctd\u003EGibt an, ob die Prognose aktuelle Kunden-, Transaktions-, Bestands- oder Prozessdaten widerspiegelt\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EQualität des Produktionsmodells\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003ETaskspezifische Performance für Live-Daten\u003C/td\u003E\u003Ctd\u003EZeigt, ob die Offline-Bewertungsergebnisse nach der Bereitstellung noch gültig sind\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EDrift\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EÄnderungen bei Inputs, Outputs oder beobachteten Ergebnissen\u003C/td\u003E\u003Ctd\u003ESignale, wann das Modell, die Feature-Logik oder die Trainingsdaten überprüft werden müssen\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003ENutzung\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003ECPU-, GPU- oder Beschleunigernutzung während der Inferenz\u003C/td\u003E\u003Ctd\u003EErkennt Leerlaufkapazität, Sättigung oder eine schlechte Anpassung zwischen Workload und Rechenressourcen\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EKaltstartzeit\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EZeitaufwand vor der ersten Prognose nach Inbetriebnahme oder Skalierung\u003C/td\u003E\u003Ctd\u003EBeeinflusst intermittierende Workloads und automatisch skalierte Endpunkte\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EFehlerquote\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EFehlerhafte, verstrichene oder ungültige Inferenzanforderungen\u003C/td\u003E\u003Ctd\u003EIdentifiziert, wo sich der Inferenzpfad unter Produktionsbedingungen bricht\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003EGeschwindigkeit der Tokengenerierung\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EToken pro Sekunde und Time-to-First Token für LLM-Inferenz\u003C/td\u003E\u003Ctd\u003EZeigt, wie schnell ein LLM eine generierte Antwort beginnt und abschließt\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003ETokenvolumen und Reaktionskosten\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EEingabetoken, Ausgabetoken und Kosten pro generierter Antwort\u003C/td\u003E\u003Ctd\u003EHilft bei der Einschätzung, ob Promptlänge, Ausgabelänge, Modellauswahl und Nutzungsvolumen nachhaltig sind\u003C/td\u003E\u003C/tr\u003E\n\u003Ctr\u003E\u003Ctd\u003E\u003Cstrong\u003ENutzbarkeit der Ausgabe\u003C/strong\u003E\u003C/td\u003E\u003Ctd\u003EOb das Ergebnis im richtigen Format und Speicherort landet\u003C/td\u003E\u003Ctd\u003EBestimmt, ob die Prognose in den nächsten Workflow einfließen kann\u003C/td\u003E\u003C/tr\u003E\n\u003C/tbody\u003E\u003C/table\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_optimizing-inference-performance-and-cost":{"id":"title-v2-0e76b91974","additionalClasses":"anchor-title anchor-title--optimizing-inference-performance-and-cost","type":"heading2","lines":["Optimierung von Inferenz-Performance und Kosten"],":type":"snowflake-site/components/title-v2"},"text_optimizing-inference-performance-and-cost_0":{"id":"text-93f07dcf82","text":"\u003Cp\u003EDie Inferenzoptimierung hat zwei Ausgangspunkte: das Modell und die Pipeline.\u003C/p\u003E\n\u003Cp\u003E\u003Cstrong\u003EModellseitig\u003C/strong\u003E sind Größe und Präzision die wichtigsten Variablen. Die Quantifizierung reduziert die numerische Genauigkeit von Gewichtungen und Aktivierungen – der Wechsel von FP32 zu INT8 reduziert den Speicherbedarf und verbessert oft den Durchsatz auf kompatibler Hardware. Dabei besteht ein gewisses Genauigkeitsrisiko, das Teams anhand produktionsähnlicher Daten validieren. Durch das Pruning werden Parameter entfernt, die wenig zur Ausgabequalität beitragen, wodurch der Rechen- und Speicherbedarf für ein Modell reduziert wird, das die Genauigkeitsleiste noch erfüllt. Die Wissensdestillation trainiert ein kleineres Modell, um das Verhalten eines größeren zu approximieren – nützlich, wenn das vollständige Modell zwar genau ist, aber für die Zielumgebung zu teuer oder langsam.\u003C/p\u003E\n\u003Cp\u003E\u003Cstrong\u003EPipelineseitig\u003C/strong\u003E ist Batching der am besten zugängliche Hebel. Die Gruppierung von Anfragen verbessert die Hardwareauslastung und den Durchsatz, führt jedoch zu einer Latenzzeit, die Batch-Workloads leichter absorbieren können als Echtzeit-Endpunkte. Dynamisches Batching passt die Gruppengröße an den eingehenden Datenverkehr an, wodurch diese konkurrierenden Anforderungen ausgeglichen werden.\u003C/p\u003E\n\u003Cp\u003EHardwareauswahl beeinflusst Kosten und Performance. CPUs arbeiten für Workloads mit geringerem Volumen oder weniger rechenintensiv, während GPUs erhebliche Durchsatzvorteile für Deep-Learning-Inferenzen bieten, wenn Batch- und Modellgrößen sie gut auslasten können.\u003C/p\u003E\n\u003Cp\u003EModellformat und Laufzeit beeinflussen die Portabilität und die Ausführungsgeschwindigkeit. ONNX gibt Teams die Möglichkeit, Modelle über Frameworks und Laufzeiten hinweg darzustellen. TensorRT kann die Deep-Learning-Inferenz auf GPUs durch Techniken wie Ebenenfusion, Präzisionskalibrierung, Kernselektion und Graphoptimierung optimieren.\u003C/p\u003E\n\u003Cp\u003ELLM-Inferenz hat zusätzliche Optimierungsüberlegungen. Promptlänge, Kontextfensternutzung und maximale Ausgabentokenlimits wirken sich alle auf die Rechenkosten pro Anforderung aus. Ein KV-Cache speichert die Aufmerksamkeitsschlüssel-Wert-Berechnungen aus dem vorherigen Kontext, damit das Modell sie nicht für jedes Token neu berechnet. Bei der spekulativen Entschlüsselung werden Token mit einem kleineren Modellentwurf vorgeschlagen, die ein größeres Modell überprüft. So wird der Durchsatz verbessert, wenn der Verifizierungsprozess genügend Tokenentwürfe akzeptiert. Ungefähre Varianten können Qualität gegen Geschwindigkeit tauschen.\u003C/p\u003E\n\u003Cp\u003EEs ist wichtig zu beachten, dass die Optimierung erfordert, dass Sie wissen, für was Sie optimieren. Latenzverringerung und Verbesserung des Durchsatzes erfordern oft unterschiedliche Ansätze, die beide mit Kostenzielen in Konflikt stehen können. Teams, die vor der Optimierung messen, vermeiden, ein Problem gegen ein anderes einzutauschen.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"callout_optimizing-inference-performance-and-cost_0":{"id":"text-51d105165c","additionalClasses":"callout callout--tip","text":"\u003Cp\u003E\u003Cstrong\u003EKURZER TIPP\u003C/strong\u003E\u003C/p\u003E\n\u003Cp\u003EMessen Sie vor der Optimierung: Entscheiden Sie, ob der Workload eine niedrigere Latenz, einen höheren Durchsatz, niedrigere Kosten oder neuere Funktionen benötigt, da die Optimierung für einen Aspekt Kompromisse bei den anderen erfordern kann.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"},"title_governance-considerations-for-ml-inference":{"id":"title-v2-f71a99235e","additionalClasses":"anchor-title anchor-title--governance-considerations-for-ml-inference","type":"heading2","lines":["Governance-Überlegungen zur ML-Inferenz"],":type":"snowflake-site/components/title-v2"},"text_governance-considerations-for-ml-inference_0":{"id":"text-db3ef06fc8","text":"\u003Cp\u003EML-Inferenz verwendet Daten, Modelle und Ausgaben, die allesamt \u003Ca href=\"https://www.snowflake.com/de/artificial-intelligence/ai-governance/\"\u003EGovernance-\u003C/a\u003EAnforderungen erfüllen können. Beispielsweise können die Eingabedaten sensible Felder enthalten, oder das Modell kann für einige Anwendungsfälle zugelassen werden, nicht aber für andere. Das bedeutet, dass Teams wissen müssen, welche Daten verwendet wurden, welche Modellversion die Ausgabe generiert hat, wer auf das Ergebnis zugreifen kann und ob die Prognose für den sie nutzenden Workflow geeignet ist. Datenherkunft, Zugriffskontrollen, Modellmetadaten und Modellüberwachung helfen dabei, diesen Kontext herzustellen.\u003C/p\u003E\n\u003Cp\u003EGovernance ist besonders dann wichtig, wenn Inferenzergebnisse zu wiederverwendbaren Daten-Assets werden. Ohne klare Eigentums-, Versions- und Zugriffsrichtlinien lassen sich diese Ausgaben nur schwer prüfen, erklären oder sicher wiederverwenden.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_running-inference-in-snowflake":{"id":"title-v2-8034ac4798","additionalClasses":"anchor-title anchor-title--running-inference-in-snowflake","type":"heading2","lines":["Ausführung der Inferenz in Snowflake"],":type":"snowflake-site/components/title-v2"},"text_running-inference-in-snowflake_0":{"id":"text-7d0c8fe27a","text":"\u003Cp\u003EProduktionsinferenz-Workflows sind Daten-Workflows. Das Modell benötigt Inputs, die von Unternehmensdatensystemen stammen, und die Outputs müssen in der Regel zurück in dieselben Systeme gehen – mit Kundendatensätzen verknüpft, in eine Tabelle geschrieben, die ein BI-Tool liest, und in eine nachgelagerte Pipeline übergeben.\u003C/p\u003E\n\u003Cp\u003ESnowflake unterstützt die Modellinferenz über zwei Rechen-Engines: die Warehouse-SQL-Engine und \u003Ca href=\"https://docs.snowflake.com/de/developer-guide/snowpark-container-services/overview\"\u003ESnowpark Container Services\u003C/a\u003E. Die Snowflake Model Registry bietet eine einheitliche Oberfläche für beides.\u003C/p\u003E\n\u003Cp\u003EBei Batch-Workloads mit hohem Durchsatz nutzen Snowflake Batch Inference Jobs Snowpark Container Services, um verteilte Rechenressourcen für eine umfangreiche Bewertung statischer oder periodisch aktualisierter Datasets bereitzustellen. Dazu gehören auch unstrukturierte Daten, die in Snowflake-Stages gespeichert sind. Snowflake unterstützt die Bereitstellung von Modellen als verwaltete HTTP-Endpunkte über Snowpark Container Services und sorgt so dafür, dass die Modellbereitstellung mit derselben Umgebung verbunden ist, in der sich die zugrunde liegenden Daten befinden.\u003C/p\u003E\n\u003Cp\u003E\u003Ca rel=\"noopener noreferrer\" href=\"https://docs.snowflake.cn/en/user-guide/snowflake-cortex/ai-documents\"\u003ECortex AI Functions\u003C/a\u003E erweitert die Inferenz auf LLM-gestützte Analysen kontrollierter Daten – Vervollständigung, Einbettung, Extraktion, Stimmungsanalyse, Zusammenfassung, Übersetzung und multimodale Dokumentenverarbeitung mit Funktionen wie AI_PARSE_DOCUMENT. Diese werden mit Daten ausgeführt, die sich bereits in Snowflake befinden, ohne sie auf ein externes System zu verschieben.\u003C/p\u003E\n\u003Cp\u003EDer Wert ist architektonische Einheitlichkeit. Verschiedene Inferenz-Workloads erfordern zwar weiterhin unterschiedliche Ausführungsmuster, können aber mit den Daten-, Modellverwaltungs- und Ausgabe-Workflows verbunden bleiben, die Produktionsteams bereits verwenden. Snowflake gibt Teams die Möglichkeit, das Muster auszuwählen, das zum Workload passt, während die Inferenz nah an den Unternehmensdaten bleibt, von denen sie abhängig sind.\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"title_turning-inference-into-a-production-data-workflow":{"id":"title-v2-e81cfdb1d7","additionalClasses":"anchor-title anchor-title--turning-inference-into-a-production-data-workflow","type":"heading2","lines":["Umwandlung von Inferenz in einen Produktionsdaten-Workflow"],":type":"snowflake-site/components/title-v2"},"text_turning-inference-into-a-production-data-workflow_0":{"id":"text-7a0a169f0a","text":"\u003Cp\u003EDie Inferenzarchitektur sollte dem Datenpfad folgen. Das Modell benötigt Eingaben, die mit der während des Trainings verwendeten Logik übereinstimmen, die Pipeline benötigt genügend Rechenressourcen, um die Timing-Anforderungen des Workflows zu erfüllen, und die Ausgabe muss dort landen, wo Analytics, Anwendungen oder nachgelagerte Systeme sie verwenden können. Die Trennung dieser Teile führt zu Datenbewegungen, -duplizierungen und unnötigen Möglichkeiten für die Feature-Logik oder die Ausgabeverarbeitung.\u003C/p\u003E\n\u003Cp\u003EWenn Teams die Inferenz näher an ihren Unternehmensdaten durchführen, können sie die Modellergebnisse als Produktionsdaten und nicht als isolierte Modellantworten behandeln. Das Ergebnis ist ein zuverlässigerer Weg von den Quelldaten über die Modellbewertung bis hin zu Geschäftsmaßnahmen – mit weniger Übergaben zwischen den Systemen, die die Daten aufbereiten, das Modell ausführen und die Ausgaben nutzen.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"},"callout_turning-inference-into-a-production-data-workflow_0":{"id":"text-5a3e5dafca","additionalClasses":"callout callout--general","text":"\u003Cp\u003E\u003Cstrong\u003EWICHTIGSTE ERKENNTNIS\u003C/strong\u003E\u003C/p\u003E\n\u003Cp\u003EBei der Inferenz mit maschinellem Lernen schaffen trainierte Modelle einen Produktionswert, indem sie neue Inputs in verwertbare Outputs umwandeln. Doch die Zuverlässigkeit hängt vom gesamten Laufzeitpfad ab – Feature-Abruf, Vorverarbeitung, Bewertung, Nachverarbeitung, Bereitstellung, Performance-Kontrollen und Governance – nicht nur vom Modell selbst.\u003C/p\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular text-color-text-05"}},":itemsOrder":["callout__0","text__0","title_what-is-machine-learning-inference","text_what-is-machine-learning-inference_0","title_inference-vs-training","text_inference-vs-training_0","title_types-of-machine-learning-inference","text_types-of-machine-learning-inference_0","callout_types-of-machine-learning-inference_0","title_inference-metrics-to-track-in-production","text_inference-metrics-to-track-in-production_0","title_optimizing-inference-performance-and-cost","text_optimizing-inference-performance-and-cost_0","callout_optimizing-inference-performance-and-cost_0","title_governance-considerations-for-ml-inference","text_governance-considerations-for-ml-inference_0","title_running-inference-in-snowflake","text_running-inference-in-snowflake_0","title_turning-inference-into-a-production-data-workflow","text_turning-inference-into-a-production-data-workflow_0","callout_turning-inference-into-a-production-data-workflow_0"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-medium"},"flexible_column_content_container_2":{"additionalClasses":"hub-sidebar","layout":"SIMPLE","id":"hub-body-aside",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"container":{"additionalClasses":"sticky-sidebar","layout":"RESPONSIVE_GRID","columnCount":12,"columnClassNames":{"text_943981956_copy_":"aem-GridColumn aem-GridColumn--default--12","text_copy":"aem-GridColumn aem-GridColumn--default--12"},"gridClassNames":"aem-Grid aem-Grid--12 aem-Grid--default--12","id":"container-b75f1b92a9",":type":"snowflake-site/components/container",":items":{"text_943981956_copy_":{"id":"text-22d5dcde4c","additionalClasses":"eyebrow-text","text":"\u003Cp\u003EIn diesem Leitfaden\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-regular"},"text_copy":{"id":"text-9418f00a50","additionalClasses":"page-toc","text":"\u003Cul\u003E\u003Cli data-anchor=\"what-is-machine-learning-inference\"\u003EWas ist Inferenz beim maschinellen Lernen?\u003C/li\u003E\u003Cli data-anchor=\"inference-vs-training\"\u003EInferenz vs. Training\u003C/li\u003E\u003Cli data-anchor=\"types-of-machine-learning-inference\"\u003EArten von Inferenz beim maschinellen Lernen\u003C/li\u003E\u003Cli data-anchor=\"inference-metrics-to-track-in-production\"\u003EInferenzmetriken in der Produktion nachverfolgen\u003C/li\u003E\u003Cli data-anchor=\"optimizing-inference-performance-and-cost\"\u003EOptimierung von Inferenz-Performance und Kosten\u003C/li\u003E\u003Cli data-anchor=\"governance-considerations-for-ml-inference\"\u003EGovernance-Überlegungen zur ML-Inferenz\u003C/li\u003E\u003Cli data-anchor=\"running-inference-in-snowflake\"\u003EAusführung der Inferenz in Snowflake\u003C/li\u003E\u003Cli data-anchor=\"turning-inference-into-a-production-data-workflow\"\u003EUmwandlung von Inferenz in einen Produktionsdaten-Workflow\u003C/li\u003E\u003C/ul\u003E","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-size-small text-color-text-05"}},":itemsOrder":["text_943981956_copy_","text_copy"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-medium"}},":itemsOrder":["container"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-small"},":type":"snowflake-site/components/flexible-column-container","isBlogPage":false,"isActiveTOC":false},"flexible_column_cont_1786318617":{"id":"flexible-column-container-c3253eee02","propertiesId":"hub-faq","type":"2-column-40-60","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"large","bottomPadding":"large","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"hub-faq-intro",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"title_v2_copy":{"id":"title-v2-3130b754bd","additionalClasses":"hub-faq__headline","type":"heading2","lines":["Häufig gestellte Fragen"],":type":"snowflake-site/components/title-v2","appliedCssClassNames":"left-alignment"},"text_copy":{"id":"text-cea10a1391","additionalClasses":"hub-faq__subheadline","text":"\u003Cp\u003EIhre häufigsten Fragen zur ML-Inferenz – beantwortet von Snowflake-Expert:innen.\u003C/p\u003E\n","richText":true,":type":"snowflake-site/components/text","appliedCssClassNames":"text-color-text-05"}},":itemsOrder":["title_v2_copy","text_copy"],"appliedCssClassNames":"snowflake-responsive-container-inner-padding-extra-small"},"flexible_column_content_container_2":{"layout":"SIMPLE","id":"hub-faq-accordions",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"simple_snowflake_acc":{"id":"simple-snowflake-accordion-a4202634c5","additionalClasses":"seo-hub__faqs","showDivider":false,"accordionItemsList":[{"title":"Was braucht mehr Rechenressourcen: Training oder Inferenz?","richText":"\u003Cp\u003EDas Training ist in der Regel rechenintensiver pro Durchlauf, da das Modell aus historischen Daten lernen und seine Parameter aktualisieren muss. Inferenz kann über den gesamten Produktionslebenszyklus hinweg mehr Rechenressourcen verbrauchen, da sie wiederholt ausgeführt wird, oft für jede Prognoseanfrage, jeden geplanten Bewertungsauftrag, jeden Ereignisstream, jede Datei oder jeden Prompt.\u003C/p\u003E\r\n"},{"title":"Was ist Inferenzlatenz und warum spielt sie eine Rolle?","richText":"\u003Cp\u003EInferenzlatenz ist die Zeit, die es dauert, um eine Prognose nach dem Eingang des Systems zu erstellen. Bei der Online-Inferenz wirkt sich Latenz auf die Anwendung oder die Nutzer:innen aus, die auf eine Antwort warten. Latenz bezieht sich in der Regel auf die Zeit, die erforderlich ist, um den Bewertungsauftrag abzuschließen, bevor der nächste Workflow startet. Latenzziele sollten den Workflow widerspiegeln, da verschiedene Jobs in unterschiedlichen Zeitfenstern ausgeführt werden.\u003C/p\u003E\r\n"},{"title":"Was ist ein Inferenz-Endpunkt?","richText":"\u003Cp\u003EEin Inferenzendpunkt ist eine Schnittstelle, über die Anwendungen oder Dienste Eingaben an ein Modell senden und im Gegenzug Prognosen erhalten. Bei der Online-Inferenz werden oft HTTP-Endpunkte verwendet, damit eine Anwendung synchron eine Prognose anfordern kann. Für die Batch-Inferenz ist möglicherweise kein Endpunkt erforderlich, wenn das Modell Zeilen aus einer Tabelle oder Dateien aus einer Stage bewertet und die Ausgaben zurück in den Speicher schreibt.\u003C/p\u003E\r\n"},{"title":"Wie unterscheiden sich Batch-Inferenz und Echtzeit-Inferenz?","richText":"\u003Cp\u003EBatch-Inferenz erfasst viele Datensätze auf einmal, normalerweise nach einem Zeitplan oder als Teil einer Pipeline. Echtzeit-Inferenz bewertet Eingaben als Reaktion auf eine Anfrage, oft über einen Inferenz-Endpunkt. Die Batch-Inferenz optimiert in der Regel den Durchsatz, die Auftragsabwicklungszeit und die Kosten pro Prognose. Echtzeitinferenz optimiert in der Regel für niedrige Latenz, Parallelität, Fehlerquote und Kaltstartverhalten.\u003C/p\u003E\r\n"},{"title":"Warum beeinflusst die Aktualität von Features die Inferenzqualität?","richText":"\u003Cp\u003EFeature-Aktualität beschreibt, wie aktuell die eingegebenen Daten sind, wenn das Modell sie bewertet. Ein Kundenabsichtsmodell, das altes Verhalten verwendet, ein Betrugsmodell, das aktuelle Transaktionen übersieht oder eine Nachfrageprognose, die aktualisierte Bestände nicht widerspiegelt, kann Ergebnisse liefern, die nicht mehr dem Geschäftszustand entsprechen. Die Aktualisierungsanforderungen variieren je nach Workload, aber jede Inferenz-Pipeline sollte klarmachen, wie alt die Eingaben zum Bewertungszeitpunkt sind.\u003C/p\u003E\r\n"}],":type":"snowflake-site/components/simple-snowflake-accordion"}},":itemsOrder":["simple_snowflake_acc"]},":type":"snowflake-site/components/flexible-column-container","isBlogPage":false,"isActiveTOC":false,"appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_1467213961":{"id":"flexible-column-container-f9e7c4b9ff","propertiesId":"hub-explore-resources-header","type":"1-column","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"large","bottomPadding":"none","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"container-e194985eca",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"title_v2":{"id":"title-v2-3ff1772486","additionalClasses":"hub-explore-resources-header__headline","type":"heading2","lines":["KI-Ressourcen entdecken"],":type":"snowflake-site/components/title-v2","appliedCssClassNames":"left-alignment"}},":itemsOrder":["title_v2"]},":type":"snowflake-site/components/flexible-column-container","isBlogPage":false,"isActiveTOC":false,"appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"},"flexible_column_cont_912630531":{"id":"flexible-column-container-55bcc49067","propertiesId":"hub-explore-resources-grid","type":"1-column","alignColumns":"top","containerMaxWidth":"extra-large","topPadding":"small","bottomPadding":"large","spaceBetween":"small","reverseOnMobile":false,"carouselOnMobile":false,"backgroundImageOption":"none","flexible_column_content_container_1":{"layout":"SIMPLE","id":"hub-explore-resources-grid-inner",":type":"snowflake-site/components/flexible-column-container/flexible-column-content-container",":items":{"resource_chip_0":{"id":"content-chip-7a591be343","tagText":"LEITFADEN","tagColor":"#71D3DC","cta":{"id":"cta","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/en/developers/guides/intro-to-machine-learning-with-snowpark-ml-for-python/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"Mehr erfahren"},"headline":{"id":"title-v2-3606373835","type":"heading5","lines":["Getting Started with ML Development in Snowflake"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip","appliedCssClassNames":"snowflake-content-chip-white-bg"},"resource_chip_1":{"id":"content-chip-972d134820","tagText":"LEITFADEN","tagColor":"#71D3DC","cta":{"id":"cta","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/en/developers/guides/snowpark-container-services-model-serving-guide/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"Mehr erfahren"},"headline":{"id":"title-v2-a099e154fa","type":"heading5","lines":["Model Serving in Snowpark Container Services"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip","appliedCssClassNames":"snowflake-content-chip-white-bg"},"resource_chip_2":{"id":"content-chip-005edaef81","tagText":"BLOG","tagColor":"#71D3DC","cta":{"id":"cta","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/en/blog/engineering/scalable-model-serving-architecture/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"Blog lesen"},"headline":{"id":"title-v2-1f9f54cd2c","type":"heading5","lines":["Scalable Model Serving: An Architectural Overview"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip","appliedCssClassNames":"snowflake-content-chip-white-bg"},"resource_chip_3":{"id":"content-chip-cdee984e8d","tagText":"BLOG","tagColor":"#71D3DC","cta":{"id":"cta","showOutboundIcon":false,"buttonLink":{"valid":true,"url":"https://www.snowflake.com/en/blog/engineering/snowflake-ml-runtime-vs-databricks-tpcx-ai/"},"linkTargetContentType":"GENERIC",":type":"snowflake-site/components/button","linkType":"SNOWFLAKE_EXTERNAL","text":"Blog lesen"},"headline":{"id":"title-v2-42e8f57c6f","type":"heading5","lines":["Accelerating Distributed Training with Snowflake ML"],":type":"snowflake-site/components/title-v2"},":type":"snowflake-site/components/content-chip","appliedCssClassNames":"snowflake-content-chip-white-bg"}},":itemsOrder":["resource_chip_0","resource_chip_1","resource_chip_2","resource_chip_3"]},":type":"snowflake-site/components/flexible-column-container","isBlogPage":false,"isActiveTOC":false,"appliedCssClassNames":"snowflake-flexible-column-container-gray-10-bg"}},":itemsOrder":["flexible_column_cont","flexible_column_cont_939100716","flexible_column_cont_1336760939","flexible_column_cont_663228916","flexible_column_cont_1786318617","flexible_column_cont_1467213961","flexible_column_cont_912630531"],":type":"wcm/foundation/components/responsivegrid"},"modal_container":{"layout":"SIMPLE","id":"container-5514a9db27",":type":"snowflake-site/components/modal/modal-container",":items":{},":itemsOrder":[]},"markup_editor_928258845":{"id":"markup-editor-92861e0be9","title":" ","cssContent":".snowflake-flexible-column-container-gray-10-bg\u003E.snowflake-flexible-column-container{background-color:var(--ui-background-05) !important}.text-size-regular:has(.seo-hub-hero__related-topic-label){display:flex;align-items:center}.hub-hero__headline span{text-transform:none !important}.hub-hero__subheadline p{max-width:70ch;margin-top:8px}.hub-hero__authors \u003E .container \u003E .cmp-container \u003E .aem-container{display:flex;flex-direction:row}.hub-hero__authors \u003E .container \u003E .cmp-container \u003E .aem-container \u003E div{width:auto !important;margin:24px 48px 0 0 !important}.hub-hero__authors .heading-5-v2{gap:var(--spacing-00)}.hub-hero__authors .snowflake-content-chip-button{display:none !important}.hub-hero__authors .snowflake-person-chip-content .body-2,.hub-hero__authors .snowflake-content-chip-content .snowflake-title-v2-line{font-size:16px !important;line-height:20px !important;font-family:\"Lato\",sans-serif !important;color:#000 !important;font-weight:600 !important}.hub-hero__authors .snowflake-person-chip-content .body-3,.hub-hero__authors .snowflake-content-chip-content .snowflake-title-v2-line:not(:first-child){font-weight:400 !important;color:var(--text-05) !important;font-size:16px !important}.hub-hero__authors .snowflake-image-container img{aspect-ratio:1 !important;border-radius:100%;overflow:hidden}.hub-hero__authors .snowflake-person-chip-avatar{width:56px;height:56px}.hub-hero__authors .snowflake-content-chip{align-items:center;display:inline-flex}.hub-hero__authors .snowflake-content-chip-image{max-width:56px;line-height:0;margin-right:var(--spacing-03)}.hub-hero__authors .snowflake-person-chip-inner-horizontal{gap:var(--spacing-03)}@media screen and (min-width:1367px){.hub-hero__headline .heading-1-v2{font-size:48px;line-height:44px}}#hub-explore-resources-grid-inner\u003E.container\u003E.cmp-container\u003E.aem-container{display:flex;flex-direction:row;flex-wrap:wrap;gap:24px}#hub-explore-resources-grid-inner\u003E.container\u003E.cmp-container\u003E.aem-container::before,#hub-explore-resources-grid-inner\u003E.container\u003E.cmp-container\u003E.aem-container::after{display:none}#hub-explore-resources-grid-inner\u003E.container\u003E.cmp-container\u003E.aem-container\u003Ediv{width:calc(25% - 18px)}.text-color-text-05 .snowflake-text h2,.text-color-text-05.cq-Editable-dom h2,.text-color-text-05 .snowflake-text h3,.text-color-text-05.cq-Editable-dom h3,.text-color-text-05 .snowflake-text h4,.text-color-text-05.cq-Editable-dom h4,.text-color-text-05 .snowflake-text h5,.text-color-text-05.cq-Editable-dom h5,.text-color-text-05 .snowflake-text h6,.text-color-text-05.cq-Editable-dom h6{color:#000 !important}","isGSAPEnabled":false,":type":"snowflake-site/components/markup-editor"},"markup_editor_597730182":{"id":"markup-editor-24bdb5346d","title":" ","cssContent":".sf-copy-markdown [data-copy-md]{display:inline-flex;align-items:center;gap:6px;padding:8px 16px;font-family:'Texta',sans-serif;text-transform:uppercase;font-weight:800 !important;font-size:14px;font-weight:500;color:#11567f;background:#f0faff;border:1px solid #b8e6f9;border-radius:24px;cursor:pointer;transition:background .2s ease,border-color .2s ease,color .2s ease}.sf-copy-markdown [data-copy-md]:hover{background:#ddf3fc;border-color:#29b5e8}.sf-copy-markdown [data-copy-md][data-copied=\"1\"]{color:#0f7b3e;background:#ecfdf5;border-color:#6ee7a0;pointer-events:none}.sf-copy-markdown [data-copy-md] svg{flex-shrink:0}.longform-conten .snowflake-content-chip-white-bg .snowflake-content-chip{box-shadow:0 0 24px 4px rgba(0,0,0,.02),0 4px 8px 0 rgba(0,0,0,.04);flex-direction:row-reverse;align-items:center}.longform-conten .snowflake-content-chip-button{display:none}.longform-conten .snowflake-content-chip-image__inner{aspect-ratio:5 / 3;display:flex;justify-content:center;align-items:center;background-color:var(--ui-01);border-radius:4px}.longform-conten .snowflake-content-chip-image{margin-right:0;margin-left:48px}.longform-conten .snowflake-content-chip-image img{width:50%;border-radius:0 !important;object-fit:contain}.longform-content .black-blue-text-color .snowflake-title-v2-line:not(:first-child){font-size:14px !important;font-weight:400 !important;color:rgba(0,0,0,.6) !important;margin-top:8px !important}.page-toc ul li:first-child{padding-top:0 !important}.page-toc ul li:last-child{padding-bottom:0 !important}.seo-hub__top-bar \u003E .container \u003E .cmp-container \u003E .aem-container \u003E div:first-child{flex-grow:1}.sf-copy-markdown{margin-top:40px !important}.page-toc ul{margin-top:16px !important}.seo-hub__top-bar \u003E .container \u003E .cmp-container \u003E .aem-container{display:flex;justify-content:space-between}.sf-copy-markdown{}.callout.snowflake-text p:not(:first-child){margin-top:var(--spacing-01)}.callout \u003E span \u003E p:first-child \u003E strong,.callout \u003E span \u003E p:first-child \u003E b{text-transform:uppercase;font-family:'Texta',sans-serif;font-size:16px !important;color:var(--ui-01) !important}.seo-hub-hero__subheadline p{max-width:50ch}.tag-group ul{list-style-type:none;padding:0;margin:0;display:flex;flex-direction:row;row-gap:12px;column-gap:8px;align-items:center;flex-wrap:wrap}.tag-group ul li:first-child{flex-shrink:0}.tag-group ul li a{display:inline-block;padding:2px 12px;border-radius:48px;background-color:#ededed;color:#666;font-size:14px !important}@media screen and (min-width:1367px){.seo-hub-hero__headline span.snowflake-title-v2-line{font-size:56px !important}}.callout.snowflake-text p:not(:first-child){margin-top:var(--spacing-01)}.callout \u003E span \u003E p:first-child \u003E b{text-transform:uppercase;font-family:'Texta',sans-serif;font-size:16px !important;color:var(--ui-01) !important}.seo-hub-hero__subheadline p{max-width:80ch}#hero:has(.snowflake-youtube-lite) .seo-hub-hero__subheadline p{max-width:50ch}.tag-group ul{list-style-type:none;padding:0;margin:0;display:flex;flex-direction:row;row-gap:12px;column-gap:8px;align-items:center;flex-wrap:wrap}.tag-group ul li:first-child{width:100%;flex-shrink:0}.tag-group ul li a{display:inline-block;padding:2px 12px;border-radius:48px;background-color:#ededed;color:#666;font-size:14px !important}@media screen and (min-width:1367px){.seo-hub-hero__headline span.snowflake-title-v2-line{font-size:56px !important}}","isGSAPEnabled":false,":type":"snowflake-site/components/markup-editor"},"markup_editor":{"id":"markup-editor-c9cb32816c","title":" ","cssContent":"div.snowflake-breadcrumb a.snowflake-breadcrumb-item,.snowflake-breadcrumb div.snowflake-breadcrumb-item{text-transform:none;font-weight:500}.snowflake-breadcrumb svg{display:none !important}.snowflake-breadcrumb a:has(svg)::after{content:'/';margin:0 12px;color:#666}.hub-sidebar{padding:0 40px}.sticky-sidebar{max-width:340px;margin-left:auto}.page-toc ul{list-style-type:none;padding:0}.page-toc li{padding:8px 16px;border-left:4px solid var(--ui-01);cursor:pointer;transition:300ms ease all}.page-toc li:hover{color:var(--ui-01);border-color:#7fd3f1;transition:300ms ease all}.callout,.customer-card{background-color:#eef9fd;border-left:4px solid var(--ui-01);padding:24px 24px 24px 32px;border-radius:4px}.logo-container{max-width:180px}.longform-content li{margin-top:1rem !important}div.longform-content p{max-width:80ch}.bolder .snowflake-title-v2-line{font-weight:900 !important}.border-top\u003Ediv{border-top:1px solid #ccc;padding-top:48px}.related-topics ul{list-style-type:none;padding:0;margin:0;display:flex;gap:8px;flex-wrap:wrap}.related-topics li{display:inline-block;border:1px solid #ccc;padding:4px 12px;border-radius:24px}div.longform-content .snowflake-text h2,div.longform-content .snowflake-text .heading-2-v2,div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-title-v2 .heading-3-v2,div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-title-v2 .heading-4-v2,div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-title-v2 .heading-5-v2,div.longform-content .snowflake-text h6,div.longform-content .snowflake-title-v2 .heading-6-v2,div.longform-content .snowflake-text .heading-6-v2{text-transform:none !important}div.longform-content .snowflake-text h2,div.longform-content .snowflake-text .heading-2-v2,div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-text h6,div.longform-content .snowflake-text .heading-6-v2{margin-top:1.5rem !important;line-height:1.1 !important}div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-title-v2 .heading-3-v2,div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-title-v2 .heading-4-v2,div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-title-v2 .heading-5-v2,div.longform-content .snowflake-text h6,div.longform-content .snowflake-text .heading-6-v2,div.longform-content .snowflake-title-v2 .heading-6-v2{font-family:Lato,sans-serif !important;font-weight:800 !important}div.longform-content .snowflake-text h2,div.longform-content .snowflake-text .heading-2-v2,div.longform-content .snowflake-title-v2 .heading-2-v2{text-transform:none !important;font-size:28px !important}div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-title-v2 .heading-3-v2{font-size:22px !important}div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-title-v2 .heading-4-v2{font-size:18px !important}div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-title-v2 .heading-5-v2{font-size:16px !important}div.longform-content .snowflake-text h6,div.longform-content .snowflake-text .heading-6-v2,div.longform-content .snowflake-title-v2 .heading-6-v2{font-size:14px !important}@media screen and (min-width:992px){div.longform-content .snowflake-text h2,div.longform-content .snowflake-text .heading-2-v2,div.longform-content .snowflake-title-v2 .heading-2-v2{font-size:38px !important}div.longform-content .snowflake-text h3,div.longform-content .snowflake-text .heading-3-v2,div.longform-content .snowflake-title-v2 .heading-3-v2{font-size:26px !important}div.longform-content .snowflake-text h4,div.longform-content .snowflake-text .heading-4-v2,div.longform-content .snowflake-title-v2 .heading-4-v2{font-size:22px !important}div.longform-content .snowflake-text h5,div.longform-content .snowflake-text .heading-5-v2,div.longform-content .snowflake-title-v2 .heading-5-v2{font-size:18px !important}div.longform-content .snowflake-text h6,div.longform-content .snowflake-text .heading-6-v2,div.longform-content .snowflake-title-v2 .heading-6-v2{font-size:16px !important}}.sticky-sidebar .page-toc li.is-active{font-weight:600;color:var(--snow-blue,#29b5e8)}.sticky-sidebar .page-toc li[data-anchor]{cursor:pointer}.longform-content table{margin-top:24px;margin-bottom:24px;width:100%;background-color:var(--ui-background-01);border-collapse:collapse;border:2px solid var(--ui-background-09);font-family:'Lato',sans-serif;color:var(--ui-background-09)}.longform-content table thead{background-color:var(--ui-01)}.longform-content th,.longform-content td{min-width:120px;border:2px solid var(--ui-background-09);padding:var(--spacing-01)}.longform-content ol{margin-top:0 !important}.longform-content ol li{margin-bottom:1rem !important}.longform-content ul li{margin:0;padding:0 0 0 32px;position:relative}.longform-content ul{list-style-type:none}.longform-content ul li::before{content:\"\";display:block;border-radius:100%;background:#29b5e8;width:18px;height:18px;position:absolute;top:4px;left:0;border:5px solid #e5f2f7;box-sizing:border-box}.seo-customer.snowflake-card-v2-advanced-horizontal .snowflake-card-v2-advanced-image-container{max-width:200px}.seo-customer.snowflake-card-v2-advanced-horizontal .snowflake-card-v2-advanced-image-container img{object-fit:contain}.related-topics-outer-container \u003E .container \u003E .cmp-container \u003E .aem-container{display:flex;flex-direction:row}.related-topics-outer-container \u003E .container \u003E .cmp-container \u003E .aem-container \u003E div{width:auto !important;margin:0 !important}.related-topics-outer-container \u003E .container \u003E .cmp-container \u003E .aem-container \u003E div:first-child{margin-right:16px !important;flex-shrink:0}","jsContent":"(function(){var OFFSET=100;if(window.gsap&&window.ScrollTrigger){gsap.registerPlugin(ScrollTrigger);var sidebar=document.querySelector('.sticky-sidebar');var body=document.querySelector('.longform-content');if(sidebar&&body){ScrollTrigger.create({trigger:sidebar,start:'top 100px',endTrigger:body,end:'bottom bottom',pin:sidebar,pinSpacing:false});}}document.addEventListener('click',function(e){var li=e.target.closest('li[data-anchor]');if(!li)return;var slug=li.getAttribute('data-anchor');var heading=document.querySelector('.anchor-title--'+CSS.escape(slug));if(!heading)return;e.preventDefault();var top=heading.getBoundingClientRect().top+window.pageYOffset-OFFSET;window.scrollTo({top:top,behavior:'smooth'});history.replaceState(null,'','#'+slug);},false);var headings=document.querySelectorAll('[class*=\"anchor-title--\"]');if(headings.length&&'IntersectionObserver'in window){var io=new IntersectionObserver(function(entries){entries.forEach(function(entry){if(!entry.isIntersecting)return;var cls=Array.from(entry.target.classList).find(function(c){return c.indexOf('anchor-title--')===0;});if(!cls)return;var slug=cls.replace('anchor-title--','');document.querySelectorAll('li[data-anchor]').forEach(function(li){li.classList.toggle('is-active',li.getAttribute('data-anchor')===slug);});});},{rootMargin:'-20% 0px -70% 0px',threshold:0});headings.forEach(function(h){io.observe(h);});}})();","isGSAPEnabled":true,":type":"snowflake-site/components/markup-editor"},"experiencefragment-footer":{"id":"experiencefragment-fecaf057b7","localizedFragmentVariationPath":"/content/experience-fragments/snowflake-site/language-masters/de/site/footer/master/jcr:content","configured":true,"xfModelPath":"/content/experience-fragments/snowflake-site/language-masters/de/site/footer/master.xfmodel.json?callerPage=/content/snowflake-site/global/de/artificial-intelligence/machine-learning/inference",":type":"snowflake-site/components/experiencefragment"},"experiencefragment":{"id":"experiencefragment-ec5dc5d0aa","localizedFragmentVariationPath":"/content/experience-fragments/snowflake-site/language-masters/de/site/footer-legal-disclaimers/master/jcr:content","configured":true,"xfModelPath":"/content/experience-fragments/snowflake-site/language-masters/de/site/footer-legal-disclaimers/master.xfmodel.json?callerPage=/content/snowflake-site/global/de/artificial-intelligence/machine-learning/inference",":type":"snowflake-site/components/experiencefragment"}},":itemsOrder":["experiencefragment-banner","experiencefragment-header","responsivegrid","modal_container","markup_editor_928258845","markup_editor_597730182","markup_editor","experiencefragment-footer","experiencefragment"],":type":"wcm/foundation/components/responsivegrid"}},":itemsOrder":["root"],":path":"/content/snowflake-site/global/de/artificial-intelligence/machine-learning/inference",":hierarchyType":"page","locale":"de"}
  