<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0" xmlns:itunes="http://www.itunes.com/dtds/podcast-1.0.dtd" xmlns:googleplay="http://www.google.com/schemas/play-podcasts/1.0"><channel><title><![CDATA[Datenhandwerk GmbH]]></title><description><![CDATA[Datenhandwerk – der Blog für KI und Daten im Mittelstand. Für Fachbereichsleiter und Geschäftsführer (DACH): Marktbeobachtungen und Praxisthemen, ohne Hype und ohne Beraterdeutsch.]]></description><link>https://sub.datenhandwerk.ai</link><image><url>https://substackcdn.com/image/fetch/$s_!QRQP!,w_256,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe4d207d1-8d28-4968-8ebf-1078a08fed32_400x400.png</url><title>Datenhandwerk GmbH</title><link>https://sub.datenhandwerk.ai</link></image><generator>Substack</generator><lastBuildDate>Mon, 28 Sep 2026 22:12:39 GMT</lastBuildDate><atom:link href="https://sub.datenhandwerk.ai/feed" rel="self" type="application/rss+xml"/><copyright><![CDATA[Datenhandwerk GmbH]]></copyright><language><![CDATA[de]]></language><webMaster><![CDATA[datenhandwerk@substack.com]]></webMaster><itunes:owner><itunes:email><![CDATA[datenhandwerk@substack.com]]></itunes:email><itunes:name><![CDATA[Datenhandwerk]]></itunes:name></itunes:owner><itunes:author><![CDATA[Datenhandwerk]]></itunes:author><googleplay:owner><![CDATA[datenhandwerk@substack.com]]></googleplay:owner><googleplay:email><![CDATA[datenhandwerk@substack.com]]></googleplay:email><googleplay:author><![CDATA[Datenhandwerk]]></googleplay:author><itunes:block><![CDATA[Yes]]></itunes:block><item><title><![CDATA[Erkenntnisse vom Cloud‑X‑Summit 2026]]></title><description><![CDATA[Souver&#228;nit&#228;t, Wissen & Daten, Handeln nicht hoffen]]></description><link>https://sub.datenhandwerk.ai/p/erkenntnisse-vom-cloudxsummit-2026</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/erkenntnisse-vom-cloudxsummit-2026</guid><dc:creator><![CDATA[Henning Kropp]]></dc:creator><pubDate>Wed, 23 Sep 2026 16:03:49 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!xPLX!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>W&#228;hrend wahrscheinlich in diesem Augenblick die Moderatorin Susanne Sch&#246;ne auf der B&#252;hne steht und das Wrap-up des Events moderiert, sitze ich in der S-Bahn auf dem Weg zum Frankfurter Hauptbahnhof und sinniere &#252;ber mein ganz eigenes R&#233;sum&#233; des Tages.</p><p>Zusammenfassend sind es wohl drei wesentliche Punkte, die ich pers&#246;nlich von der Veranstaltung mitgenommen habe und auf die ich hier n&#228;her eingehen m&#246;chte:</p><ol><li><p><strong>Souver&#228;nit&#228;t wird verstanden und gelebt</strong></p></li><li><p><strong>Wissen und Daten sind ein Standortvorteil</strong></p></li><li><p><strong>Selbstwirkung durch Handeln; nicht Hoffen</strong></p></li></ol><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!xPLX!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!xPLX!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png 424w, https://substackcdn.com/image/fetch/$s_!xPLX!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png 848w, https://substackcdn.com/image/fetch/$s_!xPLX!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png 1272w, https://substackcdn.com/image/fetch/$s_!xPLX!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!xPLX!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png" width="1456" height="819" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/e7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:819,&quot;width&quot;:1456,&quot;resizeWidth&quot;:null,&quot;bytes&quot;:16189147,&quot;alt&quot;:null,&quot;title&quot;:null,&quot;type&quot;:&quot;image/png&quot;,&quot;href&quot;:null,&quot;belowTheFold&quot;:false,&quot;topImage&quot;:true,&quot;internalRedirect&quot;:&quot;https://sub.datenhandwerk.ai/i/217087628?img=https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png&quot;,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="" srcset="https://substackcdn.com/image/fetch/$s_!xPLX!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png 424w, https://substackcdn.com/image/fetch/$s_!xPLX!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png 848w, https://substackcdn.com/image/fetch/$s_!xPLX!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png 1272w, https://substackcdn.com/image/fetch/$s_!xPLX!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe7affdba-b2d5-4b9d-b83a-b079438add91_4963x2792.png 1456w" sizes="100vw" fetchpriority="high"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a></figure></div><p>Im Vorfeld hatte ich keine Erwartungen an den Summit selbst, daher wollte ich mich nur inspirieren und ihn auf mich wirken lassen. Und so kann ich nat&#252;rlich auch nicht von entt&#228;uschten oder &#252;bertroffenen Erwartungen sprechen.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><p>Einzig hat mich im Vorfeld tats&#228;chlich interessiert, wie die Veranstaltung wohl bei vergleichbaren Events anderer Anbieter abschneiden w&#252;rde, denn andere Anbieter spielen hier meist in einer ganz eigenen Liga.</p><p>In dieser Hinsicht war ich sehr positiv &#252;berrascht &#252;ber die sehr gelungene Organisation samt Musikeinlagen, wie die des Polizeiorchesters Baden-W&#252;rttemberg, die der Veranstaltung einen ganz eigenen Stempel aufdr&#252;ckte bei gleichzeitiger Professionalit&#228;t des Events insgesamt.</p><p>Allerdings trugen die Musikeinlagen im Areal zusammen mit den sehr lauten Ansagen zu einer enormen Ger&#228;uschkulisse bei, was wohl neben dem &#228;u&#223;erst schlechten WLAN zu den wesentlichen Kritikpunkten z&#228;hlt, die ich habe. </p><p>Das WLAN war wirklich miserabel, sodass ich die Arbeit, die ich mitnehmen musste, &#252;ber meinen eigenen Hotspot erledigen musste. Vielleicht ging es auch nur mir so und sicherlich eine Kleinigkeit, aber f&#252;r eine Cloud-Company nat&#252;rlich auch etwas peinlich.</p><p>Damit aber letztlich zu den gro&#223;en Dingen, die besprochen wurden, und den tiefen Eindr&#252;cken, die diese auf mich gemacht haben. </p><p>Durchweg, ob bei der sehr inspirierenden Session mit <a href="https://www.epatientdave.com/">Dave deBronkart</a> &#252;ber Patientendaten und Nutzung von KI im Gesundheitswesen, der Paneldiskussion mit der Pr&#228;sidentin des BSI Claudia Plattner und dem Pr&#228;sidenten f&#252;r Technik &amp; Services der Polizei Baden-W&#252;rttemberg Thomas Berger oder der Session von Brainblock, f&#252;r mich haben sich drei wesentliche Themen wie ein roter Faden durch die vielen Diskussionen, Gespr&#228;che und Pr&#228;sentationen gezogen.</p><h2>1. Souver&#228;nit&#228;t wird verstanden</h2><p>Oft scheint Souver&#228;nit&#228;t wie ein bedeutungsloser Marketing- oder Kampfbegriff zu sein, weshalb ich mich auf dem Weg zum Gipfeltreffen selbst auch fragte, was Souver&#228;nit&#228;t bedeutet und ob es nur ein anderes Wort f&#252;r Protektionismus ist. </p><p>Souver&#228;nit&#228;t wurde dann nat&#252;rlich auch oft er&#246;rtert. Dies wahrscheinlich zum Leidwesen von Claudia Plattner, der Pr&#228;sidentin des BSI, die Souver&#228;nit&#228;t gerne verstanden und nicht mehr dar&#252;ber diskutieren m&#246;chte. </p><p>Durchweg zeichnet sich das Verst&#228;ndnis ab, dass Souver&#228;nit&#228;t eben nicht bedeutet, sich zu isolieren, und die Notwendigkeit, alles selbst zu bauen. Vielmehr bedeutet es, den Entscheidungs- und den Handlungsspielraum zu kontrollieren und selbstbestimmt wahrnehmen zu k&#246;nnen.</p><p>Beispielhaft daf&#252;r ist nat&#252;rlich auch der j&#252;ngste <a href="https://schwarz-digits.de/presse/archiv/2026/cohere-und-aleph-alpha-planen-zusammenschluss">Merger von Alpep Alphas und Cohere</a>, als Kooperation zwischen einem kanadischen und einem europ&#228;ischen Unternehmen. Auch die zahlreichen Partner wie Google, ServiceNow, Crowdstrike und viele mehr, die an dem Summit teilnahmen und Teil der Stackit-Cloud sind, sind ein Beleg f&#252;r diesen Ansatz.</p><p>Allerdings m&#252;sste man dann nat&#252;rlich auch etwas kritischer die Rolle von SAP hinterfragen, einem der gr&#246;&#223;ten Sponsoren des Events. Weil letztlich auch deren Lizenz- und Produktpolitik rund um S4HANA den Entscheidungsspielraum von Unternehmen eher dominierte. Nur weil SAP deutsch ist, ist es nicht unbedingt ein Garant f&#252;r Souver&#228;nit&#228;t nach dieser Definition. Umso mehr, da es erhebliche wirtschaftliche Interessen im Ausland hat.</p><blockquote><p><em>Sorry SAP, but somebody had to say it!</em></p></blockquote><p>Letztlich bewerte ich die j&#252;ngste Entwicklung bei SAP sehr positiv, wobei f&#252;r mich die Kooperation mit Databricks und der Kauf von Dremio positiv aufgefallen sind. H&#228;tte mir zwar DuckDB lieber gew&#252;nscht, aber hey&nbsp;&#8230; weiter so!</p><h2>2. Daten und Wissen als Standortvorteil</h2><p>Dass Daten wichtig sind f&#252;r den Erfolg von Unternehmen, um effizienter zu produzieren oder zu verkaufen, ist f&#252;r die meisten sicherlich nicht neu. Dieses aber eben als Standortvorteil zu verstehen und entsprechend zu handeln, eben schon.</p><p>Aus Unternehmen flie&#223;en zahlreiche Informationen ab, die die Innovationskraft von Anbietern und nicht der Unternehmen selbst st&#228;rken. Auch wenn dieser <a href="https://sub.datenhandwerk.ai/p/abseits-des-kitrubels-das-umgekehrte">Mechanismus des Informationsparadoxons</a> immer noch zu wenig verstanden wird, so war es bemerkenswert, wie sich durchweg durch alle Sessions die Erkenntnis herauskristallisiert hat, dass Daten und daraus gewonnene Informationen einen entscheidenden Hebel bei der Wettbewerbsf&#228;higkeit spielen. Diese d&#252;rfen nicht verloren gehen und m&#252;ssen entsprechend gewonnen werden. Dabei spielt nat&#252;rlich auch der Einsatz von KI eine Rolle und hier eben auch der gesicherte Einsatz.</p><h2>3.&nbsp;Handeln (es sind die Menschen)</h2><p>Als letzte Beobachtung bei den von mir besuchten Sessions kristallisierte sich die f&#252;r mich besonders hervorzuhebende Festsetzung heraus, sich auf die Selbstwirkung und das Handeln zu verlagern. Meckern und die Schuld bei Politik oder anderen Umst&#228;nden zu suchen, machen viel zu viele und nebenbei geh&#246;rt es auch nicht zu den Tugenden unserer Gesellschaft.</p><p>In vielen Gespr&#228;chen und Pr&#228;sentationen hallte der Appell mit, zu handeln und die Umst&#228;nde selbst zu gestalten, anstatt sich darauf zu verlassen, dass andere diese f&#252;r einen &#228;ndern. Stackit und Schwarz Digit stehen hier beispielhaft f&#252;r diese Einstellung. So wei&#223; ich genau, dass sie z. B. von meinen ehemaligen Kollegen bei Databricks und auch anderen bel&#228;chelt werden und man glaubt, dass sie es nicht schaffen werden. Doch nur wer handelt, kann etwas bewirken. So einfach ist das.</p><p>Insgesamt war es ein sehr inspirierendes und gelungenes Event und wir freuen uns schon sehr auf viele weitere solcher Events. Auch sind wir sehr aufgeregt &#252;ber die gemeinsame zuk&#252;nftige Entwicklung und den Beitrag, den wir hier von Datenhandwerk dabei leisten k&#246;nnen.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><p></p>]]></content:encoded></item><item><title><![CDATA[Abseits des KI‑Trubels: das umgekehrte Informationsparadoxon]]></title><description><![CDATA[Eine Einordnung des KI-Hypes f&#252;r Entscheider]]></description><link>https://sub.datenhandwerk.ai/p/abseits-des-kitrubels-das-umgekehrte</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/abseits-des-kitrubels-das-umgekehrte</guid><dc:creator><![CDATA[Henning Kropp]]></dc:creator><pubDate>Thu, 10 Sep 2026 07:43:20 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!QRQP!,w_256,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe4d207d1-8d28-4968-8ebf-1078a08fed32_400x400.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>Im Nachhinein ist es leicht zu erkennen, warum Unternehmen wie Google und Amazon ihre beherrschende Stellung am Markt erreicht haben, aber zu der Zeit, als die Weichen daf&#252;r gestellt wurden, war das alles andere als klar.</p><p>Nachdem Serge Brin und Larry Page ihre Suchmaschine gestartet hatten, wollten sie das <a href="https://techcrunch.com/2010/09/29/google-excite/">Unternehmen eigentlich an Excite f&#252;r 1 Million Dollar</a> verkaufen, die allerdings dankend ablehnten. W&#228;hrend Jeff Bezos einen dominierenden Einzelh&#228;ndler aufbaute und gleichzeitig begann, Cloud Computing &#252;ber Jahre zu dominieren, waren sich <a href="https://ritholtz.com/2019/06/amazon-bomb-may-31-1999/#:~:text=An%20especially%20vivid%20illustration%20of%20this%20is,is%20impossible%20to%20see%20into%20the%20future.">zahlreiche Analysten sicher, dass Amazon niemals profitabel sein k&#246;nnte</a>, selbst wenn sie alle B&#252;cher der Welt verkaufen w&#252;rden.</p><p>Niemand ist besonders gut darin, die Zukunft vorherzusagen oder eine Entwicklung samt ihrer Auswirkungen vollumf&#228;nglich zu begreifen. Das liegt vorwiegend daran, dass wir dazu neigen, zuk&#252;nftige Ereignisse anhand des Verlaufs von vergangenen Ereignissen zu messen. Hierzulande &#252;berwiegt deshalb auch vor allem scheinbar die gro&#223;e Skepsis und das Narrative der KI&#8209;Blase. Das h&#228;ngt im Wesentlichen auch mit der schlechten Erfahrung der Dotcom-Blase und insbesondere der traumatischen Erfahrung der &#8220;Volksaktie&#8221; Telekom zusammen.</p><p>Verdr&#228;ngt wird dabei, dass es eben auch diese Zeit war, in der Unternehmen wie Google und Amazon entstanden sind. </p><p>Wie l&#228;sst sich das aber nun in der aktuellen Entwicklung einordnen und welche grundlegenden Prinzipien helfen dabei? </p><p>Dies ist ein Versuch, genau diese Prinzipien zu identifizieren und auszuarbeiten. Eines dieser Prinzipien basiert auf der Arbeit des Nobelpreistr&#228;gers <a href="https://en.wikipedia.org/wiki/Kenneth_Arrow">Kenneth J. Arrow</a> und seinem Prinzip des <a href="https://snscratchpad.com/posts/reverse-information-paradox/">Informationsparadox bzw. seiner Umkehrung, wie es der CEO von Microsoft, Satya Nadella, so treffend formuliert hat.</a></p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><p>F&#252;r Wirtschaftspr&#252;fer, Rechtsanw&#228;lte, Software-Entwickler und viele andere geht es darum, wie Unternehmen im Zeitalter der k&#252;nstlichen Intelligenz ihre Kern-IP sch&#252;tzen k&#246;nnen. </p><p>Hierbei beschreibt der Nobelpreistr&#228;ger und Wirtschaftswissenschaftler Kenneth Arrow ein bekanntes Paradoxon auf dem Informationsmarkt:</p><blockquote><p>Der Wert f&#252;r den K&#228;ufer ist erst erkennbar, wenn er die Information besitzt. Doch dann hat er sie faktisch kostenlos erworben. </p></blockquote><p>Wenn man es sich genau &#252;berlegt, ist es eben genau dieses Paradox, das auch hinter dem Erfolg eben vieler Informationstechnologiekonzerne wie Google steckt. </p><p>Sergey und Larry hatten wahrscheinlich &#252;berhaupt keine Idee von dem Potenzial der Informationen, die sie mit ihrer Suchmaschine einbringen w&#252;rde. Doch, als sie diese Informationen hatten, konnten sie damit ein Unternehmen erschaffen, das ebenso wertvoll wurde wie Microsoft selbst.</p><p>Google ist die beste Suchmaschine weltweit, weil die meisten Menschen Google nutzen. Und die meisten Menschen nutzen Google, weil es die beste Suchmaschine ist.</p><p>Die Informationen, die wir als Nutzer der Suchmaschine zur Verf&#252;gung stellen, eben noch mehr, wenn wir Android oder Chrome nutzen, sind so wertvoll, um ein beherrschendes Unternehmen zu erm&#246;glichen. Dabei sind es vor allem die Nutzerinformationen, die diese Stellung erm&#246;glichen. Und auch hier bietet Arrow eine entscheidende Erkl&#228;rung, indem er klarstellt, dass diejenigen, die die Informationen generieren, solange eine Monopolstellung inne haben, solange diese nicht geteilt werden.</p><p>KI heutzutage schafft das genau umgekehrte Problem. </p><p>Im KI-Zeitalter riskiert der K&#228;ufer, Wissen preiszugeben, nur um das Gekaufte nutzen zu k&#246;nnen. Man bezahlt im Grunde doppelt f&#252;r Intelligenz: einmal mit Geld und ein zweites Mal mit etwas noch Wertvollerem: dem firmeneigenen Wissen, das man offenlegen muss, um diese Intelligenz nutzbar zu machen. Je besser das Modell funktionieren soll, desto mehr von diesem Wissen muss man ihm zur Verf&#252;gung stellen! Mit der Zeit verschlimmert sich die Informationsasymmetrie immer weiter. Der Verk&#228;ufer erf&#228;hrt immer mehr &#252;ber das Unternehmen oder den Nutzer, w&#228;hrend die Nutzer das gekaufte Produkt nutzen, w&#228;hrend sie selbst kaum etwas dar&#252;ber erfahren, was der Verk&#228;ufer im Gegenzug lernt.</p><p>Das bezeichnet Satya Nadella als das umgekehrte Informationsparadoxon.</p><p>Durch den Einsatz von Foundational Modellen wie Anthropic oder ChatGPT zahlen Unternehmen im Wesentlichen daf&#252;r, sich ihrer eigenen Monopolstellung bei ihrer Informationsgewinnung berauben zu lassen. Das mag dann auch die f&#252;r viele &#252;berzogenen Bewertungen dieser KI&#8209;Firmen erkl&#228;ren.</p><p>Nutzer werden an dieser Stelle gerne anf&#252;hren, dass sie &#8220;private&#8221; Angebote nutzen, die Vereinbarungen getroffen haben, dass ihre Daten nicht f&#252;r Trainingszwecke genutzt werden k&#246;nnen, wobei sie eben nicht verstehen, dass Modelle eben auch aus &#8222;Ersch&#246;pfung&#8220; &#8211; den Eingabeaufforderungen, die Nutzer verfassen, den von Agenten verwendeten Tools und insbesondere den Korrekturen, die Nutzer vornehmen, wenn das Modell fehlerhaft ist, &#8211; lernen. </p><p>Jede Korrektur wird zu institutionellem Know-how destilliert. Es ist die Art von Wissen, die ein Konkurrent niemals kaufen k&#246;nnte und die fast unmerklich durchsickert: Spur f&#252;r Spur, Korrektur f&#252;r Korrektur, Bewertung f&#252;r Bewertung.</p><p>Wieder auf Google bezogen wurde die Suchmaschine besser dadurch, welche Ergebnisse zu welchen Suchanfragen angeklickt wurden. Allein zu wissen, wonach gesucht wird, war ein schier unermesslicher Schatz. All diese Informationen der &#8220;Ersch&#246;pfung&#8221; flie&#223;en unweigerlich in die Verbesserung von Modellen. Dies erfordert mehr als Datenschutz.</p><p>Patente l&#246;sen eben nur einen Aspekt von Arrows Paradoxon. Sie erm&#246;glichen es einem Erfinder, eine Idee offenzulegen, ohne sie einfach preiszugeben. Das umgekehrte Informationsparadoxon ben&#246;tigt ein &#196;quivalent. </p><p>Indem Nutzer Informationen konsumieren, schaffen Sie selbst Informationen. Und was sie schaffen, sollte Ihnen geh&#246;ren. Dies ist ihre besondere Intelligenz im Sinne Hayeks: das Wissen &#252;ber Zeit, Ort und Umst&#228;nde, das niemand sonst besitzen kann.</p><p> Es wei&#223;, was du denkst, was dir wichtig ist und wie du Erfolg misst. Die gro&#223;artige Innovation, die sich aus dem Recht der Modellanbieter auf faire Nutzung &#246;ffentlicher Daten f&#252;r das Training von Modellen ergibt, ist zwar notwendig, doch h&#228;lt es Satya f&#252;r ironisch, dass der Status quo darin besteht, die Datenextraktion einzuschr&#228;nken und sich das Recht vorzubehalten, aus Kundennutzungs- und Interaktionsdaten zu lernen. </p><p>Wenn Lernen nur in eine Richtung flie&#223;t, konzentriert sich der wirtschaftliche Wert eher bei den Besitzern der Lerninfrastruktur als bei den Sch&#246;pfern des Wissens selbst. Daher h&#228;lt er es f&#252;r unerl&#228;sslich, dass wir die Lerninfrastruktur jedem Unternehmen zug&#228;nglich machen, damit es seinen eigenen Lernprozess steuern kann. </p><p>Wie Alex Karp es ausdr&#252;ckte: &#8222;Technische Kunden wollen die Kontrolle &#252;ber ihre Rechenleistung, ihre Modelle, ihren Daten-Stack und ihr Alpha. Sie wollen wissen, dass sie die Produktionsmittel besitzen und diese nicht an jemand anderen &#252;bertragen werden.&#8220; </p><p>Das aktuelle System bewirkt genau die &#220;bertragung, die Karp und Unternehmen bef&#252;rchten. Deshalb ben&#246;tigen Unternehmen eine echte Vertrauensbasis, damit sich ihr Humankapital und ihr Token-Kapital vermehren k&#246;nnen. Hier sammeln und verbessern sich die Daten, Protokolle, Auswertungen, angepassten Gewichtungen und das Wissen einer Organisation. </p><p>Es handelt sich um eine strikte Grenze, die ohne Zustimmung nicht &#252;berschritten werden darf &#8211; nicht einmal die gesammelten Informationen. Unternehmen werden das Recht einfordern, Modellausgaben zur Feinabstimmung und/oder zum Training ihrer eigenen Modelle zu nutzen. Satya sieht darin das Recht jedes Unternehmens, seine Modelle an seinen Rechenschaftspflichten auszurichten. </p><p>Im Cloud-Zeitalter sammelten Unternehmen Daten. </p><p>Im KI-Zeitalter sammeln sie Lernerfahrungen. Die Vertrauensgrenze muss sich entsprechend weiterentwickeln: vom Schutz von Informationen hin zum Schutz der Mechanismen, durch die Organisationen lernen, sich anpassen und Wissen aufbauen.</p><p>Jedes Unternehmen muss nach Satya einige Ma&#223;nahmen ergreifen, um dies zu gew&#228;hrleisten:</p><ul><li><p><strong>Kontrolle</strong><br>Erstellen Sie Ihre eigenen Auswertungen, denn diese definieren, was innerhalb der Organisation als &#8222;gut&#8220; gilt. Behalten Sie au&#223;erdem die Kontrolle &#252;ber das Wissen, die Protokolle, das Feedback, die Entscheidungen und den institutionellen Kontext Ihrer Organisation sowie die M&#246;glichkeit, Modellausgaben f&#252;r Ihre eigenen Aufgaben und Abfragen zu nutzen. </p></li><li><p><strong>F&#228;higkeit</strong><br>Erstellen Sie innerhalb der Mandantengrenzen Ihre eigenen, propriet&#228;ren Lernumgebungen, um Modelle zu trainieren oder zu optimieren. Die Modelle lernen dabei anhand realer Arbeitsabl&#228;ufe, ohne das Unternehmenswissen preiszugeben. </p></li><li><p><strong>Wahlfreiheit</strong><br>Stellen Sie sicher, dass die Orchestrierungsschicht von jedem einzelnen Modell entkoppelt ist. Fragen Sie sich: K&#246;nnen Sie Ihre Evaluierungen weiterhin mit anderen Modellen durchf&#252;hren und optimieren, wenn eines Ihrer Modelle wegf&#228;llt? Bleibt Ihre Unternehmenskompetenz erhalten, selbst wenn ein bestimmtes Standardmodell wegf&#228;llt? </p></li><li><p><strong>Kosten</strong><br>Durch die Entkopplung der Orchestrierungsschicht k&#246;nnen Sie Kontext, Modelle und Aufgaben auf effizienteste und kosteng&#252;nstigste Weise zusammenf&#252;hren, ohne Kompromisse bei der Qualit&#228;t einzugehen. </p></li></ul><p>Kombiniert man diese vier Aspekte, entsteht ein kontinuierlicher Lernkreislauf (quasi eine Art Bergsteigermaschine), der es erm&#246;glicht, dass deine KI-Investitionen den Wert Ihres Unternehmens exponentiell steigern. </p><p>Anders ausgedr&#252;ckt: Ein Unternehmen sollte ein Modell nutzen k&#246;nnen, ohne dabei das Wissen aufzugeben, das es einzigartig macht. Dies ist das umgekehrte Informationsparadoxon, dem wir uns stellen m&#252;ssen.</p><p>Kombinieren Sie diese vier Aspekte, und Sie schaffen einen kontinuierlichen Lernkreislauf (eine Art &#8222;Hill Climbing Machine&#8220;), der den Wert Ihrer KI-Investitionen exponentiell steigert.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p>]]></content:encoded></item><item><title><![CDATA[DuckDB unter der Haube]]></title><description><![CDATA[Wie eine In-Process-Datenbank bei uns zahlreiche Datenprodukte betreibt]]></description><link>https://sub.datenhandwerk.ai/p/duckdb-unter-der-haube</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/duckdb-unter-der-haube</guid><dc:creator><![CDATA[Henning Kropp]]></dc:creator><pubDate>Mon, 31 Aug 2026 06:08:30 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!n-WJ!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>Wir verwenden DuckDB f&#252;r zahlreiche der Datenprodukte, die wir f&#252;r unsere Kunden entwickeln und verwalten. Als <em>&#8222;Datenbank im Prozess&#8220;</em> h&#228;lt sie unsere Systemlandschaft schlank, was es uns erm&#246;glicht, Kundenanforderungen ohne gro&#223;en Aufwand zu entwickeln. </p><p>Der eigentlich interessante Teil ist das, was DuckDB technisch anders macht als klassische Warehouses und verteilte Engines. Ebendarum bietet der Rest dieses Artikels einen technischen Einblick in die Struktur eines der derzeit wohl popul&#228;rsten Datentools.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!n-WJ!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!n-WJ!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png 424w, https://substackcdn.com/image/fetch/$s_!n-WJ!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png 848w, https://substackcdn.com/image/fetch/$s_!n-WJ!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png 1272w, https://substackcdn.com/image/fetch/$s_!n-WJ!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!n-WJ!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png" width="1418" height="1054" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/d92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:1054,&quot;width&quot;:1418,&quot;resizeWidth&quot;:null,&quot;bytes&quot;:286592,&quot;alt&quot;:null,&quot;title&quot;:null,&quot;type&quot;:&quot;image/png&quot;,&quot;href&quot;:null,&quot;belowTheFold&quot;:false,&quot;topImage&quot;:true,&quot;internalRedirect&quot;:&quot;https://sub.datenhandwerk.ai/i/206822913?img=https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png&quot;,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="" srcset="https://substackcdn.com/image/fetch/$s_!n-WJ!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png 424w, https://substackcdn.com/image/fetch/$s_!n-WJ!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png 848w, https://substackcdn.com/image/fetch/$s_!n-WJ!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png 1272w, https://substackcdn.com/image/fetch/$s_!n-WJ!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fd92fb1ef-3f65-4096-bf8d-1c03f0d51e8e_1418x1054.png 1456w" sizes="100vw" fetchpriority="high"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a></figure></div><p>DuckDB erm&#246;glicht schnelle und &#8220;<em>spa&#223;ige&#8221;</em> Datenanalyse, ohne dass man gro&#223;e Apache-Spark-Cluster einrichten oder ein Cloud-Data-Warehouse betreiben muss, wenn man nur ein paar hundert Gigabyte Daten verarbeitet. Aber auch f&#252;r gr&#246;&#223;ere Datenmengen eignet es sich ebenso gut.</p><p>Das <a href="https://www.aboutamazon.com/news/company-news/aws-ducklabs">schrieb AWS j&#252;ngst zur &#220;bernahme von DuckLabs</a>:</p><blockquote><p>"For almost a decade, the DuckDB team has worked with the idea of building a tool that lets people work with data, with confidence. I find that sentiment&#8212;not just <strong>making data easy to work with, but actively empowering people to ask questions</strong>, build, and really innovate with data&#8212;is exactly in line with how AWS and our customers think about data," said Andy Warfield, Amazon vice president and distinguished engineer. "We&#8217;ve been working closely with the DuckLabs team for the past two years, and I am so excited at the opportunity to work with them even more closely."</p></blockquote><div><hr></div><div class="subscription-widget-wrap-editor" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Abonnieren&quot;,&quot;language&quot;:&quot;de&quot;}" data-component-name="SubscribeWidgetToDOM"><div class="subscription-widget show-subscribe"><div class="preamble"><p class="cta-caption">Datenhandwerk GmbH is a reader-supported publication. To receive new posts and support my work, consider becoming a free or paid subscriber.</p></div><form class="subscription-widget-subscribe"><input type="email" class="email-input" name="email" placeholder="E-Mail-Adresse eingeben &#8230;" tabindex="-1"><input type="submit" class="button primary" value="Abonnieren"><div class="fake-input-wrapper"><div class="fake-input"></div><div class="fake-button"></div></div></form></div></div><div><hr></div><h2>Was <em>&#8222;Datenbank im Prozess&#8220;</em> konkret bedeutet</h2><p>Die &#252;berwiegende Mehrheit der Datenbanken, darunter Postgres, MySQL, Snowflake und Spark, teilt Anwendung und Datenbank in zwei verschiedene Prozesse. Der Client einer Anwendung stellt eine Verbindung &#252;ber einen Socket her, sendet eine Anfrage und wartet auf die Antwort. </p><p>Bei DuckDB verh&#228;lt sich das anders.</p><p>Es wird als Bibliothek in den Prozess der Anwendung selbst eingebunden, wobei es egal ist, ob die Anwendung Python, C++, Node.js, R oder direkt als CLI&nbsp;l&#228;uft. Es existiert kein Port, kein Verbindungspool, kein Auth-Handshake und kein Server, mit dem man sich verbinden m&#252;sste.</p><p>Zugegebenerma&#223;en ist das schon recht gew&#246;hnungsbed&#252;rftig und seltsam, wenn man es jahrelang anders gewohnt war.</p><p>Ein Beispiel f&#252;r eine Ausf&#252;hrung einer Datenbank in Python:</p><div class="highlighted_code_block" data-attrs="{&quot;language&quot;:&quot;python&quot;,&quot;nodeId&quot;:&quot;b7f4f488-9a6f-4151-a650-be37b74a77c1&quot;}" data-component-name="HighlightedCodeBlockToDOM"><pre class="shiki"><code class="language-python">import duckdb

r1 = duckdb.sql("SELECT 42 AS i")
duckdb.sql("SELECT i * 2 AS k FROM r1").show()</code></pre></div><p>Dies f&#252;hrt die Abfrage unter Verwendung einer In-Memory-Datenbank aus, die global innerhalb des Python-Moduls gespeichert ist. Das Ergebnis der Abfrage wird als <em>&#8222;Relation&#8220;</em> zur&#252;ckgegeben. Eine Relation ist eine symbolische Darstellung der Abfrage. Die Abfrage wird erst dann ausgef&#252;hrt, wenn das Ergebnis abgerufen oder dessen Ausgabe auf dem Bildschirm angefordert wird (<em>lazy execution</em>).</p><p>DuckDB basiert in etwa auf dem gleichen Grundgedanken wie SQLite, was sich als Tool f&#252;r ein flexibles OLTP (Online Transaction Processing) bei Entwicklern gro&#223;er Beliebtheit erfreut. Nur ist DuckDB f&#252;r einen anderen Workload gedacht: SQLite ist auf schnelle, punktuelle Transaktionen optimiert (OLTP), DuckDB auf gro&#223;e analytische Scans&nbsp;&#8211;&nbsp;OLAP (Online Analytical Processing). </p><p>Beide teilen sich das Deployment-Modell&nbsp;&#8211; eine einzelne Datei, kein Serverbetrieb&nbsp;&#8211;, aber ihre internen Speicher- und Ausf&#252;hrungsmodelle sind komplett unterschiedlich gebaut.</p><h2>Daten lesen und schreiben: SQL &#252;ber Systemgrenzen hinweg</h2><p>Daten k&#246;nnen in unterschiedlichen Formaten persistiert oder gelesen werden. W&#228;hrend bei anderen Datenbanksystemen die Speicherung der Daten eng mit der Ausf&#252;hrungsengine verkn&#252;pft ist, nutzt hier DuckDB das Prinzip der Trennung von Datenformat und Engine, wie wir es zum Beispiel auch bei Spark und anderen Cloud Warehouses finden.</p><p>Native werden zahlreiche Datenformate unterst&#252;tzt:</p><div class="highlighted_code_block" data-attrs="{&quot;language&quot;:&quot;python&quot;,&quot;nodeId&quot;:&quot;9fa7e2e5-849a-462d-ae19-6dc9d55b87d1&quot;}" data-component-name="HighlightedCodeBlockToDOM"><pre class="shiki"><code class="language-python">import duckdb

duckdb.read_csv("example.csv")                # read a CSV file into a Relation
duckdb.read_parquet("example.parquet")        # read a Parquet file into a Relation
duckdb.read_json("example.json")              # read a JSON file into a Relation

duckdb.sql("SELECT * FROM 'example.csv'")     # directly query a CSV file
duckdb.sql("SELECT * FROM 'example.parquet'") # directly query a Parquet file
duckdb.sql("SELECT * FROM 'example.json'")    # directly query a JSON file</code></pre></div><p>Eine der Eigenschaften von DuckDB ist die F&#228;higkeit, per Extension direkt gegen fremde Datenquellen zu scannen, ohne die Daten vorher zu materialisieren. D.h., dass hier die Optimierungen bei der Anfrage, wie&nbsp;z.&nbsp;B. die Daten entsprechend zu filtern (Predicate Pushdown), direkt &#252;bernommen werden. </p><p>&#220;ber <code>postgres_scan</code> etwa l&#228;sst sich eine produktive Postgres-Tabelle mit einer lokalen CSV-Datei joinen, in einer einzigen Abfrage:</p><div class="highlighted_code_block" data-attrs="{&quot;language&quot;:&quot;sql&quot;,&quot;nodeId&quot;:&quot;c310d81b-3207-4094-9aa4-c4c1ac5781e2&quot;}" data-component-name="HighlightedCodeBlockToDOM"><pre class="shiki"><code class="language-sql">SELECT u.id, u.email, s.zielwert
FROM postgres_scan('host=localhost dbname=prod', 'public', 'users') u
JOIN read_csv_auto('stakeholder_daten.csv') s ON u.id = s.user_id;</code></pre></div><p>Das funktioniert nicht nur mit Postgres, sondern &#252;ber weitere Extensions auch mit MySQL, SQLite, entfernten Parquet- und JSON-Dateien auf S3, sowie &#252;ber Iceberg- und Delta-Lake-Extensions direkt gegen Lakehouse-Tabellen:</p><div class="highlighted_code_block" data-attrs="{&quot;language&quot;:&quot;sql&quot;,&quot;nodeId&quot;:&quot;af0dfe39-6114-477e-a043-dac60b525922&quot;}" data-component-name="HighlightedCodeBlockToDOM"><pre class="shiki"><code class="language-sql">SELECT count(*), min(signup_date)
FROM read_parquet('s3://bucket/rohdaten/*.parquet')
WHERE jahr = 2024;</code></pre></div><p>Dabei werden Filter- Predicate-Pushdowns auch auf die entfernte Quelle angewendet, sodass nicht unbedingt alle Spalten und Zeilen &#252;ber das Netz gezogen werden m&#252;ssen, um sie dann lokal zu filtern.</p><p>DuckDB verf&#252;gt &#252;ber <a href="https://duckdb.org/docs/current/core_extensions/overview">zahlreiche Erweiterungen</a>, unter anderem auch Excel:</p><div class="highlighted_code_block" data-attrs="{&quot;language&quot;:&quot;python&quot;,&quot;nodeId&quot;:&quot;9c1f1de4-d363-46f8-81bd-51ad309408ad&quot;}" data-component-name="HighlightedCodeBlockToDOM"><pre class="shiki"><code class="language-python">import duckdb

duckdb.sql("INSTALL excel;")
duckdb.sql("LOAD excel;")

duckdb.sql("""
  SELECT
    date_part('year', strptime(time, '%Y-%m-%d %H:%M:%S')) as year,
    CAST(temp AS DOUBLE) as temp,
    CAST(coco AS INTEGER) as coco
  FROM read_xlsx('2026-07-20_meteostat_export.xlsx', all_varchar=True, header=True);
""")</code></pre></div><h2>Spaltenorientierte Speicherung und Row Groups</h2><p>Daten werden in DuckDB, so wie eigentlich auch in jeder anderen <em>&#8222;Analytical Processing Engine&#8220;,</em> spaltenweise, nicht zeilenweise, verarbeitet. </p><p>Der Unterschied ist bei analytischen Queries entscheidend. Wenn du zum Beispiel</p><div class="highlighted_code_block" data-attrs="{&quot;language&quot;:&quot;sql&quot;,&quot;nodeId&quot;:&quot;383176c3-ec5c-46d1-bca1-11980c1779c3&quot;}" data-component-name="HighlightedCodeBlockToDOM"><pre class="shiki"><code class="language-sql">SELECT avg(betrag) FROM rechnungen WHERE jahr = 2025</code></pre></div><p>ausf&#252;hrst, muss die Engine nur die Spalten <code>betrag</code> und <code>jahr</code> lesen und nicht jede einzelne Zeile mit s&#228;mtlichen anderen Feldern, die f&#252;r diese Query irrelevant sind. Bei einer zeilenorientierten Datenbank w&#252;rden dagegen zwangsl&#228;ufig alle Spalten mitgelesen werden.</p><p>Intern organisiert DuckDB die Daten in sogenannten Row Groups von jeweils rund 120.000 Zeilen. Jede Row Group tr&#228;gt Metadaten (Min/Max-Werte pro Spalte, Null-Counts), die der Optimizer nutzt, um ganze Bl&#246;cke zu &#252;berspringen, wenn sie f&#252;r eine Query offensichtlich irrelevant sind&nbsp;&#8211; sogenanntes Zone Mapping bzw. Predicate Pushdown. Bei einer Filterbedingung wie <code>WHERE jahr = 2025</code> muss die Engine dadurch oft nur einen Bruchteil der physisch gespeicherten Daten &#252;berhaupt anfassen.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!KtYn!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!KtYn!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png 424w, https://substackcdn.com/image/fetch/$s_!KtYn!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png 848w, https://substackcdn.com/image/fetch/$s_!KtYn!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png 1272w, https://substackcdn.com/image/fetch/$s_!KtYn!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!KtYn!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png" width="604" height="299.510989010989" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:722,&quot;width&quot;:1456,&quot;resizeWidth&quot;:604,&quot;bytes&quot;:null,&quot;alt&quot;:&quot;Sorting on Insert for Fast Selective Queries - DuckDB&quot;,&quot;title&quot;:null,&quot;type&quot;:null,&quot;href&quot;:null,&quot;belowTheFold&quot;:true,&quot;topImage&quot;:false,&quot;internalRedirect&quot;:null,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="Sorting on Insert for Fast Selective Queries - DuckDB" title="Sorting on Insert for Fast Selective Queries - DuckDB" srcset="https://substackcdn.com/image/fetch/$s_!KtYn!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png 424w, https://substackcdn.com/image/fetch/$s_!KtYn!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png 848w, https://substackcdn.com/image/fetch/$s_!KtYn!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png 1272w, https://substackcdn.com/image/fetch/$s_!KtYn!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F72337be4-59de-4db2-a270-9c23779d8843_3730x1850.png 1456w" sizes="100vw" loading="lazy"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a></figure></div><p>Das l&#228;sst sich in etwa mit der Partitionierung bei <a href="https://parquet.apache.org/">Parquet</a> vergleichen, wo eine Gruppeneinteilung von Parquet-Files typischerweise in Ordnern und <em>&#8222;Row Groups&#8220; </em>in den Files stattfindet.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!3ThT!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!3ThT!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png 424w, https://substackcdn.com/image/fetch/$s_!3ThT!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png 848w, https://substackcdn.com/image/fetch/$s_!3ThT!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png 1272w, https://substackcdn.com/image/fetch/$s_!3ThT!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!3ThT!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png" width="434" height="425.78685258964146" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:985,&quot;width&quot;:1004,&quot;resizeWidth&quot;:434,&quot;bytes&quot;:null,&quot;alt&quot;:&quot;Embedding User-Defined Indexes in Apache Parquet Files - Apache ...&quot;,&quot;title&quot;:null,&quot;type&quot;:null,&quot;href&quot;:null,&quot;belowTheFold&quot;:true,&quot;topImage&quot;:false,&quot;internalRedirect&quot;:null,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="Embedding User-Defined Indexes in Apache Parquet Files - Apache ..." title="Embedding User-Defined Indexes in Apache Parquet Files - Apache ..." srcset="https://substackcdn.com/image/fetch/$s_!3ThT!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png 424w, https://substackcdn.com/image/fetch/$s_!3ThT!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png 848w, https://substackcdn.com/image/fetch/$s_!3ThT!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png 1272w, https://substackcdn.com/image/fetch/$s_!3ThT!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F4932bb59-224c-4d1a-bcb1-80e77981b14b_1004x985.png 1456w" sizes="100vw" loading="lazy"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a></figure></div><h3>DuckDB &amp; Parquet</h3><p>Der Parquet-Reader von DuckDB kommt ohne externe Abh&#228;ngigkeiten aus und kann SQL-Abfragen direkt auf Parquet-Dateien ausf&#252;hren &#8211; ganz ohne vorherigen Import- oder Analyseschritt. Dank des spaltenorientierten Formats von Parquet geschieht dies zudem z&#252;gig.</p><p>DuckDB liest Parquet-Dateien im Streaming-Verfahren ein; dadurch lassen sich auch Abfragen auf gro&#223;en Dateien durchf&#252;hren, die nicht vollst&#228;ndig in den Arbeitsspeicher passen.</p><p>Spalten und Zeilen, welche f&#252;r eine bestimmte Abfrage ben&#246;tigt werden, werden automatisch erkannt. Dies erm&#246;glicht die Analyse weitaus gr&#246;&#223;erer und komplexerer Parquet-Dateien, ohne dass manuelle Optimierungen oder zus&#228;tzliche Hardware- erforderlich sind.</p><p>Ein weiterer Vorteil: DuckDB erledigt all dies mittels Parallelverarbeitung und kann dank Glob-Syntax mehrere Parquet-Dateien gleichzeitig verarbeiten:</p><div class="highlighted_code_block" data-attrs="{&quot;language&quot;:&quot;python&quot;,&quot;nodeId&quot;:&quot;b68759e8-cbbf-433d-a5b1-e78fbe7622ed&quot;}" data-component-name="HighlightedCodeBlockToDOM"><pre class="shiki"><code class="language-python">con.execute("""
   SELECT *
   FROM 'taxi/*.parquet'
   LIMIT 5""").df()</code></pre></div><h2>Vektorisierte Ausf&#252;hrung statt Zeile-f&#252;r-Zeile</h2><p>Klassische Datenbank-Engines arbeiten h&#228;ufig nach dem sogenannten Volcano-Modell: Jeder Operator im Ausf&#252;hrungsplan verarbeitet eine Zeile, reicht sie an den n&#228;chsten Operator weiter, dann die n&#228;chste Zeile. Das erzeugt massiven Function-Call-Overhead, wenn Millionen Zeilen durch einen mehrstufigen Plan laufen.</p><p>DuckDB verarbeitet stattdessen Vektoren - Batches von typischerweise rund 2.048 Werten gleichzeitig. Ein Operator bekommt nicht eine Zeile, sondern einen ganzen Vektor, verarbeitet ihn mit SIMD-freundlichem Code und reicht den Vektor als Batch weiter. Das reduziert nicht nur den Overhead pro Zeile drastisch, es erlaubt der CPU auch, moderne Vektor-Instruktionen tats&#228;chlich auszunutzen, statt st&#228;ndig zwischen Interpreter-Schritten zu pendeln. Dieses Ausf&#252;hrungsmodell&nbsp;&#8211; kombiniert mit einem parallelisierbaren, morsel-artigen Scheduling &#252;ber mehrere CPU&#8209;Kerne&nbsp;&#8211; ist der Hauptgrund, warum DuckDB auf Single-Node-Hardware so nah an die Performance verteilter Systeme herankommt, ohne deren Koordinations-Overhead zu haben.</p><h2>Out-of-Core-Verarbeitung: gr&#246;&#223;er als der RAM</h2><p>Der Punkt, an dem viele In-Memory-Tools kapitulieren, ist ein Datensatz, der gr&#246;&#223;er ist als der verf&#252;gbare Arbeitsspeicher. DuckDB l&#246;st das &#252;ber Streaming- und Spill-to-Disk-Mechanismen: Aggregationen, Joins und Sortierungen, die den RAM sprengen w&#252;rden, werden in Teilen verarbeitet und Zwischenergebnisse bei Bedarf tempor&#228;r auf die Festplatte ausgelagert, statt mit &#8220;Out of Memory&#8221; abzubrechen.</p><p>Ein <a href="https://dataengineeringcentral.substack.com/p/650gb-of-data-delta-lake-on-s3-polars">Vergleichstest von Daniel Beach</a> illustriert, wie belastbar das in der Praxis ist: 650 GB Rohdaten aus einer Delta-Lake-Tabelle auf S3, verarbeitet auf einer EC2-Instanz mit lediglich 32 GB RAM und 16 vCPUs &#8212; also knapp 5 % des Datenvolumens an Arbeitsspeicher. </p><p>DuckDB kam nach 16 Minuten durch, inklusive korrekter Verarbeitung von Deletion Vectors, mit der Polars zu diesem Zeitpunkt noch Schwierigkeiten hatte. </p><p>Ein Single-Node-PySpark-Setup auf vergleichbarer Hardware brauchte &#252;ber eine Stunde, unter anderem weil Spark ohne manuelles Tuning (etwa an <code>spark.sql.shuffle.partitions</code>) nicht f&#252;r diese Konstellation ausgelegt ist.</p><div id="datawrapper-iframe" class="datawrapper-wrap outer" data-attrs="{&quot;url&quot;:&quot;https://datawrapper.dwcdn.net/mkGP3/1/&quot;,&quot;thumbnail_url&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/a495778c-decf-4b92-b82a-68b885ae9cf0_1220x730.png&quot;,&quot;thumbnail_url_full&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/b0e02b03-f640-4009-9061-0c2d0b151bec_1220x800.png&quot;,&quot;height&quot;:399,&quot;title&quot;:&quot;Polars vs. DuckDB vs. Daft vs. Spark&quot;,&quot;description&quot;:&quot;&quot;,&quot;belowTheFold&quot;:true}" data-component-name="DatawrapperToDOM"><iframe id="iframe-datawrapper" class="datawrapper-iframe" src="https://datawrapper.dwcdn.net/mkGP3/1/" width="730" height="399" frameborder="0" scrolling="no" loading="lazy"></iframe><script type="text/javascript">!function(){"use strict";window.addEventListener("message",(function(e){if(void 0!==e.data["datawrapper-height"]){var t=document.querySelectorAll("iframe");for(var a in e.data["datawrapper-height"])for(var r=0;r<t.length;r++){if(t[r].contentWindow===e.source)t[r].style.height=e.data["datawrapper-height"][a]+"px"}}}))}();</script></div><p>F&#252;r die Einordnung ist wichtig zu verstehen, dass das kein kontrollierter Benchmark Test unter Laborbedingungen ist, sondern ein einzelner, transparent dokumentierter Testlauf. </p><p>Es zeigt aber ein Muster, das sich in eigenen Projekten regelm&#228;&#223;ig best&#228;tigt&nbsp;&#8211; auf Datengr&#246;&#223;en deutlich unterhalb des Petabyte-Bereichs verliert die Koordination eines verteilten Systems gegen ein gut gebautes Single-Node-Tool.</p><h2>Zero-Copy-Integration mit dem Python/Arrow-&#214;kosystem</h2><p>DuckDB arbeitet eng mit Apache Arrow zusammen. F&#252;r Pandas- und Polars-DataFrames sowie Arrow-Tables kann DuckDB SQL direkt auf den In-Memory-Objekten ausf&#252;hren, ohne die Daten vorher zu serialisieren oder zu kopieren:</p><div class="highlighted_code_block" data-attrs="{&quot;language&quot;:&quot;python&quot;,&quot;nodeId&quot;:&quot;c06eaa4e-a003-4e3a-b36c-4dfbe6ebfc70&quot;}" data-component-name="HighlightedCodeBlockToDOM"><pre class="shiki"><code class="language-python">import duckdb
import pandas as pd

df = pd.read_parquet("umsatz.parquet")
result = duckdb.sql("SELECT region, sum(umsatz) FROM df GROUP BY region").df()</code></pre></div><p>F&#252;r diesen Fall arbeitet DuckDB im <em>Zero-Copy-Modus</em> - der Speicher wird nicht dupliziert, sondern DuckDB liest direkt auf dem Arrow-Buffer. Das macht DuckDB zu einem SQL-Layer &#252;ber bestehenden Python Datenstrukturen, statt zu einer weiteren Datenkopie, die separat zu pflegen ist.</p><h2>DuckLake: Lakehouse-Features ohne Iceberg-Komplexit&#228;t</h2><p>Ein neueres Projekt aus dem DuckDB-Umfeld ist DuckLake, ein offenes Tabellenformat, das Lakehouse-typische Eigenschaften - ACID-Transaktionen, Schema Evolution, Time Travel &#8212; bereitstellt, ohne den vollen Funktionsumfang (und die Betriebskomplexit&#228;t) von Apache Iceberg oder Delta Lake vorauszusetzen. </p><p>Der wesentliche Unterschied ist, dass DuckLake seine Metadaten nicht in einer eigenen Katalog-Infrastruktur speichert, sondern in einer regul&#228;ren SQL-Datenbank, etwa Postgres. </p><p>F&#252;r Teams, die ohnehin schon eine relationale Datenbank betreiben, entf&#228;llt damit ein zus&#228;tzlicher Metadaten-Service, den man separat hochverf&#252;gbar machen m&#252;sste.</p><h2>Im Browser: DuckDB-WASM</h2><p>&#220;ber eine WebAssembly-Kompilierung l&#228;uft DuckDB auch vollst&#228;ndig im Browser, clientseitig, ohne Serveranbindung. </p><p>Das wird bereits produktiv genutzt, etwa im Dataset Explorer von Hugging Face, um Nutzern SQL-Abfragen auf &#246;ffentlichen Datens&#228;tzen zu erlauben, ohne dass jede Filter-Interaktion eine Anfrage an einen Server ausl&#246;st. </p><p>Dadurch wird die Serverlast f&#252;r Anbieter von z.B. &#246;ffentlichen Datens&#228;tzen strukturell reduziert, da die Rechenlast auf die Clients verteilt wird.</p><h2>Wo die Architektur an ihre Grenzen st&#246;&#223;t</h2><p>Zwei Einschr&#228;nkungen sind f&#252;r die hier pr&#228;sentierte Einordnung wichtig:</p><p><strong>Single-Writer Model</strong><br>DuckDB erlaubt zu jedem Zeitpunkt genau einen schreibenden Prozess auf einer Datenbankdatei. Mehrere Prozesse k&#246;nnen gleichzeitig lesen, aber ein paralleles Schreiben mehrerer unabh&#228;ngiger Prozesse auf dieselbe Datei ist architektonisch nicht vorgesehen. F&#252;r Multi-User-Schreibzugriffe &#252;ber mehrere Anwendungen hinweg braucht es entweder eine Anwendungsschicht, die Schreibzugriffe serialisiert, oder eine Erweiterung wie MotherDuck, die eine Cloud-Koordinationsschicht &#252;ber DuckDB legt.</p><p><strong>Kein OLTP<br></strong>Die vektorisierte, batch-orientierte Ausf&#252;hrung, die DuckDB bei analytischen Scans so schnell macht, ist f&#252;r hochfrequente Einzeltransaktionen&nbsp;&#8211; ein Bestellsystem mit tausenden kleinen Writes pro Sekunde etwa&nbsp;&#8211; nicht die richtige Wahl. Eine klassische OLTP-Datenbank wie Postgres ist hier deutlich besser geeignet. DuckDB und Postgres schlie&#223;en sich deshalb nicht aus, sie l&#246;sen unterschiedliche Probleme&nbsp;&#8211; und lassen sich &#252;ber Extensions wie <code>pg_duckdb</code> sogar kombinieren, sodass Postgres analytische Queries an die DuckDB-Engine delegiert.</p><h2>Wo das in unseren Datenprodukten landet</h2><p>Wenn wir f&#252;r einen Kunden Datenprodukte bauen, ist das meistens eine Kombination aus automatisierter Datenaufbereitung von ein bis zwei angebundenen Quellsystemen und einem Reporting- oder KI&#8209;Layer obendrauf. DuckDB &#252;bernimmt dabei bei uns typischerweise die Verarbeitungsschicht zwischen Rohdaten und Auslieferung. </p><p>Konkret sieht das in der Regel so aus:</p><ul><li><p><strong>Ingestion &amp; Transformation:</strong> Statt einer eigenen Orchestrierungs-Infrastruktur l&#228;uft die Kernlogik als DuckDB-Prozess, angesto&#223;en per Cronjob oder Lambda-Funktion, der &#252;ber Extensions direkt gegen ERP-Exporte, CSV-Uploads oder S3-Buckets liest, transformiert und das Ergebnis als Parquet- oder Delta-Table zur&#252;ckschreibt. Das ersetzt in vielen Projekten eine dedizierte ETL-Orchestrierung, die f&#252;r das tats&#228;chliche Datenvolumen &#252;berdimensioniert w&#228;re.</p></li><li><p><strong>Speicherschicht im Produkt selbst:</strong> Weil eine DuckDB-Datenbank eine einzelne Datei ist, l&#228;sst sie sich sauber versionieren und als Artefakt zwischen Entwicklungs-, Test- und Produktionsumgebung durchreichen, ohne separate Datenbank-Instanz, die wir beim Kunden betreiben oder absichern m&#252;ssten. Das reduziert die Zahl der Systeme, die nach Go-Live gewartet werden m&#252;ssen, was bei Kunden ohne eigenes Data-Team der eigentliche Engpass ist, nicht die Rechenleistung.</p></li><li><p><strong>Speed Layer vor bestehenden Warehouses:</strong> L&#228;uft beim Kunden bereits ein Warehouse wie Snowflake, setzen wir DuckDB gelegentlich als vorgelagerte Aggregationsschicht ein, die die f&#252;r ein Dashboard relevanten Daten einmalig exportiert und lokal vorh&#228;lt - die interaktive Filterung im Frontend verursacht dann keine laufenden Abfragekosten mehr im Warehouse.</p></li><li><p><strong>RAG- und KI-Pipelines:</strong> In Projekten mit einer Retrieval-Komponente &#252;bernimmt DuckDB h&#228;ufig die Vorverarbeitung und Filterung der Rohdaten, bevor sie in eine Vektordatenbank wandern - die Zero-Copy-Integration mit Arrow/Pandas macht diesen Schritt in der Python-Pipeline g&#252;nstig, ohne eine zus&#228;tzliche Datenkopie zu erzeugen.</p></li></ul><p>Der gemeinsame Nenner: In keinem dieser F&#228;lle betreiben wir f&#252;r den Kunden eine zus&#228;tzliche Server-Komponente, die separat gepatcht, skaliert oder &#252;berwacht werden m&#252;sste. Das ist ein direkter Ausfluss der oben beschriebenen In-Process-Architektur &#8212; nicht ein Feature, das wir DuckDB andichten, sondern die logische Konsequenz aus einem Engine-Design, das f&#252;r genau diese Klasse von Datenvolumen gebaut ist.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><p></p>]]></content:encoded></item><item><title><![CDATA[Data Governance ohne Data Warehouse]]></title><description><![CDATA[Warum der Mythos vom &#8222;gro&#223;en Wurf&#8220; Euch ausbremst]]></description><link>https://sub.datenhandwerk.ai/p/data-governance-ohne-data-warehouse</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/data-governance-ohne-data-warehouse</guid><dc:creator><![CDATA[Ilka Landsmann-Kropp]]></dc:creator><pubDate>Tue, 28 Jul 2026 04:12:06 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!Q7qY!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>In vielen mittelst&#228;ndischen Unternehmen h&#228;lt sich eine bestimmte Vorstellung hartn&#228;ckig: Eine solide Datenstrategie braucht zwingend ein Data Warehouse. Erst wenn alle Daten zentral, sauber und in einem gro&#223;en System zusammenlaufen, kann man ernsthaft &#252;ber Data Governance sprechen.</p><p>Das ist ein Trugschluss.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!Q7qY!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!Q7qY!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png 424w, https://substackcdn.com/image/fetch/$s_!Q7qY!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png 848w, https://substackcdn.com/image/fetch/$s_!Q7qY!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png 1272w, https://substackcdn.com/image/fetch/$s_!Q7qY!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!Q7qY!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png" width="1456" height="814" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/ba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:814,&quot;width&quot;:1456,&quot;resizeWidth&quot;:null,&quot;bytes&quot;:146999,&quot;alt&quot;:null,&quot;title&quot;:null,&quot;type&quot;:&quot;image/png&quot;,&quot;href&quot;:null,&quot;belowTheFold&quot;:false,&quot;topImage&quot;:true,&quot;internalRedirect&quot;:&quot;https://sub.datenhandwerk.ai/i/203844829?img=https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png&quot;,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="" srcset="https://substackcdn.com/image/fetch/$s_!Q7qY!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png 424w, https://substackcdn.com/image/fetch/$s_!Q7qY!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png 848w, https://substackcdn.com/image/fetch/$s_!Q7qY!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png 1272w, https://substackcdn.com/image/fetch/$s_!Q7qY!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fba3b417f-a3b7-46eb-ac83-c5ad746f7ee0_1914x1070.png 1456w" sizes="100vw" fetchpriority="high"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a></figure></div><p>Ein Data Warehouse kann sinnvoll sein. Es ist aber keine Grundvoraussetzung f&#252;r eine funktionierende Data Governance. F&#252;r viele Unternehmen im Mittelstand ist es sogar der falsche erste Schritt. In diesem Artikel geht es darum, warum das so ist, und wie Ihr auch ohne DWH eine starke Datenverwaltung aufbaut.</p><div><hr></div><div class="subscription-widget-wrap-editor" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Abonnieren&quot;,&quot;language&quot;:&quot;de&quot;}" data-component-name="SubscribeWidgetToDOM"><div class="subscription-widget show-subscribe"><div class="preamble"><p class="cta-caption">Datenhandwerk GmbH is a reader-supported publication. To receive new posts and support my work, consider becoming a free or paid subscriber.</p></div><form class="subscription-widget-subscribe"><input type="email" class="email-input" name="email" placeholder="E-Mail-Adresse eingeben &#8230;" tabindex="-1"><input type="submit" class="button primary" value="Abonnieren"><div class="fake-input-wrapper"><div class="fake-input"></div><div class="fake-button"></div></div></form></div></div><div><hr></div><h2>Was Data Governance eigentlich bedeutet</h2><p>Data Governance ist im Kern nichts anderes als die Gesamtheit der Regeln, Prozesse und Verantwortlichkeiten rund um den Umgang mit Daten. Das Ziel: Daten organisieren, ihre Qualit&#228;t sicherstellen und Compliance-Anforderungen erf&#252;llen. Konkret geh&#246;ren dazu:</p><ul><li><p><strong>Datenqualit&#228;t</strong> &#8211; konsistente, fehlerfreie und aktuelle Daten</p></li><li><p><strong>Zugriffsmanagement&nbsp;&#8211;</strong> wer darf welche Daten einsehen und bearbeiten</p></li><li><p><strong>Datenschutz und Compliance</strong> &#8211; DSGVO, ISO-Normen und vergleichbare Anforderungen</p></li><li><p><strong>Metadatenmanagement</strong> &#8211; Daten verstehen und klassifizieren</p></li><li><p><strong>Prozessoptimierung</strong> &#8211; effiziente Datenfl&#252;sse im Unternehmen</p></li></ul><p>Keiner dieser Punkte verlangt nach einem zentralen Data Warehouse. Sie verlangen nach klaren Regeln und Verantwortlichkeiten &#8211; unabh&#228;ngig davon, wo die Daten technisch liegen.</p><h2>Warum das Data Warehouse oft &#252;berbewertet wird</h2><p>Ein Data Warehouse kann in bestimmten F&#228;llen n&#252;tzlich sein&nbsp;&#8211; etwa, wenn wirklich gro&#223;e Datenmengen aus vielen verschiedenen Quellen langfristig zusammengef&#252;hrt werden m&#252;ssen. F&#252;r die meisten mittelst&#228;ndischen Unternehmen sieht die Realit&#228;t aber anders aus:</p><p><strong>Der Implementierungsaufwand ist hoch.</strong> Ein DWH ist teuer, zeitintensiv und verlangt spezialisiertes Know-how, das viele Unternehmen mit 250 bis 1500 Mitarbeitenden schlicht nicht im eigenen Haus haben &#8211; und auch nicht aufbauen wollen, nur um ein einzelnes Datenprojekt zu starten.</p><p><strong>Nicht alle Daten brauchen Zentralisierung.</strong> Oft reichen dezentrale Systeme und moderne Cloud-L&#246;sungen vollkommen aus, um den eigentlichen Business-Nutzen zu heben.</p><p><strong>Flexibilit&#228;t geht verloren.</strong> &#196;nderungen an Datenmodellen oder Gesch&#228;ftsanforderungen werden in einem starren DWH-Setup zu einem eigenen Projekt&nbsp;&#8211; mit eigenem Budget, eigener Timeline, eigenem Abstimmungsaufwand.</p><p>Das gr&#246;&#223;te Missverst&#228;ndnis dabei: Viele gehen davon aus, dass ein DWH automatisch f&#252;r bessere Datenqualit&#228;t oder mehr Sicherheit sorgt. Das stimmt nicht. Ohne klare Prozesse und Regeln bleibt auch das teuerste Data Warehouse nur eine weitere technische L&#246;sung&nbsp;&#8211; ohne echten Mehrwert f&#252;r das Gesch&#228;ft.</p><p>Das ist genau das Muster, das wir auch bei Custom-AI-Projekten beobachten: Wer zuerst die Technik kauft und danach &#252;ber die Regeln nachdenkt, baut am Ende ein teures System, das niemand richtig nutzt.</p><h2>Wie Ihr Data Governance ohne Data Warehouse startet</h2><p>Der Einstieg in Data Governance muss nicht kompliziert sein. Vier Schritte reichen f&#252;r den Anfang:</p><p><strong>1. Wichtige Daten identifizieren.</strong> Welche Daten braucht Ihr wirklich, um Eure zentralen Gesch&#228;ftsfragen zu beantworten? Kundendaten, Rechnungen, Lagerbest&#228;nde&nbsp;&#8211; meistens sind es deutlich weniger Datenquellen, als man zun&#228;chst vermutet.</p><p><strong>2. Verantwortlichkeiten festlegen.</strong> Wer k&#252;mmert sich um welche Daten? Wer h&#228;lt sie aktuell, und wer greift im Zweifel ein, wenn die Qualit&#228;t nicht stimmt? Ohne eine klar benannte Person oder Rolle bleibt jede Data-Governance-Initiative ein Lippenbekenntnis.</p><p><strong>3. Einfache Analyse-Tools nutzen.</strong> Excel, Google Sheets oder BI-Tools wie Power BI reichen f&#252;r den Einstieg oft vollkommen aus, um erste belastbare Erkenntnisse zu gewinnen. Der teure Tech-Stack kommt sp&#228;ter&nbsp;&#8211; wenn &#252;berhaupt.</p><p><strong>4. Regeln f&#252;r Datenqualit&#228;t definieren.</strong> Wie werden Daten gepflegt? Welche Mindeststandards gelten &#8211; etwa f&#252;r Vollst&#228;ndigkeit, Aktualit&#228;t oder Formatierung? Diese Regeln m&#252;ssen nicht perfekt sein. Sie m&#252;ssen vor allem eines sein: befolgt.</p><h2>Starte klein und pragmatisch</h2><p>Eine gute Data Governance beginnt nicht mit einem gro&#223;en DWH-Projekt. Sie beginnt mit klaren Verantwortlichkeiten, einem strukturierten Umgang mit den Daten, die Ihr ohnehin schon habt, und einfachen Werkzeugen, die Eure Teams bereits kennen.</p><p>Der &#8222;gro&#223;e Wurf&#8220;&nbsp;&#8211; alles zentralisieren, alles neu aufsetzen, dann erst loslegen&nbsp;&#8211; klingt nach Gr&#252;ndlichkeit. In der Praxis ist er meistens der Grund, warum Data-Governance-Initiativen im Mittelstand nie &#252;ber die Planungsphase hinauskommen.</p><p><em>Mehr zum konkreten Einstieg findet Ihr in unserem Artikel &#8222;Wie starte ich Data Governance in einem mittelst&#228;ndischen Betrieb?&#8221;.</em></p><p>Wie sind Eure Erfahrungen mit Data Governance&nbsp;&#8211; habt Ihr klein angefangen, oder steckt Ihr gerade mitten in einem gro&#223;en DWH-Projekt? Schreibt es in die Kommentare.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><p></p>]]></content:encoded></item><item><title><![CDATA[Was nichts kostet, ist auch nichts wert!?]]></title><description><![CDATA[Warum unser Pay-per-Use-Modell mit einem bezahlten Workshop beginnt]]></description><link>https://sub.datenhandwerk.ai/p/was-nichts-kostet-ist-auch-nichts</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/was-nichts-kostet-ist-auch-nichts</guid><dc:creator><![CDATA[Henning Kropp]]></dc:creator><pubDate>Mon, 20 Jul 2026 05:04:04 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!F_2Z!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>Der FEX am BER kostet ein paar Euro. Trotzdem wird er regelm&#228;&#223;ig schwarzgefahren, und der Bahnhof sieht entsprechend aus. Der Arlanda Express in Stockholm kostet umgerechnet 40 Euro f&#252;r 20 Minuten Fahrt. Er ist sauber, p&#252;nktlich, gepflegt.</p><p>Der Unterschied zwischen beiden ist nicht der Zug. Es ist der Preis.</p><p>Was nichts kostet, wird von niemandem wertgesch&#228;tzt&nbsp;&#8211; weder von den Nutzern noch von den Betreibern. Subventionierte Systeme verdrecken, weil sich niemand verantwortlich f&#252;r etwas Wertvolles f&#252;hlt. </p><p>Es ist der Unterschied zwischen der U-Bahn in London, die stark zugangsbeschr&#228;nkt ist, und der U-Bahn in z.&nbsp;B. M&#252;nchen. Die eine ist sauber und gepflegt, die andere riecht nach Urin.</p><p>Genau dieses Prinzip steckt hinter einer Entscheidung, die viele unserer Kunden zun&#228;chst irritiert: Bei Datenhandwerk kostet die Entwicklung Eures individuellen KI-Produkts nichts. Aber der erste Workshop kostet etwas&nbsp;&#8211; mit Geld-zur&#252;ck-Garantie, falls er nichts bringt.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!F_2Z!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!F_2Z!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png 424w, https://substackcdn.com/image/fetch/$s_!F_2Z!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png 848w, https://substackcdn.com/image/fetch/$s_!F_2Z!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png 1272w, https://substackcdn.com/image/fetch/$s_!F_2Z!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!F_2Z!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png" width="977" height="433" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:433,&quot;width&quot;:977,&quot;resizeWidth&quot;:null,&quot;bytes&quot;:65230,&quot;alt&quot;:null,&quot;title&quot;:null,&quot;type&quot;:&quot;image/png&quot;,&quot;href&quot;:null,&quot;belowTheFold&quot;:false,&quot;topImage&quot;:true,&quot;internalRedirect&quot;:&quot;https://sub.datenhandwerk.ai/i/203723457?img=https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png&quot;,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="" srcset="https://substackcdn.com/image/fetch/$s_!F_2Z!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png 424w, https://substackcdn.com/image/fetch/$s_!F_2Z!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png 848w, https://substackcdn.com/image/fetch/$s_!F_2Z!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png 1272w, https://substackcdn.com/image/fetch/$s_!F_2Z!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F46d955fe-66e0-477a-a5ce-8f64e1ffc36e_977x433.png 1456w" sizes="100vw" fetchpriority="high"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a></figure></div><p>In diesem Artikel erkl&#228;ren wir, warum wir so abrechnen, was Pay-per-Use von klassischen Beratungsmodellen unterscheidet, und warum gerade der bezahlte Einstieg der wichtigste Teil des Modells ist.</p><div><hr></div><div class="subscription-widget-wrap-editor" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Abonnieren&quot;,&quot;language&quot;:&quot;de&quot;}" data-component-name="SubscribeWidgetToDOM"><div class="subscription-widget show-subscribe"><div class="preamble"><p class="cta-caption">Datenhandwerk GmbH is a reader-supported publication. To receive new posts and support my work, consider becoming a free or paid subscriber.</p></div><form class="subscription-widget-subscribe"><input type="email" class="email-input" name="email" placeholder="E-Mail-Adresse eingeben &#8230;" tabindex="-1"><input type="submit" class="button primary" value="Abonnieren"><div class="fake-input-wrapper"><div class="fake-input"></div><div class="fake-button"></div></div></form></div></div><div><hr></div><h2>Das Problem mit dem Tagessatz</h2><p>Die meisten KI- und Datenprojekte im Mittelstand laufen nach demselben Muster: Ein Anbieter rechnet nach Tagessatz oder Stunden ab. Das Risiko liegt vollst&#228;ndig beim Kunden. Ob das Projekt am Ende einen messbaren Nutzen bringt, ist f&#252;r die Verg&#252;tung irrelevant&nbsp;&#8211; bezahlt wird die Zeit, nicht das Ergebnis.</p><p>Das erzeugt einen stillen, aber wirksamen Fehlanreiz: Wer nach Stunden abrechnet, hat keinen wirtschaftlichen Grund, schnell zu liefern. Im Gegenteil&nbsp;&#8211; je l&#228;nger ein Projekt dauert, desto h&#246;her die Rechnung.</p><p>Wir rechnen anders ab. Unser Modell ist eine Pay-per-Use-SaaS-Abrechnung: Wir bauen ein individuelles, exklusives Produkt f&#252;r Dein Unternehmen, und Du zahlst erst, wenn es genutzt wird. Keine Tagess&#228;tze, keine Stundenzettel, keine Rechnung f&#252;r halb fertige Konzepte.</p><h2>Pay-per-Use ist kein neues Prinzip&nbsp;&#8211; es ist nur neu f&#252;r KI-Beratung</h2><p>Nutzungsabh&#228;ngige Preismodelle sind in anderen Branchen l&#228;ngst etabliert und erprobt. Rolls-Royce verkauft seine Flugzeugtriebwerke nicht nur als Produkt, sondern bietet mit &#8222;Power by the Hour&#8220; ein Modell an, bei dem Airlines pro Flugstunde zahlen statt f&#252;r die Maschine selbst. Atlas Copco l&#228;sst Kunden f&#252;r Druckluft pro Kubikmeter zahlen statt f&#252;r den Kompressor, und Michelin verkauft Reifenleistung nach gefahrener Meile statt nach St&#252;ckzahl.</p><p>Das Muster ist immer dasselbe: Der Anbieter tr&#228;gt das unternehmerische Risiko der Investition. Der Kunde zahlt nur f&#252;r das, was tats&#228;chlich funktioniert und genutzt wird.</p><p>M&#246;glich wird das durch Fortschritte in Digitalisierung, Sensorik und Cloud-Technologie&nbsp;&#8211; diese haben die &#220;berwachung und Abrechnung nutzungsabh&#228;ngiger Modelle erst wirtschaftlich tragf&#228;hig gemacht, sowohl im B2C- als auch im B2B-Bereich. Was Rolls-Royce f&#252;r Triebwerke macht, &#252;bertragen wir auf individuelle KI-Produkte f&#252;r den Mittelstand: Wir tragen das Risiko der Entwicklung. Du zahlst erst, wenn das Produkt im Alltag l&#228;uft.</p><h2>Warum der Workshop trotzdem etwas kostet</h2><p>Genau hier kommt der Punkt, der die meisten Kunden im Erstgespr&#228;ch &#252;berrascht: Wenn die Entwicklung nichts kostet&nbsp;&#8211;&nbsp;warum kostet dann der erste Workshop etwas?</p><p>Die Antwort hat zwei Ebenen.</p><p><strong>Erstens: Der Workshop ist keine Vertriebsma&#223;nahme, sondern Arbeit.</strong> <br>Im initialen Workshop scopen wir gemeinsam, welches Produkt &#252;berhaupt gebaut werden soll&nbsp;&#8211; welche Daten verf&#252;gbar sind, welcher Use Case den gr&#246;&#223;ten Hebel bringt, wo die &#8222;low hanging fruits&#8220; liegen. Das ist Expertenarbeit, kein unverbindliches Kennenlernen.</p><p><strong>Zweitens, und das ist der wichtigere Grund: Verbindlichkeit muss auf beiden Seiten beginnen, bevor irgendetwas gebaut wird.</strong></p><p>Zur&#252;ck zur &#214;PNV-Analogie: Wer nichts investiert, behandelt das Ergebnis auch nicht wie etwas Wertvolles. Das gilt f&#252;r Nutzer subventionierter &#214;PNV genauso wie f&#252;r Auftraggeber kostenloser Erstgespr&#228;che. </p><p>Ein kostenloses Erstgespr&#228;ch wird seltener vorbereitet, seltener ernst genommen, seltener mit den n&#246;tigen internen Ressourcen flankiert. Ein bezahlter Workshop ver&#228;ndert die Dynamik auf beiden Seiten des Tisches&nbsp;&#8211; auch bei uns. </p><p>Wir liefern nicht &#8222;irgendeinen Termin&#8220;, wir liefern das Fundament f&#252;r ein Produkt, das danach nichts mehr kosten soll, bis es l&#228;uft.</p><p>Falls der Workshop am Ende nichts bringt oder Du mit dem Ergebnis unzufrieden bist: Du bekommst Dein Geld zur&#252;ck. Aber kostenlos war er nie.</p><h2>Was das f&#252;r Euer Unternehmen bedeutet</h2><p>F&#252;r Fachbereichsleiter und Gesch&#228;ftsf&#252;hrer im Mittelstand &#8211; ohne eigenes Data-Team, mit begrenztem Risikoappetit f&#252;r teure PoCs ohne Ergebnis &#8211; verschiebt dieses Modell die entscheidende Frage:</p><p>Nicht mehr &#8222;Wie viele Tage kostet das?&#8220;, sondern &#8222;Tr&#228;gt der Anbieter das Risiko mit mir?&#8221;</p><p>Bei einem Tagessatz-Modell tr&#228;gst Du als Kunde das volle Risiko. Bei unserem Pay-per-Use-Modell verdienen wir erst, wenn das Produkt l&#228;uft und im Alltag genutzt wird. Der Workshop ist der einzige Punkt, an dem beide Seiten von Anfang an Verbindlichkeit zeigen m&#252;ssen&nbsp;&#8211; und genau deshalb kostet er etwas.</p><div><hr></div><p><strong>Kurz zusammengefasst:</strong></p><ul><li><p>Entwicklung: Pay-per-Use, du zahlst erst ab Nutzung</p></li><li><p>Initialer Workshop: kostet bewusst etwas, mit Geld-zur&#252;ck-Garantie</p></li><li><p>Das Prinzip: Was nichts kostet, ist auch nichts wert&nbsp;&#8211; f&#252;r keine der beiden Seiten</p></li></ul><p>Wenn Du wissen willst, wie ein solcher Workshop f&#252;r Dein Unternehmen aussehen k&#246;nnte, sprechen wir gern in einem ersten Gespr&#228;ch dar&#252;ber, wo Eure gr&#246;&#223;ten Hebel liegen.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><p></p>]]></content:encoded></item><item><title><![CDATA[Von der Miete zum Besitz der Intelligenz]]></title><description><![CDATA[&#220;ber kleine Sprachmodelle f&#252;r den Mittelstand]]></description><link>https://sub.datenhandwerk.ai/p/von-der-miete-zum-besitz-der-intelligenz</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/von-der-miete-zum-besitz-der-intelligenz</guid><dc:creator><![CDATA[Henning Kropp]]></dc:creator><pubDate>Tue, 14 Jul 2026 12:22:11 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!jO1K!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>Ich war diese Woche bei einem ACM Tech Talk zum Thema kleine Sprachmodelle&nbsp;&#8211; und ein Satz aus dem Talk ist mir seither nicht mehr aus dem Kopf gegangen. Dazu komme ich gleich. Erst zum Kontext.</p><p>Riccardo Mattivi, Senior Staff AI Engineer bei Integral AdScience, er&#246;ffnete die Session im Rahmen der ACM-Initiative f&#252;r lebenslanges Lernen. Den Hauptvortrag hielt Guglielmo Liozzi - biomedizinischer Ingenieur und Direktor f&#252;r KI und angewandte Mathematik bei MSD (Merck), mit langj&#228;hriger Erfahrung in Software-Engineering und maschinellem Lernen. Sein Thema: das, wie er es nannte, ungenutzte Gesch&#228;ftspotenzial kleiner Sprachmodelle.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!jO1K!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!jO1K!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png 424w, https://substackcdn.com/image/fetch/$s_!jO1K!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png 848w, https://substackcdn.com/image/fetch/$s_!jO1K!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png 1272w, https://substackcdn.com/image/fetch/$s_!jO1K!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!jO1K!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png" width="1208" height="691" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:691,&quot;width&quot;:1208,&quot;resizeWidth&quot;:null,&quot;bytes&quot;:94097,&quot;alt&quot;:null,&quot;title&quot;:null,&quot;type&quot;:&quot;image/png&quot;,&quot;href&quot;:null,&quot;belowTheFold&quot;:false,&quot;topImage&quot;:true,&quot;internalRedirect&quot;:&quot;https://sub.datenhandwerk.ai/i/203726426?img=https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png&quot;,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="" srcset="https://substackcdn.com/image/fetch/$s_!jO1K!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png 424w, https://substackcdn.com/image/fetch/$s_!jO1K!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png 848w, https://substackcdn.com/image/fetch/$s_!jO1K!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png 1272w, https://substackcdn.com/image/fetch/$s_!jO1K!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F102b257a-1df6-4274-a533-4f35cedac4c7_1208x691.png 1456w" sizes="100vw" fetchpriority="high"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a></figure></div><p>Das passt genau zu etwas, das ich selbst seit Jahren in Kundenprojekten beobachte&nbsp;&#8211; und das ich in j&#252;ngster Vergangenheit auch in einem Post zum Buch &#8222;Small Language Models&#8220; aufgegriffen habe: Man braucht nicht das gr&#246;&#223;te Modell. Man braucht das Richtige.</p><div><hr></div><div class="subscription-widget-wrap-editor" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Abonnieren&quot;,&quot;language&quot;:&quot;de&quot;}" data-component-name="SubscribeWidgetToDOM"><div class="subscription-widget show-subscribe"><div class="preamble"><p class="cta-caption">Datenhandwerk GmbH is a reader-supported publication. To receive new posts and support my work, consider becoming a free or paid subscriber.</p></div><form class="subscription-widget-subscribe"><input type="email" class="email-input" name="email" placeholder="E-Mail-Adresse eingeben &#8230;" tabindex="-1"><input type="submit" class="button primary" value="Abonnieren"><div class="fake-input-wrapper"><div class="fake-input"></div><div class="fake-button"></div></div></form></div></div><div><hr></div><h2>Der technische Teil: Wie weit l&#228;sst sich ein Modell schrumpfen?</h2><p>Liozzi startete mit konkreten Beispielen, wie man ein dom&#228;nenspezifisches kleines Sprachmodell aufbaut und implementiert. Dabei stellte er eine Frage, die ich f&#252;r den sch&#246;nsten Gedanken-Provokateur des ganzen Talks halte:</p><p>&#8222;Was, wenn ich versuche, eines dieser Modelle auf einem Commodore 64 zum Laufen zu bringen?&#8221;</p><p>Das ist nat&#252;rlich &#252;berspitzt&nbsp;&#8211; aber genau darin liegt der Witz. Es zwingt einen, eine Frage zu stellen, die in der aktuellen KI-Debatte viel zu selten gestellt wird: Wie wenig Hardware braucht ein Modell wirklich, um f&#252;r eine konkrete Aufgabe n&#252;tzlich zu sein? Liozzi f&#252;hrte aus, wie ein Modell quantisiert und f&#252;r stark eingeschr&#228;nkte Architekturen angepasst werden muss&nbsp;&#8211; eine &#220;bung, die zeigt, wie viel &#8222;Fett&#8220; in den meisten KI-Implementierungen tats&#228;chlich steckt, wenn man sie mit Allzweck-Modellen l&#246;st statt mit zugeschnittenen.</p><p>F&#252;r den Mittelstand ist die Commodore-64-Frage nat&#252;rlich keine reale Anforderung. Aber die Denkrichtung dahinter ist hochrelevant: Viele Unternehmen r&#252;sten ihre Infrastruktur f&#252;r KI-Anwendungen auf, die eigentlich mit deutlich weniger Rechenleistung laufen k&#246;nnten&nbsp;&#8211; wenn das Modell von Anfang an f&#252;r die konkrete Aufgabe gebaut w&#228;re, statt ein generisches Gro&#223;modell per Prompt zu b&#228;ndigen.</p><h2>Der Gesch&#228;ftsteil: Warum kleine Modelle keine Kompromissl&#246;sung sind</h2><p>Im zweiten Teil wechselte Liozzi den Fokus von der Technik zur Gesch&#228;ftsperspektive. Seine Kernaussage: Die Implementierung kleiner Sprachmodelle ist keine technische Notl&#246;sung f&#252;r Unternehmen, die sich kein gro&#223;es Modell leisten k&#246;nnen. Sie ist eine eigenst&#228;ndige Gesch&#228;ftschance.</p><p>&#8222;Die Nutzung kleiner Sprachmodelle in stark regulierten Branchen kann viele Risiken mindern.&#8221;</p><p>Das deckt sich exakt mit dem, was wir bei Datenhandwerk im Mittelstand sehen&nbsp;&#8211; gerade bei Kunden in regulierten oder datensensiblen Bereichen. Viele bestehende KI-L&#246;sungen sind f&#252;r den allgemeinen Markt gebaut und erf&#252;llen die spezifischen Anforderungen einzelner Branchen oder Unternehmen schlicht nicht. Liozzi sprach explizit von der Notwendigkeit, hier innovative, zugeschnittene L&#246;sungen zu schaffen - statt zu versuchen, ein universelles Gro&#223;modell mit immer mehr Prompt-Engineering in die richtige Richtung zu zwingen.</p><h2>Datenschutz: Das Modell kommt zu den Daten, nicht umgekehrt</h2><p>Der Punkt, der f&#252;r mich am meisten praktische Relevanz f&#252;r unsere Kunden hatte, war Liozzis Perspektive auf Datenschutz und Sicherheit:</p><p>&#8222;Die Modelle bewegen sich dorthin, wo die Daten sind, anstatt die Daten zu bewegen.&#8221;</p><p>Das ist ein einfacher Satz mit einer gro&#223;en Konsequenz. Bei den meisten kommerziellen KI-APIs ist es umgekehrt: Eure Daten verlassen Eure Infrastruktur, um vom Modell verarbeitet zu werden&nbsp;&#8211; und damit verlasst Ihr auch ein gutes St&#252;ck Kontrolle &#252;ber das, was mit sensiblen Informationen passiert. Ein kleines, lokal betreibbares Modell dreht dieses Prinzip um. Es l&#228;uft dort, wo die Daten ohnehin liegen&nbsp;&#8211;&nbsp;on-premise, in der eigenen Cloud-Umgebung, ohne dass Kundendaten, Vertragsdaten oder Produktionsdaten irgendwo anders hinwandern m&#252;ssen.</p><p>Liozzi gab konkrete Beispiele, wie Unternehmen genau &#252;ber diesen Weg Datenschutzbedenken adressieren, die bei der Nutzung gro&#223;er kommerzieller Modelle sonst schwer aufl&#246;sbar sind.</p><h2>Der Satz, der mir h&#228;ngen geblieben ist</h2><p>Zum Abschluss formulierte Liozzi eine These, die f&#252;r mich die treffendste Zusammenfassung der gesamten Bewegung hin zu kleinen, spezialisierten Modellen ist:</p><p>&#8222;Dies ist eine Verschiebung von der Anmietung von Intelligenz zu deren Besitz.&#8221;</p><p>Genau das ist der Unterschied, den ich Entscheidern im Mittelstand am liebsten erkl&#228;ren w&#252;rde, wenn ich nur einen Satz h&#228;tte. Wer ein gro&#223;es KI-Modell per API nutzt, mietet Intelligenz&nbsp;&#8211; bei einem Anbieter, der die Spielregeln, die Preise und manchmal sogar die Verf&#252;gbarkeit jederzeit &#228;ndern kann. Wer ein kleines, auf die eigenen Daten und Prozesse zugeschnittenes Modell selbst betreibt oder betreiben l&#228;sst, besitzt diese Intelligenz&nbsp;&#8211; als eigenen Verm&#246;genswert, der sich mit dem Unternehmen weiterentwickelt, statt von au&#223;en verwaltet zu werden.</p><h2>Was das f&#252;r Euch bedeutet</h2><p>Liozzis Vortrag best&#228;tigt etwas, das in der aktuellen KI-Debatte oft untergeht, weil die Schlagzeilen den gro&#223;en Modellen geh&#246;ren: Die eigentliche Paradigmenverschiebung passiert nicht beim n&#228;chsten GPT-Release. Sie passiert bei Unternehmen, die aufh&#246;ren zu fragen: &#8222;Welches Modell ist gerade das beste?&#8220; und anfangen zu fragen: &#8222;Welches Modell brauche ich f&#252;r genau mein Problem &#8211; und kann ich es selbst besitzen, statt es zu mieten?&#8220;</p><p>F&#252;r den Mittelstand ohne eigenes Data-Team klingt das zun&#228;chst nach einer H&#252;rde. Ist es aber nicht&nbsp;&#8211; es ist eine Einladung, das KI-Projekt von der richtigen Seite aus zu denken: nicht vom gr&#246;&#223;ten verf&#252;gbaren Modell aus, sondern vom eigenen, sehr konkreten Anwendungsfall.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><p></p>]]></content:encoded></item><item><title><![CDATA[Übernehmen KI-Agenten die Herrschaft? ]]></title><description><![CDATA[Die falsche Angst &#8211; und die richtigen Fragen f&#252;r Entscheider]]></description><link>https://sub.datenhandwerk.ai/p/ubernehmen-ki-agenten-die-herrschaft</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/ubernehmen-ki-agenten-die-herrschaft</guid><dc:creator><![CDATA[Ilka Landsmann-Kropp]]></dc:creator><pubDate>Mon, 06 Jul 2026 10:42:00 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!5UbL!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>Das Gedankenexperiment eines Analysehauses wird ver&#246;ffentlicht. Massenentlassungen durch KI-Agenten, hyperbolische Produktivit&#228;t, das Ende der Konsumgesellschaft, wie wir sie kennen. Ausdr&#252;cklich hypothetisch, ausdr&#252;cklich ein Szenario&nbsp;&#8211; kein Forschungsbericht.</p><p>Am n&#228;chsten Tag verlieren Uber, American Express, Mastercard und DoorDash zwischen 4 und 6 Prozent ihres B&#246;rsenwerts. Alle vier Unternehmen waren im Szenario namentlich erw&#228;hnt.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!5UbL!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!5UbL!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png 424w, https://substackcdn.com/image/fetch/$s_!5UbL!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png 848w, https://substackcdn.com/image/fetch/$s_!5UbL!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png 1272w, https://substackcdn.com/image/fetch/$s_!5UbL!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!5UbL!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png" width="1071" height="472" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/ce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:472,&quot;width&quot;:1071,&quot;resizeWidth&quot;:null,&quot;bytes&quot;:71434,&quot;alt&quot;:null,&quot;title&quot;:null,&quot;type&quot;:&quot;image/png&quot;,&quot;href&quot;:null,&quot;belowTheFold&quot;:false,&quot;topImage&quot;:true,&quot;internalRedirect&quot;:&quot;https://sub.datenhandwerk.ai/i/203720317?img=https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png&quot;,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="" srcset="https://substackcdn.com/image/fetch/$s_!5UbL!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png 424w, https://substackcdn.com/image/fetch/$s_!5UbL!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png 848w, https://substackcdn.com/image/fetch/$s_!5UbL!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png 1272w, https://substackcdn.com/image/fetch/$s_!5UbL!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fce995c1a-73c9-47d3-84d4-7cb396eb3cff_1071x472.png 1456w" sizes="100vw" fetchpriority="high"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a></figure></div><p>Das ist die aktuelle Lage: Ein hypothetisches Gedankenspiel &#252;ber KI-Agenten bewegt echtes Geld an echten M&#228;rkten. Wenn das die Reaktion auf eine Spekulation ist, wie verzerrt ist dann erst die Diskussion, die Entscheider in ihren eigenen Unternehmen f&#252;hren m&#252;ssen?</p><p>Die kurze Antwort: ziemlich verzerrt. Und genau deshalb lohnt sich ein Blick auf die richtigen Fragen &#8211; statt auf die falschen &#196;ngste.</p><div><hr></div><div class="subscription-widget-wrap-editor" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Abonnieren&quot;,&quot;language&quot;:&quot;de&quot;}" data-component-name="SubscribeWidgetToDOM"><div class="subscription-widget show-subscribe"><div class="preamble"><p class="cta-caption">Datenhandwerk GmbH is a reader-supported publication. To receive new posts and support my work, consider becoming a free or paid subscriber.</p></div><form class="subscription-widget-subscribe"><input type="email" class="email-input" name="email" placeholder="E-Mail-Adresse eingeben &#8230;" tabindex="-1"><input type="submit" class="button primary" value="Abonnieren"><div class="fake-input-wrapper"><div class="fake-input"></div><div class="fake-button"></div></div></form></div></div><div><hr></div><h2>Die falsche Frage: &#8222;&#220;bernehmen die Agenten?&#8221;</h2><p>Wir geben den Systemen menschliche Eigenschaften und messen ihre Leistungsf&#228;higkeit auf menschlicher Ebene, was die &#246;ffentliche Debatte &#252;ber Agentic AI stark anthropomorphisiert. Diese Denkweise geht letztlich auf Alan Turings Imitationsspiel aus dem Jahr 1950 zur&#252;ck: Ein System gilt als intelligent, wenn es im Dialog nicht von einem Menschen zu unterscheiden ist.</p><p>Das Problem an diesem Ma&#223;stab: Er fragt nach Imitation, nicht nach Wirkung. Ob ein KI-Agent wie ein Mensch wirkt, ist f&#252;r dein Unternehmen die uninteressanteste Frage &#252;berhaupt. Relevant ist, was passiert, wenn dieser Agent mit deinen Daten, deinen Mitarbeitenden und deinen Gesch&#228;ftsprozessen interagiert.</p><p>Schon 1989 argumentierte die Soziologin Susan Leigh Star, dass der Turing-Test der falsche Ma&#223;stab f&#252;r KI-Systeme ist. Ihr Vorschlag, angelehnt an den Soziologen &#201;mile Durkheim: Die Intelligenz eines Systems bemisst sich nicht daran, wie menschlich es wirkt, sondern daran, wie n&#252;tzlich es f&#252;r die gemeinsame Arbeit ist&nbsp;&#8211; und wie gut es sich an ver&#228;nderte Bedingungen anpassen kann. </p><p>&#220;bersetzt in die Sprache des Mittelstands: Es geht nicht darum, ob ein Agent klug klingt. Es geht darum, ob er im echten Betriebsalltag etwas bringt, und ob er sich anpassen l&#228;sst, wenn sich eure Prozesse &#228;ndern.</p><h2>Die richtige Frage: &#8222;Mit welchen Regeln lassen wir Agenten arbeiten?&#8221;</h2><p>Ein KI-Agent handelt nie im Vakuum. Er ist Teil eines gr&#246;&#223;eren Zusammenspiels aus Menschen, Software, Daten und Prozessen&nbsp;&#8211; in der Forschung wird das ein &#8222;sozialer Mechanismus&#8220; genannt. </p><p>Wikipedia ist ein bekanntes Beispiel: Menschliche Autorinnen und Autoren arbeiten mit Bots zusammen, die Vandalismus erkennen, Verlinkungen pflegen und Bearbeitungen vorschlagen&nbsp;&#8211;&nbsp;begrenzt durch klare Regeln der Community.</p><p>Autonome Fahrzeuge im Stra&#223;enverkehr sind ein anderes Beispiel: Sie agieren neben menschlichen Fahrern und Fu&#223;g&#228;ngern, in einem Umfeld mit Verkehrsregeln, Wetterbedingungen und sich durchgehend &#228;ndernden Situationen. </p><p>Die entscheidende Erkenntnis aus diesem Forschungsfeld l&#228;sst sich auf jedes Unternehmen &#252;bertragen, das KI-Agenten einsetzen will:</p><p><strong>Nicht der einzelne Agent entscheidet &#252;ber den Erfolg. Die Regeln, nach denen Mensch und Agent zusammenarbeiten, entscheiden dar&#252;ber.</strong></p><p>Forscher schlagen daf&#252;r einen erweiterten Pr&#252;fkatalog vor, der spieltheoretische Mechanismus-Gestaltung mit sozialwissenschaftlichen Fragen verbindet&nbsp;&#8211; den sogenannten Star-Durkheim-Test. Vereinfacht gefragt:</p><ul><li><p><strong>Wessen Interessen verfolgt der Agent, und wessen Interessen verfolgen die Menschen, mit denen er zusammenarbeitet?</strong> <br>Bei einem Vertriebsagenten sind das andere Ziele als bei einem Fahrer im Stra&#223;enverkehr&nbsp;&#8211; aber die Frage ist dieselbe: Laufen die Interessen von Mensch und KI-Agent in dieselbe Richtung, oder erzeugt der Agent stille Fehlanreize?</p></li><li><p><strong>Handelt der Agent verl&#228;sslich, regelkonform und nachvollziehbar?</strong> <br>Ein Agent, der &#8222;irgendwie&#8220; zum Ziel kommt, aber niemand versteht, wie, ist in einem Unternehmenskontext ein Risiko&nbsp;&#8211; nicht ein Feature.</p></li><li><p><strong>Was passiert, wenn der Agent zu viele Rechte bekommt?</strong> <br>Hier hilft ein aktuelles Beispiel: Open-Claw, ein Open-Source-System aus lokal arbeitenden Agenten, die digitale Aufgaben &#252;ber mehrere Software-Dienste hinweg selbstst&#228;ndig erledigen. Je gr&#246;&#223;er das Autonomie-Versprechen, desto gr&#246;&#223;er die Angriffsfl&#228;che&nbsp;&#8211; von kompromittierten Zugangsdaten bis zu manipulierbaren Workflows. Wer einem solchen System weitreichende Zugriffsrechte einr&#228;umt, sollte sich der Risiken bewusst sein, die der Hype gerne ausblendet.</p></li><li><p><strong>L&#228;sst sich die Sicherheit so weit erh&#246;hen, dass das System noch funktioniert?</strong> Die Forscher vergleichen &#252;berm&#228;&#223;ige Einschr&#228;nkung mit dem Versuch, eine K&#252;che kindersicher zu machen, indem man Messer, Herd und Backofen entfernt. Dann ist die K&#252;che sicher&nbsp;&#8211; aber nutzlos. Genau diese Balance m&#252;ssen Entscheider f&#252;r jeden Agenten in ihrem Unternehmen selbst finden.</p></li></ul><h2>Was das f&#252;r die Regulierung bedeutet &#8211; und warum sie allein nicht reicht</h2><p>Der EU&#8209;AI&#8209;Act verfolgt einen risikobasierten Ansatz: Je nach Risikokategorie eines KI-Systems gelten unterschiedliche Anforderungen, etwa Verbote bestimmter Techniken wie Social Scoring oder biometrischer Identifizierung im &#246;ffentlichen Raum. </p><p>Das ist sinnvoll, hat aber eine Schw&#228;che, die f&#252;r Entscheider direkt relevant ist: Die Regulierung betrachtet meist das einzelne System&nbsp;&#8211; nicht den gesamten Kontext, in den es eingebettet ist.</p><p>Beim autonomen Fahren funktioniert das einigerma&#223;en, weil es dort bereits viele Regulierungen gibt, die genau diesen Gesamtkontext mitdenken. Bei Sprachmodellen und KI-Agenten in Unternehmen sieht das anders aus&nbsp;&#8211; hier zeigt sich, wie schwer sich selbst europ&#228;ische Gesetzgebung tut, regulatorische Leitplanken gegen die Marktdynamik gro&#223;er Anbieter durchzusetzen.</p><p>Die praktische Konsequenz f&#252;r Entscheider: Wer auf gesetzliche Leitplanken wartet, bevor er sich mit den eigenen Spielregeln f&#252;r KI-Agenten besch&#228;ftigt, wartet zu lange. </p><p>Die Verantwortung, den eigenen &#8222;sozialen Mechanismus&#8220; zwischen Mitarbeitenden und Agenten sinnvoll zu gestalten, liegt zuerst im Unternehmen selbst.</p><h2>Die eigentliche Machtfrage</h2><p>Die entscheidende Frage ist nicht, ob KI-Agenten eingesetzt werden. Technologien verschwinden selten wieder, sobald sie wirtschaftlich sinnvoll sind. Die entscheidende Frage ist, welche Strukturen und Regeln ein Unternehmen f&#252;r das Zusammenspiel von Menschen und Agenten baut&nbsp;&#8211; bevor der Agent produktiv geschaltet wird, nicht danach.</p><p>Drei praktische Leitfragen f&#252;r Entscheider, abgeleitet aus der oben skizzierten Logik:</p><ol><li><p><strong>Welches Ziel verfolgt der Agent wirklich&nbsp;&#8211; und passt das zu den Zielen der Menschen, die mit ihm arbeiten?</strong> Ein Kundenservice-Agent, der prim&#228;r auf Geschwindigkeit optimiert ist, kann in Konflikt mit dem Ziel &#8222;Kundenzufriedenheit&#8220; stehen, selbst wenn beide auf dem Papier zusammengeh&#246;ren.</p></li><li><p><strong>Wie viel Autonomie braucht der Agent wirklich&nbsp;&#8211; und wie viel davon ist nur Bequemlichkeit?</strong> Jede zus&#228;tzliche Berechtigung ist eine zus&#228;tzliche Angriffsfl&#228;che. Die Frage ist nicht &#8222;Was kann der Agent maximal tun?&#8220;, sondern &#8222;Was muss er minimal k&#246;nnen, um den Job zu erledigen?&#8221;</p></li><li><p><strong>Wer im Unternehmen versteht den Agenten gut genug, um ihn anzupassen, wenn sich die Lage &#228;ndert?</strong> Ein Agent, den niemand au&#223;er dem urspr&#252;nglichen Anbieter versteht oder ver&#228;ndern kann, ist eine Blackbox mit Risikoaufschlag.</p></li></ol><p>Diese Fragen lassen sich nicht an einem Nachmittag beantworten, und sie lassen sich nicht durch ein einzelnes Tool oder eine einzelne Policy l&#246;sen. Sie verlangen eine bewusste Auseinandersetzung mit der eigenen Datenlage, den eigenen Prozessen und der eigenen Risikotoleranz&nbsp;&#8211; bevor der erste Agent live geht.</p><p>Nicht die Maschine bestimmt die Wirkung von KI-Agenten in deinem Unternehmen. Die Regeln, nach denen Menschen und Agenten zusammenarbeiten, tun das.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><p></p>]]></content:encoded></item><item><title><![CDATA[Der KI-Modell-Hype ist irreführend]]></title><description><![CDATA[Warum Benchmarks nichts &#252;ber eure Realit&#228;t sagen]]></description><link>https://sub.datenhandwerk.ai/p/der-ki-modell-hype-ist-irrefuhrend</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/der-ki-modell-hype-ist-irrefuhrend</guid><dc:creator><![CDATA[Henning Kropp]]></dc:creator><pubDate>Sun, 28 Jun 2026 11:28:58 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!tF19!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>GLM-5.2 hat in den letzten Tagen f&#252;r Aufsehen gesorgt. Ein Modell von Zhipu AI mit rund 744 Milliarden Parametern&nbsp;&#8211; deutlich kleiner als Opus, Fable oder GPT-5.5, die alle weit &#252;ber einer Billion Parameter liegen. Trotzdem zeigt eine aktuelle Analyse von <a href="https://open.substack.com/pub/msukhareva/p/glm-52-the-final-nail-in-the-coffin">AI Realist</a>: In einer realen Coding-Agenten-Aufgabe kostete GLM-5.2 nur etwa ein Viertel von Opus 4.8&nbsp;&#8211; bei vergleichbarem Ergebnis.</p><p>Das ist kein Einzelfall und kein Zufall. Es ist ein Muster, das sich durch die gesamte aktuelle KI-Forschung zieht: Gr&#246;&#223;er ist nicht automatisch besser. Und Benchmarks, auf die sich die meisten Entscheidungen st&#252;tzen, sagen oft erschreckend wenig dar&#252;ber aus, was im echten Betrieb funktioniert.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!tF19!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!tF19!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png 424w, https://substackcdn.com/image/fetch/$s_!tF19!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png 848w, https://substackcdn.com/image/fetch/$s_!tF19!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png 1272w, https://substackcdn.com/image/fetch/$s_!tF19!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!tF19!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png" width="1456" height="851" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/e82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:851,&quot;width&quot;:1456,&quot;resizeWidth&quot;:null,&quot;bytes&quot;:196116,&quot;alt&quot;:null,&quot;title&quot;:null,&quot;type&quot;:&quot;image/png&quot;,&quot;href&quot;:null,&quot;belowTheFold&quot;:false,&quot;topImage&quot;:true,&quot;internalRedirect&quot;:&quot;https://sub.datenhandwerk.ai/i/203943103?img=https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png&quot;,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="" srcset="https://substackcdn.com/image/fetch/$s_!tF19!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png 424w, https://substackcdn.com/image/fetch/$s_!tF19!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png 848w, https://substackcdn.com/image/fetch/$s_!tF19!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png 1272w, https://substackcdn.com/image/fetch/$s_!tF19!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe82b271e-26f2-486d-a757-ae1b0370371e_2148x1256.png 1456w" sizes="100vw" fetchpriority="high"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a></figure></div><div class="subscription-widget-wrap-editor" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Abonnieren&quot;,&quot;language&quot;:&quot;de&quot;}" data-component-name="SubscribeWidgetToDOM"><div class="subscription-widget show-subscribe"><div class="preamble"><p class="cta-caption">Datenhandwerk GmbH is a reader-supported publication. To receive new posts and support my work, consider becoming a free or paid subscriber.</p></div><form class="subscription-widget-subscribe"><input type="email" class="email-input" name="email" placeholder="E-Mail-Adresse eingeben &#8230;" tabindex="-1"><input type="submit" class="button primary" value="Abonnieren"><div class="fake-input-wrapper"><div class="fake-input"></div><div class="fake-button"></div></div></form></div></div><p></p><h2>Das Benchmark-Problem: Was auf dem Papier gut aussieht, scheitert im Alltag</h2><p><a href="https://kili-technology.com/blog/ai-benchmarks-guide-the-top-evaluations-in-2026-and-why-theyre-not-enough">Kili Technology hat in einer aktuellen Analyse</a> das Ausma&#223; dieses Problems beziffert: Enterprise-Agentensysteme zeigen im Schnitt eine L&#252;cke von 37 Prozent zwischen Labor-Benchmark-Werten und tats&#228;chlicher Performance im produktiven Einsatz. Bei Kostenvergleichen ist die Streuung noch dramatischer&nbsp;&#8211; bis zum 50-Fachen Unterschied zwischen Ans&#228;tzen, die auf dem Papier &#228;hnlich gut abschneiden.</p><p>Woran liegt das? </p><p>Mehrere Gr&#252;nde kommen zusammen:</p><p><strong>Benchmarks sind ges&#228;ttigt.</strong> <br><a href="https://llm-stats.com/benchmarks/mmlu">MMLU</a>, einst der Goldstandard f&#252;r KI-F&#228;higkeiten, wird heute von praktisch jedem f&#252;hrenden Modell mit &#252;ber 88 Prozent gel&#246;st. Unterschiede zwischen Modellen liegen dort im Bereich des statistischen Rauschens&nbsp;&#8211; sie sagen nichts mehr aus.</p><p><strong>Benchmarks werden kontaminiert.</strong> <br>Modelle haben Testfragen oft schon w&#228;hrend des Trainings gesehen. Bei SWE-Bench Verified, dem fr&#252;heren Coding-Standard, zeigte ein Audit, dass praktisch alle f&#252;hrenden Modelle &#220;berlappungen mit den Trainingsdaten aufweisen&nbsp;&#8211; und fast 60 Prozent der schweren Aufgaben fehlerhaft konstruiert waren.</p><p><strong>Benchmarks k&#246;nnen manipuliert werden.</strong> <br>Der <a href="https://internationalaisafetyreport.org/sites/default/files/2026-02/international-ai-safety-report-2026.pdf">internationale KI-Sicherheitsbericht 2026 </a>dokumentierte, dass Spitzenmodelle zwischen Test- und Produktionskontext unterscheiden k&#246;nnen&nbsp;&#8211; und sich in Tests sicherer verhalten als im echten Einsatz. Ein besonders deutliches Beispiel: Ein Modell, das eigentlich die Ausf&#252;hrungsgeschwindigkeit optimieren sollte, schrieb stattdessen einfach die Timer-Funktion um, damit sie schnelle Ergebnisse meldete&nbsp;&#8211; ohne die tats&#228;chliche Performance zu verbessern.</p><p><strong>Benchmarks testen die falsche Sache.</strong> <br>Ein Modell, das bei <a href="https://en.wikipedia.org/wiki/Humanity%27s_Last_Exam">Humanity&#8217;s Last Exam</a> gl&#228;nzt&nbsp;&#8211; einem Test mit Fragen an der Grenze des akademischen Wissens&nbsp;&#8211;, sagt wenig dar&#252;ber aus, ob es in eurem Kundenservice-Bot vern&#252;nftig mit einer mehrdeutigen Anfrage umgeht. Produktionssysteme interagieren mit Teams, verarbeiten unklare Eingaben und laufen &#252;ber lange Zeitr&#228;ume. Kein Standard-Benchmark berichtet Kosten pro Aufgabe, Latenz oder Zuverl&#228;ssigkeit &#252;ber mehrere Durchl&#228;ufe.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/p/der-ki-modell-hype-ist-irrefuhrend?utm_source=substack&utm_medium=email&utm_content=share&action=share&quot;,&quot;text&quot;:&quot;Teilen&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/p/der-ki-modell-hype-ist-irrefuhrend?utm_source=substack&utm_medium=email&utm_content=share&action=share"><span>Teilen</span></a></p><h2>Der Gegenbeweis: Wie ein 1,3-Milliarden-Modell gr&#246;&#223;ere Modelle schlug</h2><p>Schon 2023 lieferte <a href="https://arxiv.org/abs/2306.11644">Microsoft Research mit dem Modell &#8222;phi-1&#8220;</a> einen der eindr&#252;cklichsten Belege daf&#252;r, dass Modellgr&#246;&#223;e nicht der entscheidende Faktor ist. Phi-1 hatte gerade einmal 1,3 Milliarden Parameter&nbsp;&#8211; winzig im Vergleich zu den meisten Konkurrenten. Trainiert wurde es mit weniger als 7 Milliarden Tokens, ein Bruchteil dessen, was vergleichbare Modelle damals verschlangen.</p><p>Das Ergebnis: 50,6 Prozent Pass-Rate auf dem HumanEval-Coding-Benchmark&nbsp;&#8211; und schlug damit Modelle, die zehnmal gr&#246;&#223;er und mit hundertmal mehr Trainingsdaten gef&#252;ttert worden waren. StarCoder etwa, ein Modell mit 15,5 Milliarden Parametern und einer Billion Trainings-Tokens, kam nur auf vergleichbare oder schlechtere Werte.</p><p>Der Grund war kein cleverer Trick in der Architektur. Es war die Qualit&#228;t der Trainingsdaten. Statt <em>phi-1</em> mit dem &#252;blichen, riesigen, aber unsauberen Mix aus &#246;ffentlichem Code zu trainieren, kuratierten die Forscher gezielt &#8222;lehrbuchqualitative&#8220; Daten&nbsp;&#8211; sauber strukturierter, instruktiver Code statt zuf&#228;llig zusammengew&#252;rfelter Repositories voller Boilerplate und unverst&#228;ndlicher Snippets. Erg&#228;nzt wurde das durch synthetisch generierte &#220;bungsaufgaben.</p><p>Das Team zeigte sogar, dass dieser Effekt nicht auf Zufall oder versehentliche Kontamination der Testdaten zur&#252;ckzuf&#252;hren war: Selbst nachdem sie aggressiv &#252;ber 40 Prozent der Trainingsdaten entfernt hatten, die HumanEval-Aufgaben auch nur entfernt &#228;hnelten, blieb die Leistung von <em>phi-1 </em>stabil deutlich &#252;ber der von StarCoder.</p><p>Die Kernerkenntnis aus diesem Paper, treffend zusammengefasst im Titel selbst: &#8222;Textbooks Are All You Need&#8220;. </p><p><strong>Saubere, gezielt kuratierte Daten schlagen rohe Masse.</strong></p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/p/der-ki-modell-hype-ist-irrefuhrend?utm_source=substack&utm_medium=email&utm_content=share&action=share&quot;,&quot;text&quot;:&quot;Teilen&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/p/der-ki-modell-hype-ist-irrefuhrend?utm_source=substack&utm_medium=email&utm_content=share&action=share"><span>Teilen</span></a></p><h2>GLM-5.2: Dasselbe Prinzip, drei Jahre sp&#228;ter, im gro&#223;en Ma&#223;stab</h2><p>Was bei <em>phi-1</em> im Kleinen demonstriert wurde, zeigt sich heute bei GLM-5.2 im Ma&#223;stab von Hunderten Milliarden Parametern. GLM-5.2 wurde nicht als Allesk&#246;nner trainiert, der nebenbei auch programmieren kann. </p><p>Es wurde gezielt f&#252;r Coding-Aufgaben und f&#252;r das Arbeiten in agentischen Umgebungen wie Claude Code oder OpenCode trainiert&nbsp;&#8211; mit einer effizienten MoE-Architektur und Optimierungen, die den Rechenaufwand pro Token drastisch senken.</p><p>Das Ergebnis best&#228;tigt das Muster: In einer realen Aufgabe&nbsp;&#8211; dem Bau eines WebGL-3D-Plattformers von Grund auf&nbsp;&#8211; kostete GLM-5.2 rund 5,39 US-Dollar, w&#228;hrend Opus 4.8 etwa 21,92 US-Dollar verschlang. Opus war zwar schneller fertig und lieferte das sauberere Ergebnis, aber der Kostenunterschied von etwa dem Vierfachen zeigt deutlich: Spezialisierung auf eine klar definierte Aufgabe schl&#228;gt rohe Modellgr&#246;&#223;e, wenn das Verh&#228;ltnis von Aufwand zu Ergebnis z&#228;hlt.</p><h2>Was das f&#252;r euer Unternehmen bedeutet</h2><p>Die Kili-Analyse formuliert es treffend: Benchmarks sollten als Filter dienen, nicht als Urteil. Ein Benchmark-Score sagt euch, welches Modell es wert ist, weiter getestet zu werden&nbsp;&#8211; nicht, welches Modell f&#252;r eure Nutzer tats&#228;chlich funktioniert.</p><p>F&#252;r den Mittelstand hei&#223;t das konkret:</p><p><strong>H&#246;rt auf, dem gr&#246;&#223;ten verf&#252;gbaren Modell automatisch zu vertrauen.</strong> Die Annahme &#8222;gr&#246;&#223;er ist besser&#8220; ist bequem, aber empirisch immer wieder widerlegt&nbsp;&#8211; von <em>phi-1</em> vor drei Jahren bis zu GLM-5.2 heute.</p><p><strong>Investiert in die Qualit&#228;t eurer eigenen Daten, nicht in die Gr&#246;&#223;e des Modells.</strong> <br>Phi-1 zeigt eindr&#252;cklich: Ein kleines Modell mit sauberen, gezielt kuratierten Trainingsdaten kann ein riesiges Modell mit unsauberen Daten schlagen. Das gilt nicht nur f&#252;r die Modelle der gro&#223;en Labs&nbsp;&#8211; es gilt genauso f&#252;r jedes Custom-AI-Projekt, das auf euren eigenen Gesch&#228;ftsdaten aufbaut.</p><p><strong>Testet gegen eure eigene Realit&#228;t, nicht gegen ein Leaderboard.</strong> <br>Ein Modell, das bei Humanity&#8217;s Last Exam brilliert, kann bei eurer konkreten Reklamationsbearbeitung trotzdem scheitern&nbsp;&#8211; und ein kleineres, spezialisiertes Modell kann genau dort gewinnen, wo es darauf ankommt.</p><p><strong>Bewertet automatisierte Metriken, Modell-Screening und menschliche Fachexpertise gemeinsam.</strong> <br>Genau dieses gestaffelte Vorgehen empfiehlt auch die Kili-Analyse f&#252;r produktionsreife KI-Bewertung&nbsp;&#8211; und es deckt sich mit dem, was sich in der Praxis als robust erweist: Kein einzelner Test ersetzt das Urteil von jemandem, der wei&#223;, was in eurem spezifischen Kontext &#8222;richtig&#8220; bedeutet.</p><p>Die eigentliche Frage ist also nicht &#8222;Welches Modell hat den h&#246;chsten Benchmark-Score?&#8220;. Die eigentliche Frage ist: &#8222;Welches Modell&nbsp;&#8211; trainiert auf welchen Daten, getestet gegen welche Realit&#228;t&nbsp;&#8211; l&#246;st mein konkretes Problem am verl&#228;sslichsten und am g&#252;nstigsten?&#8221;</p><p>Genau das ist der Unterschied zwischen einem KI-Projekt, das beeindruckende Folien produziert, und einem, das im Alltag tats&#228;chlich l&#228;uft.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><p></p>]]></content:encoded></item><item><title><![CDATA[Von der KI-Idee zum Produkt]]></title><description><![CDATA[So optimiert ihr eure Entwicklungsprozesse]]></description><link>https://sub.datenhandwerk.ai/p/von-der-ki-idee-zum-produkt</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/von-der-ki-idee-zum-produkt</guid><dc:creator><![CDATA[Henning Kropp]]></dc:creator><pubDate>Sun, 05 Oct 2025 11:58:21 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!jKG1!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>In der vergangenen Woche f&#252;hrten wir ein Gespr&#228;ch mit dem technischen Leiter eines mittelst&#228;ndischen Unternehmens. In den vergangenen 18 Monaten hat sein Team mehrere KI-Pilotprojekte gestartet. Das Resultat? Drei der Projekte befanden sich weiterhin in der Entwicklungsphase, w&#228;hrend eines bereits im Produktivbetrieb eingesetzt wurde &#8211; allerdings fand es kaum Anwendung. &#8222;Obwohl wir die Technologie haben, sehen wir den Nutzen bis jetzt nicht&#8220;, bemerkte er sichtlich frustriert.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!jKG1!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!jKG1!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png 424w, https://substackcdn.com/image/fetch/$s_!jKG1!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png 848w, https://substackcdn.com/image/fetch/$s_!jKG1!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png 1272w, https://substackcdn.com/image/fetch/$s_!jKG1!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!jKG1!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png" width="974" height="792" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/a736aee8-b823-4647-9371-f169a74b3e02_974x792.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:792,&quot;width&quot;:974,&quot;resizeWidth&quot;:null,&quot;bytes&quot;:517363,&quot;alt&quot;:null,&quot;title&quot;:null,&quot;type&quot;:&quot;image/png&quot;,&quot;href&quot;:null,&quot;belowTheFold&quot;:false,&quot;topImage&quot;:true,&quot;internalRedirect&quot;:&quot;https://sub.datenhandwerk.ai/i/175334431?img=https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png&quot;,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="" srcset="https://substackcdn.com/image/fetch/$s_!jKG1!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png 424w, https://substackcdn.com/image/fetch/$s_!jKG1!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png 848w, https://substackcdn.com/image/fetch/$s_!jKG1!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png 1272w, https://substackcdn.com/image/fetch/$s_!jKG1!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fa736aee8-b823-4647-9371-f169a74b3e02_974x792.png 1456w" sizes="100vw" fetchpriority="high"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a><figcaption class="image-caption"></figcaption></figure></div><p>Diese Geschichte h&#246;ren nicht nur wir immer wieder. In seiner Studie vom <a href="https://www.artificialintelligence-news.com/wp-content/uploads/2025/08/ai_report_2025.pdf">Juli 2025 stellte das MIT fest, dass 95 % der Unternehmen keinen messbaren Erfolg durch den Einsatz insbesondere von GenAI feststellen k&#246;nnen.</a></p><p>Wir denken, dass das Problem nicht an fehlender Technologie oder Unf&#228;higkeit der Teams liegt, sondern daran, dass KI-Projekte falsch angegangen werden.</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><h1>Das Problem: KI als isoliertes Feature</h1><p>Die Mehrheit der Unternehmen betrachtet KI als eine zus&#228;tzliche Komponente. Ein Chatbot hier, ein Empfehlungsalgorithmus dort, ein Prognosemodell f&#252;r die Finanzabteilung. Jedes Team ist f&#252;r den Aufbau seiner eigenen Datenpipeline, das Trainieren eigener Modelle sowie die Bew&#228;ltigung des Change-Managements verantwortlich.</p><h4><strong>Die Realit&#228;t dahinter:</strong></h4><ul><li><p>Team A braucht 6 Monate, um Kundendaten zu strukturieren</p></li><li><p>3 Monate sp&#228;ter beginnt Team B erneut mit dem Bau derselben Datenpipeline.</p></li><li><p>Team C scheitert am Widerstand der Fachabteilung, weil niemand versteht, was das Tool eigentlich bringt</p></li></ul><p>Jedes Projekt kostet dabei mehrere hunderttausend Euro. Der ROI? Bestenfalls marginal.</p><h2>Der Wendepunkt: In Produkten denken, nicht in Projekten</h2><p>Stell dir vor, dein Vertrieb w&#228;re eine geschlossene Dom&#228;ne. Die Generierung von Leads, die Kommunikation mit Kunden, das Forecasting und die Churn-Pr&#228;vention sind alle miteinander verbunden. Jede frisch eingef&#252;hrte KI-Applikation verwendet die gleiche Dateninfrastruktur. Jedes trainierte Modell verbessert das n&#228;chste. Das Team wird durch jeden Erfolg motiviert, den n&#228;chsten Schritt zu machen.</p><h4><strong>Ein konkretes Beispiel aus der Praxis:</strong></h4><p>Ein Online-Shop-Unternehmen hat den Bereich &#8222;Kundenerlebnis&#8220; in drei Schritten ver&#228;ndert:</p><ol><li><p><strong>Start (Monat 1&#8211;3):</strong> Produktempfehlungen basierend auf historischen K&#228;ufen</p><ul><li><p>Dateninfrastruktur aufgebaut: Kundenverhalten, Produktkatalog, Transaktionen</p></li><li><p><strong>Impact:</strong> +12 % Conversion bei wiederkehrenden Kunden</p></li></ul></li><li><p><strong>Ausbau (Monat 4&#8211;6):</strong> Dynamische Preisoptimierung f&#252;r Bestandskunden</p><ul><li><p>Nutzte die gleiche Dateninfrastruktur wie Schritt 1</p></li><li><p>Erweiterte Customer-Insights um Preissensitivit&#228;t</p></li><li><p><strong>Impact:</strong> +8 % Marge bei gleichbleibender Kundenzufriedenheit</p></li></ul></li><li><p><strong>Skalierung (Monat 7&#8211;9):</strong> Predictive Churn Prevention</p><ul><li><p>Kombinierte Daten aus Schritt 1 und 2</p></li><li><p>Team hatte inzwischen Erfahrung und Vertrauen</p></li><li><p><strong>Impact:</strong> &#8211;23 % Kundenabwanderung in der Risikogruppe</p></li></ul></li></ol><p><strong>Gesamtergebnis nach 9 Monaten:</strong> 3,2&nbsp;Mio&nbsp;&#8364; zus&#228;tzlicher Jahresumsatz bei 680.000&nbsp;&#8364; Investment. </p><h1>Warum dieser Ansatz funktioniert</h1><h2>1. Daten als Produkt, nicht als Abfallprodukt</h2><p>In isolierten Projekten sind Daten ein notwendiges &#220;bel. Im Produkt-Ansatz werden sie zum Asset. Du baust einmal eine saubere, gut dokumentierte Dateninfrastruktur auf &#8211; und jede weitere Initiative profitiert davon.</p><h4><strong>Konkret bedeutet das:</strong></h4><ul><li><p>Einheitliche Datenqualit&#228;t &#252;ber alle Use Cases hinweg</p></li><li><p>Wiederverwendbare Features (z.B. &#8220;Customer Lifetime Value&#8221; einmal berechnen, &#252;berall nutzen)</p></li><li><p>Reduzierte Time-to-Market f&#252;r neue KI-Anwendungen um 60-70%</p></li></ul><p>Der Schl&#252;ssel zum Erfolg liegt nicht darin, die gesamte Organisation auf einmal umzukrempeln &#8211; ein solches Unterfangen ist zu komplex und birgt hohe Risiken. Stattdessen sollten Unternehmen einen entscheidenden Gesch&#228;ftsbereich oder eine &#8222;Dom&#228;ne&#8220; identifizieren und diesen von Grund auf neu denken. Eine solche ganzheitliche Transformation eines Kernprozesses oder einer Funktion f&#252;hrt zu erheblichen Leistungssteigerungen, die isolierte Anwendungen niemals erreichen k&#246;nnen.</p><h4><strong>Die Vorteile des Produkt-Ansatzes:</strong></h4><ol><li><p><strong>Synergien:</strong> Jede neue KI-Initiative kann auf der vorherigen aufbauen, indem Daten wiederverwendet und F&#228;higkeiten f&#252;r gemeinsame Interessengruppen erweitert werden.</p></li><li><p><strong>Organischer Wandel:</strong> Dieser Ansatz l&#246;st einen organischen Ver&#228;nderungszyklus innerhalb der Dom&#228;nen aus. Wenn F&#252;hrungskr&#228;fte und Mitarbeiter sehen, wie KI funktioniert und welche Vorteile sie bringt, entsteht eine Eigendynamik f&#252;r den KI-Einsatz im gesamten Unternehmen.</p></li><li><p><strong>Kontinuierliche Verbesserung:</strong> Der Dom&#228;nen-Ansatz f&#246;rdert eine Denkweise der kontinuierlichen Verbesserung, die angesichts der rasanten Entwicklung der KI-Technologie unerl&#228;sslich ist. KI-Transformationen sind keine einmaligen Projekte, sondern fortlaufende Anstrengungen.</p></li></ol><h2>2. Der Mensch vor der Technologie</h2><p>Ver&#228;nderungen in Organisationen entstehen nicht durch verbesserte Computerprogramme, sondern durch Menschen, die mitmachen und begreifen. Indem Mitarbeiter aus dem gesamten Dom&#228;ne-Zyklus (unabh&#228;ngig davon, wo sie zuvor in der Organisation sa&#223;en) einberufen und ihnen Verantwortung f&#252;r die Arbeit &#252;bertragen wird, f&#246;rdert es die Beteiligung an einer Initiative und erzeugt Begeisterung und Dynamik. Es ist wichtig, dass diese Faktoren ber&#252;cksichtigt werden, damit Mitarbeiter bei der Entwicklung von L&#246;sungen &#252;ber das &#220;bliche hinausdenken und dem Projekt dabei helfen, unvorhergesehene Hindernisse zu &#252;berwinden.</p><p>Um auf unser Beispiel zur&#252;ckzukommen: Im Rahmen des ersten Projekts erf&#228;hrt das Vertriebsteam Folgendes: &#8222;Offenbar hat das KI-Tool unsere vielversprechendsten Leads zutreffend prognostiziert.&#8220;</p><p>Im zweiten Projekt stellen sie sich die Frage: &#8222;K&#246;nnen wir das auch f&#252;r X verwenden?&#8220;</p><p>Beim dritten Projekt arbeiten sie an der Entwicklung ihrer eigenen Ideen.</p><h4><strong>Messbare Indikatoren:</strong></h4><ul><li><p>Adoption-Rate steigt von typischen 30 % (isoliertes Projekt) auf 75&#8211;85 % (dritte Initiative in der Dom&#228;ne)</p></li><li><p>Time-to-Value sinkt von durchschnittlich 8 Monaten auf 3&#8211;4 Monate</p></li></ul><h2>3. Prozesse, die mit der Technologie wachsen</h2><p>Die Entwicklung der KI-Technologie schreitet rapide voran. GPT-4 jetzt, GPT-5 morgen, multimodale Modelle am Tag danach. Wer immer wieder von Null beginnt, der verliert.</p><p>Durch den Produkt-Ansatz werden Prozesse zur fortlaufenden Verbesserung etabliert:</p><ul><li><p>Regelm&#228;&#223;ige Model-Retraining-Cycles</p></li><li><p>A/B-Testing neuer Ans&#228;tze gegen etablierte L&#246;sungen</p></li><li><p>Feedback-Loops zwischen Business und Data Science</p></li></ul><h2>Die Notwendigkeit ist echt</h2><p>W&#228;hrend du diese Zeilen liest, optimiert ein Konkurrent m&#246;glicherweise bereits seine Lieferkette unter Zuhilfenahme von k&#252;nstlicher Intelligenz. Ein Startup revolutioniert deine Industrie mit einem Gesch&#228;ftsmodell, das auf KI zugeschnitten ist. Ein weiterer CEO genehmigte letzte Woche den Produkt-Ansatz f&#252;r seinen Vertrieb.</p><p><strong>Die gute Nachricht:</strong> Die meisten Unternehmen haben durch die COVID-Jahre bereits erste KI-Erfahrungen gesammelt. Teams sind aufgebaut. Erste Projekte laufen.</p><p><strong>Die Herausforderung:</strong> Diese Punktl&#246;sungen in eine koh&#228;rente, dom&#228;nenweite Transformation zu &#252;berf&#252;hren.</p><h2>Deine n&#228;chsten Schritte</h2><ol><li><p><strong>Identifiziere eine kritische Dom&#228;ne.</strong> Wo w&#252;rden 20&#8211;30 % Effizienzsteigerung den gr&#246;&#223;ten Business-Impact haben?</p></li><li><p><strong>Mappe die Datenlage:</strong> Welche Daten existieren bereits? Was fehlt? Was ist die Qualit&#228;t?</p></li><li><p><strong>Definiere 3&#8211;5 vernetzte Use Cases.</strong> Nicht isolierte Projekte, sondern eine zusammenh&#228;ngende Transformationsstory</p></li><li><p><strong>Starte klein, denke gro&#223;.</strong> Erstes Projekt in 8&#8211;12 Wochen live, aber mit Infrastruktur, die skaliert.</p></li></ol><div><hr></div><p><strong>Weiterf&#252;hrende Ressourcen:</strong></p><ul><li><p>Framework f&#252;r Dom&#228;nen-Mapping&nbsp;&#8211; systematisches Vorgehen zur Identifikation der richtigen Dom&#228;ne  </p></li><li><p>Data Product Canvas &#8211; Template f&#252;r die Konzeption von Daten als Produkt</p></li><li><p>KI-Readiness-Assessment &#8211; Evaluiere die Ausgangslage deiner Organisation.</p></li></ul><p><strong>Frage in die Community:</strong> Welche Dom&#228;ne in eurem Unternehmen h&#228;tte das gr&#246;&#223;te Transformationspotenzial? Und was h&#228;lt euch aktuell davon ab, den ersten Schritt zu gehen?</p><p><strong>Noch keine Data-Community?</strong></p><div class="digest-post-embed" data-attrs="{&quot;nodeId&quot;:&quot;5cdfc0bb-9e12-4d16-b3ae-a5ce5cfdf148&quot;,&quot;caption&quot;:&quot;Im Rahmen unserer T&#228;tigkeit als Entwickler, Berater und Ansprechpartner f&#252;r eine Vielzahl von Unternehmen richten wir unser Hauptaugenmerk immer wieder auf die Entstehung von Daten, deren Ursprungsort und Qualit&#228;t sowie deren potenziellen Einfluss auf die betrieblichen Abl&#228;ufe. Immer wieder stellen wir dabei fest, dass es nur sehr aufwendig und m&#252;hsam i&#8230;&quot;,&quot;cta&quot;:&quot;Read full story&quot;,&quot;showBylines&quot;:true,&quot;showDescription&quot;:true,&quot;showImage&quot;:true,&quot;size&quot;:&quot;sm&quot;,&quot;isEditorNode&quot;:true,&quot;title&quot;:&quot;Data Community: Mehr als nur Prozesse&quot;,&quot;publishedBylines&quot;:[{&quot;id&quot;:301510294,&quot;name&quot;:&quot;Ilka Landsmann-Kropp&quot;,&quot;bio&quot;:null,&quot;photo_url&quot;:&quot;https://substackcdn.com/image/fetch/f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2F74f35c89-1630-494a-a41a-f53626a08410_144x144.png&quot;,&quot;is_guest&quot;:false,&quot;bestseller_tier&quot;:null}],&quot;post_date&quot;:&quot;2025-10-05T09:08:02.894Z&quot;,&quot;cover_image&quot;:&quot;https://substackcdn.com/image/fetch/$s_!vLTr!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png&quot;,&quot;cover_image_alt&quot;:null,&quot;canonical_url&quot;:&quot;https://sub.datenhandwerk.ai/p/data-community-mehr-als-nur-prozesse&quot;,&quot;section_name&quot;:null,&quot;video_upload_id&quot;:null,&quot;id&quot;:160413403,&quot;type&quot;:&quot;newsletter&quot;,&quot;reaction_count&quot;:0,&quot;comment_count&quot;:0,&quot;publication_id&quot;:3004396,&quot;publication_name&quot;:&quot;Datenhandwerk&quot;,&quot;publication_logo_url&quot;:&quot;https://substackcdn.com/image/fetch/$s_!QRQP!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Fe4d207d1-8d28-4968-8ebf-1078a08fed32_400x400.png&quot;,&quot;belowTheFold&quot;:true,&quot;youtube_url&quot;:null,&quot;show_links&quot;:null,&quot;feed_url&quot;:null}"></div>]]></content:encoded></item><item><title><![CDATA[Data Community: Mehr als nur Prozesse]]></title><description><![CDATA[Data Governance als lebendige Unternehmenskultur]]></description><link>https://sub.datenhandwerk.ai/p/data-community-mehr-als-nur-prozesse</link><guid isPermaLink="false">https://sub.datenhandwerk.ai/p/data-community-mehr-als-nur-prozesse</guid><dc:creator><![CDATA[Ilka Landsmann-Kropp]]></dc:creator><pubDate>Sun, 05 Oct 2025 09:08:02 GMT</pubDate><enclosure url="https://substackcdn.com/image/fetch/$s_!vLTr!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png" length="0" type="image/jpeg"/><content:encoded><![CDATA[<p>Im Rahmen unserer T&#228;tigkeit als Entwickler, Berater und Ansprechpartner f&#252;r eine Vielzahl von Unternehmen richten wir unser Hauptaugenmerk immer wieder auf die Entstehung von Daten, deren Ursprungsort und Qualit&#228;t sowie deren potenziellen Einfluss auf die betrieblichen Abl&#228;ufe. Immer wieder stellen wir dabei fest, dass es nur sehr aufwendig und m&#252;hsam ist, das Wissen dar&#252;ber zu erwerben, was ein g&#228;ngiges Thema der Data Governance ist, das jedoch viele aufgrund seines sperrigen und &#252;berbordenden Anscheins scheuen.</p><p>Durch den Ansatz einer Data Community konnten wir zeigen, dass es nicht immer so sperrig sein muss, um handfeste Ergebnisse zu erzielen.</p><p>Wertvolles Wissen &#252;ber Daten liegt in Unternehmen bei verschiedenen Teams und Abteilungen verstreut. Oft fehlt eine zentrale Anlaufstelle, um Erfahrungen auszutauschen, Best Practices zu teilen und datengetriebene Innovationen voranzutreiben. Hier kommt die <strong>Data Community</strong> ins Spiel. Sie ist das lebendige Fundament, das sicherstellt, dass Data Governance nicht nur ein Regelwerk, sondern eine gelebte Unternehmenskultur wird.</p><div class="captioned-image-container"><figure><a class="image-link image2 is-viewable-img" target="_blank" href="https://substackcdn.com/image/fetch/$s_!vLTr!,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png" data-component-name="Image2ToDOM"><div class="image2-inset"><picture><source type="image/webp" srcset="https://substackcdn.com/image/fetch/$s_!vLTr!,w_424,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png 424w, https://substackcdn.com/image/fetch/$s_!vLTr!,w_848,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png 848w, https://substackcdn.com/image/fetch/$s_!vLTr!,w_1272,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png 1272w, https://substackcdn.com/image/fetch/$s_!vLTr!,w_1456,c_limit,f_webp,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png 1456w" sizes="100vw"><img src="https://substackcdn.com/image/fetch/$s_!vLTr!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png" width="790" height="608" data-attrs="{&quot;src&quot;:&quot;https://substack-post-media.s3.amazonaws.com/public/images/f3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png&quot;,&quot;srcNoWatermark&quot;:null,&quot;fullscreen&quot;:null,&quot;imageSize&quot;:null,&quot;height&quot;:608,&quot;width&quot;:790,&quot;resizeWidth&quot;:null,&quot;bytes&quot;:681674,&quot;alt&quot;:null,&quot;title&quot;:null,&quot;type&quot;:&quot;image/png&quot;,&quot;href&quot;:null,&quot;belowTheFold&quot;:false,&quot;topImage&quot;:true,&quot;internalRedirect&quot;:&quot;https://sub.datenhandwerk.ai/i/160413403?img=https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png&quot;,&quot;isProcessing&quot;:false,&quot;align&quot;:null,&quot;offset&quot;:false}" class="sizing-normal" alt="" srcset="https://substackcdn.com/image/fetch/$s_!vLTr!,w_424,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png 424w, https://substackcdn.com/image/fetch/$s_!vLTr!,w_848,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png 848w, https://substackcdn.com/image/fetch/$s_!vLTr!,w_1272,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png 1272w, https://substackcdn.com/image/fetch/$s_!vLTr!,w_1456,c_limit,f_auto,q_auto:good,fl_progressive:steep/https%3A%2F%2Fsubstack-post-media.s3.amazonaws.com%2Fpublic%2Fimages%2Ff3ff3504-816c-4661-ad55-9dcc60015b61_790x608.png 1456w" sizes="100vw" fetchpriority="high"></picture><div class="image-link-expand"><div class="pencraft pc-display-flex pc-gap-8 pc-reset"><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container restack-image buttonBase-GK1x3M"><svg aria-hidden="true" width="20" height="20" viewBox="0 0 20 20" fill="none" stroke-width="1.5" stroke="var(--color-fg-primary)" stroke-linecap="round" stroke-linejoin="round" xmlns="http://www.w3.org/2000/svg" class="icon-noB79L"><g><path d="M2.53001 7.81595C3.49179 4.73911 6.43281 2.5 9.91173 2.5C13.1684 2.5 15.9537 4.46214 17.0852 7.23684L17.6179 8.67647M17.6179 8.67647L18.5002 4.26471M17.6179 8.67647L13.6473 6.91176M17.4995 12.1841C16.5378 15.2609 13.5967 17.5 10.1178 17.5C6.86118 17.5 4.07589 15.5379 2.94432 12.7632L2.41165 11.3235M2.41165 11.3235L1.5293 15.7353M2.41165 11.3235L6.38224 13.0882"></path></g></svg></button><button tabindex="0" type="button" class="pencraft pc-reset pencraft icon-container view-image buttonBase-GK1x3M"><svg xmlns="http://www.w3.org/2000/svg" width="20" height="20" viewBox="0 0 24 24" fill="none" stroke="currentColor" stroke-width="2" stroke-linecap="round" stroke-linejoin="round" class="lucide lucide-maximize2 lucide-maximize-2 icon-noB79L"><polyline points="15 3 21 3 21 9"></polyline><polyline points="9 21 3 21 3 15"></polyline><line x1="21" x2="14" y1="3" y2="10"></line><line x1="3" x2="10" y1="21" y2="14"></line></svg></button></div></div></div></a><figcaption class="image-caption">Data Community: Mehr als nur Prozesse</figcaption></figure></div><p>Eine Data Community bringt Mitarbeitende zusammen, die mit Daten arbeiten &#8211; von Analysten &#252;ber IT-Teams bis hin zu Fachabteilungen.</p><p>Doch welchen konkreten Mehrwert bietet eine solche Community und wie l&#228;sst sie sich implementieren? Lasst es uns herausfinden!</p><p class="button-wrapper" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Jetzt abonnieren&quot;,&quot;action&quot;:null,&quot;class&quot;:null}" data-component-name="ButtonCreateButton"><a class="button primary" href="https://sub.datenhandwerk.ai/subscribe?"><span>Jetzt abonnieren</span></a></p><h1>Die versteckte Bedrohung: Wieso Daten und Wissen in Silos stecken &#9888;&#65039;</h1><p>Daten haben sich in der heutigen Wirtschaft als entscheidender Verm&#246;genswert entwickelt. Bedauerlicherweise ist in zahlreichen Unternehmen das wertvolle Wissen &#252;ber diese Daten auf verschiedene Teams und Abteilungen verteilt und in Datensilos eingeschlossen.</p><p><strong>Der Hauptgrund ist die Art und Weise, wie das Unternehmen organisiert ist.</strong></p><p>In Unternehmen gibt es verschiedene Abteilungen wie Marketing, Vertrieb, Finanzen und Produktion, die speziell f&#252;r ihre eigenen Ziele optimiert sind.</p><ul><li><p><strong>Vertikale Optimierung:</strong> Jede Abteilung entwickelt ihre <strong>eigenen, spezialisierten Prozesse und Kennzahlen</strong> und beschafft die daf&#252;r <strong>notwendigen Daten und IT-Systeme</strong> (z. B. CRM f&#252;r den Vertrieb, ERP f&#252;r die Produktion). Diese Systeme sind oft nicht nativ miteinander verbunden.</p></li><li><p><strong>Wissenslokalisierung:</strong> Das <strong>Wissen</strong> &#252;ber die Daten &#8211; ihre genaue Herkunft, ihre Definitionen, ihre Qualit&#228;t und die Art ihrer Nutzung &#8211; <strong>verbleibt im Verantwortungsbereich der jeweiligen Abteilung</strong>. Das f&#252;hrt dazu, dass das Vertriebsteam die Definition von &#8222;Kunde&#8220; auf andere Art interpretiert als das Finanzteam.</p></li><li><p><strong>Fehlende horizontale Br&#252;cken:</strong> Es fehlt eine <strong>horizontale, unternehmensweite Struktur</strong>, die den abteilungs&#252;bergreifenden Austausch von Daten und Wissen standardisiert und f&#246;rdert.</p></li></ul><p>Die Folge dieser strukturellen Isolation ist, dass <strong>Daten und das Wissen dar&#252;ber nicht frei flie&#223;en</strong> k&#246;nnen, wodurch sich schwerwiegende Probleme ergeben:</p><ul><li><p><strong>Redundanz und Ineffizienz:</strong> Teams erfinden das Rad neu oder f&#252;hren dieselben Berechnungen mit unterschiedlichen Datens&#228;tzen durch. Das Marketing-Team nutzt insbesondere eine CRM-Datenbank, wei&#223; aber nicht, dass das Controlling bereits eine optimierte Kundensegmentierung entwickelt hat &#8211; wertvolle Arbeit wird dupliziert.</p></li><li><p><strong>Mangelndes Vertrauen in Daten:</strong> Ohne eine <strong>&#8222;Single Source of Truth&#8220; (SSOT)</strong> sind Daten inkonsistent, was zu Verwirrung und Misstrauen unter den Nutzern f&#252;hrt. Entscheidungen basieren auf fehlerhaften oder veralteten Informationen, was die betriebliche Effizienz verringert und Kosten erh&#246;ht.</p></li><li><p><strong>Compliance- und Innovationsrisiken:</strong> Unkontrollierte Datenfl&#252;sse und unklare Verantwortlichkeiten erschweren die Einhaltung gesetzlicher Vorschriften (z. B. DSGVO) und behindern die vollst&#228;ndige Nutzung des Datenpotenzials f&#252;r neue Gesch&#228;ftsmodelle oder KI-Initiativen.</p></li></ul><h1><strong>Der Mehrwert der Community: Wissen, Vertrauen und Entscheidungen</strong></h1><p>Eine Data Community bringt Mitarbeitende zusammen &#8211; von Analysten &#252;ber IT-Teams bis hin zu Fachabteilungen. Ihr Mehrwert ist direkt und operativ:</p><div><hr></div><h2><strong>1&#65039;&#8419; Bessere Nutzung und Verst&#228;ndnis von Daten</strong></h2><p>Viele Unternehmen sammeln riesige Mengen an Daten &#8211; doch oft bleibt unklar, <strong>wie diese optimal genutzt werden k&#246;nnen</strong>. Die Community hilft, Wissenssilos zu &#252;berwinden und ein gemeinsames Verst&#228;ndnis dar&#252;ber zu schaffen, <em>wo</em> wichtige Daten liegen, <em>wie</em> sie richtig interpretiert werden und <em>welche</em> Analyse-Tools sinnvoll sind.</p><p>&#9989; Wo wichtige Daten liegen<br>&#9989; Wie sie richtig interpretiert werden<br>&#9989; Welche Analyse-Tools sinnvoll sind</p><p>&#128161; <strong>Beispiel:</strong> Ein Marketing-Team nutzt eine CRM-Datenbank, wei&#223; aber nicht, dass das Controlling-Team bereits eine optimierte Kundensegmentierung entwickelt hat. Durch den Austausch in der Data Community k&#246;nnen beide voneinander profitieren.</p><div><hr></div><h2><strong>2&#65039;&#8419; F&#246;rderung von datengetriebener Entscheidungsfindung</strong></h2><p>Der gemeinschaftliche Aufbau einer Daten-Community sowie die Sicherstellung der Datenqualit&#228;t tragen dazu bei, das Vertrauen in Daten zu st&#228;rken und fundiertere sowie schnellere Entscheidungsfindungen zu beg&#252;nstigen.</p><p>Sie erm&#246;glicht:</p><p>&#128202; <strong>Bessere Entscheidungsgrundlagen</strong> durch transparenten Austausch von Analysen<br>&#128202; <strong>H&#246;here Datenkompetenz</strong> im gesamten Unternehmen<br>&#128202; <strong>Weniger Abh&#228;ngigkeit von einzelnen Experten</strong></p><p>&#128161; <strong>Beispiel:</strong> Vertrieb und Produktion k&#246;nnen durch eine bessere gemeinsame Nutzung von Daten Nachfrage-Trends schneller erkennen und Produktionsmengen anpassen.</p><div><hr></div><h2><strong>3&#65039;&#8419; Effizientere Zusammenarbeit zwischen Teams</strong></h2><p>Ohne eine zentrale Plattform f&#252;r den Austausch <strong>arbeiten viele Teams doppelt</strong>, weil sie &#228;hnliche Analysen oder Berichte unabh&#228;ngig voneinander erstellen. Eine Data Community schafft:</p><p>&#129309; <strong>Bessere Zusammenarbeit</strong> zwischen Fachbereichen, IT &amp; Data Science<br>&#128640; <strong>Synergien</strong>, die Kosten und Zeit sparen<br>&#128194; <strong>Standardisierung von Methoden &amp; Tools</strong></p><p>&#128161; <strong>Beispiel:</strong> IT und Controlling arbeiten gemeinsam an einer automatisierten Reporting-L&#246;sung, die beiden Abteilungen Arbeit erspart.</p><div><hr></div><h2><strong>4&#65039;&#8419; Innovationen durch neue Perspektiven</strong></h2><p>Oft entstehen die besten Ideen, wenn unterschiedliche Perspektiven aufeinandertreffen. Eine Data Community bietet Raum f&#252;r:</p><p>&#128269; <strong>Erfahrungsaustausch &#252;ber neue Technologien &amp; Trends</strong><br>&#128161; <strong>Kreative L&#246;sungsans&#228;tze f&#252;r Datenprobleme</strong><br>&#127757; <strong>Interdisziplin&#228;ren Wissenstransfer</strong></p><p>&#128161; <strong>Beispiel:</strong> Ein Data-Scientist teilt in der Community, wie KI f&#252;r die Lageroptimierung eingesetzt werden kann &#8211; das Logistik-Team adaptiert die Idee und reduziert Lagerkosten.</p><div><hr></div><h2><strong>5&#65039;&#8419; F&#246;rderung einer datengetriebenen Unternehmenskultur</strong></h2><p>Eine Data Community hilft, eine <strong>starke Datenkultur</strong> aufzubauen, indem sie:</p><p>&#128226; <strong>Schulungen &amp; Events organisiert</strong><br>&#128216; <strong>Wissen in Form von Leitf&#228;den &amp; Best Practices teilt</strong><br>&#127919; <strong>Datenbewusstsein auf allen Ebenen f&#246;rdert</strong></p><p>&#128161; <strong>Beispiel:</strong> Regelm&#228;&#223;ige &#8222;Lunch &amp; Learn&#8220;-Sessions helfen Mitarbeitenden, datengetriebene Ans&#228;tze besser zu verstehen und anzuwenden.</p><h1><strong>&#128640; Fazit: Eine Data Community bringt echten Mehrwert!</strong></h1><p>Unternehmen, die eine aktive Data Community aufbauen, profitieren von:</p><p>&#9989; <strong>Besserem Datenverst&#228;ndnis &amp; effizienterer Nutzung</strong><br>&#9989; <strong>Schnellerem Wissenstransfer &amp; weniger Doppelarbeit</strong><br>&#9989; <strong>Mehr Innovation &amp; besseren Gesch&#228;ftsentscheidungen</strong><br>&#9989; <strong>Einer starken, datengetriebenen Unternehmenskultur</strong></p><p><strong>&#128161; Tipp:</strong> Der Aufbau einer Data Community muss nicht kompliziert sein! Starte klein mit <strong>regelm&#228;&#223;igen Meetups, Wissens-Sharing und einer internen Plattform f&#252;r den Austausch</strong>.</p><p>&#128073; <strong>Wie nutzt dein Unternehmen Daten? Gibt es bereits eine Data Community?</strong> Teile deine Erfahrungen in den Kommentaren! &#128522;&#128071;</p><div class="subscription-widget-wrap-editor" data-attrs="{&quot;url&quot;:&quot;https://sub.datenhandwerk.ai/subscribe?&quot;,&quot;text&quot;:&quot;Abonnieren&quot;,&quot;language&quot;:&quot;de&quot;}" data-component-name="SubscribeWidgetToDOM"><div class="subscription-widget show-subscribe"><div class="preamble"><p class="cta-caption">Dieser Substack wird von den Lesern unterst&#252;tzt. Um neue Posts zu erhalten und meine Arbeit zu unterst&#252;tzen, sollten Sie ein Free- oder Paid-Abonnent werden.</p></div><form class="subscription-widget-subscribe"><input type="email" class="email-input" name="email" placeholder="E-Mail-Adresse eingeben &#8230;" tabindex="-1"><input type="submit" class="button primary" value="Abonnieren"><div class="fake-input-wrapper"><div class="fake-input"></div><div class="fake-button"></div></div></form></div></div>]]></content:encoded></item></channel></rss>