<?xml version="1.0"?>
<feed xmlns="http://www.w3.org/2005/Atom" xml:lang="de">
	<id>https://wiki.cogneon.de/index.php?action=history&amp;feed=atom&amp;title=WissensTransferCamp_2024%2Fwtc24-2-2-illi</id>
	<title>WissensTransferCamp 2024/wtc24-2-2-illi - Versionsgeschichte</title>
	<link rel="self" type="application/atom+xml" href="https://wiki.cogneon.de/index.php?action=history&amp;feed=atom&amp;title=WissensTransferCamp_2024%2Fwtc24-2-2-illi"/>
	<link rel="alternate" type="text/html" href="https://wiki.cogneon.de/index.php?title=WissensTransferCamp_2024/wtc24-2-2-illi&amp;action=history"/>
	<updated>2026-09-20T16:33:43Z</updated>
	<subtitle>Versionsgeschichte dieser Seite in Copedia</subtitle>
	<generator>MediaWiki 1.43.3</generator>
	<entry>
		<id>https://wiki.cogneon.de/index.php?title=WissensTransferCamp_2024/wtc24-2-2-illi&amp;diff=27630&amp;oldid=prev</id>
		<title>Simon.dueckert am 7. August 2025 um 20:05 Uhr</title>
		<link rel="alternate" type="text/html" href="https://wiki.cogneon.de/index.php?title=WissensTransferCamp_2024/wtc24-2-2-illi&amp;diff=27630&amp;oldid=prev"/>
		<updated>2025-08-07T20:05:04Z</updated>

		<summary type="html">&lt;p&gt;&lt;/p&gt;
&lt;table style=&quot;background-color: #fff; color: #202122;&quot; data-mw=&quot;interface&quot;&gt;
				&lt;col class=&quot;diff-marker&quot; /&gt;
				&lt;col class=&quot;diff-content&quot; /&gt;
				&lt;col class=&quot;diff-marker&quot; /&gt;
				&lt;col class=&quot;diff-content&quot; /&gt;
				&lt;tr class=&quot;diff-title&quot; lang=&quot;de&quot;&gt;
				&lt;td colspan=&quot;2&quot; style=&quot;background-color: #fff; color: #202122; text-align: center;&quot;&gt;← Nächstältere Version&lt;/td&gt;
				&lt;td colspan=&quot;2&quot; style=&quot;background-color: #fff; color: #202122; text-align: center;&quot;&gt;Version vom 7. August 2025, 22:05 Uhr&lt;/td&gt;
				&lt;/tr&gt;&lt;tr&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-lineno&quot; id=&quot;mw-diff-left-l6&quot;&gt;Zeile 6:&lt;/td&gt;
&lt;td colspan=&quot;2&quot; class=&quot;diff-lineno&quot;&gt;Zeile 6:&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;br&gt;&lt;/td&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;br&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&amp;lt;embedvideo service=youtube&amp;gt;https://www.youtube.com/watch?v=43-36-bRgA0&amp;lt;/embedvideo&amp;gt;&lt;/div&gt;&lt;/td&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&amp;lt;embedvideo service=youtube&amp;gt;https://www.youtube.com/watch?v=43-36-bRgA0&amp;lt;/embedvideo&amp;gt;&lt;/div&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot; data-marker=&quot;−&quot;&gt;&lt;/td&gt;&lt;td style=&quot;color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #ffe49c; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&lt;del style=&quot;font-weight: bold; text-decoration: none;&quot;&gt;&lt;/del&gt;&lt;/div&gt;&lt;/td&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-side-added&quot;&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot; data-marker=&quot;−&quot;&gt;&lt;/td&gt;&lt;td style=&quot;color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #ffe49c; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&lt;del style=&quot;font-weight: bold; text-decoration: none;&quot;&gt;&#039;&#039;&#039;Hauptthemen des Beitrags:&#039;&#039;&#039;&lt;/del&gt;&lt;/div&gt;&lt;/td&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-side-added&quot;&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot; data-marker=&quot;−&quot;&gt;&lt;/td&gt;&lt;td style=&quot;color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #ffe49c; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&lt;del style=&quot;font-weight: bold; text-decoration: none;&quot;&gt;&lt;/del&gt;&lt;/div&gt;&lt;/td&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-side-added&quot;&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot; data-marker=&quot;−&quot;&gt;&lt;/td&gt;&lt;td style=&quot;color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #ffe49c; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&lt;del style=&quot;font-weight: bold; text-decoration: none;&quot;&gt;# Herausforderung des demografischen Wandels und Wissenstransfers&lt;/del&gt;&lt;/div&gt;&lt;/td&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-side-added&quot;&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot; data-marker=&quot;−&quot;&gt;&lt;/td&gt;&lt;td style=&quot;color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #ffe49c; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&lt;del style=&quot;font-weight: bold; text-decoration: none;&quot;&gt;# Technischer Ansatz mit Embedding Models statt direktem Training&lt;/del&gt;&lt;/div&gt;&lt;/td&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-side-added&quot;&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot; data-marker=&quot;−&quot;&gt;&lt;/td&gt;&lt;td style=&quot;color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #ffe49c; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&lt;del style=&quot;font-weight: bold; text-decoration: none;&quot;&gt;# Praktische Implementierung und Testverfahren&lt;/del&gt;&lt;/div&gt;&lt;/td&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-side-added&quot;&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot; data-marker=&quot;−&quot;&gt;&lt;/td&gt;&lt;td style=&quot;color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #ffe49c; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&lt;del style=&quot;font-weight: bold; text-decoration: none;&quot;&gt;# Vorteile der lokalen Datenhaltung und Nachvollziehbarkeit&lt;/del&gt;&lt;/div&gt;&lt;/td&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-side-added&quot;&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot; data-marker=&quot;−&quot;&gt;&lt;/td&gt;&lt;td style=&quot;color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #ffe49c; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&lt;del style=&quot;font-weight: bold; text-decoration: none;&quot;&gt;# Anwendungsfälle und zukünftige Entwicklungsmöglichkeiten&lt;/del&gt;&lt;/div&gt;&lt;/td&gt;&lt;td colspan=&quot;2&quot; class=&quot;diff-side-added&quot;&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;br&gt;&lt;/td&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;br&gt;&lt;/td&gt;&lt;/tr&gt;
&lt;tr&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&amp;lt;span id=&amp;quot;herausforderung-des-demografischen-wandels-und-wissenstransfers&amp;quot;&amp;gt;&amp;lt;/span&amp;gt;&lt;/div&gt;&lt;/td&gt;&lt;td class=&quot;diff-marker&quot;&gt;&lt;/td&gt;&lt;td style=&quot;background-color: #f8f9fa; color: #202122; font-size: 88%; border-style: solid; border-width: 1px 1px 1px 4px; border-radius: 0.33em; border-color: #eaecf0; vertical-align: top; white-space: pre-wrap;&quot;&gt;&lt;div&gt;&amp;lt;span id=&amp;quot;herausforderung-des-demografischen-wandels-und-wissenstransfers&amp;quot;&amp;gt;&amp;lt;/span&amp;gt;&lt;/div&gt;&lt;/td&gt;&lt;/tr&gt;

&lt;!-- diff cache key db517246392:diff:1.41:old-27620:rev-27630:php=table --&gt;
&lt;/table&gt;</summary>
		<author><name>Simon.dueckert</name></author>
	</entry>
	<entry>
		<id>https://wiki.cogneon.de/index.php?title=WissensTransferCamp_2024/wtc24-2-2-illi&amp;diff=27620&amp;oldid=prev</id>
		<title>Simon.dueckert: Die Seite wurde neu angelegt: „&#039;&#039;&#039;Dieser Vortrag präsentiert einen praxisorientierten Werkstattbericht über den Einsatz von Large Language Models (LLMs) in Unternehmen, speziell zur Bewältigung des demografischen Wandels und Wissenstransfers. Das Hauptaugenmerk liegt auf der Entwicklung einer datenschutzkonformen Lösung mittels Embedding Models, die es ermöglicht, interne Unternehmensdaten zu nutzen, ohne diese in externe KI-Systeme zu übertragen oder das zugrundeliegende Modell…“</title>
		<link rel="alternate" type="text/html" href="https://wiki.cogneon.de/index.php?title=WissensTransferCamp_2024/wtc24-2-2-illi&amp;diff=27620&amp;oldid=prev"/>
		<updated>2025-08-07T15:03:15Z</updated>

		<summary type="html">&lt;p&gt;Die Seite wurde neu angelegt: „&amp;#039;&amp;#039;&amp;#039;Dieser Vortrag präsentiert einen praxisorientierten Werkstattbericht über den Einsatz von Large Language Models (LLMs) in Unternehmen, speziell zur Bewältigung des demografischen Wandels und Wissenstransfers. Das Hauptaugenmerk liegt auf der Entwicklung einer datenschutzkonformen Lösung mittels Embedding Models, die es ermöglicht, interne Unternehmensdaten zu nutzen, ohne diese in externe KI-Systeme zu übertragen oder das zugrundeliegende Modell…“&lt;/p&gt;
&lt;p&gt;&lt;b&gt;Neue Seite&lt;/b&gt;&lt;/p&gt;&lt;div&gt;&amp;#039;&amp;#039;&amp;#039;Dieser Vortrag präsentiert einen praxisorientierten Werkstattbericht über den Einsatz von Large Language Models (LLMs) in Unternehmen, speziell zur Bewältigung des demografischen Wandels und Wissenstransfers. Das Hauptaugenmerk liegt auf der Entwicklung einer datenschutzkonformen Lösung mittels Embedding Models, die es ermöglicht, interne Unternehmensdaten zu nutzen, ohne diese in externe KI-Systeme zu übertragen oder das zugrundeliegende Modell zu trainieren.&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Session Titel:&amp;#039;&amp;#039;&amp;#039; Potentiale für Generative KI im Expert Debriefing&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Session Owner:&amp;#039;&amp;#039;&amp;#039; Manuel Illi&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
&amp;lt;embedvideo service=youtube&amp;gt;https://www.youtube.com/watch?v=43-36-bRgA0&amp;lt;/embedvideo&amp;gt;&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Hauptthemen des Beitrags:&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
# Herausforderung des demografischen Wandels und Wissenstransfers&lt;br /&gt;
# Technischer Ansatz mit Embedding Models statt direktem Training&lt;br /&gt;
# Praktische Implementierung und Testverfahren&lt;br /&gt;
# Vorteile der lokalen Datenhaltung und Nachvollziehbarkeit&lt;br /&gt;
# Anwendungsfälle und zukünftige Entwicklungsmöglichkeiten&lt;br /&gt;
&lt;br /&gt;
&amp;lt;span id=&amp;quot;herausforderung-des-demografischen-wandels-und-wissenstransfers&amp;quot;&amp;gt;&amp;lt;/span&amp;gt;&lt;br /&gt;
== Herausforderung des demografischen Wandels und Wissenstransfers ==&lt;br /&gt;
&lt;br /&gt;
Der Ausgangspunkt des Projekts war eine konkrete Kundenanfrage aus der öffentlichen Verwaltung, die vor einem “Pensionierungstsunamis” steht. Die IT-Abteilung des Kunden weist eine deutlich höhere Altersstruktur auf als typische Tech-Unternehmen, wodurch in naher Zukunft ein massiver Wissensverlust droht.&lt;br /&gt;
&lt;br /&gt;
Quality Minds, ursprünglich als IT-Dienstleister gegründet, hat sich über die Jahre zu einem agilen Unternehmen entwickelt, das auch Lehr-Lern-Begleitung anbietet. Das Quality Learning Team entstand aus der Frage: “Wie lernt denn ein agiles Unternehmen?” und bietet heute verschiedene Formate an:&lt;br /&gt;
&lt;br /&gt;
* One-on-one Begleitung mit Lernenden vor Ort&lt;br /&gt;
* Re- und Upskilling-Programme&amp;lt;br /&amp;gt;&lt;br /&gt;
&lt;br /&gt;
* Gruppen-Lern-Coaching&lt;br /&gt;
* Community-Lern-Coaching&lt;br /&gt;
&lt;br /&gt;
Die zentrale Herausforderung bestand darin, eine KI-Lösung zu entwickeln, die sowohl auf der internen Infrastruktur läuft als auch vertrauenswürdig ist. Dabei stellte sich heraus, dass das Training eines eigenen Large Language Models finanziell nicht realisierbar war, selbst für etablierte Behörden in Deutschland.&lt;br /&gt;
&lt;br /&gt;
&amp;lt;span id=&amp;quot;technischer-ansatz-mit-embedding-models-statt-direktem-training&amp;quot;&amp;gt;&amp;lt;/span&amp;gt;&lt;br /&gt;
== Technischer Ansatz mit Embedding Models statt direktem Training ==&lt;br /&gt;
&lt;br /&gt;
Statt ein eigenes LLM zu trainieren, entwickelte das Team einen innovativen Ansatz mit Embedding Models. Dieser unterscheidet sich fundamental vom klassischen Verfahren, bei dem Nutzer direkt mit dem trainierten Modell interagieren.&lt;br /&gt;
&lt;br /&gt;
Der neue Ansatz funktioniert folgendermaßen:&lt;br /&gt;
&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Datenaufbereitung&amp;#039;&amp;#039;&amp;#039;: Interne Texte werden durch einen Text Splitter in gleichlange Chunks aufgeteilt&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Vektorisierung&amp;#039;&amp;#039;&amp;#039;: Ein Embedding Model erstellt aus diesen Text-Chunks eine Vektordatenbank&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Anfrageverarbeitung&amp;#039;&amp;#039;&amp;#039;: User-Queries werden zunächst an das Embedding Model gesendet&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Kontextsuche&amp;#039;&amp;#039;&amp;#039;: Das System identifiziert die relevantesten Text-Chunks basierend auf Vektorähnlichkeit&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Antwortgenerierung&amp;#039;&amp;#039;&amp;#039;: Diese Chunks werden zusammen mit der Anfrage an das LLM gesendet&lt;br /&gt;
&lt;br /&gt;
Das verwendete Modell (Llama mit 13 Milliarden Parametern) läuft auf einem AI-Cluster mit acht Kernen und kostet etwa 80.000 Euro - ein deutlicher Unterschied zu ChatGPT-4 mit über 300 Milliarden Parametern.&lt;br /&gt;
&lt;br /&gt;
Die Vorteile dieses Ansatzes sind erheblich:&lt;br /&gt;
&lt;br /&gt;
* Keine Überlagerung der internen Daten durch das Trainingsmaterial&lt;br /&gt;
* Reduzierung von Halluzinationen&lt;br /&gt;
* Vollständige Kontrolle über die Datenbasis&lt;br /&gt;
* Möglichkeit zur Nachverfolgung der Antwortquellen&lt;br /&gt;
&lt;br /&gt;
&amp;lt;span id=&amp;quot;praktische-implementierung-und-testverfahren&amp;quot;&amp;gt;&amp;lt;/span&amp;gt;&lt;br /&gt;
== Praktische Implementierung und Testverfahren ==&lt;br /&gt;
&lt;br /&gt;
Für die Validierung des Systems entwickelte das Team ein innovatives Testverfahren. Da das Trainingsmaterial der LLMs unbekannt ist, war es schwierig zu überprüfen, ob Antworten tatsächlich auf den bereitgestellten Kontextdaten basieren oder aus dem ursprünglichen Training stammen.&lt;br /&gt;
&lt;br /&gt;
Die Lösung bestand in der Erstellung von zehn fiktionalen Texten mit Hilfe von ChatGPT. Diese Texte waren:&lt;br /&gt;
&lt;br /&gt;
* Plausibel klingend, aber völlig erfunden&lt;br /&gt;
* Nachweislich nicht in bestehenden Datenquellen vorhanden&lt;br /&gt;
* Speziell für Testzwecke konzipiert&lt;br /&gt;
&lt;br /&gt;
Ein Beispiel war die erfundene “WakeShore”-Pille für minutengenaues Schlafmanagement, inklusive fiktiver Autoren und Studienergebnisse. Die Tests zeigten deutliche Unterschiede:&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Mit Kontext&amp;#039;&amp;#039;&amp;#039;: Das System referenzierte korrekt die fiktiven Autoren Dr. Olivia Hernandez und Dr. Michael Chang und gab präzise Informationen über das erfundene Produkt wieder.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Ohne Kontext&amp;#039;&amp;#039;&amp;#039;: Das LLM antwortete ehrlich: “I’m sorry, but I’m not aware of any studies specifically on this product.”&lt;br /&gt;
&lt;br /&gt;
Ein weiteres Beispiel testete die Auswirkung der Himmelsrichtung beim Lernen. Mit Kontext gab das System die korrekte Antwort (Osten) und fügte relativierend hinzu, dass dies nicht für jedermann gelten müsse. Ohne Kontext halluzinierte das System eine esoterische Antwort über die Vorteile der Nordausrichtung.&lt;br /&gt;
&lt;br /&gt;
&amp;lt;span id=&amp;quot;vorteile-der-lokalen-datenhaltung-und-nachvollziehbarkeit&amp;quot;&amp;gt;&amp;lt;/span&amp;gt;&lt;br /&gt;
== Vorteile der lokalen Datenhaltung und Nachvollziehbarkeit ==&lt;br /&gt;
&lt;br /&gt;
Ein entscheidender Vorteil des Embedding-Ansatzes ist die vollständige Transparenz und Kontrolle über die Datenquellen. Das System bietet mehrere wichtige Features:&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Nachverfolgbarkeit&amp;#039;&amp;#039;&amp;#039;: Nutzer können sich die fünf Text-Chunks anzeigen lassen, auf deren Grundlage eine Antwort generiert wurde. Dies ermöglicht eine Verifikation der Informationen, selbst wenn das System halluziniert.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Datenschutz&amp;#039;&amp;#039;&amp;#039;: Alle Daten bleiben auf der eigenen Infrastruktur. Es werden keine sensiblen Informationen an externe Anbieter übertragen.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Qualitätskontrolle&amp;#039;&amp;#039;&amp;#039;: Durch die Einsicht in die Quell-Chunks können Nutzer die Relevanz und Korrektheit der verwendeten Informationen bewerten.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Flexibilität&amp;#039;&amp;#039;&amp;#039;: Die Vektordatenbank gehört vollständig dem Unternehmen und kann nach eigenen Anforderungen verwaltet werden.&lt;br /&gt;
&lt;br /&gt;
Dieser Ansatz wird als “goldener Mittelweg” zwischen der Nutzung externer KI-Services und dem Aufbau komplett eigener Systeme beschrieben. Unternehmen können von den Vorteilen moderner LLMs profitieren, ohne ihre Daten preiszugeben oder massive Investitionen in eigene Modellentwicklung zu tätigen.&lt;br /&gt;
&lt;br /&gt;
&amp;lt;span id=&amp;quot;anwendungsfälle-und-zukünftige-entwicklungsmöglichkeiten&amp;quot;&amp;gt;&amp;lt;/span&amp;gt;&lt;br /&gt;
== Anwendungsfälle und zukünftige Entwicklungsmöglichkeiten ==&lt;br /&gt;
&lt;br /&gt;
Das System wurde bereits in einem Testprojekt beim Kunden implementiert, wobei ChatGPT als externe Schnittstelle dient, während der gesamte Datenschatz in der internen Datenbank liegt.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Konkrete Anwendungsszenarien&amp;#039;&amp;#039;&amp;#039; umfassen:&lt;br /&gt;
&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Außendienst-Support&amp;#039;&amp;#039;&amp;#039;: Schnelle Antworten für Beratungsgespräche vor Ort, mit der Möglichkeit, bei Bedarf auf detaillierte Datenblätter zuzugreifen&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Technische Dokumentation&amp;#039;&amp;#039;&amp;#039;: Auffinden spezifischer Bauanleitungen oder Montageinformationen&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Wissensmanagement&amp;#039;&amp;#039;&amp;#039;: Bewahrung und Zugänglichmachung von Expertenwissen vor Pensionierungen&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Herausforderungen und offene Fragen&amp;#039;&amp;#039;&amp;#039; für die Weiterentwicklung:&lt;br /&gt;
&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Skalierung&amp;#039;&amp;#039;&amp;#039;: Wie verhält sich das System bei 1.000 statt 10 Dokumenten?&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Automatisierung&amp;#039;&amp;#039;&amp;#039;: Entwicklung von Systemen zur automatischen Aktualisierung der Datenbank&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Vergessen&amp;#039;&amp;#039;&amp;#039;: Mechanismen zur gezielten Entfernung veralteter Informationen&lt;br /&gt;
* &amp;#039;&amp;#039;&amp;#039;Textstruktur&amp;#039;&amp;#039;&amp;#039;: Optimierung für narrative Textformate, die über einfache wissenschaftliche Papers hinausgehen&lt;br /&gt;
&lt;br /&gt;
Besonders bei narrativen Texten besteht noch Forschungsbedarf. Das Problem liegt darin, dass wichtige Informationen möglicherweise erst am Ende eines Textes stehen und den gesamten Kontext uminterpretieren können - ein Phänomen, das bei der Chunk-basierten Verarbeitung verloren gehen könnte.&lt;br /&gt;
&lt;br /&gt;
&amp;lt;span id=&amp;quot;fazit-und-ausblick&amp;quot;&amp;gt;&amp;lt;/span&amp;gt;&lt;br /&gt;
== Fazit und Ausblick ==&lt;br /&gt;
&lt;br /&gt;
Der vorgestellte Ansatz mit Embedding Models bietet eine praktikable Lösung für Unternehmen, die von den Vorteilen generativer KI profitieren möchten, ohne ihre Datensouveränität aufzugeben. Die Kombination aus lokaler Datenhaltung, Nachvollziehbarkeit der Antworten und relativ geringen Implementierungskosten macht diesen Ansatz besonders attraktiv für Organisationen mit sensiblen Daten.&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Zentrale Erkenntnisse:&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
* Embedding Models ermöglichen die Nutzung interner Daten ohne Training eigener LLMs&lt;br /&gt;
* Die Transparenz der Quellen reduziert das Risiko von Halluzinationen erheblich&lt;br /&gt;
* Der Ansatz ist kostengünstiger als das Training eigener Modelle, aber sicherer als externe APIs&lt;br /&gt;
* Praktische Tests mit fiktionalen Daten beweisen die Funktionsfähigkeit des Konzepts&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Offene Forschungsfragen:&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
* Optimierung der Text-Segmentierung für verschiedene Dokumenttypen&lt;br /&gt;
* Entwicklung automatisierter Update-Mechanismen für die Wissensbasis&lt;br /&gt;
* Skalierbarkeit bei großen Datenmengen&lt;br /&gt;
* Integration narrativer Textstrukturen&lt;br /&gt;
&lt;br /&gt;
&amp;#039;&amp;#039;&amp;#039;Handlungsempfehlungen:&amp;#039;&amp;#039;&amp;#039;&lt;br /&gt;
&lt;br /&gt;
Das Team empfiehlt, den Ansatz mit realen Daten zu testen und dabei besonders auf die Skalierbarkeit zu achten. Unternehmen sollten systematisch evaluieren, welche Arten von Dokumenten sich am besten für diesen Ansatz eignen und wie sich die Performance bei größeren Datenmengen entwickelt. Zudem ist es wichtig, frühzeitig Prozesse für die Pflege und Aktualisierung der Wissensbasis zu etablieren.&lt;/div&gt;</summary>
		<author><name>Simon.dueckert</name></author>
	</entry>
</feed>