# PS24 – KI-Potenzialanalyse für den Mittelstand > In 3–4 Wochen wissen Sie, welche KI- und Automatisierungsansätze in Ihrem Betrieb funktionieren. DSGVO-konform, ohne Hersteller-Abhängigkeit. Festpreis 4.800 €. > Generiert: 2026-08-03 | Quelle: zentrale Seiten-Daten PS24 verbindet Beratung und Umsetzung: Wir sind Entwickler mit Beratungserfahrung und analysieren in 3–4 Wochen, welche KI- und Automatisierungs-Potenziale in einem mittelständischen Betrieb tatsächlich tragen. Festpreis statt Tagessatz, Workshop plus schriftlicher Bericht, herstellerneutral und DSGVO-konform mit drei Daten-Konstellationen (lokal, EU-gehostet, US-Cloud). Was wir empfehlen, können wir auch bauen. --- ## Seiten - [KI-Potenzialanalyse](https://ps24.ai/ki-potenzialanalyse): Festpreis-Analyse: wo KI und Automatisierung in Ihrem Betrieb wirklich tragen – priorisiert und herstellerneutral. - [Was wir umsetzen](https://ps24.ai/leistungen): Beratung, KI-Anwendungen, KI-Assistenten & Agenten, KI-Wissensdatenbank und Prozessautomatisierung. - [KI-Beratung & Audits](https://ps24.ai/leistungen/ki-beratung): Wir prüfen Ihre Prozesse, decken Engpässe auf und liefern einen konkreten Fahrplan – herstellerneutral, inklusive ehrlicher Einordnung, wo sich KI nicht lohnt. - [KI-Anwendungen](https://ps24.ai/leistungen/ki-anwendungen): Interne Web- und Mobile-Anwendungen, gebaut in einem Bruchteil der Zeit klassischer Softwareprojekte – genau der Funktionsumfang, den Ihr Prozess braucht. - [Sichere KI-Arbeitsumgebung](https://ps24.ai/leistungen/ki-arbeitsumgebung): Ein DSGVO-konformer Unternehmens-Workspace, in dem Ihr Team mit eigenen Daten, Vorlagen und KI-Assistenten arbeitet – statt unkontrolliert ChatGPT zu füttern. - [KI-Assistenten & Agenten](https://ps24.ai/leistungen/ki-assistenten): KI-Assistenten & Agenten, die wiederkehrende Aufgaben übernehmen – über die Werkzeuge, die Ihr Team ohnehin nutzt. Sie starten lesend, die Freigabe bleibt bei Ihnen. - [KI-Wissensdatenbank](https://ps24.ai/leistungen/firmenwissen): Verstreutes Wissen aus PDFs, Handbüchern und Zeichnungen wird zur durchsuchbaren Wissensbasis – mit Antworten in natürlicher Sprache und Quellenverweis. - [Prozessautomatisierung](https://ps24.ai/leistungen/automatisierung): Wiederkehrende Abläufe laufen automatisiert – von der Datenübertragung bis zur Benachrichtigung. Oft der pragmatischste Einstieg in KI. - [Wer hinter PS24 steht](https://ps24.ai/ueber-uns): Beratung und Umsetzung aus einer Hand – wir bauen, was wir empfehlen. - [KI im Mittelstand – der Vortrag](https://ps24.ai/vortrag): Kostenloser Architektur-Walkthrough für Entscheider, max. 20 Plätze je Termin. - [KI-Begriffe im Glossar](https://ps24.ai/glossar): Die wichtigsten Begriffe knapp und ohne Jargon erklärt. - [Erstgespräch buchen](https://ps24.ai/erstgespraech): 30 Minuten, unverbindlich: klären, ob die KI-Potenzialanalyse der richtige nächste Schritt ist. - [Kontakt](https://ps24.ai/kontakt) --- ## Abschnitte ### 01 – Start KI nutzen, Daten behalten – Festpreis 4.800 €, 3–4 Wochen, DSGVO-konform, Open-Source ohne Lizenz-Zwang. ### 02 – Problem Warum KI-Vorhaben im Mittelstand oft steckenbleiben: Experimente ohne Priorisierung, fehlende Orientierung und DSGVO-Sorgen. ### 03 – Was wir tun Drei Hebel für mehr Effizienz – AI, Agents und Automations: von der ehrlichen Einschätzung bis zur fertig gebauten und automatisierten Lösung. ### 04 – Zielgruppe Für welche mittelständischen Unternehmen die KI-Potenzialanalyse gemacht ist. ### 05 – Differenzierung Was uns von klassischer Beratung unterscheidet: technisch umsetzbar, herstellerneutral, DSGVO von Anfang an, Festpreis, Ergebnisse in Wochen. ### 06 – Einstieg Der empfohlene erste Schritt: die KI-Potenzialanalyse zum Festpreis von 4.800 € in 3–4 Wochen – priorisierte Use-Case-Liste, Machbarkeit & DSGVO-Einordnung, Aufwand-/Kosten-Korridor und Roadmap. Vollversion auf /ki-potenzialanalyse. ### 07 – Kompetenzen Das Umsetzungs-Spektrum von PS24: KI-Beratung & Audits, KI-Anwendungen, sichere KI-Arbeitsumgebung, KI-Assistenten & Agenten, KI-Wissensdatenbank und Prozessautomatisierung – was wir in der Analyse empfehlen, können wir auch umsetzen. ### 08 – Über uns PS24 verbindet Beratung und Umsetzung – Entwickler mit Beratungserfahrung für den Mittelstand. ### 09 – Fragen Antworten auf die Fragen, die Interessenten oft vor der Buchung stellen. --- ## Team ### Paul Siegel – AI Architect Entwickler aus Paderborn, seit über 25 Jahren in der Web-Entwicklung – vom Tabellen-Layout der frühen 2000er bis zu heutigen LLM-Architekturen. Mit PS24 bringt er diese Erfahrung dorthin, wo sie im Mittelstand den größten Unterschied macht. **Werdegang:** - Nov 2023 – heute: Technical Lead & Senior Web Developer – Digitalagentur aus OWL – Web-Plattformen, CMS- und Shop-Systeme, Marketing-Technologie für Mittelstand und Konzerne. Innerhalb derselben Unternehmensgruppe seit 2020. - Aug 2020 – Nov 2023: Senior Web Developer & Web Consultant – Marketing-Agentur aus OWL – technische Beratung und Umsetzung von Kundenprojekten, vom Relaunch bis zur Systemanbindung. - Jan 2017 – Aug 2020: UX-Designer & Softwareentwickler – Software-Unternehmen aus dem Kreis Paderborn – individuelle Anwendungen und Plattformen für Industrie- und B2B-Kunden. - Aug 2011 – Okt 2014: Projektleiter – IT-Systemhaus aus Paderborn – Schwerpunkte IT-Security, Internet-Services und Consulting; parallel Ausbildung zum IT-Systemkaufmann. - Seit 2002: Nebenberuflich selbstständig – Web-Projekte für Kleinkunden – bis heute durchgehend. **Schwerpunkt heute:** Der rote Faden seit den ersten eigenen Web-Seiten: verstehen, wie etwas funktioniert, statt es nur zu benutzen. Was mit auseinandergenommenen Systemen und selbst aufgesetzten Servern anfing, ist heute eine komplette KI-Infrastruktur im eigenen Betrieb – lokale Modelle, Agenten, Automatisierungen, auf eigener Hardware und selbst gebaut. Er empfiehlt nichts, was er nicht vorher selbst im Einsatz hatte. Was ihn an KI reizt, ist nicht der Hype, sondern der Sprung: Aufgaben, für die es früher ein halbes Projektteam und ein Quartal brauchte, entstehen heute in Tagen. Genau das ins Tagesgeschäft mittelständischer Betriebe zu bringen, ist sein Schwerpunkt. --- ## Beispiel-Use-Cases Hinweis: Dies sind allgemein gehaltene Beispiel-Szenarien, keine Referenz-Cases. ### Angebots-Assistent für den Vertriebs-Innendienst (Vertrieb) Ein KI-Assistent schlägt auf Basis vergangener Angebote, technischer Datenblätter und CRM-Historie passende Konfigurationen und Preise vor. Der Innendienst behält die finale Entscheidung und spart einen Großteil der Recherche-Zeit pro Angebot. Datenzugriff strikt lesend, ohne automatischen Versand. Datenfluss: Lokal / EU ### Wartungsprotokolle automatisch strukturieren (Service) Diktierte Service-Berichte werden von einem lokal gehosteten Spracherkennungs-Modell transkribiert. Eine LLM-Pipeline extrahiert strukturierte Felder – Maschine, Befund, Maßnahme, Ersatzteil – und übergibt sie strukturiert ans ERP. Aus formloser Sprache wird ein sauberer Datensatz. Datenfluss: Lokal ### Wissens-Suche in Handbüchern und Doku (Dokumentation / Wissen) Eine lokale Wissens-Suche über die eigenen Dokumente erschließt verstreutes technisches Wissen aus PDFs, Handbüchern und Projektunterlagen. Mitarbeiter fragen in natürlicher Sprache und erhalten Antworten mit Quellenverweis – statt langer Sucherei. Datenfluss: Lokal --- ## Glossar – KI-Begriffe, geclustert und vernetzt Eigene Unterseite: https://ps24.ai/glossar ### Grundlagen **Benchmark** Standardisierte Testreihen, mit denen Modelle verglichen werden – Grundlage der meisten Ranglisten und Anbieterversprechen. Warum es zählt: Benchmark-Ergebnisse sagen wenig über Ihren konkreten Anwendungsfall aus, weil sie akademische Aufgaben messen und nicht Ihre Rechnungen, Ihre Sprache und Ihre Formate. Ein Modell auf Platz vier kann bei Ihnen besser abschneiden als der Spitzenreiter. Der einzige belastbare Vergleich läuft über eigene Testfälle. **Halluzination (Konfabulation)** Wenn ein KI-Modell etwas erfindet, das plausibel klingt, aber faktisch falsch ist. Warum es zählt: Halluzinationen sind der Hauptgrund, warum kritische KI-Ausgaben geprüft werden müssen – durch Quellenbezug (RAG), Leitplanken oder eine menschliche Freigabe. **KI / Künstliche Intelligenz (AI, Artificial Intelligence)** Sammelbegriff für Computerprogramme, die Aufgaben übernehmen, für die man früher menschliches Denken brauchte – etwa Texte verstehen, Muster erkennen oder Entscheidungen vorbereiten. Warum es zählt: Wer KI einführt, sollte wissen, dass „KI" kein einzelnes Produkt ist, sondern ein Oberbegriff. Heute ist meist generative KI gemeint – Systeme, die neue Inhalte erzeugen. **Kontextfenster (Context Window)** Die Menge an Text, die ein Modell auf einmal berücksichtigen kann – sein „Arbeitsgedächtnis", gemessen in Token. Warum es zählt: Das Kontextfenster begrenzt, wie viel Information ein Modell gleichzeitig verarbeitet. Reicht ein Dokument nicht hinein, braucht es Techniken wie RAG – ein praktischer Planungsfaktor. **LLM (Large Language Model, großes Sprachmodell)** Ein KI-Modell, das Sprache versteht und erzeugt – die Technik hinter Werkzeugen wie ChatGPT oder Claude. Warum es zählt: Das LLM ist der Motor fast jeder heutigen KI-Anwendung. Sein Verständnis und seine Grenzen zu kennen, hilft, realistische Erwartungen an Projekte zu setzen. **Modellgewichte** Die trainierten Zahlenwerte, die das gesamte Können eines Modells ausmachen – das eigentliche Produkt hinter jedem KI-Werkzeug. Warum es zählt: Ob Gewichte frei verfügbar sind, entscheidet darüber, ob Sie ein Modell selbst betreiben, einfrieren und langfristig verfügbar halten können. Genau das ist der Kern des Unterschieds zwischen offenen und geschlossenen Modellen – und zugleich der wirksamste Schutz vor der Abkündigung eines Modells, auf dem ein Prozess aufbaut. **Multimodalität (Multimodale KI, Multimodal)** Die Fähigkeit von KI-Modellen, neben Text auch Bilder, Audio oder Dokumente zu verstehen – und teils selbst zu erzeugen. Warum es zählt: Multimodalität öffnet Use-Cases, die im Mittelstand Alltag sind: Belege erfassen, Fotos beurteilen, Diktate verarbeiten. Wo Information nicht als Text vorliegt, wird KI erst dadurch einsetzbar. **Nicht-Determinismus** Dieselbe Eingabe kann bei einem KI-Modell zu unterschiedlichen Ausgaben führen – anders als bei klassischer Software. Warum es zählt: Das ist die Eigenschaft, die im Mittelstand am meisten überrascht, weil vierzig Jahre Softwareerfahrung das Gegenteil gelernt haben. Konsequenz für den Betrieb: Ein einmal erfolgreicher Test beweist wenig, Abnahmen brauchen mehrere Durchläufe, und feste Ausgabeformate müssen erzwungen und geprüft werden statt erhofft. Wo Reproduzierbarkeit zwingend ist, gehört die Aufgabe nicht ins Modell, sondern in einen festen Ablauf. **Pre-Training und Post-Training** Die zwei Phasen der Modellentwicklung: das teure Grundtraining auf riesigen Textmengen und die anschließende Feinabstimmung auf hilfreiches, sicheres Verhalten. Warum es zählt: Die Unterscheidung erklärt, warum Modelle desselben Anbieters mit gleicher Grundlage sich sehr unterschiedlich verhalten können – und warum Fine-Tuning eine Nachbearbeitung ist und kein neues Training. Für Ihre Auswahl heißt das: Verhalten und Ton sind Ergebnis der zweiten Phase und können sich mit jeder Version ändern. **Prompt (Eingabeaufforderung)** Die Eingabe oder Anweisung, die Sie einem KI-Modell geben – die Frage oder Aufgabe. Warum es zählt: Die Formulierung beeinflusst das Ergebnis erheblich. Für ernsthafte Anwendungen geht „Prompt schreiben" aber in das umfassendere Context Engineering über. **Reasoning-Modell (Reasoning Model, Denkendes Modell)** KI-Modelle, die vor der Antwort sichtbar oder intern Zwischenschritte durchrechnen – und komplexe Aufgaben dadurch zuverlässiger lösen, gegen mehr Zeit und Kosten. Warum es zählt: Nicht jede Aufgabe braucht Reasoning: Für einfache Anfragen ist es unnötig teuer und langsam, bei komplexen Analysen macht es den Unterschied. Die Modellwahl ist damit immer auch eine Kosten- und Geschwindigkeitsfrage. **System Prompt (Systemprompt, System-Anweisung)** Die feste Grundanweisung, die eine KI-Anwendung dem Modell vor jeder Nutzereingabe mitgibt – Rolle, Regeln und Grenzen. Warum es zählt: Der System Prompt erklärt, warum dieselbe Frage in verschiedenen Anwendungen unterschiedlich beantwortet wird. Für Unternehmen ist er der erste Ansatzpunkt, Verhalten und Leitplanken einer KI-Anwendung festzulegen. **Temperatur (Temperature)** Ein Regler, der bestimmt, wie kreativ oder wie vorhersehbar ein Modell antwortet – niedrig für konsistente, hoch für variantenreichere Ausgaben. Warum es zählt: Für sachliche, reproduzierbare Anwendungen (etwa Auskünfte aus Firmenwissen) ist eine niedrige Temperatur meist die richtige Wahl. Ein kleiner, aber wirksamer Stellhebel. **Token** Die kleinste Verarbeitungseinheit eines Sprachmodells – grob ein Wortteil. Modelle rechnen in Token und werden oft pro Token abgerechnet. Warum es zählt: Token sind die Maßeinheit für Kosten und Kapazität. Wer versteht, dass Texte in Token zerfallen, kann Budgets und Grenzen besser einschätzen. **Wissensstichtag (Knowledge Cutoff, Trainingsstichtag)** Der Zeitpunkt, bis zu dem das Trainingswissen eines KI-Modells reicht – alles, was danach passiert ist, kennt das Modell nicht. Warum es zählt: Der Wissensstichtag erklärt, warum Modelle aktuelle Ereignisse, Preise oder Rechtslagen verpassen. Wer Aktualität braucht, muss das Modell ergänzen – etwa über eine angebundene Suche oder RAG. ### Agenten **Agent / KI-Agent (KI-Agent, AI Agent)** Eine KI, die nicht nur antwortet, sondern selbstständig mehrschrittige Aufgaben erledigt – etwa E-Mails sortieren oder Daten zwischen Systemen übertragen. Warum es zählt: Agenten automatisieren Abläufe mit mehreren Schritten und Entscheidungen. Wichtig bleibt ein klar definierter Rahmen, in dem der Agent handeln darf. **Agent-Harness (Agent-Runtime, Agenten-Gerüst, Scaffold)** Das Gerüst rund um ein KI-Modell, das aus einem reinen Sprachmodell einen handlungsfähigen Agenten macht – es führt die Schleife aus Denken, Werkzeug nutzen und prüfen aus. Warum es zählt: Die Qualität eines KI-Agenten entscheidet sich selten am Modell, sondern an seinem Harness: Wie sauber Werkzeuge angebunden, Fehler abgefangen und Grenzen gesetzt sind. Für ein Unternehmen heißt das – die eigentliche Ingenieursarbeit steckt hier, nicht im Modell-Wechsel. **Agent-Loop** Die Grundschleife eines Agenten: denken, ein Werkzeug nutzen, das Ergebnis beobachten, erneut entscheiden – bis das Ziel erreicht oder eine Grenze überschritten ist. Warum es zählt: Jeder Durchlauf dieser Schleife ist ein bezahlter Modellaufruf, weshalb ein Agent für dieselbe Aufgabe ein Vielfaches eines einfachen Assistenten kostet. Deshalb gehören zu jedem produktiven Agenten harte Grenzen: maximale Schrittzahl, Zeitlimit, Kostendeckel. Ohne diese Grenzen ist eine Endlosschleife nicht nur möglich, sondern eine Frage der Zeit. **Agenten-Gedächtnis (Memory, Agent Memory)** Mechanismen, mit denen ein KI-Agent Wissen über die einzelne Sitzung hinaus behält – etwa Notizen, Profile oder gelernte Arbeitsweisen. Warum es zählt: Gedächtnis unterscheidet den Assistenten, der jedes Mal bei null anfängt, von einem, der eingearbeitet wirkt. Zugleich ist es eine Datenschutz-Frage: Was gespeichert wird und wie lange, muss geregelt sein. **Agentic AI (Agentenbasierte KI, Agentische KI)** KI-Systeme, die nicht nur antworten, sondern ein Ziel selbstständig in mehreren Schritten verfolgen – planen, Werkzeuge nutzen, Zwischenergebnisse prüfen und nachsteuern. Warum es zählt: Agentic AI verschiebt KI vom Antwort-Geben zum Aufgaben-Erledigen. Für Unternehmen liegt darin der größte Hebel – aber auch das größte Risiko: Ein System, das selbst handelt, braucht klare Grenzen, Protokollierung und Freigabe-Punkte. **Agentic Coding (Agentische Softwareentwicklung, Agentic Software Development)** Softwareentwicklung, bei der ein KI-Agent eigenständig plant, Code schreibt, ausführt, testet und nachbessert – während der Entwickler steuert, prüft und entscheidet. Warum es zählt: Agentic Coding verkürzt den Weg von der Anforderung zur einsatzfähigen Software erheblich – Individuallösungen entstehen in Tagen statt Monaten. Das Ergebnis trägt aber nur, wenn Erfahrung die Richtung vorgibt: klare Anforderungen, Tests und Review bleiben Handwerk. **Autonomiegrade** Die Abstufung, wie viel ein System ohne Rückfrage entscheiden und ausführen darf – vom reinen Vorschlag bis zur eigenständigen Durchführung. Warum es zählt: Autonomie ist kein Schalter, sondern eine Skala, und sie sollte sich an der Umkehrbarkeit der Handlung orientieren: Entwurf schreiben ohne Rückfrage, Mail versenden mit Freigabe, Zahlung auslösen nie automatisch. Diese Zuordnung je Anwendungsfall schriftlich festzuhalten, ist zugleich ein guter Teil der Dokumentation menschlicher Aufsicht. **Chain-of-Thought** Eine Technik, bei der ein Modell Zwischenschritte ausformuliert, bevor es antwortet – was die Zuverlässigkeit bei mehrstufigen Aufgaben erhöht. Warum es zählt: Der ausformulierte Gedankengang macht Fehler auffindbar, weil man sieht, an welcher Stelle das Modell abgebogen ist. Er ist allerdings keine ehrliche Selbstauskunft: Die Begründung wird ebenso erzeugt wie die Antwort und kann eine falsche Schlussfolgerung plausibel wirken lassen. **Computer Use (Computer-Using Agent, GUI-Agent)** Agenten, die Software wie ein Mensch bedienen: Sie sehen den Bildschirm, klicken und tippen – auch in Programmen ohne technische Schnittstelle. Warum es zählt: Computer Use erschließt Alt-Systeme, für die es keine API gibt. Zugleich steigt das Fehler- und Kontrollrisiko, wenn eine KI direkt in Ihren Programmen arbeitet – klare Grenzen und Freigaben an heiklen Stellen sind Pflicht. **Handoff** Die geordnete Übergabe eines Vorgangs von einem Agenten an einen anderen – oder an einen Menschen. Warum es zählt: Der Übergabepunkt an den Menschen ist der wichtigste im ganzen System: Was genau bekommt die Kollegin zu sehen, wie viel Vorgeschichte, und woran erkennt sie, warum übergeben wurde. Schlecht gebaute Übergaben erzeugen mehr Arbeit, als die Automatisierung eingespart hat – dann wird jeder Fall zweimal gelesen. **Human-in-the-Loop (HITL, Mensch in der Schleife)** Ein Arbeitsmuster, bei dem ein Mensch an definierten Punkten eingreift oder freigibt, bevor eine KI eine folgenreiche Aktion ausführt. Warum es zählt: Human-in-the-Loop ist die einfachste und stärkste Sicherheitsmaßnahme beim KI-Einsatz: Die KI bereitet vor, der Mensch entscheidet. Für regulierte oder geschäftskritische Abläufe ist dieser Freigabe-Punkt oft die Bedingung, überhaupt produktiv gehen zu dürfen. **Human-on-the-Loop (HOTL, Mensch über der Schleife)** Ein Aufsichtsmuster, bei dem die KI eigenständig läuft, ein Mensch sie aber überwacht und jederzeit eingreifen kann. Warum es zählt: Bei hohem Volumen und geringem Einzelrisiko ist laufende Freigabe unpraktikabel. „On-the-loop" hält den Menschen in der Aufsicht, ohne jeden Schritt zu bremsen – die Abgrenzung zu Human-in-the-Loop ist eine Risikoentscheidung. **Kontextverdichtung** Das Zusammenfassen bisheriger Zwischenschritte, wenn ein Agent an die Grenze seines Arbeitsgedächtnisses stößt. Warum es zählt: Bei längeren Vorgängen ist das der Punkt, an dem stillschweigend Information verloren geht – der Agent arbeitet weiter, aber mit einer verkürzten Version der Vorgeschichte und verliert dabei Details wie ursprüngliche Einschränkungen. Wichtige Vorgaben gehören deshalb dauerhaft in die Grundanweisung statt in den Verlauf. **Long-running Agent** Ein Agent, der über Stunden oder Tage an einer Aufgabe arbeitet, statt eine Anfrage in Sekunden zu beantworten. Warum es zählt: Sobald ein Vorgang nicht mehr in eine Sitzung passt, kommen Betriebsfragen dazu, die es beim Chatbot nicht gab: Wo liegt der Zwischenstand, was passiert bei einem Neustart, wer erfährt vom Ergebnis, und wie lange darf das Ganze kosten. Das ist weniger ein KI-Thema als ein klassisches Prozess- und Betriebsthema. **Orchestrator (Koordinator-Agent, Lead-Agent)** Der koordinierende Agent, der eine Aufgabe in Teile zerlegt, sie an Subagenten verteilt und ihre Ergebnisse wieder zusammenführt. Warum es zählt: Sobald mehrere Agenten zusammenarbeiten, braucht es eine steuernde Instanz. Der Orchestrator ist diese Instanz – er entscheidet, wer was wann tut. **Plan-Execute-Verify (Plan-Act-Reflect)** Ein Arbeitsmuster für Agenten: erst einen Plan fassen, ihn schrittweise ausführen und das Ergebnis prüfen, bevor es als fertig gilt. Warum es zählt: Der Prüf-Schritt ist der Unterschied zwischen einem Agenten, der zuverlässig liefert, und einem, der selbstbewusst Falsches abliefert. Ein Kernmuster verlässlicher Automatisierung. **ReAct (Reasoning and Acting)** Ein etabliertes Agentenmuster, das Überlegen und Handeln abwechselt: erst begründen, dann ein Werkzeug aufrufen, das Ergebnis einbeziehen, weiter überlegen. Warum es zählt: Der Großteil heutiger Agenten-Bauweisen geht auf dieses Muster zurück, weshalb es in Anbietergesprächen und Werkzeugdokumentation ständig auftaucht. Der praktische Wert für Sie liegt in der Nachvollziehbarkeit – jeder Schritt hinterlässt Begründung und Werkzeugaufruf im Protokoll. **Skills (Agent Skills, Fähigkeiten)** Gebündelte, bei Bedarf abrufbare Anleitungen und Werkzeuge, die einem Agenten eine bestimmte Fähigkeit verleihen – ohne den Kontext dauerhaft zu belasten. Warum es zählt: Skills erlauben es, einem Agenten viele Fähigkeiten zu geben und trotzdem das knappe Kontextfenster zu schonen: Wissen wird erst geladen, wenn es gebraucht wird. **Subagent (Sub-Agent, Worker-Agent)** Ein untergeordneter Agent, der eine abgegrenzte Teilaufgabe übernimmt, während ein übergeordneter Agent das Ganze steuert. Warum es zählt: Subagenten halten komplexe Aufgaben beherrschbar: Jeder bekommt einen klaren Auftrag und einen eigenen, sauberen Kontext. 2026 ein etablierter Standardbegriff im Agenten-Bau. **Tool Use (Werkzeugnutzung, Function Calling, Tool Calling)** Die Fähigkeit eines KI-Modells, externe Werkzeuge aufzurufen – etwa eine Suche, einen Taschenrechner oder eine Datenbankabfrage – statt nur Text zu erzeugen. Warum es zählt: Erst Tool Use macht aus einem Sprachmodell ein nützliches Arbeitstier: Es kann aktuelle Daten holen, rechnen, in Ihren Systemen nachschlagen. Ohne Werkzeuge bleibt KI auf ihr Trainingswissen beschränkt – mit Werkzeugen wird sie an Ihre Realität angeschlossen. ### Protokolle & Schnittstellen **A2A (Agent-to-Agent, Agent2Agent)** Ein offener Standard, über den eigenständige KI-Agenten miteinander reden und Aufgaben aneinander übergeben – auch über Anbieter- und Systemgrenzen hinweg. Warum es zählt: Sobald mehrere spezialisierte Agenten zusammenarbeiten sollen, braucht es eine gemeinsame Sprache. A2A verhindert, dass jede Agenten-Kombination einzeln verdrahtet werden muss – wichtig, wenn Sie Lösungen verschiedener Anbieter koppeln wollen. **Confused Deputy** Ein Sicherheitsmuster, bei dem ein berechtigtes System dazu gebracht wird, seine Rechte im Auftrag eines Unberechtigten zu nutzen. Warum es zählt: Genau das ist die Bauform des Risikos bei Agenten: Der Agent darf ins CRM, der Angreifer nicht – also bringt er den Agenten dazu, es für ihn zu tun. Deshalb greifen Schutzmaßnahmen an der Rechtevergabe und an Freigaben, nicht an besseren Anweisungen im Prompt. **Function / Tool Calling (Funktionsaufruf)** Der Mechanismus, mit dem ein Modell strukturiert ein Werkzeug anfordert, das die Anwendung dann ausführt – die ältere, engere Bezeichnung für Tool Use. Warum es zählt: Der Begriff begegnet Ihnen in vielen Anbieter-Dokumentationen. Für neue Arbeit ist „Tool Use" der Oberbegriff; „Function Calling" führen wir als Synonym, nicht als Leitbegriff. **MCP (Model Context Protocol)** Ein offener Standard, über den ein KI-Modell auf Werkzeuge und Datenquellen zugreift – wie ein USB-Anschluss zwischen Modell und Außenwelt. Warum es zählt: MCP entkoppelt Werkzeuge vom Modell: Ein einmal gebauter Anschluss (etwa zu Ihrem ERP oder Dateiablage) funktioniert mit jedem MCP-fähigen Modell. Das senkt die Bindung an einen Anbieter und macht eigene Integrationen wiederverwendbar. **MCP-Authentifizierung** Der Nachweis, in wessen Namen ein KI-Client auf einen MCP-Server und die dahinterliegenden Systeme zugreift. Warum es zählt: Frühe MCP-Installationen liefen mit einem Sammelzugang und damit mit den Rechten aller Nutzer gleichzeitig – für Firmendaten unhaltbar, weil jede Berechtigungsstruktur ausgehebelt wird. Anzustreben ist die Anbindung an Ihr bestehendes Anmeldeverfahren, sodass ein Agent nur sieht, was der jeweilige Mitarbeiter auch sehen dürfte. **MCP-Client (MCP Client)** Der Teil einer KI-Anwendung, der MCP-Server anspricht, ihre Werkzeuge entdeckt und für das Modell verfügbar macht. Warum es zählt: Der Client steckt meist im KI-Werkzeug selbst. Für Entscheider zählt vor allem: Unterstützt die eingesetzte Anwendung MCP, lassen sich vorhandene Server ohne Neubau anbinden. **MCP-Server (MCP Server)** Ein Programm, das nach dem MCP-Standard Werkzeuge oder Datenquellen bereitstellt, damit KI-Anwendungen sie nutzen können. Warum es zählt: Ein einmal gebauter MCP-Server (etwa für Ihr Dokumentenarchiv) ist mit jeder MCP-fähigen Anwendung wiederverwendbar – das macht Integrationen zur Investition statt zur Wegwerf-Anbindung. **Tool-Poisoning** Ein Angriff, bei dem die Beschreibung eines Werkzeugs versteckte Anweisungen enthält, die das Modell befolgt, ohne dass ein Nutzer sie je zu sehen bekommt. Warum es zählt: Werkzeugbeschreibungen landen unbesehen im Kontext des Modells und werden wie Anweisungen behandelt – ein aus einem öffentlichen Verzeichnis installierter MCP-Server ist damit ausführbarer Fremdcode mit Zugriff auf Ihre Daten. Fremde Server gehören deshalb geprüft, versionsfest eingebunden und nicht automatisch aktualisiert. **Transport (MCP-Transport)** Der Kommunikationsweg, über den MCP-Client und -Server Nachrichten austauschen – etwa lokal über die Standardschnittstelle oder über das Netz. Warum es zählt: Die Transport-Wahl entscheidet mit darüber, ob ein Werkzeug nur lokal oder auch über das Netz erreichbar ist – relevant für Architektur und Datenschutz. ### Daten & Wissen **Chunking (Textsegmentierung)** Das Zerlegen langer Dokumente in handliche Abschnitte, bevor sie für eine KI-Wissenssuche aufbereitet werden. Warum es zählt: Schlechtes Chunking ist eine der häufigsten Ursachen für schwache RAG-Ergebnisse: Sind die Abschnitte zu groß, zu klein oder unsauber geschnitten, findet das System die falschen Stellen. **Context Engineering (Kontext-Engineering)** Die gezielte Gestaltung dessen, was ein KI-Modell zur Laufzeit „sieht" – also welche Anweisungen, Daten, Werkzeuge und Erinnerungen in sein Arbeitsgedächtnis kommen. Warum es zählt: Context Engineering ist der Nachfolger des bloßen „Prompt-Schreibens" und der größte Hebel für verlässliche KI-Anwendungen. Wer steuert, welche Informationen das Modell im richtigen Moment erhält, bekommt bessere Ergebnisse als durch jeden Modellwechsel. **Context Rot** Der beobachtete Qualitätsverlust, wenn das Arbeitsgedächtnis eines Modells sehr voll wird – Angaben in der Mitte werden schlechter berücksichtigt. Warum es zählt: Ein größeres Kontextfenster ist deshalb kein Freibrief, alles hineinzuladen: Mehr Kontext kann Ergebnisse verschlechtern und kostet in jedem Fall mehr. Die praktische Konsequenz ist, gezielt wenige relevante Abschnitte zu übergeben statt ganzer Handbücher – genau die Aufgabe von Wissenssuche und Kontextgestaltung. **Datenqualität** Vollständigkeit, Aktualität und Einheitlichkeit der Daten, mit denen eine KI-Anwendung arbeiten soll. Warum es zählt: Die häufigste Ursache enttäuschender Ergebnisse ist nicht das Modell, sondern der Bestand: drei Schreibweisen desselben Kunden, veraltete Preislisten neben aktuellen, gescannte Dokumente ohne Texterkennung. Die gute Nachricht ist, dass Aufräumen auch ohne KI Nutzen bringt – es ist damit eines der wenigen Vorhaben, die sich unabhängig vom weiteren Weg rechnen. **Embedding (Vektoreinbettung)** Eine Methode, Texte in Zahlenreihen zu übersetzen, sodass eine KI ihre Bedeutung vergleichen kann – Ähnliches liegt nah beieinander. Warum es zählt: Embeddings sind die technische Grundlage von Bedeutungssuche, RAG und Vektordatenbanken. Ihre Qualität bestimmt mit, wie gut eine Wissenssuche trifft. **GraphRAG** Eine Variante der Wissenssuche, die neben den Texten auch die Beziehungen zwischen Personen, Produkten und Vorgängen abbildet. Warum es zählt: Klassisches RAG findet passende Textstellen, scheitert aber an Fragen, deren Antwort über mehrere Dokumente verteilt ist – etwa welche Kunden von einem Bauteil betroffen sind. Der Aufbau ist deutlich aufwendiger, weshalb es sich nur bei stark vernetzten Datenbeständen lohnt und nicht als Standardeinstieg taugt. **Ground Truth** Ein Satz geprüfter Fälle mit bekannt richtiger Antwort, an dem sich die Qualität einer KI-Anwendung messen lässt. Warum es zählt: Ohne diesen Referenzsatz bleibt jede Qualitätsaussage Gefühlssache, und Verbesserungen sind nicht von Zufall zu unterscheiden. Der Aufbau ist die unbeliebteste und zugleich lohnendste Stunde im Projekt: Wer 30 echte Fälle mit korrektem Ergebnis hinterlegt, kann jeden späteren Modell- oder Prompt-Wechsel in Minuten bewerten. **Grounding / Quellenbeleg** Die Rückbindung einer KI-Antwort an konkrete Fundstellen im Ausgangsmaterial – belegt statt behauptet. Warum es zählt: Für betriebliche Nutzung ist der Beleg oft wichtiger als die Antwort selbst, weil er die Prüfung in Sekunden statt Minuten erlaubt. Er ist zugleich die wirksamste Gegenmaßnahme gegen Halluzinationen: Was nicht belegt werden kann, wird als unbeantwortet ausgewiesen statt frei erfunden. **Hybride Suche** Die Kombination aus Stichwortsuche und Bedeutungssuche, deren Treffer zu einer gemeinsamen Rangfolge zusammengeführt werden. Warum es zählt: Reine Bedeutungssuche versagt genau dort, wo der Mittelstand sucht: bei Artikelnummern, Normbezeichnungen, Kundennummern und Eigennamen – Zeichenfolgen ohne Bedeutungsgehalt. Die Kombination beider Verfahren ist meist der wirksamste einzelne Qualitätssprung in einer Dokumentensuche und kostet weniger Aufwand als ein Modellwechsel. **Metadatenfilter** Die Einschränkung der Suche auf bestimmte Dokumentbereiche, Zeiträume oder Berechtigungsgruppen, bevor überhaupt nach Ähnlichkeit gesucht wird. Warum es zählt: Ohne Filter beantwortet eine Wissenssuche Fragen aus Dokumenten, die der Fragende gar nicht sehen dürfte – der häufigste Datenschutzfehler in RAG-Anwendungen. Filter sind zugleich der einfachste Qualitätshebel: Wer die Suche auf die gültige Version einer Richtlinie begrenzt, bekommt keine Antworten aus dem Stand von 2019. **Progressive Disclosure (schrittweise Offenlegung)** Das Prinzip, einem Modell Information erst dann nachzureichen, wenn es sie tatsächlich braucht – statt alles vorab in den Kontext zu laden. Warum es zählt: Progressive Disclosure hält das Kontextfenster schlank und damit Antworten schneller, günstiger und treffsicherer. Ein Kerngedanke modernen Context Engineering. **RAG (Retrieval-Augmented Generation, Retrieval Augmented Generation)** Ein Verfahren, bei dem ein KI-Modell Antworten aus Ihren eigenen Dokumenten zieht – statt nur aus seinem allgemeinen Trainingswissen. Warum es zählt: RAG ist der pragmatischste Weg, ein Modell auf Ihr Firmenwissen zu heben, ohne es teuer nachzutrainieren. Es liefert Antworten mit Quellenbezug und senkt das Risiko erfundener Aussagen – die Grundlage interner Assistenten und Wissenssuchen. **Reranking (Re-Ranking, Neugewichtung)** Ein zweiter Schritt in der KI-Suche, der die zunächst gefundenen Treffer noch einmal genauer nach Relevanz ordnet. Warum es zählt: Reranking hebt die Antwortqualität spürbar, weil dem Modell am Ende wirklich die passendsten Stellen vorliegen – oft der entscheidende Feinschliff eines RAG-Systems. **Vektordatenbank (Vector Database, Vektor-Datenbank)** Ein Speicher, der Dokumente nach ihrer Bedeutung ablegt und durchsuchbar macht – die Grundlage für KI-Wissenssuchen. Warum es zählt: Die Vektordatenbank ist die Infrastruktur hinter RAG und internen Assistenten. Sie ermöglicht eine Suche nach Sinn statt nur nach Stichworten. ### Automatisierung & Integration **API / Schnittstelle (Programmierschnittstelle)** Ein definierter Zugang, über den zwei Programme Daten austauschen – die technische Grundlage jeder Systemanbindung. Warum es zählt: Ob Ihr ERP, DMS oder Branchensystem eine brauchbare API hat, entscheidet häufiger über Machbarkeit und Aufwand eines Vorhabens als die Wahl des KI-Modells. Fehlt sie, bleiben nur teure Umwege: Datenbankzugriff, Dateiexporte oder Oberflächen-Bedienung. Diese Frage gehört deshalb an den Anfang jeder Potenzialbewertung, nicht ans Ende. **Dead Letter Queue** Ein Ablagefach für Vorgänge, die auch nach mehreren Versuchen nicht durchgelaufen sind – damit sie nicht verloren gehen, sondern sichtbar liegen bleiben. Warum es zählt: Die häufigste stille Fehlerquelle in Automatisierungen ist der Vorgang, der einfach verschwindet: keine Fehlermeldung, kein Ergebnis, niemand merkt es. Eine Fehlerablage plus Benachrichtigung macht aus einem unsichtbaren Datenverlust einen normalen Arbeitsvorrat, den jemand morgens durchsieht. **Deterministischer Workflow vs. Agent** Die Grundsatzentscheidung, ob ein Ablauf fest verdrahtet ist und immer gleich läuft – oder ob eine KI zur Laufzeit selbst entscheidet, was als Nächstes passiert. Warum es zählt: Das ist die folgenreichste Architekturentscheidung in fast jedem Projekt, und sie fällt oft unbewusst zugunsten des Agenten, weil der interessanter klingt. Ein fest verdrahteter Workflow ist prüfbar, reproduzierbar und billig; ein Agent ist flexibel, aber teurer, langsamer und in seinem Verhalten nur statistisch vorhersagbar. Faustregel: Wenn Sie die Schritte aufschreiben können, gehören sie in einen Workflow – die KI übernimmt dann nur die einzelnen Stellen, an denen wirklich Sprachverständnis nötig ist. **ETL / Datenpipeline (Extract, Transform, Load)** Der Weg, auf dem Daten aus Quellsystemen geholt, aufbereitet und an ihren Zielort gebracht werden – die Vorstufe fast jeder Auswertung. Warum es zählt: Viele KI-Vorhaben scheitern nicht am Modell, sondern daran, dass die nötigen Daten in vierzehn Excel-Ständen, einem Altsystem und drei Postfächern verteilt liegen. Der Aufbau einer verlässlichen Datenstrecke ist dann Schritt eins und liefert auch ohne KI schon Nutzen – was ihn zu einem der wenigen risikoarmen Anfangsprojekte macht. **Idempotenz** Die Eigenschaft eines Arbeitsschritts, bei mehrfacher Ausführung dasselbe Ergebnis zu liefern wie bei einmaliger – entscheidend, sobald etwas wiederholt wird. Warum es zählt: Automatisierungen brechen mitten im Ablauf ab und werden neu gestartet, das ist Normalbetrieb und kein Ausnahmefall. Ist ein Schritt nicht idempotent, entstehen dabei doppelte Rechnungen, doppelte CRM-Einträge oder zweimal versendete Kundenmails. Praktisch löst man das über einen eindeutigen Vorgangsschlüssel, gegen den vor jeder schreibenden Aktion geprüft wird – der Aufwand ist gering, das Fehlen fällt erst im Live-Betrieb auf. **iPaaS (Integration Platform as a Service)** Eine Plattform, auf der Sie Verbindungen zwischen Cloud-Diensten und internen Systemen zusammenklicken, statt sie zu programmieren. Warum es zählt: iPaaS-Werkzeuge senken die Einstiegshürde erheblich, verschieben die Kosten aber in den Betrieb: Abgerechnet wird meist pro Ausführung, und wer viele Läufe hat, zahlt schnell mehr als für einen eigenen Server. Zweiter Punkt für datensensible Prozesse: Die meisten Anbieter bieten kein Self-Hosting an, Ihre Daten laufen also zwangsläufig über deren Infrastruktur. **Retry / Backoff** Das automatische Wiederholen eines fehlgeschlagenen Schritts, mit wachsendem Abstand zwischen den Versuchen. Warum es zählt: Schnittstellen sind zeitweise nicht erreichbar oder drosseln Anfragen – ohne Wiederholungslogik scheitert der ganze Ablauf an einer Störung von zehn Sekunden. Ohne wachsende Wartezeit wiederum verschärfen die Wiederholungen das Problem und können ein angeschlagenes System vollends überlasten. Wichtig ist die Unterscheidung: Ein Zeitüberschreitungsfehler gehört wiederholt, ein Validierungsfehler nie. **RPA (Robotic Process Automation)** Software-Roboter, die Programme über die Benutzeroberfläche bedienen – klicken und tippen wie ein Mensch, aber nach starrem Skript. Warum es zählt: RPA wird regelmäßig mit KI-Automatisierung verwechselt, funktioniert aber grundlegend anders: Es folgt festen Klickpfaden und bricht, sobald sich eine Maske ändert. Sinnvoll bleibt es nur dort, wo ein Altsystem keine Schnittstelle hat. Wo eine API existiert, ist der direkte Weg fast immer stabiler und billiger – und wo echtes Verständnis von Inhalten nötig ist, führt an einem Modell kein Weg vorbei. **Systemanbindung (ERP, DMS, CRM)** Die Kopplung einer KI- oder Automatisierungslösung an Ihre führenden Systeme – dort, wo die Daten tatsächlich liegen und gepflegt werden. Warum es zählt: Erst mit der Anbindung wird aus einem Assistenten ein Prozess: Ein Chat-Fenster spart Minuten, eine automatisch verbuchte Rechnung spart Stellenanteile. Der Aufwand steckt selten in der KI, sondern in Berechtigungen, Datenmodell und Testumgebung des Zielsystems – deshalb gehört diese Frage in die Bewertung eines Anwendungsfalls, nicht in die Umsetzungsphase. **Webhook** Ein automatischer Anruf eines Systems bei einem anderen, sobald ein bestimmtes Ereignis eintritt – die übliche Startpistole für Automatisierungen. Warum es zählt: Webhooks ersetzen das regelmäßige Nachfragen („Gibt's was Neues?") durch aktives Benachrichtigen und machen Abläufe damit sofort reaktionsfähig statt minutenverzögert. Sie sind aber offene Türen ins eigene Netz: Ohne Signaturprüfung und Zugriffsbeschränkung kann sie jeder auslösen, der die Adresse kennt. **Workflow-Automatisierung** Software, die wiederkehrende Abläufe zwischen Ihren Systemen selbstständig ausführt – ausgelöst durch ein Ereignis, abgearbeitet nach festen Regeln. Warum es zählt: Der größte Teil dessen, was im Mittelstand als „KI-Projekt" startet, ist bei genauer Betrachtung ein Automatisierungsprojekt mit einem KI-Baustein an ein bis zwei Stellen. Werkzeuge wie n8n, Make oder Zapier verbinden E-Mail, ERP, CRM und Dateiablage, ohne dass für jede Verbindung eigene Software entwickelt werden muss. Wer das trennt, spart Geld: Der Automatisierungsteil ist erprobte Technik, nur der KI-Teil braucht Absicherung und Messung. **Workflow-Sprawl** Der Wildwuchs schnell gebauter Automatisierungen, die niemand mehr vollständig überblickt, dokumentiert oder abschaltet. Warum es zählt: Genau das macht Automatisierung im zweiten Jahr teuer: fünfzig Abläufe, von denen die Hälfte niemand mehr zuordnen kann, mit Zugangsdaten ehemaliger Mitarbeiter und stillschweigenden Abhängigkeiten untereinander. Gegenmittel sind unspektakulär und wirken sofort: Namenskonventionen, ein Verantwortlicher je Ablauf, Versionierung in Git und ein fester Termin zum Aufräumen. ### Betrieb & Governance **Audit-Log (Prüfprotokoll, Audit Trail)** Ein lückenloses Protokoll der Aktionen einer KI-Anwendung – wer, was, wann, mit welchen Daten. Warum es zählt: Für regulierte Branchen und den Datenschutz ist ein Audit-Log oft Pflicht. Es macht im Streitfall belegbar, was das System getan hat – und was nicht. **Circuit Breaker (Notabschaltung, Sicherung)** Ein Schutzmechanismus, der eine KI-Anwendung automatisch stoppt, wenn etwas aus dem Ruder läuft – etwa zu viele Fehler oder zu hohe Kosten. Warum es zählt: Ein Circuit Breaker begrenzt den Schaden, wenn ein Agent in eine Schleife gerät oder Kosten explodieren. Eine einfache, aber wirksame Betriebssicherung. **Cost Control (Kostenkontrolle, Kostensteuerung)** Maßnahmen, die die laufenden Kosten einer KI-Anwendung im Blick und im Rahmen halten – Limits, Modellwahl, Caching. Warum es zählt: Bei Cloud-Modellen summieren sich Token-Kosten schnell. Aktive Kostenkontrolle entscheidet darüber, ob ein Use-Case wirtschaftlich bleibt. **Datenexfiltration** Der ungewollte Abfluss vertraulicher Daten aus einer KI-Anwendung – etwa über manipulierte Inhalte, die das System zur Weitergabe verleiten. Warum es zählt: Das ist die konkrete Schadensform hinter Prompt Injection: Ein Agent mit Postfach- und Internetzugriff kann durch eine präparierte E-Mail dazu gebracht werden, Inhalte an eine fremde Adresse zu senden. Wirksam dagegen ist weniger ein besseres Modell als eine engere Architektur – Trennung von Lese- und Schreibrechten, Freigaben bei Ausleitungen nach außen, Protokollierung jeder Werkzeugnutzung. **Evaluation / Eval (Eval, Bewertung)** Das systematische Messen, wie gut eine KI-Anwendung ihre Aufgabe erfüllt – mit definierten Testfällen statt nach Bauchgefühl. Warum es zählt: Ohne Evals weiß niemand, ob eine Änderung das System besser oder schlechter gemacht hat. Sie sind die Voraussetzung, KI-Qualität überhaupt zu steuern. **Fallback-Modell** Ein hinterlegtes Ersatzmodell, auf das eine Anwendung automatisch umschaltet, wenn das primäre nicht erreichbar ist. Warum es zählt: Anbieterausfälle von mehreren Stunden sind keine Seltenheit, und Ihre Automatisierung steht in der Zeit still. Ein Fallback ist technisch schnell eingerichtet, wenn die Anwendung über eine einheitliche Schnittstelle spricht – er muss aber vorher einmal getestet worden sein, sonst tauscht man den Ausfall gegen falsche Ergebnisse. **Guardrails (Leitplanken)** Technische Leitplanken, die festlegen, was eine KI darf und was nicht – etwa welche Themen, Daten oder Aktionen ausgeschlossen sind. Warum es zählt: Guardrails verwandeln „die KI soll sich benehmen" in durchgesetzte Regeln. Für den produktiven Einsatz sind sie die Voraussetzung, Risiken kontrollierbar zu halten. **Kill Switch** Ein bewusst einfach gehaltener Weg, eine KI-Automatisierung sofort und vollständig anzuhalten. Warum es zählt: Bei einem Fehlverhalten zählt, wie schnell jemand ohne Spezialwissen abschalten kann – nicht, wie elegant die Architektur ist. Ein Schalter, den auch die Geschäftsführung am Wochenende bedienen kann, ist zugleich das überzeugendste Argument in Freigabediskussionen und ein sinnvoller Baustein der menschlichen Aufsicht nach AI Act. **Least Privilege für Agenten** Das Prinzip, einem KI-Agenten nur die Rechte zu geben, die er für seine konkrete Aufgabe braucht – und keine darüber hinaus. Warum es zählt: Der bequeme Weg ist ein Sammelkonto mit Vollzugriff, und genau das macht aus einem Fehlverhalten oder einer eingeschleusten Anweisung einen Schaden. Praktisch heißt es: eigener Nutzer je Agent, Schreibrechte nur auf die tatsächlich benötigten Objekte, unumkehrbare Aktionen grundsätzlich mit menschlicher Freigabe. **LLMOps (LLM Operations)** Die Betriebsdisziplin rund um KI-Anwendungen – Versionierung von Prompts, Messung der Qualität, Kostenüberwachung und kontrollierte Modellwechsel. Warum es zählt: Eine KI-Anwendung ist nach dem Livegang nicht fertig, sondern fängt an zu driften: Modelle ändern sich, Daten ändern sich, Nutzer stellen andere Fragen als gedacht. Ohne Versionsstand, Testfälle und Auswertung ist jede Änderung ein Blindflug. Für kleine Installationen reicht dafür wenig – Prompts in Git, ein Satz Testfälle, ein Kostenbericht pro Monat. **Logits-Masking / dynamische Tool-Provisionierung (Constrained Decoding, dynamische Werkzeugfreigabe)** Techniken, die einem Modell zur Laufzeit nur die jeweils erlaubten Antworten oder Werkzeuge zugänglich machen – statt auf nachträgliche Kontrolle zu setzen. Warum es zählt: Wer unerwünschte Aktionen gar nicht erst zulässt, braucht weniger nachgelagerte Prüfung. Ein fortgeschrittener, aber wirkungsvoller Baustein sicherer Agenten. **Modellkarte** Die Anbieterdokumentation zu einem Modell – Fähigkeiten, Grenzen, Trainingsdatenherkunft, empfohlene und ausgeschlossene Einsatzzwecke. Warum es zählt: Seit den GPAI-Pflichten sind solche Unterlagen für die großen Modelle verfügbar und damit als Beschaffungsgrundlage nutzbar. Für Ihre eigene Dokumentation sind sie die Quelle, aus der sich Angaben zur Eignung eines Systems belegen lassen, statt sie behaupten zu müssen. **Observability / Tracing (Nachvollziehbarkeit, Tracing)** Die Fähigkeit, nachzuvollziehen, was eine KI-Anwendung intern getan hat – welche Schritte, welche Werkzeuge, welche Daten zu einem Ergebnis führten. Warum es zählt: Ohne Beobachtbarkeit lässt sich ein KI-System weder verbessern noch im Fehlerfall erklären. Sie ist die Grundlage für Qualität, Kostenkontrolle und Audits. **Prompt Injection (Indirekte Prompt Injection)** Angriffe, bei denen manipulierte Inhalte – etwa in einer E-Mail oder auf einer Webseite – einem KI-System versteckte Anweisungen unterschieben. Warum es zählt: Sobald Agenten fremde Inhalte lesen und Werkzeuge nutzen dürfen, ist Prompt Injection das zentrale Sicherheitsthema. Gegenmittel sind begrenzte Rechte, Freigaben an heiklen Stellen und Guardrails. **Rate Limit** Die Begrenzung, wie viele Anfragen Sie in einem Zeitraum an eine Schnittstelle stellen dürfen. Warum es zählt: Ratenbegrenzungen sind der häufigste Grund, warum eine Automatisierung im Testbetrieb läuft und beim ersten größeren Stapel abbricht. Wer Massenverarbeitung plant, muss Warteschlange, Wiederholungslogik und gestaffelte Wartezeiten von vornherein einbauen – oder auf Bündelverarbeitung ausweichen. **Red Teaming** Der gezielte Versuch, die eigene KI-Anwendung zu Fehlverhalten zu bringen, bevor es jemand anderes tut. Warum es zählt: Funktionstests prüfen, ob die Anwendung tut, was sie soll – Red Teaming prüft, ob sie sich zu etwas anderem überreden lässt: interne Informationen preisgeben, unzulässige Zusagen machen, Werkzeuge missbräuchlich aufrufen. Für kundenzugewandte Anwendungen ist ein dokumentierter Durchgang vor dem Livegang inzwischen Mindeststandard. **Regressionstest bei Modellwechsel** Ein fester Satz Testfälle, der vor jedem Modell- oder Prompt-Wechsel durchläuft und zeigt, ob sich das Verhalten verschlechtert hat. Warum es zählt: Ohne diesen Schritt ist jeder Wechsel ein Risiko, das erst beim Kunden sichtbar wird. Der Aufwand ist niedriger als erwartet: 20 bis 50 echte Fälle mit erwarteter Antwort reichen für die meisten betrieblichen Anwendungen und lassen sich automatisch durchrechnen. Das ist zugleich die einzige belastbare Antwort auf die Frage „Können wir auf das neue Modell wechseln?". **Schatten-KI (Shadow AI)** KI-Nutzung im Unternehmen ohne Wissen oder Freigabe der IT – etwa wenn Mitarbeiter Kundendaten in private ChatGPT-Konten kopieren. Warum es zählt: Schatten-KI ist eines der realsten Datenschutz-Risiken im Mittelstand: Sie entsteht überall dort, wo es keine freigegebene Alternative gibt. Die Antwort ist keine Verbotskultur, sondern eine kontrollierte, sichere KI-Arbeitsumgebung im eigenen Haus. **Secrets Management** Die geordnete Verwaltung von Zugangsdaten und Schlüsseln – getrennt vom Programmcode, mit klarer Zuständigkeit und Möglichkeit zum Austausch. Warum es zählt: In schnell gebauten Automatisierungen landen API-Schlüssel im Klartext in Workflows, Notizen oder Chatverläufen. Spätestens wenn jemand das Unternehmen verlässt oder ein Schlüssel öffentlich wird, fehlt der Überblick, was wo hinterlegt ist. Ein zentraler Speicher mit dokumentierter Rotation ist keine Kür, sondern die Voraussetzung dafür, dass Zugänge überhaupt entziehbar sind. ### Datenschutz & Recht **AVV (Auftragsverarbeitungsvertrag, Auftragsverarbeitungs-Vereinbarung)** Ein Vertrag nach Art. 28 DSGVO, der regelt, wie ein Dienstleister mit Ihren personenbezogenen Daten umgehen darf. Warum es zählt: Sobald ein Cloud-KI-Dienst personenbezogene Daten in Ihrem Auftrag verarbeitet, ist eine AVV Pflicht. Bei lokalem Betrieb ohne Datenabfluss entfällt dieser Punkt weitgehend. **Betreiber vs. Anbieter** Die Rollenunterscheidung des EU AI Act: Anbieter entwickeln und bringen KI-Systeme auf den Markt, Betreiber setzen sie im eigenen Betrieb ein – mit deutlich unterschiedlichen Pflichten. Warum es zählt: Der weitaus größte Teil des Mittelstands ist Betreiber, nicht Anbieter, und trägt damit ein spürbar schlankeres Pflichtenpaket: KI-Kompetenz der Beschäftigten, Einhaltung der Verbote, Transparenz gegenüber betroffenen Menschen. Die Rolle kann allerdings kippen – wer ein System unter eigenem Namen anbietet, wesentlich verändert oder zweckentfremdet, wird selbst zum Anbieter. Vor jeder Compliance-Diskussion sollte deshalb die Rollenfrage geklärt sein, sonst diskutiert man Pflichten, die einen nicht treffen. **C2PA / Wasserzeichen** Technische Verfahren, die maschinenlesbar in einer Datei vermerken, dass und womit ein Inhalt KI-generiert wurde. Warum es zählt: Die EU-Kommission empfiehlt C2PA-Metadaten als Standard, räumt aber ein, dass Wasserzeichen die Qualität beeinträchtigen und beim Hochladen auf Drittplattformen verloren gehen können. Die entsprechende Anbieterpflicht wurde auf den 2. Dezember 2026 verschoben – die Kennzeichnungspflicht für Sie als Nutzer nach Art. 50 gilt davon unabhängig ab August 2026. **Digital Omnibus (KI-Omnibus)** Das EU-Änderungspaket vom Juli 2026, das Teile des AI Act entschärft und mehrere Fristen nach hinten verschiebt. Warum es zählt: Der Omnibus ist der Grund, warum in Umlauf befindliche Compliance-Fahrpläne veraltet sind – verschoben wurden vor allem die Hochrisiko-Pflichten und die Wasserzeichen-Pflicht, nicht aber der Stichtag 2. August 2026 für Transparenz und Sanktionen. Praktische Lesart für Betreiber: Der Termin, der Sie betrifft, ist geblieben; verschoben wurde, was Sie ohnehin erst später betroffen hätte. **Drittlandtransfer (Drittstaatentransfer, US-Drittland)** Die Übermittlung personenbezogener Daten in ein Land außerhalb der EU – etwa an einen US-Cloud-Dienst – mit besonderen Schutzanforderungen. Warum es zählt: Viele populäre KI-Dienste verarbeiten Daten in den USA. Genau hier entstehen die meisten DSGVO-Risiken – wer sie vermeiden will, setzt auf EU-Hosting oder lokalen Betrieb. **DSFA (Datenschutz-Folgenabschätzung, DPIA)** Eine vorab durchgeführte Risikoprüfung, wenn eine Datenverarbeitung voraussichtlich hohe Risiken für Betroffene birgt. Warum es zählt: Bei KI-Projekten mit personenbezogenen Daten kann eine DSFA gesetzlich nötig sein. Ob, klärt man früh in der Planung – nachträglich wird es teuer. **DSGVO im KI-Kontext (Datenschutz bei KI, GDPR)** Die EU-Datenschutz-Grundverordnung gilt auch beim KI-Einsatz – entscheidend ist nicht das Tool an sich, sondern welche personenbezogenen Daten wohin fließen. Warum es zählt: Die häufigste Frage im Mittelstand – „Welche KI ist DSGVO-konform?" – ist fast falsch gestellt. Konformität ist keine Eigenschaft eines Werkzeugs, sondern eine Frage der Datenverarbeitung. Wer das versteht, trifft schnellere und sichere Entscheidungen. **EU AI Act (KI-Verordnung, EU-KI-Verordnung, AI Act)** Die EU-Verordnung, die KI-Anwendungen nach ihrem Risiko einstuft und daran abgestufte Pflichten knüpft – von harmlos bis verboten. Warum es zählt: Der AI Act gilt zusätzlich zur DSGVO und betrifft auch Anwender, nicht nur Hersteller. Die Pflichten greifen gestaffelt: Seit Februar 2025 gelten Verbote und die KI-Kompetenz-Pflicht, ab August 2026 weitere Stufen wie Transparenzpflichten; Teile des Zeitplans – etwa für Hochrisiko-Anwendungen – wurden 2026 noch einmal verschoben. Umso wichtiger: früh klären, in welche Risikoklasse ein Use-Case fällt. **EU-Hosting (EU-Cloud, Serverstandort EU)** Der Betrieb eines KI-Modells in einem Rechenzentrum innerhalb der EU – ein Mittelweg zwischen voller US-Cloud und eigenem On-Premise-Betrieb. Warum es zählt: EU-Hosting vermeidet den heiklen Drittlandtransfer, ohne dass Sie eigene Hardware betreiben müssen. Auf die genaue Vertrags- und Betreiberkonstellation kommt es aber an. **GPAI (General Purpose AI, KI mit allgemeinem Verwendungszweck)** KI-Modelle mit allgemeinem Verwendungszweck – die großen Sprachmodelle, die nicht für eine einzelne Aufgabe gebaut sind, sondern als Basis für vieles dienen. Warum es zählt: Die zugehörigen Pflichten treffen die Modellanbieter, nicht Sie als Nutzer – aber sie sind der Grund, warum Anbieter zunehmend Modellkarten, Trainingsdaten-Zusammenfassungen und Nutzungsbedingungen veröffentlichen. Diese Unterlagen sind für Sie das Beschaffungsmaterial: Wer ein Modell auswählt, kann sich seit 2025 auf dokumentierte Angaben stützen statt auf Marketingaussagen. **Hochrisiko-KI-System** KI-Anwendungen in besonders sensiblen Bereichen – etwa Personalauswahl, Kreditvergabe oder Sicherheitsbauteile in Produkten –, für die der AI Act die strengsten Anforderungen vorsieht. Warum es zählt: Für den Mittelstand ist vor allem der Personalbereich relevant: Bewerbervorauswahl und Leistungsbewertung fallen in diese Kategorie, auch wenn sie mit einem gewöhnlichen Cloud-Tool umgesetzt sind. Die zugehörigen Pflichten wurden im Juli 2026 zeitlich gestreckt – auf Dezember 2027 für eigenständige Systeme nach Anhang III und auf 2028 für KI, die in regulierte Produkte eingebettet ist. Aufgeschoben heißt nicht aufgehoben: Wer heute ein solches System einführt, sollte die Anforderungen bereits einplanen statt später nachzurüsten. **KI-Kompetenz (Art. 4 EU AI Act) (AI Literacy, KI-Kompetenz-Pflicht)** Die Pflicht aus dem EU AI Act, dass Unternehmen, die KI-Systeme einsetzen, die KI-Kompetenz der beteiligten Mitarbeiter durch geeignete Maßnahmen fördern – sie gilt seit Februar 2025. Warum es zählt: Die Pflicht betrifft praktisch jedes Unternehmen, das KI einsetzt – Schulung ist damit keine Kür mehr. Verlangt werden geeignete Maßnahmen, kein formaler Nachweis; was für Ihr Team angemessen ist, sollte früh geklärt und dokumentiert werden. **KI-Reallabor (Sandbox)** Ein behördlich begleiteter Testrahmen, in dem KI-Anwendungen unter aufsichtlicher Aufsicht erprobt werden können, bevor sie regulär in den Markt gehen. Warum es zählt: Für kleine und mittlere Unternehmen sieht der AI Act hier ausdrücklich vorrangigen und vergünstigten Zugang vor – zusammen mit vereinfachten Dokumentationsanforderungen ist das eine der wenigen echten KMU-Erleichterungen im Regelwerk. Relevant vor allem, wenn Sie selbst ein KI-gestütztes Produkt anbieten wollen und damit in die Anbieterrolle rutschen. **Lokales LLM / On-Premise (On-Premise-KI, Self-Hosted LLM, lokales Sprachmodell)** Ein KI-Modell, das auf Ihrer eigenen Hardware oder im eigenen Rechenzentrum läuft, statt bei einem Cloud-Anbieter – die Daten verlassen das Haus nicht. Warum es zählt: Für sensible Daten ist der lokale Betrieb oft der direkteste Weg zur Datenschutz-Sicherheit: kein Drittlandtransfer, kein Datenabfluss, volle Kontrolle. Der Preis dafür sind eigene Hardware und Wartung – eine Abwägung, die sich ab einem gewissen Volumen rechnet. **Marktüberwachung** Die nationale Behördenstruktur, die die Einhaltung des AI Act kontrolliert und Verstöße ahndet. Warum es zählt: Ab dem 2. August 2026 sind Verstöße auch durchsetzbar, nicht mehr nur regelwidrig – Zuständigkeit und Meldewege liegen in Deutschland bei den national benannten Stellen. Für Betreiber praktisch bedeutsam ist die Meldepflicht bei schwerwiegenden Vorfällen und die Pflicht, Protokolle bereithalten zu können. **Mitbestimmung (§ 87 BetrVG)** Das Mitbestimmungsrecht des Betriebsrats bei technischen Einrichtungen, die geeignet sind, Verhalten oder Leistung von Beschäftigten zu überwachen. Warum es zählt: „Geeignet zur Überwachung" reicht aus – eine tatsächliche Absicht ist nicht nötig, weshalb bereits ein KI-Assistent mit Nutzungsprotokoll unter die Mitbestimmung fallen kann. Das ist in der Praxis eine der häufigsten Projektbremsen und lässt sich nur durch frühe Einbindung entschärfen, nicht durch nachträgliche Argumentation. Eine Rahmenbetriebsvereinbarung zu KI-Werkzeugen ist der übliche und schnellere Weg gegenüber Einzelfreigaben. **Rechte am KI-Output** Die Frage, wem KI-erzeugte Texte, Bilder oder Code gehören – und ob daran überhaupt ein Urheberrecht entstehen kann. Warum es zählt: Rein maschinell erzeugte Inhalte sind mangels menschlicher Schöpfung in der Regel nicht urheberrechtlich geschützt, Sie können Dritten die Nutzung also nicht ohne Weiteres untersagen. Praktisch relevanter ist die Gegenrichtung: die Frage, ob ein Output fremde Rechte verletzt, und ob die Nutzungsbedingungen Ihres Anbieters die kommerzielle Verwendung überhaupt erlauben. Für Marketing- und Produktinhalte gehört das vor die erste Kampagne geklärt. **Sanktionen (AI Act)** Die Bußgeldstufen des EU AI Act – gestaffelt nach Art des Verstoßes und bemessen am weltweiten Jahresumsatz. Warum es zählt: Die kursierende Zahl von 35 Millionen Euro (oder 7 % des Jahresumsatzes) gilt ausschließlich für verbotene Praktiken; für Verstöße gegen die meisten übrigen Pflichten, einschließlich der Transparenzpflicht, liegt der Rahmen bei bis zu 15 Millionen Euro oder 3 Prozent des Umsatzes, bei fehlerhaften Angaben gegenüber Behörden bei bis zu 7,5 Millionen Euro oder 1 Prozent. Für KMU gilt jeweils der niedrigere der beiden Werte. Durchgesetzt wird ab dem 2. August 2026 durch die nationalen Aufsichtsbehörden. **SCC (Standardvertragsklauseln, Standard Contractual Clauses)** Von der EU-Kommission vorgegebene Vertragsklauseln, die einen Datentransfer in ein Drittland (etwa die USA) absichern sollen. Warum es zählt: SCC sind ein zentrales Werkzeug, wenn Daten die EU verlassen. Sie allein genügen oft nicht – meist braucht es zusätzlich eine Transfer-Folgenabschätzung. **TDM-Opt-out (Text and Data Mining Opt-out)** Der Widerspruch eines Rechteinhabers gegen die Nutzung seiner Inhalte für Text- und Data-Mining, also für KI-Training. Warum es zählt: Für Sie greift das an zwei Stellen: Wenn Sie eigene Inhalte davor schützen wollen, in Modelle einzufließen, brauchen Sie einen maschinenlesbaren Vorbehalt auf Ihrer Webseite. Und wenn Sie selbst Daten sammeln oder Webseiten auslesen, ist die Prüfung solcher Vorbehalte Voraussetzung dafür, dass die Nutzung zulässig bleibt. **TIA (Transfer Impact Assessment, Transfer-Folgenabschätzung)** Eine Prüfung, ob die Daten in einem Drittland trotz Standardvertragsklauseln tatsächlich angemessen geschützt sind. Warum es zählt: Die TIA ist der Schritt, der oft vergessen wird: Sie verlangt eine ehrliche Einschätzung der Rechtslage im Zielland – und kann ergeben, dass ein Transfer eben nicht zulässig ist. **Trainingsdaten-Opt-out** Die vertragliche oder technische Zusicherung eines Anbieters, Ihre Eingaben nicht zum Training seiner Modelle zu verwenden. Warum es zählt: Dieses eine Kriterium trennt die für Firmendaten brauchbaren Tarife von den unbrauchbaren – bei denselben Anbietern und oft demselben Modell. Kostenlose und Consumer-Tarife trainieren häufig mit, Geschäfts- und API-Tarife in der Regel nicht. Ohne diese Zusage ist jede Eingabe faktisch eine Offenlegung, unabhängig davon, wie gut die Verschlüsselung ist. **Transparenzpflicht (Art. 50 EU AI Act)** Die Pflicht, Menschen erkennbar zu machen, dass sie mit einer KI sprechen oder KI-erzeugte Inhalte vor sich haben – anwendbar ab dem 2. August 2026. Warum es zählt: Das ist die erste Regel des AI Act, die praktisch jedes Unternehmen mit Chatbot, automatisierter Mailbeantwortung oder KI-gestützten Inhalten unmittelbar betrifft. Betroffen ist die tägliche Produkt- und Content-Praxis, nicht nur ein Dokument im Ordner: Hinweis im Chat, Kennzeichnung generierter Texte und Bilder, Offenlegung bei Deepfakes. Der Fehler, den man vermeiden sollte, ist die Behandlung als reine Oberflächenfrage – die Kennzeichnung setzt voraus, dass Sie Ihre Systeme überhaupt erst eingestuft und dokumentiert haben. **Verbotene Praktiken (Art. 5 EU AI Act)** KI-Anwendungen, die in der EU generell untersagt sind – darunter Emotionserkennung am Arbeitsplatz und Bewertungssysteme über soziales Verhalten. Warum es zählt: Die Verbote gelten bereits seit Februar 2025 und treffen Ideen, die im Personalbereich durchaus aufkommen: Stimmungsanalyse von Mitarbeitern, Verhaltens-Scoring, biometrische Auswertung im Betrieb. Hier liegt zugleich der höchste Bußgeldrahmen des gesamten Regelwerks. Eine kurze Prüfung gegen diese Liste gehört an den Anfang jeder Anwendungsfall-Bewertung, nicht ans Ende. **Zero Data Retention** Eine Betriebsweise, bei der ein Anbieter Ihre Anfragen und Antworten nach der Verarbeitung nicht speichert. Warum es zählt: Standardmäßig halten die meisten Anbieter Eingaben für einige Tage oder Wochen zur Missbrauchsprüfung vor – für personenbezogene oder vertrauliche Inhalte ist das der entscheidende Unterschied. Der Verzicht muss meist gesondert beantragt oder gebucht werden und schließt Komfortfunktionen wie serverseitige Verläufe aus. In der DSFA ist er ein wirksames Argument, ersetzt aber weder AVV noch Prüfung des Drittlandtransfers. ### Praxis & Markt **Abstraktionsschicht / Modell-Router** Eine Zwischenebene zwischen Ihrer Anwendung und den KI-Anbietern, die Anfragen vereinheitlicht und je nach Aufgabe an das passende Modell weiterleitet. Warum es zählt: Sie erkauft sich damit drei Dinge auf einmal: Austauschbarkeit der Anbieter, zentrale Messung von Kosten und Fehlern, und die Möglichkeit, einfache Aufgaben günstig und schwierige teuer zu bearbeiten. Der Preis ist eine zusätzliche Komponente, die selbst betrieben werden will – für Einzelanwendungen überzogen, ab dem dritten produktiven Anwendungsfall meist eine Ersparnis. **Agent-Washing** Die Vermarktung gewöhnlicher Automatisierung oder einfacher Chatbots als „KI-Agent", ohne dass eigenständige Planung oder Werkzeugnutzung dahintersteckt. Warum es zählt: Der Begriff ist 2025/26 so weit ausgefranst, dass er in Anbietergesprächen keine Information mehr trägt. Nützliche Rückfragen: Welche Werkzeuge darf das System aufrufen? Entscheidet es die Reihenfolge selbst? Was passiert, wenn ein Schritt fehlschlägt? Wer darauf keine konkrete Antwort bekommt, kauft einen Workflow zum Agentenpreis. **Batch-Verarbeitung** Die gebündelte Abarbeitung vieler Anfragen ohne Zeitdruck – von den meisten Anbietern deutlich günstiger abgerechnet als Einzelanfragen. Warum es zählt: Ein großer Teil betrieblicher Anwendungsfälle ist gar nicht zeitkritisch: Dokumente klassifizieren, Stammdaten anreichern, Rückläufer auswerten. Wer das nachts im Bündel laufen lässt statt einzeln in Echtzeit, halbiert bei manchen Anbietern die Kosten für dieselbe Arbeit. **Build vs. Buy** Die Abwägung zwischen einer zugekauften Standardlösung und einer selbst gebauten, auf den eigenen Prozess zugeschnittenen Anwendung. Warum es zählt: Die Antwort hängt weniger an den Entwicklungskosten als daran, ob der Prozess ein Wettbewerbsvorteil oder Beiwerk ist: Standardaufgaben kauft man, Kernprozesse baut man. Zweites Kriterium ist die Schnittstellenlage – eine Branchenlösung ohne API kann teurer werden als eine schlanke Eigenentwicklung, weil jede Integration zum Sonderfall wird. **Cost per Task** Die Kosten je erledigtem Vorgang statt je verarbeitetem Token – die einzige Kennzahl, die Preisänderungen und Modellwechsel übersteht. Warum es zählt: Tokenpreise sind für Entscheidungen wertlos, weil sich der Verbrauch je Vorgang stark unterscheidet: Ein Agent macht für dieselbe Aufgabe ein Vielfaches der Modellaufrufe eines einfachen Assistenten. Erst „was kostet eine bearbeitete Rechnung" ist mit „was kostet sie heute manuell" vergleichbar – und damit die Grundlage jeder Wirtschaftlichkeitsrechnung. **Dokumenten-KI (IDP, Intelligent Document Processing)** KI-gestützte Verarbeitung von Geschäftsdokumenten: Rechnungen, Lieferscheine und Formulare werden erkannt, ausgelesen und strukturiert an Ihre Systeme übergeben. Warum es zählt: Dokumenten-KI ist einer der häufigsten und am schnellsten rechenbaren KI-Use-Cases im Mittelstand: Der manuelle Aufwand ist bekannt, die Ersparnis direkt messbar – und heikle Fälle bleiben per Freigabe beim Menschen. **Exit-Strategie** Der vorab durchdachte Weg aus einem Werkzeug oder Anbieter heraus – inklusive Datenexport, Ersatzoption und realistischer Aufwandsschätzung. Warum es zählt: Anbieter können Modelle abkündigen, Preise anheben oder – wie 2026 mehrfach zu beobachten – durch regulatorische Eingriffe kurzfristig nicht verfügbar sein. Eine Exit-Strategie ist deshalb kein Misstrauensvotum, sondern Betriebsvorsorge: Welches Ersatzmodell ist geprüft, wo liegen die Prompts versioniert, wie kommen Daten und Konfiguration heraus. Der Aufwand dafür ist am Anfang klein und wächst mit jeder Woche Nutzung. **Fine-Tuning (Nachtraining, Feinabstimmung)** Ein bestehendes Modell mit eigenen Beispieldaten nachschärfen, damit es zu einem speziellen Anwendungsfall besser passt. Warum es zählt: Fine-Tuning klingt verlockend, ist aber für viele Unternehmensfälle gar nicht nötig – oft reicht es, dem Modell zur Laufzeit die richtigen Daten mitzugeben (RAG). Erst prüfen, dann investieren. **Inferenz (Inference)** Die eigentliche Nutzung eines fertig trainierten Modells – der Moment, in dem es auf Ihre Eingabe antwortet. Warum es zählt: Anders als das einmalige Training fällt Inferenz bei jeder Nutzung an und verursacht die laufenden Kosten – lokal als Hardware-Auslastung, in der Cloud als Token-Kosten. **KI-Reifegrad** Eine strukturierte Einschätzung, wie weit ein Unternehmen bei Daten, Prozessen, Kompetenzen und Governance tatsächlich ist. Warum es zählt: Der Nutzen liegt weniger in der Punktzahl als in der Reihenfolge, die sich daraus ergibt: Wo Daten unauffindbar sind, ist Aufräumen der erste Schritt und nicht die Toolauswahl. Vorsicht bei kostenlosen Online-Tests – die meisten sind Lead-Formulare mit vorgezeichnetem Ergebnis. **Latenz** Die Zeit zwischen Anfrage und Antwort – bei KI-Anwendungen oft mehrere Sekunden, bei Agenten deutlich mehr. Warum es zählt: Latenz entscheidet über die Einsetzbarkeit: Im Kundenchat sind fünf Sekunden grenzwertig, in der nächtlichen Rechnungsverarbeitung sind fünf Minuten belanglos. Reasoning-Modelle und mehrstufige Agenten tauschen Zeit gegen Qualität – eine bewusste Wahl, die man je Anwendungsfall treffen sollte statt global. **Modell-Deprecation** Die Abkündigung eines Modells durch den Anbieter – es wird abgeschaltet oder durch eine neue Version ersetzt, oft mit begrenzter Vorlaufzeit. Warum es zählt: Das ist der praktische Grund, warum KI-Automatisierungen ohne Zutun kaputtgehen: Das Nachfolgemodell verhält sich anders, hält sich nicht exakt an dasselbe Ausgabeformat, bewertet Grenzfälle abweichend. Wer keine Testfälle hat, merkt das an Kundenbeschwerden statt an einer roten Ampel. Deshalb gehören zu jedem produktiven Anwendungsfall eine feste Modellversion, ein Prüflauf vor dem Wechsel und ein Kalendereintrag zum Ablaufdatum. **On-Device-KI (On-Device, Edge-KI)** KI, die direkt auf dem Endgerät läuft – Laptop, Smartphone oder Maschine – statt in einem Rechenzentrum. Warum es zählt: On-Device hält Daten auf dem Gerät und funktioniert auch offline. Für sensible oder latenzkritische Anwendungen am Arbeitsplatz oder in der Anlage eine interessante Option. **Open-Source-Modell (Open-Weight-Modell, offenes Modell)** Ein KI-Modell, dessen Gewichte frei verfügbar sind und das Sie selbst betreiben können – ohne Bindung an einen einzelnen Anbieter. Warum es zählt: Offene Modelle geben volle Datenkontrolle und vermeiden laufende Lizenz-Token-Kosten, erfordern aber eigene oder beauftragte Wartung. Die Grundlage für lokalen und On-Premise-Betrieb. **OpenAI-kompatible API** Ein faktischer Industriestandard: Viele Anbieter stellen ihre Modelle über dieselbe Schnittstellenform bereit, sodass ein Wechsel ohne Umbau der Anwendung möglich ist. Warum es zählt: Das ist der billigste verfügbare Schutz gegen Anbieterbindung – vorausgesetzt, Sie nutzen nur den kompatiblen Kern und keine anbieterspezifischen Zusatzfunktionen. Wer den Standard einhält, tauscht Modell und Anbieter im Idealfall über zwei Konfigurationswerte. Wer bequemlichkeitshalber die Sonderfunktionen mitnimmt, hat sich die Bindung selbst gebaut. **PoC, Pilot, Produktion** Die drei Reifestufen eines Vorhabens: Machbarkeitsnachweis, begrenzter Echteinsatz, regulärer Betrieb – mit stark unterschiedlichen Anforderungen. Warum es zählt: Die meisten steckengebliebenen KI-Projekte scheitern nicht am Machbarkeitsnachweis, sondern am Sprung danach: Ein Prototyp braucht keine Fehlerbehandlung, keine Rechteverwaltung, keine Protokollierung und keinen Verantwortlichen – der Produktivbetrieb alle vier. Wer diese Lücke von Anfang an einplant, entscheidet früher und billiger, welche Anwendungsfälle den Weg wirklich lohnen. **Prompt Caching (Context Caching)** Eine Anbieter-Funktion, die wiederkehrende Teile des Kontexts zwischenspeichert, sodass sie nicht bei jeder Anfrage neu berechnet und bezahlt werden. Warum es zählt: Prompt Caching ist einer der wirksamsten Kostenhebel bei Cloud-Modellen: Lange, gleichbleibende Anweisungen oder Dokumente kosten ohne Caching bei jeder Anfrage aufs Neue. **Quantisierung (Quantization)** Eine Technik, die ein Modell „verkleinert", indem sie seine internen Zahlen gröber speichert – es läuft dann auf schwächerer Hardware, bei etwas geringerer Genauigkeit. Warum es zählt: Quantisierung macht lokalen Betrieb erst bezahlbar: Sie bringt leistungsfähige Modelle auf vorhandene Hardware. Der Kompromiss bei der Qualität ist je nach Anwendung gut vertretbar. **Self-Hosting vs. Managed** Die Entscheidung, Software auf eigener Infrastruktur zu betreiben oder als fertigen Dienst einzukaufen. Warum es zählt: Selbstbetrieb senkt die laufenden Kosten und hält Daten im eigenen Haus, verlagert aber Updates, Sicherung und Verfügbarkeit zu Ihnen – realistisch also die Frage, ob Sie jemanden haben, der das dauerhaft macht. Ein häufig übersehener Mittelweg ist der gemischte Betrieb: Automatisierung selbst hosten, das Modell als Dienst zukaufen. **SLM (Small Language Model, kleines Sprachmodell)** Kompakte Sprachmodelle, die auf normaler Hardware laufen und für klar abgegrenzte Aufgaben oft ausreichen. Warum es zählt: Nicht jede Aufgabe braucht das größte Modell. SLMs machen lokalen Betrieb günstig – für Klassifizierung, Extraktion oder einfache Assistenz sind sie oft die wirtschaftlichste Wahl. **TCO (Total Cost of Ownership, Gesamtbetriebskosten)** Die Gesamtkosten über die Laufzeit – Lizenzen, Betrieb, Wartung und Personalaufwand zusammengerechnet statt nur der Monatspreis. Warum es zählt: Vergleiche zwischen Cloud-Diensten und Eigenbetrieb kippen fast immer an derselben Stelle: Der Serverpreis ist eindeutig, die Wartungsstunden sind es nicht. Eine belastbare Rechnung legt beides offen – geschätzte Stunden mal internem Stundensatz, plus einmaliger Aufbauaufwand, über 24 oder 36 Monate. Ohne diese Annahmen ist jeder Kostenvergleich in dem Bereich Marketing. **Tokenkosten / Pricing-Modelle (Token-Kosten, Token-Pricing)** Bei Cloud-Modellen zahlen Sie meist pro verarbeiteter Textmenge, gemessen in Token – getrennt nach Eingabe und Ausgabe. Warum es zählt: Bei hohem Volumen summieren sich Token-Kosten erheblich. Lokale Modelle haben stattdessen Fixkosten – die Abwägung entscheidet, welches Betriebsmodell wirtschaftlich ist. **Vendor Lock-in** Die Abhängigkeit von einem einzelnen Anbieter, die entsteht, wenn ein Wechsel technisch, vertraglich oder wirtschaftlich unverhältnismäßig teuer wird. Warum es zählt: Bindung entsteht bei KI-Projekten selten über den Modellzugang selbst – der ist meist austauschbar – sondern über alles daneben: proprietäre Assistenten-Formate, anbietereigene Dateispeicher, eingebettete Werkzeug-Definitionen, Abrechnungsmodelle mit Mindestabnahme. Die brauchbare Prüffrage lautet nicht „Bin ich abhängig?", sondern „Wie viele Tage und welche Kosten liegen zwischen mir und dem Wechsel?". **Vibe Coding** Eine lockere Arbeitsweise, bei der man Software überwiegend durch Beschreiben in natürlicher Sprache von einer KI bauen lässt – mehr Gefühl als formale Spezifikation. Warum es zählt: Vibe Coding macht schnelle Prototypen möglich, auch ohne tiefe Programmierkenntnis. Für tragfähige Unternehmenssoftware braucht es danach aber Sorgfalt, Tests und Review – der professionelle, kontrollierte Gegenmodus dazu ist Agentic Coding. --- ## Kontakt E-Mail: hi@ps24.ai · Web: https://ps24.ai Paul Siegel, Cyriakusstr. 55, 59590 Geseke, Deutschland