KI-Implementierung
KI, die echte Arbeit macht — mit einem Menschen, der sie prüft.
Das meiste, was ein Unternehmen wiederholt, folgt einer Regel und gehört in gewöhnliche Software. Ein kleinerer Teil braucht jedes Mal eine Entscheidung: was man einem Kunden sagt, welche Anfrage zuerst drankommt, wo in alten Unterlagen eine Antwort steckt. Dort gehört KI hin — und nur unter Bedingungen: an Ihrer eigenen Vergangenheit bewiesen, bevor sie startet, nach dem Start beobachtet, und nie vor einem Kunden, ohne dass ein Mensch die Worte freigibt.
Für wen
Situationen, für die wir bauen
Dieses Projekt ist für Unternehmen, in denen ein Teil der Wochenroutine Denkarbeit ist — lesen, formulieren, sortieren, suchen — und bei den Menschen landet, die Besseres mit der Stunde anfangen könnten. Wenn mehrere dieser Punkte nach Ihrer Woche klingen, passt es vermutlich.
- Kundenantworten kosten jedes Mal echtes Nachdenken, und das Schreiben bleibt an den ein, zwei Leuten hängen, die das Geschäft am besten kennen.
- Alles landet auf einem Stapel, und jemand liest alles nur, um herauszufinden, was dringend ist.
- Die Antwort auf die meisten Fragen steckt in alten E-Mails, Angeboten oder Auftragsnotizen — aber sie zu finden dauert länger, als die Frage verdient.
- Sie haben einen Chatbot von der Stange ausprobiert und abgeschaltet, nachdem er einem Kunden etwas Unwahres erzählt hat.
- Dieselbe Ermessensentscheidung wird Dutzende Male pro Woche getroffen, jedes Mal etwas anders, je nachdem, wer gerade Dienst hat.
- Sie wollen KI, die messbare, beaufsichtigte Arbeit leistet — nicht noch eine Demo, die alle beeindruckt und nichts verändert hat.
Die Methode
Was der Aufbau tatsächlich umfasst
Sechs Entscheidungen trennen KI, die still hilft, von KI, die nach einer schlechten Woche abgeschaltet wird. So treffen wir jede davon.
Aufgabenauswahl
Nicht jeder Schritt verdient ein Modell. Arbeit, die einer aufgeschriebenen Regel folgt — dieses Feld kopieren, jene Erinnerung an Tag drei senden — läuft als gewöhnliche Software: Sie kostet weniger, und am Freitag verhält sie sich wie am Montag. KI bleibt den Schritten vorbehalten, bei denen heute jemand nachdenken muss: eine Antwort formulieren, einordnen, worum es in einer Anfrage wirklich geht, entscheiden, was ein alter Vorgang bedeutet. Diese Trennung ist die erste Arbeitssitzung — und die KI-Liste kommt kürzer heraus, als sie hineinging.
Die Freigabe
Alles, was für einen Kunden geschrieben wird, entsteht als Entwurf und hält bei einer benannten Person in Ihrem Team an, die ihn bearbeitet, freigibt oder verwirft, bevor er irgendwohin geht. Das ist keine vorübergehende Trainingsphase, sondern das dauerhafte Design. Der Geschwindigkeitsgewinn überlebt die Prüfung: Aus einem brauchbaren Entwurf zu arbeiten ist deutlich schneller, als bei null anzufangen — und die prüfende Person bleibt nah genug dran, um den Tag zu bemerken, an dem die Qualität nachlässt.
Eskalation
Jeder KI-Schritt trägt eine Konfidenzschwelle. Ist das Modell unsicher oder sieht eine Anfrage anders aus als alles, woran es getestet wurde, geht der Vorgang an einen Menschen — mit dem bis dahin gesammelten Kontext im Anhang. Keine Antwort wird erzwungen. Wir konstruieren gegen die selbstbewusste falsche Antwort: Ein höfliches „wir melden uns“ kostet Minuten, ein glatt vorgetragener Fehler kann den Kunden kosten. Die Kette endet immer bei einem Menschen, nie bei einer Vermutung.
Erst testen
Bevor ein KI-Schritt echte Arbeit berührt, wird er an Beispielen aus Ihren Unterlagen gemessen: Antworten, die Ihr Team tatsächlich verschickt hat, Anfragen, die es tatsächlich sortiert hat, Fragen mit nachprüfbaren Antworten. Jede Aufgabe bekommt ihren eigenen Testsatz und ihre eigene Bestehensgrenze; ein Schritt, der sie verfehlt, geht nicht live — die Aufgabe bleibt bei einem Menschen oder bekommt ein einfacheres Design. Zeigt sich später im Betrieb ein Fehler, wandert er in den Testsatz, damit derselbe Fehler nicht zweimal leise durchkommt.
Nach dem Start
Der Livegang ist der Anfang der Messung, nicht ihr Ende. Das System protokolliert, was jeder KI-Schritt getan hat und warum, und wir beobachten neben Kosten und Volumen, wie oft Prüfer Entwürfe umschreiben — das ehrliche Qualitätssignal. Neue Modelle der Anbieter behandeln wir als Kandidaten, nicht als Upgrades: Jedes läuft zuerst durch die bestehenden Testsätze und übernimmt eine Aufgabe nur, wenn es mindestens so gut abschneidet wie das aktuelle. Das Vorgängermodell bleibt installiert; eine Änderung, die sich danebenbenimmt, wird direkt zurückgerollt.
Modelle in der richtigen Größe
Die leistungsfähigsten Modelle kosten pro Anfrage ein Vielfaches der kleinen, und die meisten Aufgaben in einem Unternehmen brauchen nicht die leistungsfähigsten. Jeder Schritt läuft auf dem kleinsten Modell, das seine Tests besteht: Eine Nachricht in sechs Kategorien einzusortieren ist Arbeit für ein kleines Modell, auch wenn das Entwerfen einer heiklen Antwort es nicht ist. Weil die Tests je Aufgabe existieren, ist der Wechsel auf eine kleinere Größe eine Entscheidung mit Belegen, keine Hoffnung. Die voraussichtlichen monatlichen Betriebskosten je Aufgabe sehen Sie vor dem Start — die laufende Rechnung ist eine Zahl, die Sie freigegeben haben, keine, die Sie entdecken.
Das Projekt
So läuft es
Eingrenzen und sortieren
Wir gehen die infrage kommende Arbeit mit Ihnen durch und teilen sie auf: Regel-Schritte in gewöhnliche Software, echte Ermessensfragen auf die KI-Liste. Sie bekommen diese Liste mit voraussichtlichen Betriebskosten und einer Baureihenfolge, und der Preis jeder Phase wird schriftlich vereinbart, bevor die Phase beginnt.
Beweisen
Für jeden KI-Schritt bauen wir den Testsatz aus Ihren Unterlagen und messen Kandidatenmodelle daran. Sie sehen die Ergebnisse in klaren Worten — wie oft der Entwurf dem entsprach, was Ihr Team verschickt hätte —, und nichts geht in den Bau, bevor es die Grenze nimmt.
Beaufsichtigt starten
Das System geht mit allen Freigabestufen live. Die ersten Wochen beobachten wir gemeinsam mit Ihrem Team und justieren Schwellen, wo echter Verkehr von der Vergangenheit abweicht, bis die Menge, die bei Menschen landet, stimmt.
Übergeben
Code, Konten, Dokumentation und die Testsätze gehen an Sie über, und die Menschen, die es betreiben werden, werden an echter Arbeit geschult. Support nach der Übergabe wird eigenständig angeboten und bepreist; das System läuft weiter, ob wir dabeibleiben oder nicht.
Was übergeht
Was Ihnen gehört, wenn wir gehen
Jedes Projekt ist auf Übergabe gebaut. All das gehört Ihnen, sobald die Arbeit bezahlt ist — es wird nicht an Sie zurücklizenziert.
- Das laufende System selbst — die Automatisierungen, die KI-Schritte, die Prüfwarteschlangen und die Eskalationswege — auf Konten, die auf Ihren Namen laufen.
- Die Testsätze je Aufgabe, gebaut aus Ihren Unterlagen — sie sind es, die Sie das nächste Modell bewerten lassen, ohne uns anzurufen.
- Dokumentation, geschrieben für die Menschen, die es betreiben: was jeder Schritt allein darf, was eine Freigabe braucht und wo man zuerst nachsieht, wenn etwas schiefgeht.
- Prüfer und Betreiber, geschult an echtem Verkehr, plus das Betriebskostenbild je Aufgabe — die Monatsrechnung bleibt eine bekannte Größe.
Nächster Schritt
Erst darüber sprechen.
Bringen Sie das Stück Ihrer Woche mit, das Urteilsvermögen braucht und Zeit frisst: den Posteingang, die Antworten, das Suchen in alten Unterlagen. In einem kurzen Kennenlerngespräch sagen wir Ihnen ehrlich, ob KI dort hingehört — und wo wir anfangen würden.
Gespräch buchen