Support- und Vertriebsassistenten
Ein Chatbot, der aus Ihrer Dokumentation und Ihren Produktdaten antwortet, an einen Menschen übergibt, wenn es angebracht ist, und die offen gebliebenen Fragen protokolliert.
KI-Integration
Assistenten, Dokumentensuche und Automatisierung in dem, was Sie bereits betreiben. Cloud-Modelle, wo sie passen, in der EU gehostete Modelle, wo der Datenstandort zählt, oder ein privates LLM auf Ihren eigenen Servern mit Kipper AI.
Was wir bauen
Ein Chatbot, der aus Ihrer Dokumentation und Ihren Produktdaten antwortet, an einen Menschen übergibt, wenn es angebracht ist, und die offen gebliebenen Fragen protokolliert.
Suche über Verträge, Handbücher, Tickets oder Wikis, mit Quellenangabe zu jeder Antwort. Arbeitet auf Ihren Dateien dort, wo sie bereits liegen.
Klassifizierung, Extraktion, Zusammenfassungen und Entwürfe in den Werkzeugen, die Ihr Team bereits nutzt, mit einem Menschen in der Schleife, wo es darauf ankommt.
Kipper AI installiert Ollama und eine Chat-Oberfläche mit einem Befehl auf Ihren eigenen Servern. Sie zahlen für den Server, behalten Ihre eigenen Schlüssel, und Ihre Daten bleiben im Cluster.
Modell und Datenstandort
Die Wahl wird einmal getroffen, schriftlich, vor jeder Zeile Code. Sie folgt Ihren Datenschutzanforderungen und Ihrem Budget, in dieser Reihenfolge.
| Modelle | Wo es läuft | Wann es passt |
|---|---|---|
| Claude, OpenAI, Gemini | Clouds der Anbieter | Stärkste Modelle, am schnellsten ausgeliefert. Daten verlassen Ihre Umgebung zu den Bedingungen des Anbieters. |
| Mistral | In der EU gehostet | Gute Modelle mit europäischem Hosting und Verträgen. Der Standard, wenn EU-Datenstandort Pflicht ist. |
| Kipper AI (Ollama) | Ihre eigenen Server | Offene Modelle in Ihrem Cluster. Nutzbar ab 16 GiB RAM, schnell mit GPU. Alles bleibt auf dem Server. |
Aus der Praxis
Unser eigenes HR-Produkt liefert Assistenten für Onboarding und Dokumentenentwürfe auf in der EU gehosteten Modellen, die Daten bleiben in deutschen Rechenzentren. Dasselbe Muster gibt es für Ihre Software.
PersoHR ansehenVor dem Gespräch
Wohin Sie es entscheiden. In die Clouds der Anbieter, zu einem in der EU gehosteten Modell oder zu einem Modell in Ihrem eigenen Cluster. Wir haben Umgebungen gebaut, in denen alle Daten in der EU bleiben, und solche, in denen alle Daten auf einem Server bleiben.
Der Installer verweigert den Start bei weniger als 8 GiB freiem Speicher auf einem Node. Für alles jenseits einer Demo planen Sie 16 GiB RAM und 4 vCPUs. Eine GPU mit 16 GiB VRAM oder mehr macht den Chat schnell und erlaubt größere Modelle.
Ja, deshalb zeigt er seine Quellen, bleibt innerhalb der Dokumente, die Sie ihm geben, und übergibt an einen Menschen, wenn er etwas nicht belegen kann. Wir messen die Antwortqualität vor und nach dem Start, statt Genauigkeit zu versprechen.
Ein kurzes Assessment, um Anwendungsfall und Modell zu wählen, dann Meilensteine wie bei jeder anderen Softwarearbeit. Die laufenden Kosten sind entweder die Token-Abrechnung des Anbieters oder Ihr eigener Server, und wir zeigen beides, bevor Sie sich entscheiden.
Sprechen Sie mit einem Engineer
Dreißig Minuten mit einem Senior Engineer. Antwort innerhalb eines Werktags.