KI-Integration

KI-Funktionen, die in Ihrer Software leben und Ihre Daten dort lassen, wo Sie es wollen

Assistenten, Dokumentensuche und Automatisierung in dem, was Sie bereits betreiben. Cloud-Modelle, wo sie passen, in der EU gehostete Modelle, wo der Datenstandort zählt, oder ein privates LLM auf Ihren eigenen Servern mit Kipper AI.

$ kip ai install
preflight: 16 GiB frei, Storage ok
lade qwen2.5:7b …
✓ Ollama läuft in kipper-ai
✓ Chat-Oberfläche unter https://chat.example.com
Modelle, Chat und Daten, alles auf Ihrem eigenen Server.

Was wir bauen

Vier Dinge, nach denen Kunden fragen, und was jedes davon bedeutet

Support- und Vertriebsassistenten

Ein Chatbot, der aus Ihrer Dokumentation und Ihren Produktdaten antwortet, an einen Menschen übergibt, wenn es angebracht ist, und die offen gebliebenen Fragen protokolliert.

Dokumentensuche

Suche über Verträge, Handbücher, Tickets oder Wikis, mit Quellenangabe zu jeder Antwort. Arbeitet auf Ihren Dateien dort, wo sie bereits liegen.

Automatisierung in Ihrer Software

Klassifizierung, Extraktion, Zusammenfassungen und Entwürfe in den Werkzeugen, die Ihr Team bereits nutzt, mit einem Menschen in der Schleife, wo es darauf ankommt.

Ein privates Modell in Ihrem Cluster

Kipper AI installiert Ollama und eine Chat-Oberfläche mit einem Befehl auf Ihren eigenen Servern. Sie zahlen für den Server, behalten Ihre eigenen Schlüssel, und Ihre Daten bleiben im Cluster.

Modell und Datenstandort

Drei Orte, an denen ein Modell laufen kann, und wann welcher passt

Die Wahl wird einmal getroffen, schriftlich, vor jeder Zeile Code. Sie folgt Ihren Datenschutzanforderungen und Ihrem Budget, in dieser Reihenfolge.

ModelleWo es läuftWann es passt
Claude, OpenAI, GeminiClouds der AnbieterStärkste Modelle, am schnellsten ausgeliefert. Daten verlassen Ihre Umgebung zu den Bedingungen des Anbieters.
MistralIn der EU gehostetGute Modelle mit europäischem Hosting und Verträgen. Der Standard, wenn EU-Datenstandort Pflicht ist.
Kipper AI (Ollama)Ihre eigenen ServerOffene Modelle in Ihrem Cluster. Nutzbar ab 16 GiB RAM, schnell mit GPU. Alles bleibt auf dem Server.

Aus der Praxis

PersoHR: KI-Funktionen, bei denen alles in der EU bleibt

Unser eigenes HR-Produkt liefert Assistenten für Onboarding und Dokumentenentwürfe auf in der EU gehosteten Modellen, die Daten bleiben in deutschen Rechenzentren. Dasselbe Muster gibt es für Ihre Software.

PersoHR ansehen
Modelle
In der EU gehostet (Mistral), keine US-Anbieter
Hosting
Deutschland, Hetzner
Stack
Nuxt, Spring Boot, PostgreSQL
Muster
Assistent im Produkt, Quellen sichtbar, Mensch in der Schleife

Vor dem Gespräch

Fragen, die wir zu KI-Projekten hören

Wohin gehen unsere Daten?

Wohin Sie es entscheiden. In die Clouds der Anbieter, zu einem in der EU gehosteten Modell oder zu einem Modell in Ihrem eigenen Cluster. Wir haben Umgebungen gebaut, in denen alle Daten in der EU bleiben, und solche, in denen alle Daten auf einem Server bleiben.

Welche Hardware braucht Kipper AI?

Der Installer verweigert den Start bei weniger als 8 GiB freiem Speicher auf einem Node. Für alles jenseits einer Demo planen Sie 16 GiB RAM und 4 vCPUs. Eine GPU mit 16 GiB VRAM oder mehr macht den Chat schnell und erlaubt größere Modelle.

Kann der Assistent falsch liegen?

Ja, deshalb zeigt er seine Quellen, bleibt innerhalb der Dokumente, die Sie ihm geben, und übergibt an einen Menschen, wenn er etwas nicht belegen kann. Wir messen die Antwortqualität vor und nach dem Start, statt Genauigkeit zu versprechen.

Wie wird das bepreist?

Ein kurzes Assessment, um Anwendungsfall und Modell zu wählen, dann Meilensteine wie bei jeder anderen Softwarearbeit. Die laufenden Kosten sind entweder die Token-Abrechnung des Anbieters oder Ihr eigener Server, und wir zeigen beides, bevor Sie sich entscheiden.

Sprechen Sie mit einem Engineer

Sagen Sie uns, wonach Ihre Leute am häufigsten fragen. Das ist meist der erste Assistent.

Dreißig Minuten mit einem Senior Engineer. Antwort innerhalb eines Werktags.