Wir entwickeln KI-Systeme in Ihrer Django-Anwendung und betreiben Modelle auf Ihrer eigenen Hardware. Entwicklung und Betrieb kommen aus einer Hand.
Maßgeschneiderte KI-Systeme
für regulierte Unternehmen.
KI-Engineering für Mittelstand, Kanzleien, Praxen und Industrie. On-Premise LLM (Llama, Mistral) auf eigener Hardware, RAG mit Datensouveränität, Agenten direkt in Ihre Anwendungen integriert. Kein reiner API-Wrapper, keine Cloud-Zwänge.
Engineering Notes
Wie wir bauen — Notizen vom Engineering-Tisch.
Dokumentierte Architektur-Entscheidungen, Benchmarks aus Produktions-Deployments und Engineering-Pattern, die wir wiederverwenden. Keine generischen Tutorials, keine Marketing-Whitepaper — nur die Fragen, die wir bei realen Kundenprojekten beantworten mussten.
Wie wir ein RAG-System bewerten, bevor es live geht
Unser internes Eval-Harness: 7 Metriken, drei Ground-Truth-Sets aus echten Kundenfragen, automatisierte Regression bei jedem Modell-Wechsel. Was wir messen — und warum „funktioniert in der Demo” nicht reicht.
Lesen → Note 02 · InferenceLlama 3.1 70B auf einer L40S — was wir gemessen haben
Quantisierung (Q4/Q8), Batched Inference, vLLM-Konfiguration. Wo der Latency-Knick liegt, wann eine zweite GPU lohnt und welche Token-Größen den Throughput halbieren. Reale Zahlen aus einem Produktions-Deployment.
Lesen → Note 03 · Architekturpgvector neben dem Django-ORM — Pattern und Benchmark
Warum wir Vektor-Suche direkt in Postgres legen statt eine separate Pinecone- oder Weaviate-Instanz zu betreiben. Indexing-Strategie, HNSW-Tuning, Recall-Vergleich. Mit dem ORM-Mixin, den wir in jedem Projekt wiederverwenden.
Lesen →Unser KI-Stack
Open-Source-LLMs, in Django integriert, auf Ihrer Hardware.
Wir setzen auf produktionsreife, offene Komponenten. Modelle und Tools austauschbar, kein Vendor-Lock-in, keine versteckten Cloud-Abhängigkeiten.
Engagement Models
Vier Wege, mit uns zu arbeiten.
Vom KI-Strategie-Audit bis zum vollständig betriebenen On-Premise-Cluster. Jeder Schritt mit Festpreis nach Strategiegespräch, ohne Stundenfalle.
01
KI-Strategie & Audit
Workflow-Analyse, Use-Case-Bewertung, Architektur-Empfehlung. Inklusive EU-AI-Act-Klassifizierung Ihrer bestehenden Systeme und einer schriftlichen Roadmap.
02
Pilot-Implementierung
Ein produktionsfähiger KI-Agent oder RAG-Prototyp, eingebettet in Ihre Django-Anwendung. Wöchentliche Demos, iterativ bis zum Go-Live.
03
Production Rollout
Vollständiges On-Premise-Setup mit eigener Hardware, vLLM/Ollama-Stack, Monitoring, DSGVO-Dokumentation und Wartungsvertrag von Tag eins.
04
Managed AI
Laufender Betrieb Ihrer KI-Systeme: Modell-Updates, GPU-Wartung, vLLM-Tuning, Compliance-Reviews und erweiterte Bereitschaft auf Wunsch.
FAQ
Die häufigsten Fragen vor dem Anruf.
Genau dafür sind wir da. Wir analysieren Ihren Workflow, bauen, deployen und warten das System — inklusive Modell-Updates und laufendem Betrieb. Sie brauchen keine KI-Expertise im Haus: Sie bekommen Dokumentation, einen klaren Wartungsweg und einen direkten Ansprechpartner, kein Callcenter.
Nach dem Strategie-Audit liefert ein Pilot in 8–12 Wochen einen produktionsreifen Use-Case — mit wöchentlichen Demos. Kein Big-Bang nach einem Jahr: Sie sehen früh, ob es trägt, und entscheiden nach jedem 2-Wochen-Sprint, ob wir weitermachen.
Dann sagen wir es Ihnen — im Strategie-Audit, bevor Sie groß investieren. Wir bewerten ehrlich, ob ein Use-Case echten ROI bringt. Lieber ein klares „hier lohnt es sich nicht“ als ein teures Projekt ohne Wirkung. Den Audit-Festpreis rechnen wir auf einen folgenden Pilot an.
Lassen Sie uns Ihre KI-Lösung skizzieren.
30 Minuten am Telefon. Wir analysieren Ihren Workflow und sagen ehrlich, ob KI für Sie ROI bringt — und wenn ja, mit welcher Architektur (Agent, RAG, on-premise oder Cloud). Kein KI-Hype, kein Verkaufspitch.
+49 941 20 90 28 62 [email protected]