Haystack
Production-RAG-Framework. Wir betreiben die Pipeline auf unserem 13-File-DSGVO/AI-Act-Corpus,
mit bge-m3-bunker als Embedder und qwen3.6-27b-bunker als Generator —
ohne eine einzige Zeile US-Cloud.
Wir evaluieren die wichtigsten Open-Source-AI-Frameworks und integrieren sie auf unserem Sovereign-Stack im Bunker. Jede Integration: live deploybar, dokumentiert, optional als Customer-Addon buchbar.
Production-RAG-Framework. Wir betreiben die Pipeline auf unserem 13-File-DSGVO/AI-Act-Corpus,
mit bge-m3-bunker als Embedder und qwen3.6-27b-bunker als Generator —
ohne eine einzige Zeile US-Cloud.
Sitzungs-Recorder für Coaches & Therapeuten: Aufnahme → whisper-large-v3-turbo-bunker-Transkript
→ qwen3.6-27b-bunker-Notizen. Klient-Consent per Magic-Link, AES-256-GCM, 90-Tage-Löschung —
sovereign, keine US-Cloud. Plus Live-Untertitel-Modus.
Role-based Multi-Agent-Crews gegen Bunker-LLM. Profil-Agent → Sourcing-Agent → Triage-Agent als sequenzielle Crew am Recruiter-Beispiel — statt manuellem Handoff.
State-Machine für Agents mit Branches/Loops/Conditionals. Kandidat für VESTIGIA-AI-Act-Audit-Trail-Bot.
LLM-Traces enthalten oft personenbezogene Daten — Prompts, Antworten, RAG-Kontext. Wie man Observability self-hosted und datensparsam aufsetzt, statt Roh-Prompts in die US-Cloud zu schicken.
Self-hosted Universal-Memory-Layer mit Bunker-LLM. Extrahiert automatisch Memories aus Konversationen, durchsucht semantisch — pro user_id, ohne dass eine Erinnerung den Bunker verlässt.
Real-time-Voice-Agent gegen Bunker-Stack: Whisper (STT) → qwen3.6-27b (LLM) → voxcpm2 (TTS). Self-hosted LiveKit-Server im Sovereign-Container — keine Audio-Sekunde verlässt unsere Hardware.
Qognio-Skills als MCP-Server. Damit können Claude-Desktop, Cursor, Hayhooks unsere Tools nutzen.
Vector-DB für größere RAG-Korpora. Folgeschritt zu Haystack wenn InMemoryStore nicht reicht.
Durable Execution für Agent-Workflows. Wenn ein Bot mid-flow crasht, restart from last checkpoint.
Kleine, scharf umrissene Compliance-Helfer. Kein Account, keine Installation — eine Aufgabe, ein Ergebnis. Alle laufen auf demselben Sovereign-Stack im Bunker.
URL rein, Compliance-Report raus: Impressum, Datenschutz, Cookie-Banner — geprüft gegen die aktuelle Rechtslage, mit Ampel + Lückenliste.
Verdächtige Mail einfügen → Ampel + 2-Satz-Begründung. Erkennt AiTM, Quishing, BitB, Deepfake-Voice-Muster. Für Teams ohne SOC.
„Was gilt für uns?" — Cleo sortiert nach Größe + Branche und zeigt, welche Pflichten ab wann greifen. Einstieg in den ganzen Compliance-Stack.
Beschreib dein KI-System → Einordnung in die AI-Act-Risikoklasse (verboten / hoch / begrenzt / minimal) mit den daraus folgenden Pflichten.
Audit-Trail- und Annex-IV-Doku-Generator für Hochrisiko-KI: Klassifizierung, Logging, Oversight, Konformitätsbewertung — forensisch-präzise.
Navigator durch die E-Rechnungs-Pflicht: Formate, Fristen, Empfangs- und Ausstellungspflicht — was ab wann für dein Unternehmen gilt.
Wir bauen jedes dieser Frameworks gegen unseren eigenen Bunker-Stack auf, bevor wir es einem Kunden empfehlen. Das spart später Tage in der Architektur-Phase und liefert ehrliche Lessons-Learned statt Folien-Wissen.
Wenn ihr eines davon braucht: wir installieren es bei euch oder bei uns on-prem, Open-Source-Code-Basis, dokumentierte Stolperer, fester Aufwand statt „Beratungs-Tage". Code-Einsicht und Architektur-Walkthrough auf Anfrage.