Leistungen
Was ich baue
RAG-Architektur (aktueller Schwerpunkt)
Mehrstufiges Retrieval
Entwurf und Implementierung einer mehrstufigen Retrieval-Architektur, die lexikalisches und semantisches Retrieval kombiniert:
- BM25-lexikalisches Retrieval und Bi-Encoder-semantisches Retrieval
- Hybrid Search und Reciprocal Rank Fusion (RRF)
- Cross-Encoder-Reranking zur Verbesserung der Retrieval-Präzision
- Query Expansion mit Synonym-Maps und Query-Rewriting
- Multi-Hop-Retrieval-Workflows für komplexe Informationsbedürfnisse
- Vollständige Orchestrierung über LangChain und LangGraph, mit explizitem State-Management und kontrolliertem Ausführungsfluss
- Evaluierung mittels Recall@k, MRR und nDCG@k
- Validierungs-, Evaluierungs- und Guardrail-Mechanismen für Zuverlässigkeit und Vorhersagbarkeit
Breitere KI-Entwicklung
- Entwurf und Implementierung von LLM-basierten Anwendungen und Agentic-AI-Systemen
- Bereitstellung und Integration lokaler Open-Source-Modelle (Hugging Face, PyTorch, vLLM), einschließlich Inferenz-Optimierung und ressourcenbewusstem Deployment
- Parameter-effizientes Fine-Tuning (PEFT/LoRA), einschließlich adapterbasierter Modellspezialisierung
- Agentic Workflows mit Tool-Calling, MCP, Speicher, strukturierten Outputs und Multi-Agenten-Orchestrierung
- Anwendung von Softwarearchitektur-Prinzipien auf KI-Systeme: Modularität, Wartbarkeit, Beobachtbarkeit, Skalierbarkeit, klare Trennung zwischen deterministischen und nicht-deterministischen Komponenten
- Bewertung von Modellen, Architekturen, Frameworks und Deployment-Ansätzen anhand praktischer Einschränkungen: Qualität, Latenz, Speicher, Skalierbarkeit, Komplexität
Außerdem verfügbar
Ich kann auch Ihr Team schulen — denn mein Wissen geht tiefer als nur einen API-Aufruf zu machen.
Verfügbar für Projektaufträge, Architektur-Reviews oder laufende Beratung — nehmen Sie Kontakt auf, um zu besprechen, was passt.