Hrishikesh Jadhav
AI Engineer, Deutschland
Offen für AI-Engineering-Rollen in Deutschland ab Oktober 2026. Inhaber der Blauen Karte EU mit Arbeitserlaubnis für Deutschland.
Berufserfahrung
- 10/2025–09/2026
AI Engineer, Toku
Globale Employer-of-Record- und Payroll-Infrastrukturplattform, tätig in 46 Ländern.
- Brachte AI-Tools in den täglichen Produktivbetrieb von Product-, Engineering- und Sales-Teams: einen MCP-Server, der interne Systeme für LLM-Clients zugänglich macht, einen RAG-Assistenten (FastAPI, LangChain, pgvector) sowie n8n-Automatisierungen für Onboarding, die Verarbeitung von Gehaltsabrechnungen und Support-Triage. Verantwortete Deployment, Dokumentation, Onboarding und direkten Anwendersupport.
- Reduzierte die Erfassung produktiver Payroll-Daten von Stunden manueller Arbeit pro Abrechnungszyklus auf Minuten, mit einer selbst gehosteten LLM-Extraktionspipeline (Python, FastAPI, PostgreSQL, DigitalOcean), die personenbezogene Daten vor der Inferenz maskiert.Selbst gehostet, damit keine Mitarbeiterdaten die kontrollierte Infrastruktur verlassen.
- Sicherte eine feldbasierte Extraktionsgenauigkeit oberhalb des vereinbarten Schwellenwerts über alle extrahierten Felder, geprüft gegen ein umfangreiches Golden Evaluation Set; entwickelte dafür das Evaluation Framework und ein CI Regression Gate, das jedes Deployment unterhalb des Schwellenwerts blockiert.So kann keine Änderung, die die Extraktionsgenauigkeit verschlechtert, Payroll-Daten erreichen.
- Verlagerte Security Reviews für Tausende Pull Requests direkt in den Pull Request, indem automatisierte, LLM-gestützte Sicherheitsprüfungen in GitHub CI für Tokus Finanzplattform integriert wurden.
- Entwickelte status.toku.com, Tokus öffentliche Statusplattform: Produktionskomponenten werden in einem kurzen, festen Intervall vom Cloudflare Edge aus geprüft und Incidents automatisch erkannt und geschlossen, mit Dependency Rollups, Edge-vs.-Origin-Fehlerisolierung sowie JSON API und RSS-Feed. Neue Incidents lösen eine Slack-Benachrichtigung an das Team aus, und Fehler, die eine Codeänderung erfordern, übernimmt ein Coding Agent.Weil Edge und Origin getrennt geprüft werden, ist ein Fehler dem CDN oder der Anwendung zugeordnet, bevor sich jemand damit befasst.
- Entwickelte Tokus kundenseitiges Help Center mit AI-Assistenten (toku.com/help, Next.js) auf Basis der Notion-Wissensdatenbank von Toku, mit Artikeln zu Payroll, Benefits, Richtlinien und Länderleitfäden für Dutzende Länder; Inhalte für allgemeine Hilfe und Visa-Support liegen in getrennten Retrieval-Korpora, mit Multi-Model-Fallback über mehrere Provider.Getrennte Korpora, damit Fragen zu Einwanderung und Arbeitserlaubnis nie aus allgemeinen Payroll-Inhalten beantwortet werden.
- Senkte die LLM-Inferenzkosten auf einen Bruchteil der geschätzten Kosten vergleichbarer externer API-Nutzung durch den Betrieb von Open-Weight-Modellen auf selbst gehosteter GPU-Infrastruktur.
Personenbezogene Daten werden vor der Inferenz maskiert, und ein Gate auf Basis des Golden Sets entscheidet, was deployt wird. - 08/2022–09/2025
Data Scientist, GfK - An NIQ Company
Werkstudent, Data Science, 08/2022–07/2024
- Reduzierte den manuellen Aufwand bei der Produkt-Taxonomie-Klassifizierung um rund 30 % durch einen LLM-basierten Klassifikationsservice auf Amazon Bedrock mit Prompt Engineering und RegEx-basiertem Post-Processing.
- Reduzierte die Suchzeit in internen Produktkatalogen um rund 40 % gegenüber der bisherigen Keyword-Suche durch semantisches Retrieval auf Basis von Vector Embeddings.
- Verbesserte die Vorhersagegenauigkeit für simultane Zuschauer um rund 20 % gegenüber dem bisherigen Modell durch Training und Deployment eines CatBoost-Modells mit über 30 entwickelten Features aus Soziodemografie, zeitlichen Mustern und Programm-Metadaten.
- Gewährleistete den 24/7-Betrieb produktiver Scoring-Pipelines ohne manuelle Eingriffe durch die Orchestrierung von S3-Ingestion, Feature-Generierung, Model Scoring und automatisierten Integrationstests in GitLab CI/CD, containerisiert mit Docker unter Linux.
- Entwickelte eine Data-Fusion-Pipeline für TV-Zuschauerdaten mit K-Nearest Neighbors und einem genetischen Algorithmus, um Panel-Haushalte anhand umfangreicher Return-Path-Daten zuzuordnen und zu replizieren.
- 04/2020–08/2020
Softwareentwickler (Praktikum), Sapio Analytics Pvt. Ltd.
- Entwickelte COVID-19-Modelle zur Entscheidungsunterstützung in Python (SEIRD, scikit-learn, SciPy) und Prognose-Dashboards (Plotly, AWS), die als Grundlage für Entscheidungen der indischen Regierung zu Lockdowns und Teststrategien dienten, mit einem um 4,8 % niedrigeren RMSE gegenüber der vorherigen Baseline.
Projekte
Interner RAG-Lernassistent
NIQ/GfK HACKFEST 2024, Top 3. Entwickelte und präsentierte innerhalb von 24 Stunden einen Retrieval-Augmented-Lernassistenten für interne Wissensinhalte, mit Document Retrieval und Audio-Ingestion über Whisper (LangChain, Vektordatenbank, GPT, FastAPI).
Ausbildung
- 2021–2024
M.Sc. Artificial Intelligence Engineering (Studienleistungen und Masterarbeit)
- 04/2022–10/2022
Honours Degree in Entrepreneurship
- 2018–2021
B.E. Computer Science
Publikationen
- 2025
- 2021
Auszeichnungen
- 2024
NIQ/GfK HACKFEST · Top 3, mit einem RAG-Lernassistenten, der in 24 Stunden gebaut und präsentiert wurde
- 2024
BMW Innovation Challenge · Ausgewählter Teilnehmer der 24-Stunden-Challenge in der BMW iFactory Dingolfing (Use Case: DocCheck)
- 2020
IEEE Machine Learning Hackathon · 1. Platz
- 2020
HackCovid-19 · Sieger unter 130 Teams
- 2017
Smart India Hackathon · Sieger (indisches Verteidigungsministerium)
Kenntnisse
- AI und LLM
- RAG, MCP, LLM-Evaluation und Regressionstests, Prompt Engineering, Vector Search, Guardrails, LangChain, LangGraph, Claude SDK, OpenAI SDK, Amazon Bedrock, Hugging Face, OpenRouter, CrewAI, n8n
- Backend und Daten
- Python, TypeScript, Node.js, FastAPI, Flask, Django, Next.js, React, REST-APIs, PostgreSQL, Prisma, pgvector, Qdrant, FAISS, Pinecone
- Cloud und DevOps
- GitLab CI/CD, GitHub Actions, Docker, Linux, AWS (Bedrock, S3), GCP, DigitalOcean, Cloudflare, Git
- ML und Data Science
- PyTorch, scikit-learn, CatBoost, pandas, NumPy, Feature Engineering, Modellevaluation, Embeddings
- Sprachen
- Englisch (C1), Deutsch (B1), Hindi (Muttersprache), Marathi (Muttersprache)
Drucken Sie diese Seite, um sie als PDF zu speichern.