Forward Deployed Engineer (m/w/d)

Mayflower· München, Würzburg· personio· veröffentlicht 10.07.2026
Muss:KubernetesCloudFullstackAgileAISeniorRemote
Wer wir sind Die Mayflower GmbH baut Individualsoftware mit Fokus auf Generative AI – seit 1998 inhabergeführt.  Wir bringen komplette AI-Infrastrukturen in Produktion: Model-Serving, Agent-Gateways, Chat und Voice – direkt in der Umgebung des Kunden. Bei uns erwartet dich ein  agiles Arbeitsumfeld  mit Verantwortung auf Augenhöhe - ohne Hierarchien. Für unseren Bereich  Forward Deployed Engineering  suchen wir dich – jemanden, der AI-Systeme nicht empfiehlt, sondern baut, deployt und in Produktion verantwortet. Was dich erwartet Forward Deployed heißt bei uns: Du bist Beobachter, Architekt und Entwickler in einer Person. Dieselbe Person, die das Problem beim Kunden versteht, schreibt den Code, der es löst - und bleibt, bis es produktiv läuft. End-to-End-Ownership:  Du verantwortest Deployments von der Discovery über technisches Scoping, Architektur und Build bis zum Produktions-Rollout in der Infrastruktur des Kunden - eingebettet in dessen Engineering- und Fachteams. Full-Stack, wörtlich gemeint:  Du arbeitest über alle Schichten - Model-Serving (vLLM, eigene GPU-Cluster), Agent-Gateways und Runtimes, RAG-/GraphRAG-Pipelines, spezialisierte Agenten, Integration in ERP, CRM, DMS und Legacy-Systeme. Auf erprobtem Fundament:   Du deployst und erweiterst unsere Produkt-Stacks (mAIstack, VoiceAI, Amicable) beim Kunden, statt jedes Projekt bei null zu beginnen – mit LLMs wie GPT, Gemini, Claude oder Nemotron, Agent-Frameworks und agentischen Harnesses. Vector-Datenbanken und RAG sind dabei Handwerkszeug; als Senior sorgst du dafür, dass die Systeme im Betrieb  messbar und beherrschbar  bleiben – über Dataset-basierte Evaluations, Logging/Tracing und Observability. Der Rückfluss ist Teil des Jobs:  Was sich im Feld als wiederkehrendes Muster erweist, kodifizierst du mit deinem Team in unseren Produkten, Skills und Playbooks. Dein Projektwissen bleibt nicht beim Kunden liegen - es macht das nächste Deployment schneller. Kunde auf Augenhöhe:  Du entwickelst in Workshops ein gemeinsames Bild von Problem, Chancen und Lösung, triffst Trade-off-Entscheidungen zwischen Scope, Tempo und Qualität - und sprichst auch an, was der Kunde nicht hören will, wenn es das Ergebnis schützt. Sichtbarkeit:  Du bringst deine Erfahrungen in Whitepaper, Talks und unsere AI-Produkte ein - mit Unterstützung unserer technischen Redaktion. Das solltest du mitbringen Mindestens 10 Jahre in der Softwareentwicklung, idealerweise bei einem Individual-Software-Dienstleister oder in der IT-Beratung. Du hast LLM-Systeme in Produktion gebracht - nicht nur prototypisiert: RAG-Implementierungen, Vector Databases, Agent-Frameworks (LangGraph, OpenAI Agent SDK o. ä.), Evals und MLOps. Erfahrung mit der Integration von AI-Systemen in bestehende, gewachsene Enterprise-Architekturen - inklusive der unbequemen Teile (Auth, Legacy, Compliance). Von Vorteil: Erfahrung mit Inference-Infrastruktur (vLLM, GPU-Serving), Kubernetes und On-Prem-/Private-Cloud-Deployments. Die Kompetenz, AI-Konzepte Fachbereichen und C-Level anschaulich zu vermitteln - und die Standfestigkeit, Ownership für Entscheidungen zu übernehmen. Deutsch- und Englischkenntnisse auf C1-Niveau. Bereitschaft, phasenweise beim Kunden vor Ort zu arbeiten (projektabhängig, remote-embedded als Regelfall), plus Workshops und Konferenzen 1–2× im Monat innerhalb Deutschlands. Das haben wir zu bieten Kompetitive Vergütung:  Je nach Erfahrung und Kompetenz vergüten wir die Stelle mit einem Bruttojahresgehalt von 80.000 € bis 90.000 € bei 40 Wochenstunden. Echte Produktionsverantwortung:  Deine Systeme laufen produktiv bei großen Unternehmensgruppen - nicht in der Demo-Umgebung. Gute Software bauen:  Hier wird echter Wert auf Code- und Softwarequalität gelegt. Kein 08/15:  Abwechslung durch unterschiedliche Branchen, Use Cases und Technologien - vom GPU-Cluster bis zum Voice-Agenten. Kundenbeziehung auf Augenhöhe:  Wir pflegen eine ehrliche und vertrauensvolle Zusammenarbeit mit unseren Kunden. Mache einen Unterschied:  Viel Verantwortung, großer Gestaltungsspielraum - in einem Mittelständler, in dem dein Beitrag den wirtschaftlichen Erfolg direkt beeinflusst. Lerne immer dazu:  Weiterbildung (intern und extern), Training-on-the-job und regelmäßige Weiterentwicklungs- und Gehaltsgespräche. Wie arbeiten selbstorganisiert:   Wir geben dir den Freiraum, den Rahmen für gute Arbeit selbst mitzugestalten – im Team wie beim Kunden. Werde berühmt:  Eine technische Redaktion unterstützt dich beim Schreiben und Publizieren, sodass du als Experte nach außen sichtbar wirst. Du musst nicht die klügste Person im Raum sein:  Echte Sparring-Partner, die deine Ideen gemeinsam mit dir auf die Probe stellen und weiterentwickeln. Schalte einfach ab:  Niemand erwartet Erreichbarkeit nach Feierabend, im Urlaub oder trotz Krankmeldung. Viele Überstunden sind bei uns nicht üblich. Gut für die Psyche:  Ersthelfer psychische Gesundheit, Employee Assistance Programm und ein offener Umgang mit mentaler Gesundheit. Freiraum für dein Privatleben:  Flexible Arbeitszeiten, bis zu vier Tage Homeoffice die Woche, spontan einen Tag frei, Arbeiten aus dem EU-Ausland, Sabbatical oder 4 Wochen Urlaub am Stück. Bring dein +1 mit:  Brave Bürohunde oder Kinder an schulfreien Werktagen sind herzlich willkommen. Finanzielle Benefits:  Regelmäßige Teamevents, Wellpass, 30 Tage Urlaub, Kindergartenzuschuss, Deutsche Dienstrad. Der Kontakt zu uns Du hast Feedback oder Fragen zu der Stelle?  Schreib uns eine Email an  bewerbung@mayflower.de