Forward Deployed Engineer (m/w/d)

Mayflower· München, Würzburg· personio· publicerad 2026-07-10
Krav:KubernetesCloudFullstackAgileAISeniorRemote

Wer wir sind Die Mayflower GmbH baut Individualsoftware mit Fokus auf Generative AI – seit 1998 inhabergeführt.  Wir bringen komplette AI-Infrastrukturen in Produktion: Model-Serving, Agent-Gateways, Chat und Voice – direkt in der Umgebung des Kunden. Bei uns erwartet dich ein  agiles Arbeitsumfeld  mit Verantwortung auf Augenhöhe - ohne Hierarchien. Für unseren Bereich  Forward Deployed Engineering  suchen wir dich – jemanden, der AI-Systeme nicht empfiehlt, sondern baut, deployt und in Produktion verantwortet.

Was dich erwartet Forward Deployed heißt bei uns: Du bist Beobachter, Architekt und Entwickler in einer Person. Dieselbe Person, die das Problem beim Kunden versteht, schreibt den Code, der es löst - und bleibt, bis es produktiv läuft. End-to-End-Ownership:  Du verantwortest Deployments von der Discovery über technisches Scoping, Architektur und Build bis zum Produktions-Rollout in der Infrastruktur des Kunden - eingebettet in dessen Engineering- und Fachteams.

Full-Stack, wörtlich gemeint:  Du arbeitest über alle Schichten - Model-Serving (vLLM, eigene GPU-Cluster), Agent-Gateways und Runtimes, RAG-/GraphRAG-Pipelines, spezialisierte Agenten, Integration in ERP, CRM, DMS und Legacy-Systeme.

Auf erprobtem Fundament:   Du deployst und erweiterst unsere Produkt-Stacks (mAIstack, VoiceAI, Amicable) beim Kunden, statt jedes Projekt bei null zu beginnen – mit LLMs wie GPT, Gemini, Claude oder Nemotron, Agent-Frameworks und agentischen Harnesses. Vector-Datenbanken und RAG sind dabei Handwerkszeug; als Senior sorgst du dafür, dass die Systeme im Betrieb  messbar und beherrschbar  bleiben – über Dataset-basierte Evaluations, Logging/Tracing und Observability.

Der Rückfluss ist Teil des Jobs:  Was sich im Feld als wiederkehrendes Muster erweist, kodifizierst du mit deinem Team in unseren Produkten, Skills und Playbooks. Dein Projektwissen bleibt nicht beim Kunden liegen - es macht das nächste Deployment schneller.

Kunde auf Augenhöhe:  Du entwickelst in Workshops ein gemeinsames Bild von Problem, Chancen und Lösung, triffst Trade-off-Entscheidungen zwischen Scope, Tempo und Qualität - und sprichst auch an, was der Kunde nicht hören will, wenn es das Ergebnis schützt.

Sichtbarkeit:  Du bringst deine Erfahrungen in Whitepaper, Talks und unsere AI-Produkte ein - mit Unterstützung unserer technischen Redaktion.

Das solltest du mitbringen Mindestens 10 Jahre in der Softwareentwicklung, idealerweise bei einem Individual-Software-Dienstleister oder in der IT-Beratung.

Du hast LLM-Systeme in Produktion gebracht - nicht nur prototypisiert: RAG-Implementierungen, Vector Databases, Agent-Frameworks (LangGraph, OpenAI Agent SDK o. ä.), Evals und MLOps.

Erfahrung mit der Integration von AI-Systemen in bestehende, gewachsene Enterprise-Architekturen - inklusive der unbequemen Teile (Auth, Legacy, Compliance).

Von Vorteil: Erfahrung mit Inference-Infrastruktur (vLLM, GPU-Serving), Kubernetes und On-Prem-/Private-Cloud-Deployments.

Die Kompetenz, AI-Konzepte Fachbereichen und C-Level anschaulich zu vermitteln - und die Standfestigkeit, Ownership für Entscheidungen zu übernehmen.

Deutsch- und Englischkenntnisse auf C1-Niveau.

Bereitschaft, phasenweise beim Kunden vor Ort zu arbeiten (projektabhängig, remote-embedded als Regelfall), plus Workshops und Konferenzen 1–2× im Monat innerhalb Deutschlands.

Das haben wir zu bieten Kompetitive Vergütung:  Je nach Erfahrung und Kompetenz vergüten wir die Stelle mit einem Bruttojahresgehalt von 80.000 € bis 90.000 € bei 40 Wochenstunden.

Echte Produktionsverantwortung:  Deine Systeme laufen produktiv bei großen Unternehmensgruppen - nicht in der Demo-Umgebung.

Gute Software bauen:  Hier wird echter Wert auf Code- und Softwarequalität gelegt.

Kein 08/15:  Abwechslung durch unterschiedliche Branchen, Use Cases und Technologien - vom GPU-Cluster bis zum Voice-Agenten.

Kundenbeziehung auf Augenhöhe:  Wir pflegen eine ehrliche und vertrauensvolle Zusammenarbeit mit unseren Kunden.

Mache einen Unterschied:  Viel Verantwortung, großer Gestaltungsspielraum - in einem Mittelständler, in dem dein Beitrag den wirtschaftlichen Erfolg direkt beeinflusst.

Lerne immer dazu:  Weiterbildung (intern und extern), Training-on-the-job und regelmäßige Weiterentwicklungs- und Gehaltsgespräche.

Wie arbeiten selbstorganisiert:   Wir geben dir den Freiraum, den Rahmen für gute Arbeit selbst mitzugestalten – im Team wie beim Kunden.

Werde berühmt:  Eine technische Redaktion unterstützt dich beim Schreiben und Publizieren, sodass du als Experte nach außen sichtbar wirst.

Du musst nicht die klügste Person im Raum sein:  Echte Sparring-Partner, die deine Ideen gemeinsam mit dir auf die Probe stellen und weiterentwickeln.

Schalte einfach ab:  Niemand erwartet Erreichbarkeit nach Feierabend, im Urlaub oder trotz Krankmeldung. Viele Überstunden sind bei uns nicht üblich.

Gut für die Psyche:  Ersthelfer psychische Gesundheit, Employee Assistance Programm und ein offener Umgang mit mentaler Gesundheit.

Freiraum für dein Privatleben:  Flexible Arbeitszeiten, bis zu vier Tage Homeoffice die Woche, spontan einen Tag frei, Arbeiten aus dem EU-Ausland, Sabbatical oder 4 Wochen Urlaub am Stück.

Bring dein +1 mit:  Brave Bürohunde oder Kinder an schulfreien Werktagen sind herzlich willkommen.

Finanzielle Benefits:  Regelmäßige Teamevents, Wellpass, 30 Tage Urlaub, Kindergartenzuschuss, Deutsche Dienstrad.

Der Kontakt zu uns Du hast Feedback oder Fragen zu der Stelle?  Schreib uns eine Email an  bewerbung@mayflower.de