Data Lake Experten in Germany
aus über 15.000 CVs mit der Kraft von KI.Beauftragen Sie Experten, die Data-Lake-Speicher entwerfen, Ingestions- und Transformations-Pipelines bauen und Roh- sowie kuratierte Daten für Analytics und Machine Learning ordentlich strukturieren. Erhalten Sie schnelles, präzises Matching mit geprüften, verfügbaren Freelancern.
Lerne FRATCH Experten in Germany kennen, die kürzlich Data Lake eingesetzt haben
Karin Albiez
Letzte Position:
AI Benchmark Engineer | Native language specialist German bei Lilt
- Task Engineering: Bewertung von Coding Agents.
- Asset-Erstellung: Aufbau realistischer Aufgabenumgebungen mit Datensätzen und Dateien auf Deutsch. Entscheidend ist dabei, dass diese Assets in der Zielsprache bleiben, um den Umgang mit mehreren Sprachen wirklich zu messen.
- Prompting & Translation: Finden von Fehlerstellen, an denen die KI nicht funktioniert, auf Deutsch.
- Implementierung & Verifikation: Unterstützung bei der Entwicklung robuster Lösungen (Referenzimplementierungen) und Schreiben sehr zuverlässiger, deterministischer Verifizierungs-Skripte (mit rubric-basierten Bewertungen nur dann, wenn es unbedingt nötig ist).
- Kalibrierung & Ausführung: Auswertung von Ausführungslogs und Kalibrierung des Aufgabenschwierigkeitsgrads (Easy bis Very Hard) mit Standard-Terminal-Bench-Run-Konfigurationen gegen verschiedene Modellstufen (Haiku, Opus).
- Qualitätssicherung: Mitarbeit in einem strengen, 4-stufigen menschlichen Qualitätskontrollprozess (Erstellung, menschliche Prüfung, Kalibrierungsprüfung und Audit) zusammen mit automatisierten LLM-basierten Checks, um Fairness, grammatikalische Korrektheit und Benchmark-Integrität sicherzustellen.
- Linguistische Prüfung: Überprüfung von KI-Benchmark-Aufgaben in Hindi, Arabisch, Japanisch, Chinesisch, Tschechisch und Türkisch.
Niko Schmuck
Letzte Position:
Entwicklungsarchitekt, Technischer Leiter "gridlytics" bei HH Energienetze
- Aufbau einer Datenintegrationsplattform für Hoch-, Mittel- und Niederspannungs-Assets zur kontextuellen Analyse von Zeitreihen mit Stammdaten aus dem SCADA-Leitsystem (IEC 60870 104), INIS und SAP.
- Verantwortung für Architektur und Implementierung der Lösung sowie Sparringpartner für den Product Owner.
- Einsatz von Kotlin, Spring Boot, Maven, TimescaleDB, PostgreSQL, liquibase, Elements IoT, Docker, Kubernetes, Grafana, Python, Jupyter und verschiedenen API-Gateways.
Umut Gülac
Letzte Position:
Data Architect bei BA Technology
Ich bin ein erfahrener Data Engineer mit Spezialisierung auf End-to-End Data Integration, Cloud-DWH-Architekturen und hochwertige, gesteuerte Datenprodukte.
Ich habe folgende Projekte und Einsätze als Freelancer umgesetzt.
- Data Migration des CRM-Systems für AL-FA Objekt Service Gmbh
- Microsoft Software Resales Partnership
Ich suche freiberufliche Rollen wie: Freelance Data Engineer Cloud Data Warehouse Architect Data Modeling & Architecture Consultant MDM & Data Governance Specialist BI & Analytics Developer
Technische Schwerpunkte
- Data Engineering & Integration: SQL Server/SSIS, Informatica PowerCenter/IDQ, Talend, Kafka, Azure Data Factory – Delta/CDC/ELT-Patterns, robuste Pipelines, Monitoring/Recovery, Data Lineage & Impact Analysis, Medallion Architecture mit Bronze/Silver/Gold-Layern
- DWH & Cloud: Azure SQL / Data Lake / Synapse, AWS Redshift/S3, on-prem SQL/Oracle – skalierbare Data Marts mit starkem Kosten-Nutzen-Fokus.
- Data Modeling: Atomic (Inmon) und Dimensional (Kimball), Data Vault (Linstedt), Domain-Driven Design, klare Herkunft & Verträge.
- MDM & Governance: Informatica MDM, IBM MDM, Stewardship-Prozesse, Data-Quality-Regeln, Survivorship/XREF, Katalog/Glossar, SIF/BES/REST-Publikation.
- Analytics/BI: Power BI, SSAS, Cognos – geschäftsreife, wartbare Datenprodukte.
Christian Frauer
Letzte Position:
Abteilungsleiter (Interim) bei Städtisches Versorgungs- und Verkehrsunternehmen
- Definition und Aufbau der Themenbereiche
- Aufbau eines Governance-Modells für die Abteilung mit den Verantwortungsbereichen
- IT-Strategie, Projektmanagement, Prozessmanagement sowie Qualitäts- und Nachhaltigkeitsmanagement
- Ausarbeiten einer Kommunikationsstrategie in den Konzern
- Erstellen der IT-Strategie
- Design von Templates, Guidelines und Prozessen für einheitliches Arbeiten
- Aufnahme strategischer Leitplanken und Gruppierung laufender Projekte – Ableitung einer Roadmap für die strategische Planung
- Review laufender Projekte
- Erstellen der Kalkulation und des Staffing-Mengengerüsts
- Definition von Stellenprofilen
Chisom N.
Letzte Position:
Founder & Analytics Engineer bei Museni Nexus
- Kunde — Podimo ApS (Podcast- & Hörbuch-Streaming): Aufbau der Finance-Reporting-Schicht auf BigQuery + dbt + Airflow, inklusive der zentralen Revenue-Transaction-Fact-Tabellen, die im gesamten Finance-Reporting genutzt werden.
- API-Automatisierung: Entwurf und Aufbau einer BigQuery → Airflow → Microsoft Dynamics 365 Business Central REST-API-Pipeline zur Automatisierung der Verbuchung von Ausgangsrechnungen, mit Idempotenz und Stammdaten-Synchronisierung zwischen den Systemen.
- Delivery: alleiniger Engineer im Projekt — Anforderungen, Modellierung, Orchestrierung und Stakeholder-Kommunikation mit dem Finance-Team des Kunden, end to end.
Alexander Zhirov
Letzte Position:
Senior Data Solutions Engineer bei VMware Inc.
- Private Cloud-Datenplattform auf VMware vSphere entworfen und implementiert, Greenplum MPP, Apache Kafka, Kubernetes und Apache Solr integriert und Echtzeit-Ingestion-Pipelines mit Kafka Connect und Schema Registry entwickelt.
- Migration von Oracle Exadata zu Greenplum geleitet, Datenmodelle neu architektonisch aufgebaut, Speicher optimiert, RabbitMQ mit Debezium für CDC implementiert und VectorDB für Generative AI eingeführt.
- PoC für Multi-Cloud-Migration über AWS, Azure und GCP entworfen und umgesetzt, KPIs für Durchsatz, Latenz und Kosteneffizienz definiert, Bulk-Datentransfers durchgeführt, Analytics- und Streaming-Workloads validiert und Architektur-Empfehlungen im großen Maßstab geliefert.
- Legacy-On-Premises-Infrastruktur bewertet und moderne cloud-native Datenplattformen mit Greenplum und containerisierten Microservices entworfen, mit Beratung zu Skalierbarkeit, Disaster Recovery und High Availability.
Philipp Grunert
Letzte Position:
Data Scientist & ML Engineer bei Data-Science Factory GmbH
- Aufbau, Implementierung und Vertrieb von automatisierten Data-Science-Lösungen wie Scorecard Factory und Prognose Factory
- Implementierung automatisierter End-to-End-Cloud-Prozesse
- Entwicklung von LLM- und NLP-Modellen
- Erstellung interaktiver Reports
- Betreuung nationaler und internationaler Großkonzerne sowie mittelständischer Firmen bei der Implementierung von ML-Projekten
Justina Kmiecik
Letzte Position:
Freiberufliche Beraterin für Change & Data Transformation bei Freelance Fast Data Consulting
Projekt, strategische Beratung – Aufbau der Data Strategy und Data Governance Policy für die Niederlassung Deutschland, Kunde (Privatbank Julius Bär, Hauptsitz Zürich), März 2026 – bis heute
- Konzeption und Verhandlung der Datenstrategie mit den wichtigsten Stakeholdern sowie Einholung des Sign-offs durch den Vorstand (strategische Beratung) – in diesem Rahmen regulatorische Beratung zur Datenregulierung in der EU und speziell für Deutschland. Die Datenstrategie umfasst: Data Lifecycle Management: data capture, data storage, data usage, data retention policy, data quality incident management
- Definition von Meilensteinen und der technischen Machbarkeit zur Implementierung von TOM für die Datenstrategie, Datenqualitätsprüfungen, Metriken und ein Metadateninventar, um die Compliance der Bank mit den Anforderungen von DORA, BCBS239 und MaRisk sicherzustellen.
Projekt Kerndatenänderung, Kunde: (ING Bank, Frankfurt am Main), März – bis Dezember 2025
- Konzeption und Solution Design für neue End-to-End-Prozesse inkl. technischer Schnittstellen
- Definition von Synchronisationslogiken und Datenflüssen zwischen Legacy- und Zielsystemen (Dekommissionierung von Legacy-Systemen)
- Analyse und Validierung von Datenmodellen
- Stakeholder-Kommunikation mit Produktverantwortlichen, Feature Engineers, UX Designern und operativen Einheiten zur Entscheidungsfindung
- Analytics und Impact-Einschätzungen, z. B. zur Bewertung von Folgeeffekten und regulatorischen Anforderungen
- Dokumentation und Kommentierung technischer und fachlicher Anforderungen zur Unterstützung der Umsetzung in agilen Squads
Projekt Digitalisierung einer Usergruppe, Kunde: (ING Bank, Frankfurt am Main), als Interim Product Owner, Jan. 2025 – bis heute
- Mitgestaltung von Grundlagenentscheidungen zur Datenarchitektur und Prozesslogik im Kontext von historisierten Daten und Login-Funktionalität für User
- Entwicklung fachlicher Lösungskonzepte für die Migration zum Zielsystem, inkl. Systemintegration und Datenflüsse
- Unterstützung bei Analytics und Impact-Analysen, insbesondere zur Auskunftsfähigkeit gegenüber Ermittlungsbehörden
- Aktive Abstimmung mit Stakeholdern aus verschiedenen Squads zur Entscheidungsfindung und Sicherstellung regulatorischer Anforderungen
- Erstellung von Testszenarien für operative Teams und Backend-Systeme im Bereich API-Management unter Verwendung von Postman und Bruno.
Alexander Bromberg
Letzte Position:
Senior Data Engineer bei RWE AG
Architektur und Betrieb von Data Products für den Betrieb im Bereich erneuerbare Energien, einschließlich Windturbinen-, Netz-Mess- und Wetterdaten. Aufbau skalierbarer ETL/ELT-Pipelines in Azure Databricks mit Delta Lake (Bronze/Silver/Gold-Schichten) und Verarbeitung von Daten in verschiedenen Formaten, darunter strukturierte und semi-strukturierte Daten. Mitwirkung an einem Data-Quality-Framework mit Tabellen- und Spaltendokumentation, Ausreißererkennung und Vollständigkeitsmetriken für alle Datensätze innerhalb eines Data Products. Zusätzlich Implementierung eines DORA-KPI-Dashboards in Databricks, das für alle Data Products genutzt wird. Optimierung der CI/CD-Prozesse in Azure DevOps zur Vereinfachung der Bereitstellung über Entwicklungs-, Test- und Produktionsumgebungen hinweg.
Technology stack: Azure Databricks, PySpark, SQL, Delta Lake, Unity Catalog, Azure Data Lake, APIs, Dremio, Azure DevOps, YAML, Git, Databricks Workflows, Application Insights, Terraform, OpenAI API, Codex, LLM-assisted workflows
Prasad Tilloo
Letzte Position:
Solution Architect / Senior Manager – DTC E-Commerce-Plattform bei BRITA
- Leitete die Discovery-Phase und den POC für die Migration von Shopware zu Shopify Plus in EMEA-Märkten und bewertete die Eignung der Plattform, die technische Architektur sowie Multi-Brand-/Multi-Country-Funktionen anhand der Business-Anforderungen.
- Entwarf die Referenzarchitektur für die Shopify-Plus-Implementierung mit Headless-Frontend-Patterns (Vue.js, Nuxt.js), CMS-Integration (Magnolia) und Azure-Middleware (APIM, Functions, Logic Apps, Service Bus) für 11 EMEA-Märkte.
- Definierte die Migrationsstrategie mit Analyse von Data Mapping, Cutover-Ansatz und Zero-Downtime-Deployment-Patterns unter Einsatz von Varnish-Cache, GitOps-Pipelines und CI/CD-Orchestrierung über sechs Vendor-Teams hinweg.
- Entwickelte ein Multi-Tenant-Governance-Modell für Shopify Plus mit zentraler Administration, lokaler Storefront-Anpassung und Compliance-Kontrollen (GDPR, Datenresidenz).
- Prototypte KI-gestützte Suchoptimierung (LLM.txt, JSON-LD) für die Auffindbarkeit von Produkten in Google-AI-Ergebnissen und zeigte damit Potenziale für die Performance nach dem Go-live auf.
- Definierte mit C-Level-Strategie-Workshops die EMEA-Expansions-Roadmap für 15+ Märkte, einschließlich gestaffeltem Rollout, marktspezifischen Konfigurationen und Ressourcenbedarf.
- Tech Stack: React, Nuxt.js, Vue.js, Magnolia CMS, Shopware, Shopify Plus, Azure (APIM, Functions, Logic Apps, Service Bus, Front Door), Varnish, SAP, MS Dynamics, Docker, Kubernetes, GitHub Actions, PostgreSQL, Kafka
Oliver Voss
Letzte Position:
Interim Manager und Unternehmensberater bei Selbstständiger
- Entwicklung einer Eintrittsstrategie für den Schadenbereich eines Versicherungsdienstleisters.
- Analyse und Optimierung der bestehenden Schadenprozesse.
- Definition von Steuerungskennzahlen und KPIs zur Leistungs- und Effizienzverbesserung.
- Beratung des Managements zur Marktpositionierung und Prozessdigitalisierung.
- Führung eines IT-Teams mit 13 Mitarbeitenden im Rahmen einer Vakanzvertretung.
- Sicherstellung des stabilen IT-Betriebs und Steuerung externer IT-Dienstleister.
- Leitung regulatorischer Projekte, insbesondere zur Umsetzung der DORA-Verordnung.
- Vorbereitung und Begleitung eines IT-Sicherheitsaudits.
- Change Management und Konfliktmoderation in einem herausfordernden Transformationsumfeld (FI-Migration).
Jorge Machado
Letzte Position:
Technical Lead / Fractional CTO bei Würth GmbH
Ich habe eine KI-gestützte Multi-Tenant-Plattform auf Azure entworfen und entwickelt, die SAP-Prozessaufzeichnungen in technische Dokumentation, Präsentationen und automatisierte Tests umwandelt und dabei über 15.000 Prozessaufzeichnungen für Unternehmenskunden wie Würth verarbeitet. Ich war verantwortlich für die Architektur, die produktiven Releases und das DevOps-Setup. Außerdem habe ich ein Multi-Tenant-System mit SSO und rollenbasierter Zugriffskontrolle auf Azure entworfen. MCP Server mit dynamischer OAuth-Authentifizierung implementiert.
Hauptaufgaben:
- Sprint-Planung und Feature-Vorbereitung
- Design der Multi-Tenant-Plattform-Architektur (FastAPI, SQLAlchemy, PostgreSQL Row-Level Security für Tenant-Isolation)
- Entwicklung von KI-Pipelines mit Prefect für Transkription (Azure Speech API), Dokumentengenerierung und SAP-Screen-Recording-Analyse (Claude, gpt-4-mini)
- Design und Implementierung eines MCP-Servers, um Tenant-Wissen für LLM-Clients (Claude) bereitzustellen, mit asynchronem Retrieval und Reranking
- Implementierung von LLM-Kosten-Tracking, Rate Limiting und Client-Pooling für Anthropic/OpenAI/Azure-OpenAI-Endpunkte
- Einrichtung von CI/CD: Docker-Images in Azure Container Registry, GitHub Actions, Azure Static Web Apps, Alembic-Migrationen in Containern
- Verwaltung von Produktions-Deployments und Durchführung von Live-Datenmigrationen für Unternehmenskunden
- Definition von Engineering-Standards und Architekturmustern für das Team
Umgebung: Azure / Azure Foundry / Python / FastAPI / Prefect / React / PostgreSQL
Maximilian Braun
Letzte Position:
CTO bei nikan.ai
Ich verantworte die technische Vision und Produktstrategie für ein souveränes KI-Startup mit Fokus auf europäische Dateninfrastruktur und Compliance. Dabei leite ich ein funktionsübergreifendes Team von 7 Personen in den Bereichen Engineering, KI-Entwicklung und Betrieb in einer vollständig remote arbeitenden Umgebung.
- Definition der Produkt- und Technologieroadmap des Unternehmens, inklusive KI-gestützter Lösungen mit integrierten Zahlungsservices
- Entwicklung skalierbarer Plattformarchitekturen mit Fokus auf Datensouveränität, Sicherheit und europäische regulatorische Vorgaben
- Aktive Mitgestaltung der Full-Stack-Entwicklung sowie Etablierung von Engineering-Best-Practices und DevOps-Workflows
- Förderung der Entwicklerproduktivität durch Mentoring, architektonische Beratung und Tool-Entscheidungen
- Mitgestaltung der langfristigen technischen Strategie, um das Unternehmen für nachhaltiges Wachstum zu positionieren
Christiane Neher
Letzte Position:
Management Consultant bei Christiane Neher Management Consulting
Großes Versicherungsunternehmen – Consultant Wiesbaden: Beratungsunterstützung bei der Einführung eines integrierten Planungs- und Performance-Management-Frameworks (operativ, finanziell, Kunde) zur Verbesserung der kundenzentrierten Transparenz, der Entscheidungsqualität und der Steuerungsfähigkeit über alle Geschäftsbereiche innerhalb eines Versicherungsunternehmens:
- Analyse bestehender Prozesse, Reports, KPIs und Methoden zur KPI-Berechnung
- Konzeption und Einführung neuer, standardisierter Kunden-KPIs (brutto/netto) sowie zentraler Steuerungskennzahlen mit konsistenter Verknüpfung über alle Geschäftsbereiche hinweg
- Neuberechnung, Validierung und Plausibilitätsprüfungen von KPIs auf Basis bestehender und neu integrierter Datenquellen
- Konzeptionelle Unterstützung beim Aufbau eines integrierten Reporting- und Performance-Management-Setups
- Durchführung von Customer-Insights-Analysen zur Identifikation von Mustern und Auffälligkeiten in Kunden-Datenclustern
Großes Handelsunternehmen – Consultant in Karlsruhe: Beratungsleistungen für den Aufbau und die schrittweise Implementierung einer international einsetzbaren RELEX-Lösung im Umfeld des Supply-Chain-Managements:
- Beratung der Gesamt- und Teilprojektleitung bei Methodik, Projektaufsetzung und Steuerung (z. B. agiler Ansatz, Jira-Konfiguration, RELEX-Phasen, Jira Structure PPM)
- Strategisch-operative Beratung bei der Einführung von RELEX einschließlich Best Practices
- Unterstützung bei der Definition übergeordneter Ziele und Anforderungen (2-Jahres-Zielbild)
- Begleitung bei der Eingrenzung eines relevanten Supply-Chain-Netzwerksegments für das Projekt
- Entwicklung einer Roadmap für den iterativen, inkrementellen RELEX-Aufbau und Rollout
- Bewertung von Projektabhängigkeiten (Schnittstellen, Konfigurationen etc.)
- Beratung zur priorisierten Umsetzung von fachlichen Anforderungen und Datenschnittstellen
- Unterstützung bei der Testplanung (Datenvalidierung, Systemtest, UAT)
- Beratung zu Internationalisierung, Change Management, Training und Wissenstransfer
- Stakeholder-Beratung und Abstimmung zwischen Kunde, Implementierungspartner und RELEX
Versicherungsunternehmen – Management Consultant in München: Analyse, Beratung und Unterstützung bei der Optimierung einer groß angelegten Business- und IT-Transformation. Fokus auf strategisch wichtige Programme und Modernisierungsprojekte im Bereich Managed Services Operations und Prozesse:
- Prüfung von Projektplänen und Deliverables; Analyse von Programmen und Projekten (z. B. Cloud-Ansatz, Prozessstandardisierung, Systemintegration, Roadmaps)
- Identifikation technischer, fachlicher und personeller Risiken und Herausforderungen; Entwicklung inhaltlicher Maßnahmen und Alternativen
- Vorschläge zur Qualitätsverbesserung für Programm- und Modernisierungsmaßnahmen
- Sparringspartner sowie fachliche, technische, strukturelle und organisatorische Beratung für Projekt- und Programmmanagement
Großer Handelskonzern – Management Consultant & Stream Lead in Köln: Beratung, Prozess-, Projekt- und Produktmanagement für die Einführung und Umsetzung eines großen strategischen Programms im Bereich Advanced Analytics, Sortiment und Flächenmanagement:
- Aufbau, Test und Rollout eines neuen Flächenplanungs-, Automatisierungs- und Optimierungsprodukts auf Basis des bestehenden clusterbasierten Merchandising-Ansatzes
- Definition und Aufbau neuer Prozesse sowie Transformations- und Change-Management-Maßnahmen für den neuen filialspezifischen Merchandising-Ansatz
- Zusammenarbeit mit Advanced Analytics und IT (intern und extern) bei Softwareeinführungen, Automatisierungen, Erweiterungen und Schnittstellen
- MVP-Ansatz und Pilotierung in Phasen mit schrittweisem Rollout (Pilot mit 80 Filialen, Region mit 500 Filialen, nationale Ebene mit 4000 Filialen)
Großes Handelsunternehmen – Agile Coach & Change Agent in Köln: Agile Coach, OKR Master und Facilitator für die Einführung des OKR-Ansatzes in einem großen strategischen Digitalisierungsprogramm für Einzelhandelsfilialen:
- Coaching des Kernteams mit Themenverantwortlichen und Teamleitern
- Einführung in das OKR-Thema und Aufbau des OKR-Zyklus
- Etablierung des OKR-Ansatzes in den Teams und auf bereichsübergreifender Ebene
Dienstleistungs- und Logistikunternehmen – Management Consultant in Großbritannien: Beratung und Coaching bei der Umstrukturierung der Data-Analytics-Abteilung:
- Analyse der aktuellen Herausforderungen
- Definition übergeordneter Ziele
- Entwicklung eines Vorschlags für eine neue Teamstruktur
- Identifikation benötigter Kompetenzen, Fähigkeiten und Verantwortlichkeiten
- Beratung und Abstimmung zur Kommunikations- und Change-Management-Strategie
Thomas Hoefkens
Letzte Position:
Senior MLOps-, DevOps Engineer bei Trianel Energy
- Aufbau und Betrieb einer End-to-End-MLOps-Plattform auf Azure ML und Kubernetes (Kubeflow) zur automatisierten Bereitstellung, Überwachung und Skalierung von Forecasting-Modellen (u. a. Temporal Fusion Transformer, Informer, Autoformer).
- Implementierung von CI/CD-Pipelines in Azure DevOps für den vollständigen ML-Lifecycle – von Ressourcbereitstellung (Terraform), Datentransformation (Hugging Face Datasets, Pandas, PyTorch, CUDA-Cluster) über Training und Evaluation bis hin zu Model Registry und Endpoint-Deployment.
- Integration von MLflow für Experiment-Tracking, Modellversionierung, Performance-Monitoring und automatisierte Registrierung in der Azure Model Registry.
- Entwicklung und Containerisierung von PyTorch-Trainingsjobs (Azure Notebook, Jupyter Notebooks) für Preis- und Zeitreihenprognosen (PFC-Modelle) mit automatischem Rollout über Azure ML Endpoints und REST/gRPC-Schnittstellen, Docker-Containerisierung, Absicherung über OAuth 2.0.
- Einrichtung von Monitoring- und Alerting-Mechanismen (Prometheus, MLflow Metrics), Log-Zentralisierung und Kostenüberwachung.
- Automatisierung der Infrastruktur-Bereitstellung und Modellbereitstellung mittels Terraform, Helm und Azure CLI; Anbindung an bestehende Marktdatensysteme und Event-Pipelines.
- Migration bestehender Workloads und Datenbanken (IONOS → Azure, MongoDB) mit Integration in zentrale MLOps-Workflows und interne Netzwerke.
- Erweiterung der Plattform um LLM-basierte Tools (LangChain, LangServe) zur Integration von GPT-basierten Analysemodulen in bestehende Spring-Boot-Dienste für Marktanomalie-Erkennung und automatisierte Reports.
- Analyse, Architektur einer Softwarelösung zur effizienten Verarbeitung von Massendaten (>3000 Nachrichten/Sek.) (Market Data Store).
- Spring Boot / Java 21 Container-Entwicklung mit RabbitMQ zur Verteilung von Börsendaten über MongoDB (Kubernetes) mit Schnellspeicherung von Daten in Redis RMaps, Deduplizierung und Weiterleitung von Nachrichten an Read-Model-Queues, Aufbau von Read Models für die UI-Anzeige in MongoDB.
- Einbindung von RESTHeart zur Erzeugung einer REST API gegen MongoDB.
- Aufbau eines Angular-Frontends zur Vereinfachung der Datenabfrage und Stammdatenpflege.
- Agentic Coding mit remote und local LLM (Claude Sonnet, Ollama Qwen) und MCP-Servern.
- Entwicklung von Python-Skripten zur Transformation und Bereinigung eingehender Börsendaten (Pandas, scikit-learn).
Entdecke mehr als 15.000 Top-Freelancer
Statistiken von Experten, die Data Lake einsetzen
Aggregiert aus den beruflichen Profilen passender Freelancer.
Berufserfahrung
18 Jahre
Positionsdauer
2,4 Jahre
Positionen pro Freelancer
10
Häufigste Fachbereiche
Informationstechnologie (IT), Business Intelligence, Produktentwicklung
Häufigste Branchen
Informationstechnologie (IT), Professionelle Dienstleistungen, Bank- und Finanzwesen
Fokus der Zertifizierungen
Informationstechnologie (IT), Business Intelligence, Projektmanagement
Bachelor-Abschluss oder höher
95%
Master-Abschluss oder höher
70%
Doktortitel
17%
Zertifizierungen pro Freelancer
4
Häufigste Sprachen
Deutsch, Englisch, Französisch
Sprechen zwei oder mehr Sprachen
98%
Basierend auf unserem Profilpool, Stand 30 Aug 2026.
Tagessatzverteilung
Das Diagramm zeigt, wie sich die Tagessätze der Freelancer in dieser Technologie in Germany verteilen, basierend auf aktuellen Verträgen auf unserer Plattform. Jeder Balken deckt eine Tagessatzspanne ab – seine Höhe zeigt, wie viele Freelancer innerhalb dieser Spanne abrechnen.
Durchschnittssätze von Experten in Germany, die Data Lake einsetzen
Die Tagessätze basieren auf aktuellen Verträgen und enthalten keinen FRATCH-Aufschlag.
Der durchschnittliche Tagessatz ist der Mittelwert aller Tagessätze aus aktuellen Verträgen vergleichbarer Freelancer auf unserer Plattform.
Der Median-Tagessatz ist der mittlere Wert aller Tagessätze – die Hälfte der vergleichbaren Freelancer verlangt weniger, die andere Hälfte mehr. Anders als der Durchschnitt wird er von Ausreißern kaum beeinflusst.
Berechnet auf Basis der Tagessätze unserer Freelancer, Stand 30 Aug 2026. Die tatsächlichen Tagessätze können je nach Dienstalter, Erfahrung, Fachkenntnissen, Projektkomplexität und Auftragsdauer variieren.
Über die Technologie
Was ein Data Lake ist
Ein Data Lake speichert rohe und verarbeitete Daten an einem Ort, bereit für Reporting, Analytics und Machine Learning. Er eignet sich für strukturierte Tabellen, Logs, Events, Dateien und Streaming-Daten, ohne zuerst ein festes Schema vorzuschreiben.
Häufige Anwendungsfälle
- Daten aus Apps, Datenbanken und SaaS-Tools zentral zusammenführen
- Datensätze für BI, Prognosen und Modelltraining aufbereiten
- Historie für Audit, Replay und Ad-hoc-Analysen behalten
- Batch-Ladeprozesse, Event-Streams und Dateiuploads unterstützen
Plattform-Stack
Starke Spezialisten arbeiten mit Objektspeicher, Katalog-Tools und Transformationsschichten rund um den Lake. Sie nutzen oft S3, Azure Data Lake Storage, Google Cloud Storage, Databricks, Spark, dbt, Airflow sowie Metadaten- oder Governance-Services.
Wo Unternehmen Hilfe brauchen
Teams holen sich freiberufliche Expertise dazu, wenn ein Lake unübersichtlich, langsam oder schwer vertrauenswürdig wird. Das passiert bei Cloud-Migrationen, neuen Datenprodukten, Plattform-Neuentwicklungen oder wenn Quellsysteme in Germany und anderen Regionen eine gemeinsame Analytics-Schicht speisen müssen.
Was gute Spezialisten liefern
Gute Profis definieren Ordner- und Tabellenstruktur, Namensregeln, Zugriffssteuerung und Aufbewahrungsrichtlinien. Sie richten außerdem Ingestion, Schema-Behandlung, Qualitätsprüfungen und Dokumentation ein, damit Teams den Lake nutzen können, ohne zu raten, woher die Daten kommen.
Worauf man achten sollte
- Klare Gedanken zu Roh-, kuratierten und vertrauenswürdigen Zonen
- Praktische Arbeit mit Batch- und Streaming-Pipelines
- Pragmatische Gewohnheiten bei Governance, Sicherheit und Lineage
- Erfahrung mit Query-Engines und Performance-Tuning für den Lake
Häufig gestellte Fragen
Was Kunden uns zu Data Lake am häufigsten fragen – kurz beantwortet.
Ein Data Lake wird genutzt, um viele Arten von Daten an einem Ort zu speichern, damit Teams sie später analysieren können. Unternehmen nutzen ihn für Reporting, Machine Learning, historische Replays und den zentralen Datenaustausch zwischen Abteilungen. Er funktioniert am besten, wenn Rohdaten flexibel bleiben müssen, bevor sie für einen bestimmten Zweck aufbereitet werden.
Ein Data Lake speichert Daten in einer eher rohen Form und akzeptiert viele Datei- und Event-Typen. Ein Data Warehouse ist meist stärker strukturiert und für vertrauenswürdiges Reporting optimiert. Viele Unternehmen nutzen beides: den Lake für breite Aufnahme und Erkundung, das Warehouse für kuratierte Business-Berichte.
Holen Sie einen Data Lake-Spezialisten dazu, wenn Ingestion fehlschlägt, die Datenqualität unklar ist oder Zugriffsregeln chaotisch sind. Freelancer-Hilfe ist auch sinnvoll bei einer Cloud-Migration, einem Plattform-Neubau oder wenn Teams eine saubere Grundlage brauchen, bevor Analytics oder Machine Learning dazukommen. Ein starker Spezialist kann das Design schnell stabilisieren.
Ein guter Data Lake-Experte sollte auch Pipelines, Datenmodellierung und Governance kennen. Nützliche Zusatzkenntnisse sind Spark, Airflow, dbt, SQL, Cloud Storage und Katalog- oder Lineage-Tools. Sicherheit und Kostenkontrolle sind ebenfalls wichtig, weil Lakes ohne Disziplin schnell teuer und schwer zu verwalten werden können.
Azure Data Lake ist ein Microsoft-Dienst, mit dem man einen Data Lake auf Azure aufbauen kann. Es ist nicht der einzige Weg, einen zu erstellen, aber eine häufige Option für Unternehmen, die bereits Microsoft-Cloud-Dienste nutzen. Viele Suchende verwenden den Begriff sowohl für den Dienst als auch für die breitere Architektur.
Fragen Sie, wie der Data Lake organisiert wird, wer die Qualitätsprüfungen verantwortet und wie der Zugriff gesteuert wird. Fragen Sie außerdem, welche Tools die Person für Ingestion, Transformation und Governance bevorzugt und wie Entscheidungen dokumentiert werden. Die besten Experten erklären Abwägungen in klarer Sprache, nicht nur Tool-Namen.
Ja, Data Lake-Arbeit wird oft remote erledigt, weil die meisten Aufgaben Design-, Pipeline- und Review-Arbeit sind. Für Unternehmen in Germany funktioniert die Zusammenarbeit aus der Ferne meist gut, wenn der Spezialist klar auf Englisch kommunizieren kann und sich mit den lokalen Stakeholdern abstimmt. Vor-Ort-Zeit hilft eher bei Workshops, sensiblen Migrationsphasen oder wenn Teams eine enge Abstimmung der Abläufe wünschen.
Ein starker Data Lake-Spezialist hinterlässt eine Struktur, die andere Teams tatsächlich nutzen können. Achten Sie auf klares Zonen-Design, zuverlässige Ingestion, dokumentierte Datenverträge und praxistaugliche Governance. Gute Arbeit zeigt sich in weniger Ausfällen, leichterer Auffindbarkeit und weniger manueller Nacharbeit für die Teams, die vom Lake abhängen.
Der durchschnittliche Stundensatz von Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, liegt bei 103 €, was einem Tagessatz von etwa 822 € bei einem 8-Stunden-Tag entspricht.
Von den Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, haben 95% mindestens einen Bachelor-Abschluss, 70% mindestens einen Master-Abschluss und 17% einen Doktortitel.
Freelancer in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, haben im Durchschnitt 18 Jahre Berufserfahrung; ein einzelnes Projekt dauert typischerweise etwa 2,4 Jahre.
Die häufigsten Sprachen unter Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, sind Deutsch (98%), Englisch (98%) und Französisch (22%).
Die häufigsten Industrien unter Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, sind Informationstechnologie (IT) (86%), Professionelle Dienstleistungen (56%) und Bank- und Finanzwesen (49%).
Die häufigsten Bereiche unter Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, sind Informationstechnologie (IT) (95%), Business Intelligence (78%) und Produktentwicklung (64%).
Hauptstandorte der FRATCH Experten, die kürzlich Data Lake eingesetzt haben
Unsere Freelancer und Interim-Experten sind in der gesamten DACH-Region zuhause — verfügbar vor Ort in den wichtigsten Wirtschaftszentren oder komplett remote. Wähle einen Standort und entdecke passende Spezialisten, lokale Markteinblicke und aktuelle Verfügbarkeiten.
Kostenlose Demo vereinbaren
Kontaktiere uns und das FRATCH-Team meldet sich innerhalb von 4 Stunden bei dir.
Möchtest du lieber direkt mit uns in Kontakt treten?
Wir haben immer Zeit für einen Anruf oder eine E-Mail!

Berlin
Hamburg
München
Frankfurt