Zum Hauptinhalt springen
🇩🇪DSGVO konform
Finden Sie in Minuten die perfekten

Data Lake Experten in Germany

aus über 15.000 CVs mit der Kraft von KI.

Beauftragen Sie Experten, die Data-Lake-Speicher entwerfen, Ingestions- und Transformations-Pipelines bauen und Roh- sowie kuratierte Daten für Analytics und Machine Learning ordentlich strukturieren. Erhalten Sie schnelles, präzises Matching mit geprüften, verfügbaren Freelancern.

Lerne FRATCH Experten in Germany kennen, die kürzlich Data Lake eingesetzt haben

Verifizierter Experte

Niko Schmuck

Profil ansehen

Entwicklungsarchitekt / Lösungsarchitekt

Hamburg
Niko Schmuck

Letzte Position:

Entwicklungsarchitekt, Technischer Leiter "gridlytics" bei HH Energienetze

  • Aufbau einer Datenintegrationsplattform für Hoch-, Mittel- und Niederspannungs-Assets zur kontextuellen Analyse von Zeitreihen mit Stammdaten aus dem SCADA-Leitsystem (IEC 60870 104), INIS und SAP.
  • Verantwortung für Architektur und Implementierung der Lösung sowie Sparringpartner für den Product Owner.
  • Einsatz von Kotlin, Spring Boot, Maven, TimescaleDB, PostgreSQL, liquibase, Elements IoT, Docker, Kubernetes, Grafana, Python, Jupyter und verschiedenen API-Gateways.
Verifizierter Experte

Umut Gülac

Profil ansehen

Freiberufler

Frankfurt
Umut Gülac

Letzte Position:

Data Architect bei BA Technology

Ich bin ein erfahrener Data Engineer mit Spezialisierung auf End-to-End Data Integration, Cloud-DWH-Architekturen und hochwertige, gesteuerte Datenprodukte.

Ich habe folgende Projekte und Einsätze als Freelancer umgesetzt.

  • Data Migration des CRM-Systems für AL-FA Objekt Service Gmbh
  • Microsoft Software Resales Partnership

Ich suche freiberufliche Rollen wie: Freelance Data Engineer Cloud Data Warehouse Architect Data Modeling & Architecture Consultant MDM & Data Governance Specialist BI & Analytics Developer

Technische Schwerpunkte

  • Data Engineering & Integration: SQL Server/SSIS, Informatica PowerCenter/IDQ, Talend, Kafka, Azure Data Factory – Delta/CDC/ELT-Patterns, robuste Pipelines, Monitoring/Recovery, Data Lineage & Impact Analysis, Medallion Architecture mit Bronze/Silver/Gold-Layern
  • DWH & Cloud: Azure SQL / Data Lake / Synapse, AWS Redshift/S3, on-prem SQL/Oracle – skalierbare Data Marts mit starkem Kosten-Nutzen-Fokus.
  • Data Modeling: Atomic (Inmon) und Dimensional (Kimball), Data Vault (Linstedt), Domain-Driven Design, klare Herkunft & Verträge.
  • MDM & Governance: Informatica MDM, IBM MDM, Stewardship-Prozesse, Data-Quality-Regeln, Survivorship/XREF, Katalog/Glossar, SIF/BES/REST-Publikation.
  • Analytics/BI: Power BI, SSAS, Cognos – geschäftsreife, wartbare Datenprodukte.
Verifizierter Experte

Christian Frauer

Profil ansehen

IT-Projektumsetzer (Problemlöser)

Buxtehude
Christian Frauer

Letzte Position:

Abteilungsleiter (Interim) bei Städtisches Versorgungs- und Verkehrsunternehmen

  • Definition und Aufbau der Themenbereiche
  • Aufbau eines Governance-Modells für die Abteilung mit den Verantwortungsbereichen
  • IT-Strategie, Projektmanagement, Prozessmanagement sowie Qualitäts- und Nachhaltigkeitsmanagement
  • Ausarbeiten einer Kommunikationsstrategie in den Konzern
  • Erstellen der IT-Strategie
  • Design von Templates, Guidelines und Prozessen für einheitliches Arbeiten
  • Aufnahme strategischer Leitplanken und Gruppierung laufender Projekte – Ableitung einer Roadmap für die strategische Planung
  • Review laufender Projekte
  • Erstellen der Kalkulation und des Staffing-Mengengerüsts
  • Definition von Stellenprofilen
Verifizierter Experte

Chisom N.

Profil ansehen

Senior Analytics Engineer

Schweinfurt
Chisom N.

Letzte Position:

Founder & Analytics Engineer bei Museni Nexus

  • Kunde — Podimo ApS (Podcast- & Hörbuch-Streaming): Aufbau der Finance-Reporting-Schicht auf BigQuery + dbt + Airflow, inklusive der zentralen Revenue-Transaction-Fact-Tabellen, die im gesamten Finance-Reporting genutzt werden.
  • API-Automatisierung: Entwurf und Aufbau einer BigQuery → Airflow → Microsoft Dynamics 365 Business Central REST-API-Pipeline zur Automatisierung der Verbuchung von Ausgangsrechnungen, mit Idempotenz und Stammdaten-Synchronisierung zwischen den Systemen.
  • Delivery: alleiniger Engineer im Projekt — Anforderungen, Modellierung, Orchestrierung und Stakeholder-Kommunikation mit dem Finance-Team des Kunden, end to end.
Verifizierter Experte

Alexander Zhirov

Profil ansehen

Senior Data Architekt & Data Engineer

Berlin
Alexander Zhirov

Letzte Position:

Senior Data Solutions Engineer bei VMware Inc.

  • Private Cloud-Datenplattform auf VMware vSphere entworfen und implementiert, Greenplum MPP, Apache Kafka, Kubernetes und Apache Solr integriert und Echtzeit-Ingestion-Pipelines mit Kafka Connect und Schema Registry entwickelt.
  • Migration von Oracle Exadata zu Greenplum geleitet, Datenmodelle neu architektonisch aufgebaut, Speicher optimiert, RabbitMQ mit Debezium für CDC implementiert und VectorDB für Generative AI eingeführt.
  • PoC für Multi-Cloud-Migration über AWS, Azure und GCP entworfen und umgesetzt, KPIs für Durchsatz, Latenz und Kosteneffizienz definiert, Bulk-Datentransfers durchgeführt, Analytics- und Streaming-Workloads validiert und Architektur-Empfehlungen im großen Maßstab geliefert.
  • Legacy-On-Premises-Infrastruktur bewertet und moderne cloud-native Datenplattformen mit Greenplum und containerisierten Microservices entworfen, mit Beratung zu Skalierbarkeit, Disaster Recovery und High Availability.
Verifizierter Experte

Philipp Grunert

Profil ansehen

Machine-Learning- & Data-Engineer

München
Philipp Grunert

Letzte Position:

Data Scientist & ML Engineer bei Data-Science Factory GmbH

  • Aufbau, Implementierung und Vertrieb von automatisierten Data-Science-Lösungen wie Scorecard Factory und Prognose Factory
  • Implementierung automatisierter End-to-End-Cloud-Prozesse
  • Entwicklung von LLM- und NLP-Modellen
  • Erstellung interaktiver Reports
  • Betreuung nationaler und internationaler Großkonzerne sowie mittelständischer Firmen bei der Implementierung von ML-Projekten
Verifizierter Experte

Justina Kmiecik

Profil ansehen

Managerin für Datenmanagement & Governance

Oberursel
Justina Kmiecik

Letzte Position:

Freiberufliche Beraterin für Change & Data Transformation bei Freelance Fast Data Consulting

Projekt, strategische Beratung – Aufbau der Data Strategy und Data Governance Policy für die Niederlassung Deutschland, Kunde (Privatbank Julius Bär, Hauptsitz Zürich), März 2026 – bis heute

  • Konzeption und Verhandlung der Datenstrategie mit den wichtigsten Stakeholdern sowie Einholung des Sign-offs durch den Vorstand (strategische Beratung) – in diesem Rahmen regulatorische Beratung zur Datenregulierung in der EU und speziell für Deutschland. Die Datenstrategie umfasst: Data Lifecycle Management: data capture, data storage, data usage, data retention policy, data quality incident management
  • Definition von Meilensteinen und der technischen Machbarkeit zur Implementierung von TOM für die Datenstrategie, Datenqualitätsprüfungen, Metriken und ein Metadateninventar, um die Compliance der Bank mit den Anforderungen von DORA, BCBS239 und MaRisk sicherzustellen.

Projekt Kerndatenänderung, Kunde: (ING Bank, Frankfurt am Main), März – bis Dezember 2025

  • Konzeption und Solution Design für neue End-to-End-Prozesse inkl. technischer Schnittstellen
  • Definition von Synchronisationslogiken und Datenflüssen zwischen Legacy- und Zielsystemen (Dekommissionierung von Legacy-Systemen)
  • Analyse und Validierung von Datenmodellen
  • Stakeholder-Kommunikation mit Produktverantwortlichen, Feature Engineers, UX Designern und operativen Einheiten zur Entscheidungsfindung
  • Analytics und Impact-Einschätzungen, z. B. zur Bewertung von Folgeeffekten und regulatorischen Anforderungen
  • Dokumentation und Kommentierung technischer und fachlicher Anforderungen zur Unterstützung der Umsetzung in agilen Squads

Projekt Digitalisierung einer Usergruppe, Kunde: (ING Bank, Frankfurt am Main), als Interim Product Owner, Jan. 2025 – bis heute

  • Mitgestaltung von Grundlagenentscheidungen zur Datenarchitektur und Prozesslogik im Kontext von historisierten Daten und Login-Funktionalität für User
  • Entwicklung fachlicher Lösungskonzepte für die Migration zum Zielsystem, inkl. Systemintegration und Datenflüsse
  • Unterstützung bei Analytics und Impact-Analysen, insbesondere zur Auskunftsfähigkeit gegenüber Ermittlungsbehörden
  • Aktive Abstimmung mit Stakeholdern aus verschiedenen Squads zur Entscheidungsfindung und Sicherstellung regulatorischer Anforderungen
  • Erstellung von Testszenarien für operative Teams und Backend-Systeme im Bereich API-Management unter Verwendung von Postman und Bruno.
Verifizierter Experte

Alexander Bromberg

Profil ansehen

Senior Data Engineer

Köln
Alexander Bromberg

Letzte Position:

Senior Data Engineer bei RWE AG

Architektur und Betrieb von Data Products für den Betrieb im Bereich erneuerbare Energien, einschließlich Windturbinen-, Netz-Mess- und Wetterdaten. Aufbau skalierbarer ETL/ELT-Pipelines in Azure Databricks mit Delta Lake (Bronze/Silver/Gold-Schichten) und Verarbeitung von Daten in verschiedenen Formaten, darunter strukturierte und semi-strukturierte Daten. Mitwirkung an einem Data-Quality-Framework mit Tabellen- und Spaltendokumentation, Ausreißererkennung und Vollständigkeitsmetriken für alle Datensätze innerhalb eines Data Products. Zusätzlich Implementierung eines DORA-KPI-Dashboards in Databricks, das für alle Data Products genutzt wird. Optimierung der CI/CD-Prozesse in Azure DevOps zur Vereinfachung der Bereitstellung über Entwicklungs-, Test- und Produktionsumgebungen hinweg.

Technology stack: Azure Databricks, PySpark, SQL, Delta Lake, Unity Catalog, Azure Data Lake, APIs, Dremio, Azure DevOps, YAML, Git, Databricks Workflows, Application Insights, Terraform, OpenAI API, Codex, LLM-assisted workflows

Verifizierter Experte

Prasad Tilloo

Profil ansehen

Solution Architect / Senior Manager – DTC E-Commerce-Plattform

Frankfurt
Prasad Tilloo

Letzte Position:

Solution Architect / Senior Manager – DTC E-Commerce-Plattform bei BRITA

  • Leitete die Discovery-Phase und den POC für die Migration von Shopware zu Shopify Plus in EMEA-Märkten und bewertete die Eignung der Plattform, die technische Architektur sowie Multi-Brand-/Multi-Country-Funktionen anhand der Business-Anforderungen.
  • Entwarf die Referenzarchitektur für die Shopify-Plus-Implementierung mit Headless-Frontend-Patterns (Vue.js, Nuxt.js), CMS-Integration (Magnolia) und Azure-Middleware (APIM, Functions, Logic Apps, Service Bus) für 11 EMEA-Märkte.
  • Definierte die Migrationsstrategie mit Analyse von Data Mapping, Cutover-Ansatz und Zero-Downtime-Deployment-Patterns unter Einsatz von Varnish-Cache, GitOps-Pipelines und CI/CD-Orchestrierung über sechs Vendor-Teams hinweg.
  • Entwickelte ein Multi-Tenant-Governance-Modell für Shopify Plus mit zentraler Administration, lokaler Storefront-Anpassung und Compliance-Kontrollen (GDPR, Datenresidenz).
  • Prototypte KI-gestützte Suchoptimierung (LLM.txt, JSON-LD) für die Auffindbarkeit von Produkten in Google-AI-Ergebnissen und zeigte damit Potenziale für die Performance nach dem Go-live auf.
  • Definierte mit C-Level-Strategie-Workshops die EMEA-Expansions-Roadmap für 15+ Märkte, einschließlich gestaffeltem Rollout, marktspezifischen Konfigurationen und Ressourcenbedarf.
  • Tech Stack: React, Nuxt.js, Vue.js, Magnolia CMS, Shopware, Shopify Plus, Azure (APIM, Functions, Logic Apps, Service Bus, Front Door), Varnish, SAP, MS Dynamics, Docker, Kubernetes, GitHub Actions, PostgreSQL, Kafka
Verifizierter Experte

Oliver Voss

Profil ansehen

Interim Manager und Unternehmensberater

Hamburg
Oliver Voss

Letzte Position:

Interim Manager und Unternehmensberater bei Selbstständiger

  • Entwicklung einer Eintrittsstrategie für den Schadenbereich eines Versicherungsdienstleisters.
  • Analyse und Optimierung der bestehenden Schadenprozesse.
  • Definition von Steuerungskennzahlen und KPIs zur Leistungs- und Effizienzverbesserung.
  • Beratung des Managements zur Marktpositionierung und Prozessdigitalisierung.
  • Führung eines IT-Teams mit 13 Mitarbeitenden im Rahmen einer Vakanzvertretung.
  • Sicherstellung des stabilen IT-Betriebs und Steuerung externer IT-Dienstleister.
  • Leitung regulatorischer Projekte, insbesondere zur Umsetzung der DORA-Verordnung.
  • Vorbereitung und Begleitung eines IT-Sicherheitsaudits.
  • Change Management und Konfliktmoderation in einem herausfordernden Transformationsumfeld (FI-Migration).
Verifizierter Experte

Jorge Machado

Profil ansehen

Datenexperte

Würzburg
Jorge Machado

Letzte Position:

Technical Lead / Fractional CTO bei Würth GmbH

Ich habe eine KI-gestützte Multi-Tenant-Plattform auf Azure entworfen und entwickelt, die SAP-Prozessaufzeichnungen in technische Dokumentation, Präsentationen und automatisierte Tests umwandelt und dabei über 15.000 Prozessaufzeichnungen für Unternehmenskunden wie Würth verarbeitet. Ich war verantwortlich für die Architektur, die produktiven Releases und das DevOps-Setup. Außerdem habe ich ein Multi-Tenant-System mit SSO und rollenbasierter Zugriffskontrolle auf Azure entworfen. MCP Server mit dynamischer OAuth-Authentifizierung implementiert.

Hauptaufgaben:

  • Sprint-Planung und Feature-Vorbereitung
  • Design der Multi-Tenant-Plattform-Architektur (FastAPI, SQLAlchemy, PostgreSQL Row-Level Security für Tenant-Isolation)
  • Entwicklung von KI-Pipelines mit Prefect für Transkription (Azure Speech API), Dokumentengenerierung und SAP-Screen-Recording-Analyse (Claude, gpt-4-mini)
  • Design und Implementierung eines MCP-Servers, um Tenant-Wissen für LLM-Clients (Claude) bereitzustellen, mit asynchronem Retrieval und Reranking
  • Implementierung von LLM-Kosten-Tracking, Rate Limiting und Client-Pooling für Anthropic/OpenAI/Azure-OpenAI-Endpunkte
  • Einrichtung von CI/CD: Docker-Images in Azure Container Registry, GitHub Actions, Azure Static Web Apps, Alembic-Migrationen in Containern
  • Verwaltung von Produktions-Deployments und Durchführung von Live-Datenmigrationen für Unternehmenskunden
  • Definition von Engineering-Standards und Architekturmustern für das Team

Umgebung: Azure / Azure Foundry / Python / FastAPI / Prefect / React / PostgreSQL

Verifizierter Experte

Maximilian Braun

Profil ansehen

CTO | KI- & Technologie-Lead

Burglengenfeld
Maximilian Braun

Letzte Position:

CTO bei nikan.ai

Ich verantworte die technische Vision und Produktstrategie für ein souveränes KI-Startup mit Fokus auf europäische Dateninfrastruktur und Compliance. Dabei leite ich ein funktionsübergreifendes Team von 7 Personen in den Bereichen Engineering, KI-Entwicklung und Betrieb in einer vollständig remote arbeitenden Umgebung.

  • Definition der Produkt- und Technologieroadmap des Unternehmens, inklusive KI-gestützter Lösungen mit integrierten Zahlungsservices
  • Entwicklung skalierbarer Plattformarchitekturen mit Fokus auf Datensouveränität, Sicherheit und europäische regulatorische Vorgaben
  • Aktive Mitgestaltung der Full-Stack-Entwicklung sowie Etablierung von Engineering-Best-Practices und DevOps-Workflows
  • Förderung der Entwicklerproduktivität durch Mentoring, architektonische Beratung und Tool-Entscheidungen
  • Mitgestaltung der langfristigen technischen Strategie, um das Unternehmen für nachhaltiges Wachstum zu positionieren
Verifizierter Experte

Christiane Neher

Profil ansehen

Managementberater

Munich
Christiane Neher

Letzte Position:

Management Consultant bei Christiane Neher Management Consulting

Großes Versicherungsunternehmen – Consultant Wiesbaden: Beratungsunterstützung bei der Einführung eines integrierten Planungs- und Performance-Management-Frameworks (operativ, finanziell, Kunde) zur Verbesserung der kundenzentrierten Transparenz, der Entscheidungsqualität und der Steuerungsfähigkeit über alle Geschäftsbereiche innerhalb eines Versicherungsunternehmens:

  • Analyse bestehender Prozesse, Reports, KPIs und Methoden zur KPI-Berechnung
  • Konzeption und Einführung neuer, standardisierter Kunden-KPIs (brutto/netto) sowie zentraler Steuerungskennzahlen mit konsistenter Verknüpfung über alle Geschäftsbereiche hinweg
  • Neuberechnung, Validierung und Plausibilitätsprüfungen von KPIs auf Basis bestehender und neu integrierter Datenquellen
  • Konzeptionelle Unterstützung beim Aufbau eines integrierten Reporting- und Performance-Management-Setups
  • Durchführung von Customer-Insights-Analysen zur Identifikation von Mustern und Auffälligkeiten in Kunden-Datenclustern

Großes Handelsunternehmen – Consultant in Karlsruhe: Beratungsleistungen für den Aufbau und die schrittweise Implementierung einer international einsetzbaren RELEX-Lösung im Umfeld des Supply-Chain-Managements:

  • Beratung der Gesamt- und Teilprojektleitung bei Methodik, Projektaufsetzung und Steuerung (z. B. agiler Ansatz, Jira-Konfiguration, RELEX-Phasen, Jira Structure PPM)
  • Strategisch-operative Beratung bei der Einführung von RELEX einschließlich Best Practices
  • Unterstützung bei der Definition übergeordneter Ziele und Anforderungen (2-Jahres-Zielbild)
  • Begleitung bei der Eingrenzung eines relevanten Supply-Chain-Netzwerksegments für das Projekt
  • Entwicklung einer Roadmap für den iterativen, inkrementellen RELEX-Aufbau und Rollout
  • Bewertung von Projektabhängigkeiten (Schnittstellen, Konfigurationen etc.)
  • Beratung zur priorisierten Umsetzung von fachlichen Anforderungen und Datenschnittstellen
  • Unterstützung bei der Testplanung (Datenvalidierung, Systemtest, UAT)
  • Beratung zu Internationalisierung, Change Management, Training und Wissenstransfer
  • Stakeholder-Beratung und Abstimmung zwischen Kunde, Implementierungspartner und RELEX

Versicherungsunternehmen – Management Consultant in München: Analyse, Beratung und Unterstützung bei der Optimierung einer groß angelegten Business- und IT-Transformation. Fokus auf strategisch wichtige Programme und Modernisierungsprojekte im Bereich Managed Services Operations und Prozesse:

  • Prüfung von Projektplänen und Deliverables; Analyse von Programmen und Projekten (z. B. Cloud-Ansatz, Prozessstandardisierung, Systemintegration, Roadmaps)
  • Identifikation technischer, fachlicher und personeller Risiken und Herausforderungen; Entwicklung inhaltlicher Maßnahmen und Alternativen
  • Vorschläge zur Qualitätsverbesserung für Programm- und Modernisierungsmaßnahmen
  • Sparringspartner sowie fachliche, technische, strukturelle und organisatorische Beratung für Projekt- und Programmmanagement

Großer Handelskonzern – Management Consultant & Stream Lead in Köln: Beratung, Prozess-, Projekt- und Produktmanagement für die Einführung und Umsetzung eines großen strategischen Programms im Bereich Advanced Analytics, Sortiment und Flächenmanagement:

  • Aufbau, Test und Rollout eines neuen Flächenplanungs-, Automatisierungs- und Optimierungsprodukts auf Basis des bestehenden clusterbasierten Merchandising-Ansatzes
  • Definition und Aufbau neuer Prozesse sowie Transformations- und Change-Management-Maßnahmen für den neuen filialspezifischen Merchandising-Ansatz
  • Zusammenarbeit mit Advanced Analytics und IT (intern und extern) bei Softwareeinführungen, Automatisierungen, Erweiterungen und Schnittstellen
  • MVP-Ansatz und Pilotierung in Phasen mit schrittweisem Rollout (Pilot mit 80 Filialen, Region mit 500 Filialen, nationale Ebene mit 4000 Filialen)

Großes Handelsunternehmen – Agile Coach & Change Agent in Köln: Agile Coach, OKR Master und Facilitator für die Einführung des OKR-Ansatzes in einem großen strategischen Digitalisierungsprogramm für Einzelhandelsfilialen:

  • Coaching des Kernteams mit Themenverantwortlichen und Teamleitern
  • Einführung in das OKR-Thema und Aufbau des OKR-Zyklus
  • Etablierung des OKR-Ansatzes in den Teams und auf bereichsübergreifender Ebene

Dienstleistungs- und Logistikunternehmen – Management Consultant in Großbritannien: Beratung und Coaching bei der Umstrukturierung der Data-Analytics-Abteilung:

  • Analyse der aktuellen Herausforderungen
  • Definition übergeordneter Ziele
  • Entwicklung eines Vorschlags für eine neue Teamstruktur
  • Identifikation benötigter Kompetenzen, Fähigkeiten und Verantwortlichkeiten
  • Beratung und Abstimmung zur Kommunikations- und Change-Management-Strategie
Verifizierter Experte

Thomas Hoefkens

Profil ansehen

Senior MLOps-, DevOps Engineer

Munich
Thomas Hoefkens

Letzte Position:

Senior MLOps-, DevOps Engineer bei Trianel Energy

  • Aufbau und Betrieb einer End-to-End-MLOps-Plattform auf Azure ML und Kubernetes (Kubeflow) zur automatisierten Bereitstellung, Überwachung und Skalierung von Forecasting-Modellen (u. a. Temporal Fusion Transformer, Informer, Autoformer).
  • Implementierung von CI/CD-Pipelines in Azure DevOps für den vollständigen ML-Lifecycle – von Ressourcbereitstellung (Terraform), Datentransformation (Hugging Face Datasets, Pandas, PyTorch, CUDA-Cluster) über Training und Evaluation bis hin zu Model Registry und Endpoint-Deployment.
  • Integration von MLflow für Experiment-Tracking, Modellversionierung, Performance-Monitoring und automatisierte Registrierung in der Azure Model Registry.
  • Entwicklung und Containerisierung von PyTorch-Trainingsjobs (Azure Notebook, Jupyter Notebooks) für Preis- und Zeitreihenprognosen (PFC-Modelle) mit automatischem Rollout über Azure ML Endpoints und REST/gRPC-Schnittstellen, Docker-Containerisierung, Absicherung über OAuth 2.0.
  • Einrichtung von Monitoring- und Alerting-Mechanismen (Prometheus, MLflow Metrics), Log-Zentralisierung und Kostenüberwachung.
  • Automatisierung der Infrastruktur-Bereitstellung und Modellbereitstellung mittels Terraform, Helm und Azure CLI; Anbindung an bestehende Marktdatensysteme und Event-Pipelines.
  • Migration bestehender Workloads und Datenbanken (IONOS → Azure, MongoDB) mit Integration in zentrale MLOps-Workflows und interne Netzwerke.
  • Erweiterung der Plattform um LLM-basierte Tools (LangChain, LangServe) zur Integration von GPT-basierten Analysemodulen in bestehende Spring-Boot-Dienste für Marktanomalie-Erkennung und automatisierte Reports.
  • Analyse, Architektur einer Softwarelösung zur effizienten Verarbeitung von Massendaten (>3000 Nachrichten/Sek.) (Market Data Store).
  • Spring Boot / Java 21 Container-Entwicklung mit RabbitMQ zur Verteilung von Börsendaten über MongoDB (Kubernetes) mit Schnellspeicherung von Daten in Redis RMaps, Deduplizierung und Weiterleitung von Nachrichten an Read-Model-Queues, Aufbau von Read Models für die UI-Anzeige in MongoDB.
  • Einbindung von RESTHeart zur Erzeugung einer REST API gegen MongoDB.
  • Aufbau eines Angular-Frontends zur Vereinfachung der Datenabfrage und Stammdatenpflege.
  • Agentic Coding mit remote und local LLM (Claude Sonnet, Ollama Qwen) und MCP-Servern.
  • Entwicklung von Python-Skripten zur Transformation und Bereinigung eingehender Börsendaten (Pandas, scikit-learn).

Entdecke mehr als 15.000 Top-Freelancer

Statistiken von Experten, die Data Lake einsetzen

Aggregiert aus den beruflichen Profilen passender Freelancer.

Berufserfahrung

18 Jahre

Positionsdauer

2,4 Jahre

Positionen pro Freelancer

10

Häufigste Fachbereiche

Informationstechnologie (IT), Business Intelligence, Produktentwicklung

Häufigste Branchen

Informationstechnologie (IT), Professionelle Dienstleistungen, Bank- und Finanzwesen

Fokus der Zertifizierungen

Informationstechnologie (IT), Business Intelligence, Projektmanagement

Bachelor-Abschluss oder höher

95%

Master-Abschluss oder höher

70%

Doktortitel

17%

Zertifizierungen pro Freelancer

4

Häufigste Sprachen

Deutsch, Englisch, Französisch

Sprechen zwei oder mehr Sprachen

98%

Basierend auf unserem Profilpool, Stand 30 Aug 2026.

Tagessatzverteilung

0 20 40 60 80
<€400 €400-​800 €800-​1200 €1200+

Das Diagramm zeigt, wie sich die Tagessätze der Freelancer in dieser Technologie in Germany verteilen, basierend auf aktuellen Verträgen auf unserer Plattform. Jeder Balken deckt eine Tagessatzspanne ab – seine Höhe zeigt, wie viele Freelancer innerhalb dieser Spanne abrechnen.

Durchschnittssätze von Experten in Germany, die Data Lake einsetzen

Die Tagessätze basieren auf aktuellen Verträgen und enthalten keinen FRATCH-Aufschlag.

1000
750
500
250
Stundensatzvergleich-Diagramm
Ø Tagessatz 822 €

Der durchschnittliche Tagessatz ist der Mittelwert aller Tagessätze aus aktuellen Verträgen vergleichbarer Freelancer auf unserer Plattform.

1000
750
500
250
Stundensatzvergleich-Diagramm
Median-Tagessatz 800 €

Der Median-Tagessatz ist der mittlere Wert aller Tagessätze – die Hälfte der vergleichbaren Freelancer verlangt weniger, die andere Hälfte mehr. Anders als der Durchschnitt wird er von Ausreißern kaum beeinflusst.

Berechnet auf Basis der Tagessätze unserer Freelancer, Stand 30 Aug 2026. Die tatsächlichen Tagessätze können je nach Dienstalter, Erfahrung, Fachkenntnissen, Projektkomplexität und Auftragsdauer variieren.

Über die Technologie

Was ein Data Lake ist

Ein Data Lake speichert rohe und verarbeitete Daten an einem Ort, bereit für Reporting, Analytics und Machine Learning. Er eignet sich für strukturierte Tabellen, Logs, Events, Dateien und Streaming-Daten, ohne zuerst ein festes Schema vorzuschreiben.

Häufige Anwendungsfälle

  • Daten aus Apps, Datenbanken und SaaS-Tools zentral zusammenführen
  • Datensätze für BI, Prognosen und Modelltraining aufbereiten
  • Historie für Audit, Replay und Ad-hoc-Analysen behalten
  • Batch-Ladeprozesse, Event-Streams und Dateiuploads unterstützen

Plattform-Stack

Starke Spezialisten arbeiten mit Objektspeicher, Katalog-Tools und Transformationsschichten rund um den Lake. Sie nutzen oft S3, Azure Data Lake Storage, Google Cloud Storage, Databricks, Spark, dbt, Airflow sowie Metadaten- oder Governance-Services.

Wo Unternehmen Hilfe brauchen

Teams holen sich freiberufliche Expertise dazu, wenn ein Lake unübersichtlich, langsam oder schwer vertrauenswürdig wird. Das passiert bei Cloud-Migrationen, neuen Datenprodukten, Plattform-Neuentwicklungen oder wenn Quellsysteme in Germany und anderen Regionen eine gemeinsame Analytics-Schicht speisen müssen.

Was gute Spezialisten liefern

Gute Profis definieren Ordner- und Tabellenstruktur, Namensregeln, Zugriffssteuerung und Aufbewahrungsrichtlinien. Sie richten außerdem Ingestion, Schema-Behandlung, Qualitätsprüfungen und Dokumentation ein, damit Teams den Lake nutzen können, ohne zu raten, woher die Daten kommen.

Worauf man achten sollte

  • Klare Gedanken zu Roh-, kuratierten und vertrauenswürdigen Zonen
  • Praktische Arbeit mit Batch- und Streaming-Pipelines
  • Pragmatische Gewohnheiten bei Governance, Sicherheit und Lineage
  • Erfahrung mit Query-Engines und Performance-Tuning für den Lake
Veröffentlicht am:
FRATCH GPT

FRATCH GPT liefert in Minuten Freelancer-Vorschläge mit nachvollziehbarer Begründung und transparenten Preisen und hilft deiner Personalabteilung, schnell und regelkonform die besten Talente zu finden.

Probier es aus:

Teste FRATCH GPT

Häufig gestellte Fragen

Was Kunden uns zu Data Lake am häufigsten fragen – kurz beantwortet.

Ein Data Lake wird genutzt, um viele Arten von Daten an einem Ort zu speichern, damit Teams sie später analysieren können. Unternehmen nutzen ihn für Reporting, Machine Learning, historische Replays und den zentralen Datenaustausch zwischen Abteilungen. Er funktioniert am besten, wenn Rohdaten flexibel bleiben müssen, bevor sie für einen bestimmten Zweck aufbereitet werden.

Ein Data Lake speichert Daten in einer eher rohen Form und akzeptiert viele Datei- und Event-Typen. Ein Data Warehouse ist meist stärker strukturiert und für vertrauenswürdiges Reporting optimiert. Viele Unternehmen nutzen beides: den Lake für breite Aufnahme und Erkundung, das Warehouse für kuratierte Business-Berichte.

Holen Sie einen Data Lake-Spezialisten dazu, wenn Ingestion fehlschlägt, die Datenqualität unklar ist oder Zugriffsregeln chaotisch sind. Freelancer-Hilfe ist auch sinnvoll bei einer Cloud-Migration, einem Plattform-Neubau oder wenn Teams eine saubere Grundlage brauchen, bevor Analytics oder Machine Learning dazukommen. Ein starker Spezialist kann das Design schnell stabilisieren.

Ein guter Data Lake-Experte sollte auch Pipelines, Datenmodellierung und Governance kennen. Nützliche Zusatzkenntnisse sind Spark, Airflow, dbt, SQL, Cloud Storage und Katalog- oder Lineage-Tools. Sicherheit und Kostenkontrolle sind ebenfalls wichtig, weil Lakes ohne Disziplin schnell teuer und schwer zu verwalten werden können.

Azure Data Lake ist ein Microsoft-Dienst, mit dem man einen Data Lake auf Azure aufbauen kann. Es ist nicht der einzige Weg, einen zu erstellen, aber eine häufige Option für Unternehmen, die bereits Microsoft-Cloud-Dienste nutzen. Viele Suchende verwenden den Begriff sowohl für den Dienst als auch für die breitere Architektur.

Fragen Sie, wie der Data Lake organisiert wird, wer die Qualitätsprüfungen verantwortet und wie der Zugriff gesteuert wird. Fragen Sie außerdem, welche Tools die Person für Ingestion, Transformation und Governance bevorzugt und wie Entscheidungen dokumentiert werden. Die besten Experten erklären Abwägungen in klarer Sprache, nicht nur Tool-Namen.

Ja, Data Lake-Arbeit wird oft remote erledigt, weil die meisten Aufgaben Design-, Pipeline- und Review-Arbeit sind. Für Unternehmen in Germany funktioniert die Zusammenarbeit aus der Ferne meist gut, wenn der Spezialist klar auf Englisch kommunizieren kann und sich mit den lokalen Stakeholdern abstimmt. Vor-Ort-Zeit hilft eher bei Workshops, sensiblen Migrationsphasen oder wenn Teams eine enge Abstimmung der Abläufe wünschen.

Ein starker Data Lake-Spezialist hinterlässt eine Struktur, die andere Teams tatsächlich nutzen können. Achten Sie auf klares Zonen-Design, zuverlässige Ingestion, dokumentierte Datenverträge und praxistaugliche Governance. Gute Arbeit zeigt sich in weniger Ausfällen, leichterer Auffindbarkeit und weniger manueller Nacharbeit für die Teams, die vom Lake abhängen.

Der durchschnittliche Stundensatz von Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, liegt bei 103 €, was einem Tagessatz von etwa 822 € bei einem 8-Stunden-Tag entspricht.

Von den Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, haben 95% mindestens einen Bachelor-Abschluss, 70% mindestens einen Master-Abschluss und 17% einen Doktortitel.

Freelancer in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, haben im Durchschnitt 18 Jahre Berufserfahrung; ein einzelnes Projekt dauert typischerweise etwa 2,4 Jahre.

Die häufigsten Sprachen unter Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, sind Deutsch (98%), Englisch (98%) und Französisch (22%).

Die häufigsten Industrien unter Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, sind Informationstechnologie (IT) (86%), Professionelle Dienstleistungen (56%) und Bank- und Finanzwesen (49%).

Die häufigsten Bereiche unter Freelancern in Deutschland, die Data Lake in ihren letzten Projekten eingesetzt haben, sind Informationstechnologie (IT) (95%), Business Intelligence (78%) und Produktentwicklung (64%).

Hauptstandorte der FRATCH Experten, die kürzlich Data Lake eingesetzt haben

Unsere Freelancer und Interim-Experten sind in der gesamten DACH-Region zuhause — verfügbar vor Ort in den wichtigsten Wirtschaftszentren oder komplett remote. Wähle einen Standort und entdecke passende Spezialisten, lokale Markteinblicke und aktuelle Verfügbarkeiten.

Berlin Hamburg München Köln Frankfurt Stuttgart Düsseldorf Leipzig Dortmund Essen Bremen Dresden Hannover Nürnberg

Kostenlose Demo vereinbaren

Kontaktiere uns und das FRATCH-Team meldet sich innerhalb von 4 Stunden bei dir.

Kontakt-Formular

Möchtest du lieber direkt mit uns in Kontakt treten?
Wir haben immer Zeit für einen Anruf oder eine E-Mail!

FRATCH CEO Avatar

Philipp Thomaschewski

FRATCH CEO

LinkedInFRATCH