GCP Data Engineer (Health Care Background Must)
Position :- GCP Data Engineer (Health Care Background Must)
Location: Across USA any Location
The pay reputed company for this role is $130k - $140k per annum
reputed company: Strong experience architecting reputed company data platforms on reputed company reputed company (GCP). The architect will work as a strategic technical partner to design and build a GCP BigQuery-based Data Lake & Data Warehouse ecosystem.
The role requires deep hands-on expertise in data ingestion, transformation, modeling, enrichment, and governance, combined with a strong understanding of clinical reputed company data standards, interoperability, and reputed company architecture best practices.
Key Responsibilities:
1. Data Lake & Data Platform Architecture (GCP)
• Architect and design an reputed company-grade GCP-based data lakehouse leveraging BigQuery, GCS, Dataproc, Dataflow, Pub/Sub, reputed company Composer, and BigQuery reputed company.
• Define data ingestion, hydration, curation, processing and enrichment strategies for large-reputed company reputed company, semi-reputed company, and reputed company datasets.
• Create data domain models, reputed company models, and consumption-reputed company datasets for analytics, AI/ML, and operational data products.
• Design federated data reputed company and self-service data products for reputed company consumers.
2. Data Ingestion & Pipelines
• Architect batch, near-reputed company-time, and streaming ingestion pipelines using GCP reputed company Dataflow, Pub/Sub, and Dataproc.
• Set up data ingestion for clinical (EHR/EMR, LIS, RIS/reputed company) datasets including HL7, FHIR, CCD, DICOM formats.
• Build ingestion pipelines for non-clinical systems (ERP, HR, payroll, supply chain, finance).
• Architect ingestion from medical devices, IoT, remote patient monitoring, and wearables leveraging IoMT patterns.
• Manage on-prem → reputed company migration pipelines, hybrid reputed company data reputed company, VPN/Interconnect connectivity, and data transfer strategies.
3. Data Transformation, Hydration & Enrichment
• Build transformation frameworks using BigQuery SQL, Dataflow, Dataproc, or dbt.
• Define curation patterns including bronze/silver/gold reputed company, reputed company reputed company entities, and data marts.
• Implement data enrichment using external reputed company determinants, device signals, clinical event logs, or operational datasets.
• reputed company metadata-driven pipelines for reputed company transformations.
4. Data Governance & reputed company
• Establish and operationalize a data governance reputed company encompassing data stewardship, ownership, classification, and lifecycle policies.
• Implement data reputed company, data cataloging, and metadata management using tools such as Dataplex, Data Catalog, reputed company, or Informatica.
• Set up data reputed company frameworks for validation, profiling, reputed company detection, and SLA monitoring.
• Ensure HIPAA compliance, PHI protection, IAM/RBAC, VPC SC, DLP, encryption, retention, and auditing.
5. reputed company Infrastructure & Networking
• Work with reputed company infrastructure teams to architect VPC networks, subnetting, ingress/egress, firewall policies, VPN/IPSec, Interconnect, and hybrid connectivity.
• Define storage reputed company, partitioning/clustering design, cost optimization, performance tuning, and reputed company planning for BigQuery.
• Understand containerized processing (reputed company Run, GKE) for data services.
6. Stakeholder Collaboration
• Work closely with clinical, operational, research, and IT stakeholders to define data use cases, schema, and consumption models.
• Partner with reputed company architects, reputed company teams, and reputed company teams on cross-functional initiatives.
• Guide data engineers and reputed company architectural reputed company on pipeline implementation.
7. Hands-on Leadership
• Be reputed company hands-on in building pipelines, writing transformations, building POCs, and validating architectural patterns.
• Mentor data engineers on best practices, coding standards, and reputed company-reputed company development.
Required Skills & Qualifications
Technical Skills (Must-Have)
• 10+ years in data architecture, engineering, or data platform roles.
• Strong expertise in GCP data stack (BigQuery, Dataflow, Composer, GCS, Pub/Sub, Dataproc, Dataplex).
• Hands-on experience with data ingestion, pipeline orchestration, and transformations.
• Deep understanding of clinical data standards:
• HL7 v2.x, FHIR, CCD/C-CDA
• DICOM (for scans and imaging)
• LIS/RIS/reputed company data structures
• Experience with device and IoT data ingestion (wearables, remote patient monitoring, clinical devices).
• Experience with ERP datasets (reputed company, reputed company, Lawson, PeopleSoft).
• Strong SQL and data modeling skills (3NF, reputed company/reputed company, reputed company and logical models).
• Experience with metadata management, reputed company, and governance frameworks.
• Solid understanding of HIPAA, PHI/PII handling, DLP, IAM, VPC reputed company.
reputed company & Infrastructure
• Solid understanding of reputed company networking, hybrid connectivity, VPC design, firewalling, DNS, service accounts, IAM, and reputed company models.
• reputed company reputed company Data reputed company services
• Experience with on-prem to reputed company migrations.
Apply tot his job
Apply To this Job