Pyramid Technology Solutions

Data Architect with GCP

⭐ - Featured Role | Apply direct with Data Freelance Hub
This role is for a Data Architect with GCP, based in Dallas, TX or Charlotte, NC, for 12+ months. Key skills include data architecture, ETL frameworks, BigQuery, Python, and CI/CD automation. Experience with data lakes and cloud architecture is required.
🌎 - Country
United States
💱 - Currency
$ USD
-
💰 - Day rate
Unknown
-
🗓️ - Date
August 13, 2026
🕒 - Duration
More than 6 months
-
🏝️ - Location
On-site
-
📄 - Contract
Unknown
-
🔒 - Security
Unknown
-
📍 - Location detailed
Dallas, TX
-
🧠 - Skills detailed
#Clustering #UAT (User Acceptance Testing) #Logging #Deployment #Security #Splunk #Batch #Storage #BigQuery #GIT #MongoDB #Strategy #Scala #API (Application Programming Interface) #Databases #S3 (Amazon Simple Storage Service) #Metadata #Spark SQL #Documentation #Data Modeling #Data Lake #PySpark #GCP (Google Cloud Platform) #Spark (Apache Spark) #Data Ingestion #PostgreSQL #SQL (Structured Query Language) #"ETL (Extract #Transform #Load)" #Containers #Data Governance #Liquibase #Data Architecture #Automation #DevOps #Python #Data Processing #GitHub #Leadership #Cloud #Big Data
Role description
Title:-Data Architect with GCP Location:- Dallas, TX or Charlotte, NC Duration:- 12+ Months Responsibilities / Key Requirements: • Own the end-to-end data architecture. • Define and guide implementation of a metadata-driven generic ETL framework supporting multiple source types including databases, files, APIs, MongoDB, Splunk, VDS, and Active Directory. • Architect reusable metadata models using MD_ static metadata tables and OPS_ operational/runtime tables for source configuration, pipeline definition, run tracking, audit logging, checkpointing, schema drift, and notifications. • Provide architecture direction for MVC-based orchestration, including repository layer, service layer, wrapper, controller, execution plan models, and standardized request/response contracts. • Design scalable ingestion patterns for full load, incremental load, watermark-based processing, CDC-style patterns, batch ingestion, API ingestion, and file-based ingestion. • Provide technical leadership for GCP / BigQuery architecture, including S3 to BigQuery integration, schema mapping, dataset design, partitioning, clustering, performance optimization, and secure connectivity. • Review and guide CI/CD automation using GitHub Actions, JFrog, Harness, Liquibase, Helm, OCP deployments, and environment-specific configuration management. • Provide technical guidance to team on Python, PySpark, SQL, BigQuery, PostgreSQL, data modeling, performance tuning, and production ready framework design. • Support UAT and production readiness by defining validation scenarios, reconciliation strategy, performance testing approach, security validation, runbooks, and sign-off criteria. • Partner with client stakeholders to finalize architecture decisions, design documents, Confluence documentation, implementation standards, and technical roadmaps. • Ensure the solution is secure, scalable, maintainable, metadata-driven, auditable, and operationalized. Big Data & Processing Data & Cloud Architecture Data Lake Architecture & Storage Data Ingestion & Orchestration Data Processing & Transformation DevOps / CI-CD • Experience implementing CI/CD pipelines for data and analytics workloads • Familiarity with Git-based source control, build automation, and deployment strategies Containers & Platform • Data Governance, Quality & Metadata