Skip to content
View hridoy1335's full-sized avatar
🏠
Working from home
🏠
Working from home
  • Jhitka, Manikganj, Dhaka-1831
  • 23:56 (UTC -12:00)
  • LinkedIn in/hrido

Block or report hridoy1335

Block user

Prevent this user from interacting with your repositories and sending you notifications. Learn more about blocking users.

You must be logged in to block users.

Content in all repositories owned by your account will be closed.
Maximum 250 characters. Please don’t include any personal information such as legal names or email addresses. Markdown is supported. This note will only be visible to you.
Report abuse

Contact GitHub support about this user’s behavior. Learn more about reporting abuse.

Report abuse
hridoy1335/README.md

Typing SVG
Hridoy Khan - Senior Data Engineer

LinkedIn Portfolio Email Profile Views

πŸ› οΈ Tech Stack & Expertise


☁️ Cloud & Infrastructure

Azure AWS Terraform Docker Linux

πŸ”₯ Data Engineering

Databricks Apache Spark Delta Lake Kafka Airflow

πŸ’» Languages & Querying

Python PySpark SQL Spark SQL HCL

πŸš€ DevOps & CI/CD

GitHub Actions Azure DevOps Git DABs YAML

πŸ—„οΈ Storage & Formats

ADLS Gen2 S3 Delta Parquet PostgreSQL

πŸ“Š Analytics & Governance

Power BI Unity Catalog Key Vault Azure Monitor dbt


πŸ›οΈ Medallion Lakehouse Architecture

Medallion Lakehouse Architecture

🟀 Bronze
Raw Ingestion
Schema-on-read β€’ Append-only β€’ Full history

➑️

βšͺ Silver
Cleansed & Conformed
Deduplication β€’ Type casting β€’ Data quality

➑️

🟑 Gold
Business-Ready
Aggregations β€’ Star schema β€’ KPI metrics


πŸ“Œ Featured Projects

Production-grade Databricks Asset Bundle deployment with automated CI/CD pipelines across dev/staging/prod environments.

Databricks Python DABs GitHub Actions Delta Lake

⭐ Highlights: Multi-environment deployment, automated testing, asset bundle best practices

End-to-end Infrastructure-as-Code for Azure data platform with private networking, security controls, and automated provisioning.

Terraform Azure HCL ADLS Gen2 Key Vault

⭐ Highlights: Private endpoints, RBAC, modular Terraform, state management

Multi-environment (dev/prod) Lakehouse pipeline with automated deployment, Delta Lake transformations, and data quality checks.

PySpark Databricks Delta Lake CI/CD Azure

⭐ Highlights: Medallion architecture, environment promotion, automated deployment

Large-scale e-commerce data processing pipeline with Silver/Gold zone transformations and business analytics layer.

PySpark Delta Lake Python Azure Databricks

⭐ Highlights: Complex transformations, aggregation pipelines, analytics-ready output

Medallion architecture pipeline for retail analytics with automated data quality checks and business KPI generation.

Python Databricks Azure Delta Lake

⭐ Highlights: Domain-specific modeling, data quality framework, retail KPIs

πŸ—οΈ Terraform Modules

Reusable Terraform modules for cloud infrastructure provisioning across AWS and Azure with best practices.

Terraform HCL AWS Azure IaC

⭐ Highlights: Modular design, multi-cloud support, production-ready templates


πŸ“ˆ GitHub Analytics

GitHub Streak

Hridoy's github activity graph


πŸ† Certifications & Credentials

Azure Data Engineer Databricks DE Terraform Azure Fundamentals


πŸ’‘ Core Competencies

Data Platform Architecture    β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆ  Expert
Databricks & Spark            β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆ  Expert
Delta Lake & Lakehouse        β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–‘  Advanced
Terraform & IaC               β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–‘  Advanced
Azure Cloud Services          β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆ  Expert
CI/CD & DevOps                β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–‘β–‘  Advanced
Data Modeling (Star/Snow)     β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–‘β–‘  Advanced
Python & PySpark              β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆ  Expert
Data Quality Engineering      β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–‘β–‘β–‘  Advanced
Streaming (Kafka/Event Hub)   β–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–ˆβ–‘β–‘β–‘β–‘  Proficient

πŸ§‘β€πŸ’» About Me

name: Hridoy Khan
role: Senior Data Engineer
location: Bangladesh
focus: Enterprise Lakehouse Platforms & Cloud Data Architecture

experience:
  - Building production-grade data pipelines processing millions of records daily
  - Designing multi-environment Lakehouse architectures (Bronze β†’ Silver β†’ Gold)
  - Automating cloud infrastructure with Terraform & Databricks Asset Bundles
  - Implementing DataOps practices with CI/CD, testing, and monitoring

currently_building: "Multi-cloud Lakehouse platforms with Databricks & Delta Lake"
learning: "Apache Iceberg, dbt, Kafka Streams, Data Mesh patterns"
passionate_about: "Data quality engineering, platform reliability, DataOps"

πŸ“¬ Let's Connect

I'm open to collaborating on data engineering projects, speaking at conferences, and discussing cloud data architecture.

LinkedIn Email Portfolio


Pinned Loading

  1. databricks_asset_bundle databricks_asset_bundle Public

    databricks_asset_bundle

    Python 1

  2. databricks_json_data_flatten databricks_json_data_flatten Public

    databricks_json_data_flatten

    Jupyter Notebook 1 1

  3. OLIST OLIST Public

    I was trying to build spark declarative pipeline on databricks

    Python 1