Обладаю практическим опытом проектирования систем хранения данных (DWH) и разработки отказоустойчивых ETL/ELT-пайплайнов для обработки неструктурированной информации. Специализируюсь на автоматизации процессов сбора, очистки и валидации данных, а также на интеграции реляционных баз данных с векторными хранилищами для ИИ-решений (RAG-систем). Умею оптимизировать ресурсоемкие процессы обработки тяжелых документов, минимизируя нагрузку на инфраструктуру и оперативную память. Нацелен на решение сложных инфраструктурных задач бизнеса и развитие отказоустойчивых конвейеров данных.
Рассматриваю предложения на позицию Data Engineer.
- Programming Languages: Python, SQL
- Data Engineering: ETL, Data Warehousing, Data Pipelines
- Databases: PostgreSQL, Vertica
- Orchestration: Apache Airflow
- IDEs & Tools: Visual Studio Code, DBeaver, Jupyter Notebook
- Stream Processing: Apache Kafka, Apache Spark
- Containerization: Docker
- Version Control: Git, GitHub
- Analytics: Pandas, PySpark
- Cloud Technologies: Yandex Cloud
- English Language: B2
- Email: krasochkinm@gmail.com
- Telegram: mkrasochkin