플렉스팀의 Data Engineer는 HR 데이터와 데이터+AI 처리기술의 높은 이해를 토대로 데이터를 통해 사람과 조직에 관한 문제를 해결합니다.
이를 위해 플렉스팀의 Data Engineer는 적극적으로 People Analytics 영역과 AI 제품 개발에 참여합니다. flex는 "Next flex with AI" 비전 아래 경영진과 조직에게 의미 있는 시그널과 인사이트를 제공하고 있습니다. 이제는 HR을 넘어 기업 비즈니스 운영 전반의 데이터로 영역을 확장하고, 데이터를 더 깊이 있게 해석하여 고객에게 더욱 높은 가치를 제공하고자 합니다. 특히 데이터를 사람뿐 아니라 AI 에이전트가 잘 이해할 수 있는 형태로 구조화하여, AI를 통해 구성원에게 데이터 인사이트를 전달합니다.
더불어, 회사 전반의 data-driven 문화를 만들어가는 역할도 함께 합니다. 제품 기획, 개발, 운영, 마케팅, 사업 등 전반의 영역에서 플렉스팀은 이미 다양한 데이터를 활용하고 있습니다. Data Engineer는 플렉스팀에 보다 정확하고 빠른 데이터를 제공하며, 구성원 스스로 데이터와 AI를 손쉽게 활용할 수 있는 환경을 제공합니다.
일반적인 Data Engineer 포지션 특성상 플렉스팀만큼 제품과 비즈니스에 직접적으로 기여할 수 있는 기회는 흔치 않다고 생각합니다. 물론 그만큼 다양하고 어려운 도전 과제들이 많습니다. 플렉스팀처럼 빠르게 제품과 조직이 성장하는 환경에서는 더욱 그렇습니다. 이를 함께 고민하고 해결해나갈 동료를 찾고 싶습니다.
이런 일을 함께 하게 됩니다.
[Data Analytics Engineer]
- 플렉스팀이 데이터를 보다 쉽고 적극적으로 사용할 수 있도록 합니다.
- 플렉스팀의 빠른 제품 성장과 확장은 높은 수준의 데이터 복잡성으로도 이어집니다. 이를 쉽게 이해 가능한 수준으로 가공하고 표준화하는 등의 LakeHouse 모델을 설계하고 구현합니다.People Analytics와 Growth 분석, Product 분석이 가능한 피쳐 스토어를 설계하고 지속적으로 개선합니다.LLM을 활용한 데이터 표준화 기술을 접목하여 비정형 데이터를 구조화된 형태로 가공합니다.다양한 조직/직군 동료와 협업하며 셀프 서비스를 위한 데이터 이해도와 활용도를 높이도록 기여합니다.사람뿐 아니라 AI 에이전트가 이해하고 활용할 수 있는 형태로 데이터를 구조화하여, AI를 통해 구성원에게 데이터 인사이트가 전달되도록 합니다.
- 다양한 분석에 필요한 데이터를 가공하여 제품 개선과 비즈니스 의사결정을 지원합니다.
- People AnalyticsPeople Analytics에 필요한 HR 지표를 설계하고, 분석에 바로 활용할 수 있는 데이터셋으로 가공합니다.ML 기반 HR 예측 모델 개발에 필요한 피쳐와 학습 데이터를 가공합니다.Growth리드 획득부터 유료 전환, 리텐션까지 이어지는 Growth 퍼널 분석에 필요한 데이터셋과 지표를 설계하고 가공합니다.광고 마케팅 효과 측정, 리드 너처링 Attribution 등 Growth 분석에 필요한 데이터를 가공·제공합니다.ProductUser Behavior 분석을 위한 웹/모바일 제품의 이벤트 로그를 설계·관리하고, 제품 사용성 지표를 개발합니다.VOC·세일즈 블로커 등 비정형 데이터를 제품 분석에 활용할 수 있도록 가공합니다.
- 가장 신뢰할 수 있고 안전한 데이터 환경을 만듭니다.
- 전사적 관점의 핵심 지표 정의, 데이터 활용 정책을 설계하며, 빠르고 다양한 변화 속에서도 일관성이 유지될 수 있도록 관리합니다.플렉스팀의 전반적인 Data Quality를 수호하기 위하여, 다양한 오류 검증, 이상 탐지 등의 로직을 구현하고 자동화합니다.데이터 보안 정책을 준수하며, 구성원들이 가장 안전하게 데이터를 활용할 수 있도록 데이터를 가공합니다.
[Data Platform Engineer]
- 제품 개발과 운영까지 가능한 가장 안전하고 빠른 데이터 인프라와 플랫폼을 구축합니다.
- 플렉스팀의 데이터 인프라는 사내 분석 목적 외에도, 실제 제품에 바로 반영되는 서비스 데이터를 생산합니다. 서비스 인프라 수준의 가용성과 안정성을 보장하는 아키텍처를 설계하고 운영합니다.매월 급증하는 데이터와 배치를 유연하게 처리하고 확장 가능하도록 k8s(EKS) 기반의 인프라를 구축합니다.모니터링/관측성을 강화하고 장애 복구를 자동화하여, 안정적이고 효율적인 운영 체계를 만들어갑니다.멀티 클라우드(AWS/Azure) 환경에서 제품 데이터 파이프라인을 구성하고 안정적으로 운영합니다.
- 다양한 데이터 소스를 안정적이고 효율적으로 수집/적재하는 파이프라인을 개발합니다.
- RDB(CDC), 클라이언트 로그(모바일+웹), 서버 이벤트 로그(Kafka), 써드파티 API 등 다양한 데이터 소스를 안정적으로 수집 가능한 시스템을 개발하고 운영합니다.LakeHouse 기반의 효율적인 데이터 저장/처리 환경을 구축하고, 대규모 배치를 안정적으로 운영합니다.
- 데이터 거버넌스 체계를 고도화합니다.
- 이미 구축된 데이터 카탈로그, 리니지(Lineage), Data Quality 등 데이터 디스커버리/관리 환경을 고도화합니다. 메타데이터 수집 소스와 리니지 커버리지를 확대하고, 이상 탐지와 같은 운영 모니터링 및 품질 검증 자동화를 강화합니다.국내 최고 수준의 보안 정책(ISMS 등)을 준수하며, 민감정보 비식별/파기, 접근제어, 감사로그 등 안전한 데이터 활용 환경을 만들어갑니다.
- 데이터 직군과 전사 구성원의 생산성을 높입니다.
- 데이터 분석가들이 분석 업무에 집중할 수 있도록 분석 환경 및 도구를 개발하고, AI를 활용한 마트 개발 등 데이터 직군의 개발 생산성을 높입니다.Metabase 등 셀프서브 분석 도구와 AI 활용 분석 환경을 지원하여 전사 구성원의 데이터 활용도를 높입니다.
이런 분과 함께 하고 싶습니다.
[공통]
- 데이터의 특성과 흐름에 대한 명확한 이해를 토대로 시스템을 설계하고 운영하시는 분
- 기술적인 욕심보다는 고객과 데이터 관점에서 가장 빠르고 효율적인 해결책을 고민하시는 분
- Product Manager, Product Engineer, Performance Marketer 등 다양한 직군과의 커뮤니케이션에 어려움이 없으신 분
[Data Analytics Engineer]
- DW 모델링 및 데이터 품질 관리 경험이 있으신 분
- Metabase, Redash, Tableau와 같은 BI 도구 활용 경험이 있으신 분
- Airflow 혹은 유사 Workflow 도구를 활용한 데이터 파이프라인 개발 경험이 있으신 분
- SQL 사용에 익숙하신 분
[Data Platform Engineer]
- AWS 혹은 On-premise Hadoop 기반의 빅데이터 인프라 구축 및 운영 경험이 있으신 분 (3년 이상)
- RDB, 클라이언트/서버 로그 등의 다양한 형태의 데이터를 수집 및 가공한 경험이 있으신 분
- Spark를 활용한 데이터 파이프라인 개발 경험이 있으신 분
- Python, Java, Scala, Kotlin 중 1개 이상의 언어에 익숙하신 분
이런 경험이 있다면 더 좋겠습니다.
[Data Analytics Engineer]
- 데이터 분석가 혹은 그에 준하는 역할로 데이터 시각화 및 리포트 경험이 있으신 분
- 유저 행동 로그 설계 및 관리 경험이 있으신 분
- 데이터 품질 관리를 위한 다양한 도구 개발 경험이 있으신 분
- Presto, Spark, Hive 등 빅데이터 처리 기반 환경에 익숙하신 분
- LLM을 활용한 데이터 생산/가공 경험이 있으신 분
[Data Platform Engineer]
- k8s 기반의 인프라 구축 및 운영 경험이 있으신 분
- 데이터 거버넌스(카탈로그, 리니지, Data Quality) 도구 구축 및 운영 경험이 있으신 분
- Kafka를 활용한 Flink, Structured Streaming 기반의 스트리밍 환경 구축 경험이 있으신 분
- Terraform 등 IaC(Infrastructure as Code) 활용 경험이 있으신 분
- 멀티 클라우드(Azure 등) 환경에서의 인프라 구축 경험이 있으신 분
- 사내 데이터 어드민 개발이 가능한 수준의 백엔드/프론트 웹 개발 경험이 있으신 분 (Spring, FastAPI 등)
flex Data Infra을 이루는 기술 스택
- Spark(EMR on k8s), Databricks, Presto(Athena)
- Kubernetes(AWS EKS), Helm, Terraform
- S3, Glue Catalog, Lake Formation
- Airflow, Metabase
- Airbyte, AWS DMS(CDC)
- OpenSearch, Vespa, Aurora MySQL, Kafka
- Azure (Multi-Cloud)
- Python, Kotlin