Recruitment background

데이터 엔지니어 (Data Engineer)

모두싸인|2026. 5. 4. 게시|
59

공고 원문

경력5년 이상
채용 유형정규직
학력무관
지역서울
마감일마감
출처원티드

소개

| 회사 소개 대한민국 ​전자서명·전자계약 ​1위, 모두싸인입니다. 2015년 ​설립 이후 33만 기업·기관과 ​1,000만 ​이용자가 선택한 ​계약의 표준을 만들어왔습니다. ​이제 전자계약을 ​넘어계약의 ​작성부터 분석까지 ​전 ​과정을 ​AI로 잇는 CLM(Contract ​Lifecycle ​Management, 계약 생애주기 ​관리) ​플랫폼으로 ​나아가고 있습니다. 검증된 1위 ​서비스 위에서, ​아직 ​아무도 만들지 ​못한 한국형 ​계약 ​AI의 기준을 함께 ​만들어 갈 ​동료를 기다립니다. [데이터로 계약의 표준을 만드는 일에 함께합니다] 모두싸인은 국내 1위 전자서명 서비스에서 시작해, 계약의 작성·검토·체결·보관·활용 전 과정을 다루는 CLM Suite로 진화하고 있습니다. 그 중심에는 계약이라는 비즈니스 인프라에서 만들어지는 풍부한 데이터가 있습니다. 현재 모두싸인의 고객·계약·행동·CRM 데이터는 AWS, NCP, Hubspot, Mixpanel 등 여러 환경에 흩어져 있습니다. Intelligence Lab의 Data Engineer는 이 데이터를 통합·정제·표준화하고, 분석과 AI/ML/RAG가 작동할 수 있는 인프라를 만드는 역할입니다. 우리는 이 자리를 데이터를 처리하는 담당자로 정의하지 않습니다. 데이터 기반 제품 개발이 가능하도록 만드는 전략적 엔지니어로 정의합니다. [모두싸인은 Agentic Software Development를 체계화하고 있습니다] 모두싸인의 제품 개발 방식은 Agentic Software Development(Agentic SD) 로 전환되고 있습니다. 사람은 문제 정의·기준 설정·판단에 집중하고, 실행은 AI Agent가 수행하는 구조입니다. 이미 Discovery–Delivery–Release 전 흐름에 Agent가 들어와 있으며, 데이터 영역 또한 같은 방향으로 진화하고 있습니다. 이 환경에서 가장 중요한 변수는 얼마나 많은 코드를 직접 짜느냐가 아닙니다. • 무엇을 풀어야 하는지 정의할 수 있는가 • 여러 맥락 속에서 가장 중요한 문제를 스스로 판단할 수 있는가 • AI Agent와 자동화 도구를 활용해 한 사람이 더 넓은 영역을 더 빠르게 해낼 수 있는가 • Agent가 안정적으로 작동할 수 있도록 환경을 설계할 수 있는가 우리는 코드를 잘 쓰는 엔지니어만 찾지 않습니다. 설계할 줄 알고, 우선순위를 스스로 판단하며, AI를 자기 역량의 일부로 다룰 줄 아는 엔지니어를 찾고 있습니다. | 모두싸인이 기대하는 엔지니어 1. 구현자가 아니라 설계자 기능을 구현하기 전에 데이터 모델, 파이프라인 구조, 책임 경계를 먼저 설계합니다. AI Agent에게 위임하기 전에 무엇이 입력이고 무엇이 검증 기준인가를 명확히 정의할 수 있어야 합니다. 코드는 결과물이고, 기준이 코드에 우선합니다. 2. 맥락 속에서 스스로 우선순위를 판단하는 사람 Intelligence Lab은 빠르게 움직입니다. 동시에 여러 요구가 들어오고, 정보가 완전한 상태로 제공되지 않을 때도 많습니다. 우리는 모든 지시를 그대로 처리하는 사람이 아니라, 여러 맥락을 종합해 지금 가장 임팩트가 큰 문제를 스스로 찾아내고, 다른 맥락이 끼어들어도 핵심을 놓치지 않는 사람을 기대합니다. 3. AI를 일상의 도구로 다루는 사람 코드 작성, 파이프라인 설계, 스키마 정의, 데이터 검증, 문서화 — 이 모든 영역에서 AI를 적극적으로 활용합니다. 모두싸인은 이를 권장하는 것이 아니라 기본값으로 두고 있습니다. AI를 도구가 아닌 동료로 쓰며, 한 사람의 엔지니어가 다룰 수 있는 영역의 폭과 깊이를 함께 확장하는 분을 찾습니다. 4. 비즈니스 임팩트로 일하는 사람 데이터 인프라는 그 자체가 목적이 아닙니다. 제품·세일즈·마케팅·CS·AI 기능이 데이터로 작동하게 만드는 것이 목적입니다. 자신이 짠 파이프라인이 실제로 어떤 비즈니스 결정과 고객 가치를 만드는지 추적하고, 그 임팩트를 기준으로 우선순위를 정할 줄 아는 분이어야 합니다.

주요업무

1. 데이터 통합 및 파이프라인 구축 • Hubspot, Mixpanel, AWS, NCP 등 외부·내부 시스템에서 데이터 수집 • ETL/ELT 워크플로우 개발 및 자동화 • CDC(Change Data Capture) 기반의 실시간·근실시간 데이터 동기화 2. 데이터 레이크 및 고객 데이터 모델 설계 • AWS S3 기반 Data Lake 설계·운영 • 표준 고객 프로필(Customer 360) 스키마 설계 • PII(개인식별정보) 분리 저장 정책 설계 및 보안 고려 3. 데이터 품질 및 정합성 관리 • 데이터 정제·중복 제거·정합성 검사 로직 개발 • 마케팅 동의·철회, 고객 상태 등 SSOT(Single Source of Truth) 구축 • 자동 검증 가능한 데이터 품질 모니터링 체계 운영 4. 분석·서비스·AI 기능 지원 • 제품·세일즈·마케팅·CS 조직이 활용할 분석 데이터셋 구축 • AI·LLM 기반 지능형 기능(문서 분류, 위험도 분석, 추천 모델) 학습 데이터 준비 • Embedding/RAG용 문서 파이프라인 운영 5. 데이터 플랫폼 고도화 • Airflow, Glue, Lambda 등 오케스트레이션 환경 구성 • 로그·행동데이터 스키마 관리 • Insight Dashboard, 세그먼트 추천 자동화 기반 구축 6. Agent-Ready 데이터 환경 설계 • AI Agent가 안정적으로 조회·실행할 수 있도록 데이터 자산을 정의·문서화 • 데이터 정합성·접근 권한·감사 로그 등을 기계적으로 검증 가능한 형태로 설계 • Agent 기반 분석·자동화 워크플로우의 입력/출력을 표준화

자격요건

• 데이터 엔지니어링 또는 관련 영역 5년 이상의 실무 경험 • Python, Java/Kotlin, 또는 Node.js 기반의 데이터 처리 경험 • AWS 데이터 스택 경험 (S3, Glue, Lambda, Athena 등) • 안정적인 ETL/ELT 파이프라인을 직접 설계·구축해본 경험 • 관계형 DB와 SQL에 대한 깊은 이해 • 로그·이벤트 데이터 처리 경험 • 비즈니스 요구사항을 데이터 모델·파이프라인으로 구체화할 수 있는 역량 • 여러 요구가 동시에 들어오는 환경에서 스스로 우선순위를 판단해본 경험 • AI 도구(Claude, ChatGPT, Cursor 등)를 일상 업무에 적극적으로 활용하고 있는 분 [이런 분과 함께하고 싶습니다] • 코드를 짜기 전에 구조와 기준을 먼저 설계하는 분 • 여러 맥락이 섞여 들어와도 가장 중요한 일을 스스로 짚어낼 수 있는 분 • 명확한 지시가 있을 때는 그것을 끝까지 이행하고, 지시가 없을 때는 지금 무엇을 해야 하는가를 스스로 정의할 수 있는 분 • 완벽함보다 빠른 실행과 학습을 중시하며, 불확실한 상황에서도 추진력을 잃지 않는 분(Act Now) • 데이터가 실제 고객 가치를 만드는 데 어떻게 기여할지 끝까지 추적하는 분(Customer Centric) • 기존 방식에 안주하지 않고 더 나은 구조·효율을 주도적으로 제안하는 분(Go Beyond) • 가장 큰 임팩트를 만드는 문제부터 해결하는 분(Focus on Impact) • 논의에서는 적극적으로 의견을 내되, 결정 후에는 끝까지 책임지고 몰입하는 분(Disagree and Commit) • AI를 일하는 방식의 일부로 받아들이고, 그것으로 자기 역량을 확장해온 분

우대사항

• Airflow, Mage, Dagster 등 오케스트레이션 도구 경험 • Hubspot, Mixpanel 또는 외부 SaaS 데이터 연동 경험 • Kafka, Kinesis 기반 스트리밍 파이프라인 구축 경험 • Data Lake + Warehouse(Lakehouse) 아키텍처 경험 • ML 학습 데이터 파이프라인, LLM/RAG 데이터 처리 경험 • B2B SaaS 환경에서 고객·사용자 데이터 처리 경험 • 보안·컴플라이언스(PII, 개인정보보호법, 데이터 분리 설계) 경험 • AI Agent를 활용한 코드 생성·자동화 워크플로우 설계 경험 우리는 단순히 데이터를 처리하는 엔지니어를 찾고 있지 않습니다. 데이터로 풀어야 할 문제를 정의하고, 맥락 속에서 우선순위를 판단하며, AI와 함께 모두싸인의 데이터 기반을 설계해갈 엔지니어를 찾고 있습니다.

혜택 및 복지

1. 유연한 업무환경 • 유연 근무 : 9~10시 사이 자유롭게 출근, 8시간 근무 후 퇴근 2. 최상의 업무환경 • 맥북프로, 맥북에어, 레노버 씽크패드 등 직무에 맞는 사양의 최신 장비 지원 • 마우스, 키보드 등 개인 업무장비 지원 (35만원 한도, 1년 근속 시 개인 소유 전환) • 듀얼 또는 4K 모니터 지원 • 허리 건강을 위한 시디즈 의자 제공 • 다양한 간식 제공 및 점심 식대 지원 • 야근 시 택시비/저녁 식대 지원 3. 적극적인 성장을 위한 지원 • 이러닝 교육, 도서, 강의, 세미나 및 컨퍼런스 참가비 지원 • 자유로운 사내 스터디 지원 4. 적극적인 협업을 위한 친목 및 교류 활동 지원 • 팀 리더와의 주기적인 1on1(페이스톡) 진행 • 신규 구성원 메이트 활동 지원 • 주기적인 전사 지표공유(모두회의) 진행 5. 함께 일하기 좋은 회사가 되기 위한 기타 복지 혜택 • 3/5/7/10년 장기근속자 휴가/휴가비 지급 • 좋은 동료와 함께하기 위한 사내추천 보상금 지급 (최대 500만원) • 매년 종합건강검진, 독감 예방 접종비 지원 • 구성원과 가족의 경조사 지원 • 생일선물 및 명절선물 지원

이런 공고는 어때요?

인포시즈

인포시즈

1년~5년 · 정규직 · 서울

Forward Deployed Engineer#데이터모델링  #AI솔루션
상시
그룹바이그룹바이
50
워트인텔리전스

워트인텔리전스

7년~20년 · 정규직 · 서울

Data Engineer: Ontology 전문가 (7년 이상)#그래프설계  #지식그래프
상시
그룹바이그룹바이
13
울트라 텐던시 코리아

울트라 텐던시 코리아

20년 이하 · 정규직 · 해외

[100%재택]데이터브릭스 레지던트 솔루션 아키텍트#데이터브릭스  #아키텍처설계
상시
그룹바이그룹바이
46
어쎈드(ASCEND)

어쎈드(ASCEND)

10년 이하 · 정규직 · 서울

Quantitative Research Engineer#퀀트트레이딩  #트레이딩개발  #재택가능
상시
그룹바이그룹바이
792
모다플

모다플

3년~10년 · 정규직 · 서울

머신러닝 엔지니어(3년이상)#머신러닝모델  #모빌리티  #MLOps
상시
그룹바이그룹바이
51
페이스웹

페이스웹

20년 이하 · 정규직 · 서울

SLM Modeling & Data Engineering#데이터자산화  #파인튜닝  #의료AI
상시
그룹바이그룹바이
76
텐

10년 이하 · 정규직 · 서울

AI 인프라 연구원(SW+HW)#ML서비스  #AI인프라
상시
그룹바이그룹바이
328
미리비트

미리비트

10년 이하 · 정규직 · 경기

빅데이터 엔지니어,서버 백엔드 엔지니어 (인메모리 기반)#파이프라인  #실시간데이터  #빅데이터
상시
그룹바이그룹바이
653
워트인텔리전스

워트인텔리전스

10년~15년 · 정규직 · 서울

Senior Data Engineer (10년 이상) | 시니어 데이터 플랫폼 엔지니어#시용기간  #아키텍처설계  #데이터플랫폼
상시
그룹바이그룹바이
4
앰플랩

앰플랩

3년~20년 · 정규직 · 대전

Field AI Solutions Engineer#데이터설계  #AI자동화  #스마트팩토리
상시
그룹바이그룹바이
7
스텝에이아이

스텝에이아이

20년 이하 · 정규직 · 서울

[팀 스케일업] AI 풀스택 개발자 (LLM 파이프라인 · 대규모 데이터 수집)#B2BAI  #대용량데이터  #LLM파이프라인
상시
그룹바이그룹바이
152
퓨처릭스

퓨처릭스

20년 이하 · 정규직 · 경기

ML Engineer (시계열 예측·머신러닝)#수요예측모델  #예지보전  #AISaaS
상시
그룹바이그룹바이
93
미리디

미리디

3년~6년 · 정규직 · 서울

[미리디] Data Engineer#레이크하우스  #데이터엔지니어  #디자인플랫폼
상시
그룹바이그룹바이
41
콕스웨이브

콕스웨이브

3년~7년 · 정규직 · 서울

[AX AgentX] 데이터 엔지니어(RAG/LLM Pipeline)#LLMOps  #ETL파이프라인  #AI솔루션
상시
그룹바이그룹바이
42
원체크

원체크

3년~10년 · 정규직 · 경기

MLOps Engineer (LLM/AI 플랫폼 운영)#ML파이프라인  #인공지능  #정규직
상시
그룹바이그룹바이
94
미리비트

미리비트

3년~10년 · 정규직 · 경기

데이터 플랫폼 엔지니어 (3년차~PL) Spark · Airflow · K8s#스트리밍  #빅데이터
상시
그룹바이그룹바이
62
그로잉랩

그로잉랩

3년~9년 · 정규직 · 서울

개인투자자의 블룸버그, '버틀러'의 데이터 엔진을 구축할 시니어 엔지니어#연봉1억이상  #핀테크  #ETL파이프라인
상시
그룹바이그룹바이
201
원체크

원체크

3년~10년 · 정규직 · 경기

Backend 개발자 (LLM/AI 플랫폼 운영)#ML파이프라인  #ML플랫폼
상시
그룹바이그룹바이
80
페이스웹

페이스웹

20년 이하 · 정규직 · 서울

AI 학습데이터 · SLM 운영 담당#파인튜닝  #데이터정제  #의료AI
상시
그룹바이그룹바이
43
피에프씨테크놀로지스

피에프씨테크놀로지스

7년 이상 · 정규직 · 서울

B2B Senior Data Engineer(시니어 데이터 엔지니어)-Databricks#핀테크  #데이터플랫폼  #시차출퇴근
상시
그룹바이그룹바이
1