백엔드 커리큘럼 심화: Job Result Ledger, 재시작 가능한 워커를 운영 가능한 작업으로 만드는 법
비동기 job과 worker를 단순 retry 코드가 아니라 결과 원장, checkpoint, lease, evidence, 재처리 기준을 가진 운영 단위로 설계하는 방법을 정리합니다.
비동기 job과 worker를 단순 retry 코드가 아니라 결과 원장, checkpoint, lease, evidence, 재처리 기준을 가진 운영 단위로 설계하는 방법을 정리합니다.
HTTP 상태 코드, 비즈니스 error code, retryable 여부, 사용자 메시지, 관측 필드를 분리해 API 실패를 운영 가능한 계약으로 만드는 기준을 정리합니다.
크론·배치·주기 작업이 지연되거나 누락됐을 때 skip, coalesce, replay, manual backfill 중 무엇을 선택할지 실무 기준과 운영 가드를 정리합니다.
장애 후 데이터 보정을 개인 SQL 작업이 아니라 dry-run, 승인, 멱등 실행, 감사 로그, 종료 기준을 갖춘 운영 작업으로 설계하는 방법을 정리합니다.
결제사·인증 SaaS·마켓플레이스·외부 파트너가 보내는 webhook을 수신할 때 서명 검증, replay 방지, 멱등 처리, 상태 전이를 어떻게 설계할지 실무 기준으로 정리합니다.
주문, 결제, 업로드, 배치, 이벤트 소비처럼 상태가 있는 백엔드 흐름을 단순 status 컬럼이 아니라 전이표·불변식·감사 로그·재처리 기준으로 설계하는 방법을 정리합니다.
CSV·엑셀·JSONL 같은 대량 업로드를 동기 API로 처리하지 않고, import job·row error·멱등성·부분 성공·재처리 기준으로 운영하는 방법을 정리합니다.
재고, 좌석, 쿠폰, 포인트처럼 먼저 잡아두고 나중에 확정하는 자원을 Reservation Ledger와 Expiry Worker로 안전하게 운영하는 기준을 상태 전이, TTL, 멱등성, 정산 관점에서 정리합니다.
메시지 큐에서 반복 실패하는 poison message를 무한 재시도하지 않고 격리·분류·안전 재처리하는 운영 기준을 DLQ, 멱등성, replay throttle, 승인 절차 중심으로 정리합니다.
중복 요청과 재처리를 막을 때 UPSERT, UNIQUE 제약, 멱등 키를 언제 어떻게 조합해야 하는지 쓰기 경로 기준으로 정리합니다.