백엔드 커리큘럼 심화: Job Result Ledger, 재시작 가능한 워커를 운영 가능한 작업으로 만드는 법
비동기 job과 worker를 단순 retry 코드가 아니라 결과 원장, checkpoint, lease, evidence, 재처리 기준을 가진 운영 단위로 설계하는 방법을 정리합니다.
비동기 job과 worker를 단순 retry 코드가 아니라 결과 원장, checkpoint, lease, evidence, 재처리 기준을 가진 운영 단위로 설계하는 방법을 정리합니다.
HTTP 상태 코드, 비즈니스 error code, retryable 여부, 사용자 메시지, 관측 필드를 분리해 API 실패를 운영 가능한 계약으로 만드는 기준을 정리합니다.
외부 시스템으로 webhook를 보내는 백엔드에서 중복 전송, 유실, 서명 검증 실패, 재시도 폭주를 줄이기 위한 실무 기준을 숫자와 우선순위 중심으로 정리합니다.
결제·배송·정산처럼 길고 복잡한 비즈니스 플로우를 Temporal로 안정적으로 운영하는 기준을 실무 관점에서 정리합니다.
타임아웃/재시도/백오프를 잘못 설정했을 때 발생하는 장애 전파를 막는 실무 기준과 Spring 예제
멱등키 설계, 재시도 안전한 API 구현, 분산 환경에서의 중복 방지 전략
재시도 토픽, DLQ, 멱등 처리로 Kafka 소비 실패를 다루는 패턴
WebClient로 외부 API 호출 시 타임아웃/재시도/서킷 브레이커/백프레셔 설정 가이드