매일메일을 통한
하루 CS 공부하기
DB Replication은 데이터베이스의 고가용성과 데이터 안정성을 보장하기 위해 널리 활용되는 핵심 기술이다.
특히, 대규모 애플리케이션 환경에서는 데이터의 지속적인 가용성과 신뢰성이 매우 중요하기 때문에, 원본(Source) 서버와 복제(Replica) 서버 간의 데이터 동기화는 필수이다.
Binary log를 저장하는 방식은?
Replication은 Source 서버에서 발생하는 모든 데이터 변경 사항을 Replica 서버로 복제하여 두 서버 간의 데이터 일관성을 유지하는 메커니즘이다.
이러한 과정은 주로 Binary log를 기반으로 이루어지며, Binary log는 Source 서버에서 실행된 모든 데이터 변경 쿼리를 기록하는 역할을 한다. MySQL에서는 해당 Binary Log를 저장하는 방식으로 Row, Statement, Mixed 세 가지 방식을 제공한다.
Row
Row 방식은 DB의 각 행별로 변경된 내용을 정확히 기록한다.
이 방식은 데이터 일관성을 매우 높게 유지할 수 있다는 큰 장점이 있다.
예를 들어서, 특정 행이 수정되었을 때 그 행의 이전 상태와 변경된 상태를 모두 기록하므로, Replica 서버에서도 Source 서버와 동일한 데이터 상태를 유지할 수 있다.
그러나, 모든 행의 변경 사항을 저장하기 때문에, Binary log 파일의 크기가 급격히 증가할 수 있어 저장 공간에 부담을 줄 수 있다는 단점이 존재한다.
[MVCC (Multi-Version Concurrency Control) 와 비슷한 개념]
Statement
데이터 변경을 일으킨 SQL 문 자체를 Binary log에 기록한다.
이 방식은 로그 파일의 크기를 상대적으로 작게 유지할 수 있어 저장 공간을 절약할 수 있는 장점이 있다.
하지만, 실행할 때마다 다른 값을 반환하는 함수와 같이 비확정적 SQL 쿼리가 실행될 경우, 동일한 쿼리가 Source와 Replica 서버에서 다른 결과를 초래할 수 있어, 데이터 불일치 문제가 발생할 수 있다.
ex> SELECT NOW() 같은 함수는 복제시 문제가 될 수 있다.
Mixed
이러한 문제를 보완하기 위해 MySQL은 상황에 따라 Row 기반과 Statement 기반을 혼합하여 로그를 기록하는 Mixed 방식을 사용한다.
비확정적 SQL이 아닌 경우는 statement 방식을 사용하여 저장 공간을 절약하고, 비확정적 SQL이 아닌 경우에는 Row 방식을 사용하여 데이터 일관성을 유지한다.
다만, 구현이 다소 복잡할 수 있다는 단점 존재.
복제 과정
- Source 서버에서 데이터 변경 쿼리가 실행
- 선택된 로그 저장 방식에 따라 Binary log에 기록
- Replica 서버의 IO Thread가 Binary log를 읽어와 Replica 서버의 Relay log로 전송
Relay log는 Replica 서버에서 Source 서버의 Binary log를 저장하는 임시 저장소 역할
이곳에 저장된 로그를 기반으로 Replica 서버의 SQL 스레드가 실제 데이터베이스에 변경 사항을 적용
이 과정은 매우 효율적으로 설계되어 일반적으로 약 100밀리초 이내에 데이터 동기화가 완료된다.
이러한 빠른 동기화 속도 덕분에 원본과 복제 서버 간의 데이터 일관성이 실시간에 가깝게 유지될 수 있다.
'Back-end' 카테고리의 다른 글
[DataBase] Transaction - ACID란? (0) | 2025.02.03 |
---|---|
[Back-End] 로드밸런싱 톺아보기 (0) | 2025.01.30 |
[Back-End] HTTPS란 정확히 무엇일까? (0) | 2025.01.21 |
[Back-End] 리버스 프록시 vs 포워드 프록시 (0) | 2025.01.13 |
[Back-End] CORS란 무엇인가요? (1) | 2025.01.10 |