devBlog
본문 바로가기
devBlog.kr
포스트주간 인기글즐겨찾기(로그인 필요)프로필(로그인 필요)새로운 소식요청하기
devBlog.kr
포스트주간 인기글즐겨찾기(로그인 필요)프로필(로그인 필요)새로운 소식요청하기
devBlog

푸터 메뉴

탐색
  • 포스트
  • 태그별 보기
  • 기업별 보기
  • 주간 인기글
정보
  • 이용약관
  • 개인정보 처리방침

© 2026 devBlog.kr. All rights reserved.

태그/Monitoring

Monitoring 글 모음

기업 기술블로그의 Monitoring 관련 글 151개

글루시스 로고

글루시스

2025-11-28 · 8개월 전

Lustre Changelog DR

목차 인사말 전통적인 rsync 방식의 한계와 파일 히스토리 기반 DR Lustre Changelog Changelog의 동작 원리 Changelog 활성화 및 확인 changelog_mask 이벤트 타입 Changelog 읽기 글루시스 DR 솔루션 주요 특징 시스템 구성 시스템 아키텍처 컴포넌트별 상세 기능 동작 원리 1. 이벤트 수집 단계 2. 동기화 처리 단계 3. 이벤트 처리 상태 관리 4. 예상치 못한 종료 시 복구 메커니즘 5. 오류

ArchitectureBackendData EngineeringInfraMonitoring
11번가 로고

11번가

2025-11-25 · 8개월 전

한계에 도달한 전시 서버, 그리고 우리의 해답

늘어나는 트래픽, 늘어나는 서버: 한계를 돌파하다 안녕하세요. 11번가 전시서비스개발팀에서 백엔드를 담당하고 있는 서장원입니다. 이번 글에서는 고객이 11번가에 처음 진입하는 관문인 전시서비스를 더 비용 효율적으로, 그리고 대량 트래픽 환경에서도 안정적으로 운영하기 위해 전시서비스개발팀의 김민교 님과 함께 고민하고 풀어나갔던 과정에서 다뤘던 주요 개선 포인트를 중심으로 소개합니다. 목차 미리보기: 핵심 개선 포인트 들어가며 트래픽의 꾸준한 증가

AWSBackendDevOpsMonitoringPerformance
사람인 로고

사람인

2025-10-28 · 9개월 전

‘에러를 읽는 AI’ - Gemini와 Slack으로 만든 자동 오류 분석 시스템 Solomon

1. 들어가며 현재 사내의 로그 수집은 Heimdall과 OpenTelemetry(w. sigNoz)를 기반으로 이루어지고 있습니다. 오류 관제의 대부분은 Heimdall의 룰(rule) 에 따라 Slack 채널로 전달되며, 실제 장애 발생 시 관련 로그가 아래와 같이 공유 되고 있습니다. (이미지 참조) 그러나 기존 메시지 템플릿으로 모니터링을 진행하면서 다음과 같은 불편함이 있었습니다. 불필요하게 긴 Stack Trace (메시지가 너무 길

AI/MLDevOpsMonitoring
마켓컬리 로고

마켓컬리

2025-10-10 · 10개월 전

nginx 설정 없이 우아하게 서비스 점검하기 (下)

리뉴얼된 AccessBlock

DevOpsMonitoringTools
마켓컬리 로고

마켓컬리

2025-10-10 · 10개월 전

nginx 설정 없이 우아하게 서비스 점검하기 (上)

AccessBlock, 그 시작과 진화의 여정

DevOpsMonitoringTools
글루시스 로고

글루시스

2025-09-01 · 11개월 전

Lustre의 파일 create & open 과정 분석 - 2

들어가기 앞서 이번 블로그에서 설명할 내용은 지난 Lustre의 파일 create & open 과정 분석 -1의 후속 내용으로, 클라이언트에서 보낸 요청이 MDS에서 처리되는 과정과 이후 클라이언트의 후속 처리 과정을 담고 있습니다. 아래 그림에서 1번은 지난 1편 블로그의 내용이고, 2번은 본 편에서 설명할 내용입니다. 1편의 내용을 숙지하고, 2편을 보시면 전체 흐름을 이해하는 데 도움이 될 수 있습니다. 러스터의 전체적인 software

ArchitectureBackendData EngineeringMonitoringTools
카카오뱅크 로고

카카오뱅크

2025-08-08 · 12개월 전

그 많던 메시지는 누가 다 먹었을까? 🧀

카카오뱅크 알림탭 시스템에서 발생한 동시성 문제를 해결한 경험을 다룬 글입니다. ShardingSphere 라이브러리로 인해 발생한 문제를 분석하고, 이를 재현 및 해결한 과정을 상세히 담았습니다. 또한, 핵심 라이브러리 관리의 중요성과 새롭게 도입한 관리 방법에 대해 설명합니다. 알림탭 시스템의 비정상적인 동작과 그 원인을 파악하는 여정을 다룬 만큼, 백엔드 개발과 시스템 안정성에 관심 있는 분들은 꼭 읽어보세요!

BackendDatabaseDevOpsMonitoring
사람인 로고

사람인

2025-07-31 · 12개월 전

표준을 통한 마이크로 서비스의 Observability 구축기

저희는 Kubernetes 환경에서 동작하는 서비스의 증가와 최근 k8s 환경에서 대규모 서비스 오픈을 진행 했으며, 이에 대비하여 어떻게 마이크로 서비스에서 가시성을 확보할지, 또 문제가 생겼을 경우 어떻게 쉽게 문제를 확인하고 추적 할지에 대해 고민하게 되었습니다. 그 결과, OpenTelemetry와 SigNoz 조합을 활용한 Observability 환경을 구축하게 되었으며, 그 경험을 공유하고자 합니다. 시작하게 된 배경 기존 모니터링

DevOpsKubernetesMSAMonitoring
클라우드메이트 로고

클라우드메이트

2025-07-28 · 약 1년 전

Database Insights, 메트릭 대시보드 사용자 정의 지원 추가

Database Insights

DatabaseMonitoringTools
포스타입 로고

포스타입

2025-07-18 · 약 1년 전

쿼리가 길면 밟힌다! 포스타입에서 데이터베이스를 모니터링 하는 방식

안녕하세요. 포스타입 기술팀의 백엔드 엔지니어 김안선 입니다. 포스타입은 대량의 요청을 실시간으로 처리하는 서비스 입니다. 대규모 서비스 운영에서 데이터베이스의 안정성은 곧 서비스의 품질과도 직결되는 요소인데요. 데이터베이스는 마치 시스템의 심장과도 같아서 사용자가 늘어남에 따라 데이터를 혈액처럼 끊임없이 공급하고 생성합니다. 하지만 급격한 혈류의 증가로 처리 속도가 저하된다면 시스템의 장애를 야기할 수도 있습니다. 오늘은 포스타입을 지탱하는

BackendData EngineeringDatabaseMonitoringPerformance
네이버 페이 로고

네이버 페이

2025-06-30 · 약 1년 전

레거시 시스템 교체기: 실시간 트래픽 미러링을 통한 안정적 전환 사례

DevOpsMSAMonitoringPerformanceTools
IMQA 로고

IMQA

2025-06-25 · 약 1년 전

[보도자료] 어니컴, '라이나생명'에 프런트엔드 성능 관리 솔루션 'IMQA' 구축 완료

IMQA가 고객 중심 시스템을 갖추고 고객 접점에서 빠른 응대와 안정적인 시스템을 운영하는 라이나생명과 함께합니다.

FrontendMonitoringPerformance
베스핀글로벌 로고

베스핀글로벌

2025-05-30 · 약 1년 전

[WhaTap] RDS Failover/Reboot 관제 2 – RDS Failover

오늘은 BESPIN GLOBAL SRE실 지봉근님이 작성해주신 '[WhaTap] RDS Failover / Reboot 관제 2 - RDS Failover'에 대해 소개해드리도록 하겠습니다. The post [WhaTap] RDS Failover/Reboot 관제 2 – RDS Failover appeared first on BESPIN Tech Blog.

AWSDatabaseInfraMonitoringSRE
베스핀글로벌 로고

베스핀글로벌

2025-05-29 · 약 1년 전

[WhaTap] RDS Failover / Reboot 관제 1 – Describe RDS

오늘은 BESPIN GLOBAL SRE실 지봉근님이 작성해주신 '[WhaTap] RDS Failover / Reboot 관제 1 - Describe RDS' 에 대해 소개해드리도록 하겠습니다. The post [WhaTap] RDS Failover / Reboot 관제 1 – Describe RDS appeared first on BESPIN Tech Blog.

AWSDatabaseMonitoringSRE
11번가 로고

11번가

2025-05-28 · 약 1년 전

Micrometer 객체 증가로 인한 메모리 이슈 회고

목차 들어가며 시스템 구성 및 개선 배경 주요 이슈 분석 1. 이슈 1: Micrometer 객체 증가 현상 2. 이슈 2: 메모리 점진적 증가 현상 최종 결론 마무리하며 들어가며 안녕하세요. 주문플랫폼개발팀 이경진입니다. 최근 주문플랫폼개발팀과 쿠폰/PCS개발팀이 함께 진행한 최대할인가 구조 개선 과정에서 예상치 못한 몇 가지 성능 이슈를 마주하게 되었습니다. 이 글에서는 함께 논의하며 문제를 해결해 나갔던 과정을 되짚어보고, 어떤 이슈가 있

BackendMonitoringPerformanceTools
비브로스 로고

비브로스

2025-05-25 · 약 1년 전

DevLake를 활용한 DORA Metrics 지표 수집 및 시각화 도입기

안녕하세요, 비브로스 DevOps 엔지니어 박도준 입니다.

DevOpsMonitoringTools
카카오뱅크 로고

카카오뱅크

2025-05-16 · 약 1년 전

R.I.P. 내가 만든 시스템이 무지개 다리를 건넌 이야기 🪦🍂

Oslo는 카카오뱅크 첫 화면의 장애격리 문제를 해결하기 위해 시작된 프로젝트였습니다. 하지만 오픈 이후, 여러 우여곡절을 겪으면서 3년 만에 EOS(End Of Service) 되었습니다. 이 글에서는 Oslo 시스템의 생존과 진화 과정을 통해 얻은 통찰과, 새로운 시스템 도입 전 반드시 고려해야 할 고민들을 소개합니다.

BackendDevOpsMonitoringPerformanceTools
IMQA 로고

IMQA

2025-04-16 · 1년 이상 전

IMQA, 이런 기업에게 추천합니다 #1 - 금융/보험

금융/보험 서비스 기업의 고민, "서비스 안정성" 고객을 위한 안정적인 서비스 운영이 가능하도록 IMQA가 도와드릴게요!

BackendDevOpsMonitoringSecurity
12345

페이지 4 / 9 (총 151개)