devBlog
본문 바로가기
devBlog.kr
포스트주간 인기글최근 본 글즐겨찾기(로그인 필요)프로필(로그인 필요)새로운 소식요청하기
devBlog.kr
포스트주간 인기글최근 본 글즐겨찾기(로그인 필요)프로필(로그인 필요)새로운 소식요청하기
devBlog

푸터 메뉴

탐색
  • 포스트
  • 태그별 보기
  • 기업별 보기
  • 주간 인기글
정보
  • 이용약관
  • 개인정보 처리방침

© 2026 devBlog.kr. All rights reserved.

·

v3.0.1

태그/Monitoring

Monitoring 글 모음

기업 기술블로그의 Monitoring 관련 글 196개

네이버 클라우드 플랫폼 로고

네이버 클라우드 플랫폼

2026-09-30

[프로모션] 로봇 생산성부터 고장 예측까지 한 번에, AI 기반 로봇 운영 OS ROBOT FACTORY

안녕하세요, 누구나 쉽게 시작하는 클라우드 네이버클라우드 ncloud.com 입니다. 오늘은 로봇을 운영하는 현장에 도움이 될 마켓플레이스 오픈 프로모션 소식을 들고 왔습니다. 야심 차게 도입한 로봇, 생산성과 운영 효율까지 챙기기는 생각보다 쉽지 않으시죠? "실시간 생산성이 보이지 않아 생산 손실과 병목을 찾기 어렵다" "작업 중인 로봇의 상태와 가동 현황을 한눈에 확인할 수 없다" "로봇의 이상 징후와 고장 위험을 미리 알 수 없다" "갑자

AI AgentAI/MLDevOpsMonitoringTools
KT 클라우드 로고

KT 클라우드

2026-09-29

[인사이트] 발전소에서 서버 랙까지, AI 시대 데이터센터 전력의 대장정

.ktc-poster img { transition: transform .3s ease, box-shadow .3s ease; } .ktc-poster:hover img { transform: translateY(-4px); box-shadow:0 10px 22px rgba(0,154,135,0.22) !important; } .imageblock img { max-width:100% !important; height:auto !importan

AI/MLData EngineeringDevOpsInfraMonitoring
AWS 로고

AWS

2026-09-28

웅진프리드라이프의 AWS Elastic Disaster Recovery 기반 클라우드 DR 환경 구축

“재해 상황에서 모든 서버를 같은 방식으로 복구해야 할까요?” 재해복구(DR, Disaster Recovery)는 시스템 장애나 재해 상황에서 서비스를 복구하기 위한 체계입니다. 백업을 확보하고 복제를 구성하는 것까지는 비교적 명확한 작업에 해당합니다. 일반적으로 재해복구의 목표는 모든 시스템을 장애 이전 상태로 되돌리는 것으로 설정됩니다. 다만 모든 시스템에 동일한 복구 수준을 적용하려면 그만큼의 자원과 운영 부담이 따릅니다. 복구 시간을 짧

AWSDevOpsInfraMonitoring
AWS 로고

AWS

2026-09-23

Strands Agents와 Amazon Bedrock AgentCore을 이용한 발전설비진단 구현하기

발전소에는 목적이 다른 시스템과 문서가 함께 존재합니다. 원격 진동 고장진단 시스템(Remote Vibration Monitoring System, RVMS)은 회전설비의 베어링 진동을 상시 감시하고 임계치 초과를 알려 줍니다. 운전 매뉴얼과 로직 도면에는 조치 절차와 설비 관계가 기록되어 있습니다. 하지만 경보가 발생한 뒤 원인 후보를 좁히고, 여러 지표를 비교하고, 필요한 근거를 찾아 조치 순서를 정하는 일은 여전히 전문가의 경험에 의존합니

AI AgentAWSData AnalysisMonitoringSecurity
버즈빌 로고

버즈빌

2026-09-23

Memory DB는 무엇으로 가득 차 있었을까 - 2부 : BCAST 전환과 Failover

안녕하세요. 할당시스템 파트 서버 엔지니어, Simon 이상원입니다. 'MemoryDB는 무엇으로 가득 차 있었을까?'의 2부 글입니다. 1부에서는 MemoryDB 메모리의 85%를 채우고 있던 것의 정체를 찾아가는 과정을 다뤘습니다. 2부는 이 문제를 어떻게 해결했는가, 그리고 더 나은 방법은 없었을까에 대한 회고를 담았습니다. 1부에서는 무슨 일이 있었…

BackendDatabaseInfraMonitoringPerformance
flex 로고

flex

2026-09-22

"다 됐습니다" 알림, 대체 언제 보내야 맞나

완료를 나중에 관측하지 않고, 처리하는 순간에 기록하기로 한 이유

AgileBackendMonitoring
AWS 로고

AWS

2026-09-22

Strands Agents와 Amazon Bedrock AgentCore을 이용한 발전설비진단 구현하기

발전소에는 목적이 다른 시스템과 문서가 함께 존재합니다. 원격 진동 고장진단 시스템(Remote Vibration Monitoring System, RVMS)은 회전설비의 베어링 진동을 상시 감시하고 임계치 초과를 알려 줍니다. 운전 매뉴얼과 로직 도면에는 조치 절차와 설비 관계가 기록되어 있습니다. 하지만 경보가 발생한 뒤 원인 후보를 좁히고, 여러 지표를 비교하고, 필요한 근거를 찾아 조치 순서를 정하는 일은 여전히 전문가의 경험에 의존합니

AI AgentAWSData AnalysisMLOpsMonitoring
KT 클라우드 로고

KT 클라우드

2026-09-22

[아키텍처] 이기종 데이터 통합 설계, 모니터링 통합에서 얻은 3가지 경계

@keyframes kttblink { 50% { opacity:0; } } .ktt-cursor { animation:kttblink 1.05s step-end infinite; } @keyframes kttlive { 0% { box-shadow:0 0 0 0 rgba(63,185,80,0.55); } 70% { box-shadow:0 0 0 6px rgba(63,185,80,0); } 100% { box-shadow:0 0 0 0 rgba

ArchitectureData EngineeringMonitoring
AWS 로고

AWS

2026-09-21

AWS 네트워크 데이터 전송 및 처리 요금, 아키텍처로 이해하기 [2부: 리전 안의 트래픽]

이 글은 VPC와 가용 영역(Availability Zone, AZ)의 기본 개념과 Elastic Load Balancing, Amazon ElastiCache, Amazon EKS를 운영해 본 경험이 있는 아키텍트와 운영 담당자를 대상으로, 같은 리전 안에서 AZ 경계를 넘는 트래픽이 어디에서 발생하고 어떻게 최적화하는지를 다룹니다. 1부에서는 AWS 네트워크 비용이 데이터 전송 요금과 데이터 처리 요금 두 축으로 결정된다는 점을 살펴보았습니

AWSArchitectureDevOpsInfraMonitoring
데브시스터즈 로고

데브시스터즈

2026-09-18

쿼리가 아니라 정의를 고치기로 했습니다: Databricks Metric View 도입기

Metric View를 신규 런칭 게임의 데이터 파이프라인에 도입하면서, 대시보드와 분석 에이전트가 같은 지표 정의를 읽게 하기 위해 데이터 구조를 어떻게 나눴는지, 그 과정에서 정한 설계 규칙과 결과를 공유합니다.

AWSArchitectureData AnalysisData EngineeringMonitoring
KT 클라우드 로고

KT 클라우드

2026-09-16

[kt cloud 웨비나] AI 시대, 데이터센터 운영의 기준을 높이다

요약SUMMARY 이번 kt cloud 웨비나에서는 kt cloud에서 25년간 축적한 데이터센터 운영 경험을 바탕으로, AI와 BIM을 실제 현장에 적용해 AIDC 구축·운영을 혁신한 사례를 공유합니다. 안녕하세요. kt cloud 마케팅커뮤니케이션팀입니다. AI 인프라의 고집적·고도화로 데이터센터 환경이 복잡해지면서, 어떻게 보다 효율적이고 지능적으로 데이터센터를 구축하고 운영할 것인가가 중요한 과제로 떠오르고 있습니다.이러한 과제에 대한

AI/MLData EngineeringDevOpsInfraMonitoring
미리디 로고

미리디

2026-09-15

외부 API 장애가 우리 서비스 장애로 이어졌다

BackendDevOpsMonitoringSRESecurity
가비아 로고

가비아

2026-09-14

AI 데이터센터 효율 지표 4가지 [PUE·WUE·ERF·REF]

AI가 데이터센터의 전력·물·폐열 부담을 동시에 키우면서 전력만 재는 PUE 하나로는 효율을 모두 확인하기 어려워졌습니다. AI 데이터센터 시대에는 실제 환경 성능을 보기 위해 물은 WUE, 폐열은 ... Read More

AI/MLData AnalysisInfraMonitoring
여기어때 로고

여기어때

2026-09-10

[2편] Grafana 커스텀 패널로 10만 점 산점도 그리기 — 만들고 나서야 보인 함정 3가지

Data AnalysisMonitoring
여기어때 로고

여기어때

2026-09-10

[1편] APM 스캐터 차트 직접 만들기 — OpenTelemetry 수집과 ClickHouse 저장

BackendData AnalysisMonitoring
버즈빌 로고

버즈빌

2026-09-05

Memory DB는 무엇으로 가득 차 있었을까 - 1부 : 클라이언트 캐싱과 tracking item

안녕하세요. 할당시스템 파트 서버 엔지니어, Simon 이상원입니다. 최근 저희 할당시스템 파트에서 활용하는 MemoryDB(Redis)의 메모리 사용량이 85%까지 차올랐습니다. 사용 가능한 메모리가 500MB도 남지 않은 상황. 과연 무엇이 메모리를 점유하고 있었는지, 그리고 다시 3GB 이상의 여유 공간을 확보하기까지 어떤 여정이 있었는지 정리해보았습…

BackendData EngineeringMonitoringRedis
라인 로고

라인

2026-09-04

장애 Alert의 원인을 스스로 찾다: SRE Observer 개발기

들어가며안녕하세요. LINE Plus에서 Home 서비스의 안정성을 책임지고 있는 Home SRE(Site Reliability Engineering) 팀입니다.SRE Observ...

DevOpsMonitoringSRE
AWS 로고

AWS

2026-09-03

삼성 계정 AIOps: AgentCore기반 AlOps의 실전 활용과 자율성 확장

지난 1부에서는 삼성계정 서비스의 멀티 에이전트 AIOps 시스템을 어떤 구조로 설계했고, 그 구조를 안정적으로 운영하기 위해 무엇을 뒷받침했는지, 그리고 그 위에서 자율성을 어떻게 조금씩 넓혀왔는지를 다뤘습니다. 이 글에서는 그 시스템이 실제 운영 현장에서 어떻게 쓰이고 있는지, 도입 전후로 업무가 어떻게 달라졌는지, 그리고 더 높은 수준의 자율운영으로 나아가기 위해 무엇을 준비하고 있는지를 다룹니다. 이 글은 2부작으로 […]

AI AgentDevOpsInfraMonitoring
12345

페이지 1 / 11 (총 196개)