인프라·보안 · 관측 기능과 운영 비용
클라우드플레어 관측 기능 확대…12월 과금 변경 앞두고 보존·내보내기 점검
클라우드플레어가 로그·추적·분석을 통합하는 관측 기능 업데이트 8개를 발표했다. 국내 운영자는 베타와 향후 제공 기능을 구분하고, 수집·저장·외부 내보내기 비용을 함께 살펴볼 필요가 있다.

클라우드플레어가 10월 2일 발표한 관측 기능 개편에서 국내 서비스 운영자가 먼저 살펴볼 부분은 요금 적용 시점과 데이터 보존 조건이다. 회사는 로그·트레이스의 수집량과 저장량을 기준으로 한 과금을 12월 1일부터 적용하며, Enterprise 고객에게는 계약 갱신 때 적용한다고 안내했다. 제공 자료에는 제품을 외부에서 시험한 결과가 없다.
회사 발표에 따르면 무료 요금제의 로그·트레이스 수집 제공량은 하루 0.5GB이고 보존 기간은 7일이다. 유료·Enterprise 요금제 표에는 청구 주기당 수집 50GB와 저장 10GB-month가 포함돼 있다. 추가 수집은 GB당 0.25달러, 추가 저장은 GB-month당 0.10달러다. 도메인 분석 데이터는 모든 요금제에서 30일 보존한다고 밝혔지만, 로그·트레이스의 최대 1년 보존은 향후 제공 계획이다.
요금을 검토할 때는 내보내기도 별도로 봐야 한다. 회사는 로그 내보내기를 모든 셀프서비스 요금제로 확대하고 SQL 기반 변환 기능을 정식 제공한다고 발표했다. 월 포함량은 자사 목적지와 외부 목적지 내보내기 각각 25GB이며, 초과 단가는 GB당 각각 0.03달러와 0.10달러다. 변환 기능은 월 1GB를 포함하고 초과분에 GB당 0.04달러를 안내했다.
기능별 준비 상태도 다르다. 요청 처리 경로를 살펴보는 트레이스는 공개 베타이며, 회사가 안내한 범위는 지원되는 보안 규칙·변환·캐시·라우팅·Workers·원본 서버 처리다. OpenTelemetry 내보내기와 W3C 추적 문맥 전달도 지원한다고 설명했다. 통합 SQL API와 관측 데이터 기반 사용자 지정 알림 역시 베타다. 여러 데이터셋을 하나의 쿼리로 함께 조회하는 기능은 향후 제공으로 표시돼 있다.
관측 기능의 확대가 장애 탐지 성과를 얼마나 바꿀지는 별도의 검증이 필요하다. 배경 자료인 9월 30일 CNCF 회원 기고에서 Atlassian의 Deepak Biswas는 자사 시스템의 이벤트 발생부터 메트릭 생성까지 지연이 40초 초과에서 10초 미만으로 줄었다고 보고했다. 이는 클라우드플레어 제품 도입 사례나 성능 검증이 아니며, 장애 발생부터 탐지까지 걸린 시간과도 다른 지표다.
같은 기고는 수집 지연을 트래픽 소실로 해석해 잘못된 장애 티켓이 발생했다고 설명했다. 대응으로 데이터량 감소 탐지에 최소 120초 지연을 적용했으며, 단일 리전에 있는 탐지 입력 파이프라인이 지역 장애 때 중단된 사례도 기록했다. 작성자의 내부 운영 보고로, 관측 데이터 자체의 지연과 가용성도 점검 대상임을 보여준다.
Our view
비용과 탐지 품질을 나눠 확인할 때
국내 운영팀은 현재 수집량, 필요한 조사 기간, 외부로 보내는 데이터량을 각각 산정해 요금 변경에 대비할 수 있다. 도메인 분석의 30일 보존을 로그·트레이스에도 적용되는 조건으로 읽거나, 향후 기능을 현재 제공 범위에 넣으면 운영 계획이 달라질 수 있다.
알림을 도입할 때는 실제 장애뿐 아니라 데이터가 늦게 도착하거나 관측 경로가 끊기는 상황도 시험할 필요가 있다. 통합 조회의 편의성과 장애 탐지의 정확도는 구분해서 평가해야 한다.
출처 · 이 기사는 아래 소식을 직접 확인해 트리루의 문장으로 다시 썼습니다
- 01
8 major updates to Cloudflare Observability
Cloudflare · Nevi Shah, Arti Kumar, Tom Benn, Sahidya Devadoss · 2026.10.02 게재 · 2026.10.04 확인
확인한 것: 주 소식의 공식 제품 발표. 기능 상태·요금·보존 조건을 확인한 제공 메모에 근거하며 외부 성능 검증 자료는 아니다.
https://blog.cloudflare.com/one-observability-platform/
- 02
CNCF · Deepak Biswas, Senior Engineering Manager, Central Monitoring and Disaster Recovery, Atlassian · 2026.09.30 게재 · 2026.10.04 확인
확인한 것: 배경 자료인 Atlassian 회원 기고. 지연 수치와 탐지 실패 사례는 작성자의 자체 보고이며 클라우드플레어 제품을 검증한 자료가 아니다.
https://www.cncf.io/blog/2026/09/30/from-40-seconds-to-under-10-rebuilding-incident-detection-on-opentelemetry-apache-kafka-and-apache-flink-on-kubernetes/
이 글은 AI 도구를 활용해 초안을 작성하고, 출처 자료와 내용을 대조해 편집했습니다. 기사의 사실과 트리루의 해설을 구별해 전합니다.
제작 방식과 이미지 사용, 정정 절차는 콘텐츠 제작·검토 기준에서 확인하실 수 있습니다.