필터 1
Istio 3-3편: Ambient mode 안전하게 업그레이드하기
채널톡
데브옵스

Istio 3-3편: Ambient mode 안전하게 업그레이드하기

Istio Ambient mode 업그레이드를 istiod, istio-cni, ztunnel로 나눠 안전하게 진행하는 순서를 정리했습니다. 특히 ztunnel은 rolling update보다 node pool blue-green 방식이 더 안전하다고 설명했습니다.

#Istio#Kubernetes
500
TVING
데브옵스

KBO 리그 이닝 교체 때 광고 요청 견뎌내기

KBO 리그 이닝 교체 때 몰리는 광고 요청을 분산하기 위해 prefetching과 내부 캐시 구조를 적용했습니다. 그 결과 외부 광고 서버 부하와 지연을 줄이고 버퍼링 지표도 개선했습니다.

#AWS#Kafka
3300
채널톡
백엔드

급증하는 트래픽 안정적으로 처리하기: 개선편(1) 동적 스케일링

벌크액션 트래픽에 대응하기 위해 PWQD를 핵심 메트릭으로 삼아 동적 스케일링을 설계했습니다. 연속 초과 시 확대하고 Time Decay로 축소해 Spike에도 안정적으로 대응했습니다.

#traffic#동적 스케일링
300
급증하는 트래픽 안정적으로 처리하기: 개선편(1) 동적 스케일링
채널톡
백엔드

급증하는 트래픽 안정적으로 처리하기: 개선편(1) 동적 스케일링

벌크액션 트래픽의 지연과 오실레이션 문제를 해결하기 위해 동적 스케일링을 개선했습니다. PWQD와 Time Decay를 결합해 Spike에도 안정적으로 대응했습니다.

#동시성#traffic
1300
가비아
데브옵스

클라우드 서버 트래픽 비용 절감하는 TIP 알아보기 (4TB 무료 지원 혜택💰)

클라우드 트래픽 비용은 외부 유입과 콘텐츠 사용량에 따라 급격히 늘 수 있어 사전 점검이 필요했습니다. 가비아 클라우드의 무료 트래픽 혜택으로 스타트업과 중소기업의 비용 부담을 줄일 수 있었습니다.

#cloud#AWS
9300
첫 개발자 컨퍼런스, 이렇게 만들었습니다
채널톡
기타

첫 개발자 컨퍼런스, 이렇게 만들었습니다

채널톡 첫 개발자 컨퍼런스의 기획과 운영 과정을 공유했습니다. 사전 녹화와 실시간 Q&A로 완성도와 참여도를 함께 높인 점이 인상적입니다.

#회의#문화
1900
카카오뱅크
데브옵스

정적 그만!✋ 은행에 서비스 디스커버리 도입하기

카카오뱅크가 온프레미스 멀티데이터센터 환경에서 서비스 디스커버리를 도입한 사례를 소개합니다. 서비스 의존성과 트래픽 증가 문제를 자동화와 동적 관리로 해결했습니다.

#service discovery#system
3000
카카오뱅크
아키텍처

구해줘 홈즈! 은행에서 3천만 트래픽의 홈 서비스 새로 만들기

은행의 하루 3천만 트래픽 홈 화면을 레거시에서 분리해 새로 개편한 사례를 다뤘습니다. MSA 기반으로 안정적인 홈 서비스 분리를 추진한 여정을 정리했습니다.

#MSA#Spring Boot
4200
SK플래닛
데브옵스

Locust를 활용한 부하 테스트 작성

Locust를 활용해 부하 테스트 시나리오를 작성하고 실행하는 방법을 소개했습니다. 요청 제한, 분산 부하, 고유 사용자 테스트 예시로 주요 기능을 설명했습니다.

#Python#Golang
3100
[Project Loom] Virtual Thread에 봄(Spring)은 왔는가
카카오페이
백엔드

[Project Loom] Virtual Thread에 봄(Spring)은 왔는가

대규모 트래픽 환경에서 Virtual Thread를 적용한 경험을 공유한 글입니다. Project Loom과 Spring 조합의 적용 가능성을 살펴봅니다.

#Java#Spring Boot
3900
네이버 D2
데브옵스

네이버 검색 SRE - 상위 레벨 모니터링 시스템

네이버 검색 SRE의 상위 레벨 모니터링 시스템 구축 사례를 소개했습니다. 통합 대시보드, 규칙 기반 이상 탐지, ChatOps로 장애 대응 효율을 높였습니다.

#SRE#모니터링
2900
삼성
데브옵스

대규모 트래픽 속 무중단 클라우드 인프라 업그레이드, 그 비결은?

삼성계정의 대규모 트래픽 처리와 무중단 클라우드 인프라 업그레이드 사례를 소개하는 글입니다. 다만 본문은 Cloudflare 오류로 확인되지 않았습니다.

#cloud#traffic
200
사이트 신뢰성에 대한 지표는 어떻게 구성할까? (Feat. SRE)
사람인
데브옵스

사이트 신뢰성에 대한 지표는 어떻게 구성할까? (Feat. SRE)

서비스 전반의 모니터링과 별개로, 사이트 신뢰성을 위한 서비스 레벨 지표와 목표 범위를 고민한 글입니다. SRE 관점에서 Request 기준의 신뢰성 측정 체계를 구성하려는 방향을 다뤘습니다.

#SRE#모니터링
3500
RDS MySQL IOPS 장애 대응기
버즈빌
백엔드

RDS MySQL IOPS 장애 대응기

AWS RDS MySQL 운영 중 메모리 문제로 장애가 발생한 사례를 소개했습니다. 높은 트래픽 환경에서의 원인과 해결 과정을 다루는 글입니다.

#AWS#RDS
1300