Hye Jin Ryoo

[대규모 시스템] Day 4: 레이트 리미팅 - 시스템을 보호하고 공정하게 나누기

서론: 무제한은 곧 붕괴다 확장 가능한 시스템(Day 3)을 만들어도, 한 클라이언트가 초당 수만 요청을 던지면 다른 모두가 피해를 본다. 악의적 공격이든, 버그 난 클라이언트든, 폭주하는 재시도든. 레이트 리미팅은 “초당 N개까지만”이라는 경계로 시스템을 보호하고 자원을 공정하게 나눈다. 1. 왜 필요한가 보호: DDoS·폭주 클라이언트로부터 ...

스타트업의 Postgres 생존 가이드

이 글은 GeekNews - 개발/기술/스타트업 뉴스 서비스 블로그에 게시된 글을 자동으로 가져온 것입니다. 더 자세한 내용과 원문은 아래 링크를 참고해 주세요. ➡️ 원문 보러 가기 원문 요약 Hatchet이 2년간 프로덕션에서 겪은 문제를 바탕으로, 초기 스키마·쿼리 설계부터 대량 쓰기와 테이블 마이그레이션까지 단계별 운영 원칙을 정리함...

AI 연구소들은 ‘자전거 타는 펠리컨’에 맞춰 모델을 최적화했을까?

이 글은 GeekNews - 개발/기술/스타트업 뉴스 서비스 블로그에 게시된 글을 자동으로 가져온 것입니다. 더 자세한 내용과 원문은 아래 링크를 참고해 주세요. ➡️ 원문 보러 가기 원문 요약 7개 프런티어 모델에서 1,008개 SVG를 비교한 결과, 유명 프롬프트에 맞춰 성능을 끌어올리는 pelicanmaxxing의 뚜렷한 증거는 발견되...

[대규모 시스템] Day 3: 로드밸런싱과 수평 확장 - 서버를 여러 대로 늘리기

서론: 한 대를 키우기 vs 여러 대로 늘리기 서버가 한계에 닿으면 두 갈래다. 더 큰 서버로 바꾸거나(수직 확장), 서버를 여러 대로 늘리거나(수평 확장). 수직 확장은 한계가 있고 단일 장애점이다. 대규모 시스템은 결국 수평 확장으로 간다. 그 전제 조건과 트래픽 분산 장치가 로드밸런서다. 1. 수직 확장 vs 수평 확장 수직 확장(Scale...

구글 제미나이 새 모델(3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber) 출시

이 글은 GeekNews - 개발/기술/스타트업 뉴스 서비스 블로그에 게시된 글을 자동으로 가져온 것입니다. 더 자세한 내용과 원문은 아래 링크를 참고해 주세요. ➡️ 원문 보러 가기 원문 요약 • 구글은 AI 에이전트 개발의 효율성, 낮은 지연 시간, 신뢰성을 위해 설계된 새로운 제미나이 모델인 3.6 Flash, 3.5 Flash-Lit...

[대규모 시스템] Day 2: 메시지 큐 - 트래픽 급증을 흡수하고 시스템을 분리하기

서론: 모든 것을 즉시 처리할 필요는 없다 사용자가 동영상을 업로드하면 인코딩에 수 분이 걸린다. 그동안 요청을 붙들고 있으면 서버가 막힌다. 메시지 큐는 “지금 받아두고 나중에 처리”를 가능케 해, 트래픽 급증을 흡수하고 컴포넌트를 분리한다. Day 1의 캐싱이 읽기를 줄였다면, 오늘은 쓰기와 무거운 작업을 다룬다. 1. 큐가 푸는 세 가지 문제...

왜 LangGraph 도입 후 코드가 더 복잡해졌나 — 실패에서 배운 기록

이 글은 GeekNews - 개발/기술/스타트업 뉴스 서비스 블로그에 게시된 글을 자동으로 가져온 것입니다. 더 자세한 내용과 원문은 아래 링크를 참고해 주세요. ➡️ 원문 보러 가기 원문 요약 “상태 관리와 흐름 제어가 깔끔해지겠지”라는 기대로 LangGraph를 도입했는데, 오히려 코드가 복잡해졌습니다.  진단해보니 상태는 이러했는데 그...

하루 15원으로 완전히 독립적인 웹사이트 운영하기

이 글은 GeekNews - 개발/기술/스타트업 뉴스 서비스 블로그에 게시된 글을 자동으로 가져온 것입니다. 더 자세한 내용과 원문은 아래 링크를 참고해 주세요. ➡️ 원문 보러 가기 원문 요약 Hardcore IndieWeb는 콘텐츠 원본과 게시 가능한 HTML·웹 자산을 자신의 장치에 보관해, 서비스 사업자에게 정체성과 콘텐츠 통제권을 ...