카테고리별 기사
분야별로 기사를 탐색하세요
100개 기사
AWS: 부정확한 추정 청구 데이터 – 17억 달러
AWS: Inaccurate Estimated Billing Data – $1.7 billion
AWS의 추정 청구 데이터가 부정확해 17억 달러 규모의 차이가 발생한 사례가 제기됨. 클라우드 비용 예측과 청구 신뢰성에 대한 우려를 드러냄.
GitHub.com 장애 발생
Incident with Github.com
GitHub.com에서 장애가 발생해 서비스 가용성에 영향이 생김. 상태 페이지를 통해 복구 진행 상황을 안내하는 공지.
Cloudflare OS: 에이전트, 앱, 업무를 위한 개방형 플랫폼
Cloudflare OS: an open platform for agents, apps, and work
Cloudflare가 에이전트, 앱, 업무 통합을 위한 오픈 플랫폼 Cloudflare OS를 발표. 개발자에게 일관된 환경과 도구를 제공할 예정.
Apple Silicon과 macOS VM: llama.cpp로 더 빠른 LLM 추론
Apple Silicon and macOS VMs: Faster LLM Inference with llama.cpp
Apple Silicon과 macOS VM 조합에서 llama.cpp 추론 성능을 끌어올리는 방법을 다룸. 로컬 LLM 실행을 위한 VM 활용과 가속 구성이 핵심.
스타트업의 Postgres 생존 가이드
The startup's Postgres survival guide
스타트업 환경에서 Postgres를 운영할 때 필요한 실전 대응법을 정리한 글. 확장성, 백업, 성능, 장애 대응이 핵심 주제로 보임.
미국 빅테크 5곳, 불투명한 AI 자금 조달로 숨은 부채 1.65조달러 급증
Five US tech giants' hidden debts soar to $1.65T on opaque AI funding
미국 주요 빅테크 5곳의 AI 투자 관련 숨은 부채가 1.65조달러까지 불어난 것으로 보도됨. 복잡한 자금 조달 구조가 재무 리스크와 AI 인프라 투자 열기를 동시에 키우는 양상.
Fastmail, EU 데이터 리전 제공
Fastmail offers EU data region
Fastmail이 유럽 연합 데이터 리전을 제공한다고 발표. 데이터 거주지 요구가 있는 고객의 규제 대응과 프라이버시 수요를 겨냥.
Nvidia, CoreWeave, Nebius: GPU 붐을 둘러싼 순환 금융의 내부
Nvidia, CoreWeave, and Nebius: Inside the Circular Financing of the GPU Boom
GPU 수요 확대 국면에서 Nvidia, CoreWeave, Nebius 간 자금 순환 구조를 분석. AI 인프라 성장과 자본 조달 방식의 얽힘을 조명.
Oxide Computer, 4억 4,500만 달러 투자 유치 (SEC Form D)
Oxide Computer raises $445M (SEC Form D)
Oxide Computer가 SEC Form D 공시를 통해 4억4500만 달러 규모의 자금 조달을 완료. 클라우드 인프라 하드웨어 스타트업의 대규모 라운드.
Intel, High-NA EUV 실리콘 출하 시작
Intel Starts Shipping High-NA EUV Silicon
Intel이 High-NA EUV 공정용 실리콘 출하를 시작함. 차세대 반도체 미세화 경쟁에서 EUV 장비 도입 속도가 다시 주목받는 흐름.
Climate.gov는 파괴됐지만, 오픈 데이터가 이를 살렸다
Climate.gov was destroyed. Open data saved it
Climate.gov의 운영 기반이 훼손됐지만 공개 데이터가 서비스 복원에 핵심 역할을 함. 데이터 개방성과 백업 체계의 중요성을 보여줌.
내슈빌, 동물원 인근 데이터 센터 건설 저지 위해 공용수용권 행사
Nashville uses eminent domain to block data center near zoo
내슈빌 시, 동물원 옆 데이터 센터 건설 중단 위해 공용수용권 발동.
프로덕션에서의 SQLite: WAL 모드, 동시성, VFS 레이어 최적화
SQLite in Production: Optimizing WAL Mode, Concurrency, and VFS Layers
SQLite를 프로덕션 환경에서 운용할 때의 WAL 모드, 동시성 제어, VFS 튜닝 방법을 정리. 저지연 애플리케이션 서버에서 성능과 안정성을 높이는 실전 팁을 제공함.
Telegram 데이터 센터의 미스터리 (2022)
Mysteries of Telegram Data Centers (2022)
Telegram의 데이터 센터 운영과 인프라 구조를 추적한 분석 글. 공개되지 않은 배치와 동작 방식에 대한 의문을 다룸.
단일 로그 한 줄이 ext4에서 49KB+, btrfs에서 110KB+의 systemd-journald 디스크 쓰기를 유발
Single log line is 49KB+ (ext4) / 110KB+ (btrfs) of systemd-journald disk writes
systemd-journald가 짧은 로그 한 줄에도 파일시스템별로 과도한 디스크 쓰기를 발생시킨다는 문제 제기. ext4와 btrfs에서 쓰기 증폭 차이를 수치로 제시함.
Claude: 모든 모델에서 오류 증가
Claude: Elevated errors across all models
Claude 서비스의 전 모델에서 오류율이 상승한 장애 공지. 서비스 상태 저하가 광범위하게 발생해 정상 응답에 영향을 주고 있음.
낯선 것을 마주하라
Turn And Face The Strange
Fly.io 블로그의 글로, 익숙하지 않은 변화와 전환을 다룸. 기술과 실행 환경의 예기치 않은 면모를 짚는 성격의 아티클.
Lobste.rs, 이제 SQLite로 운영
Lobste.rs is now running on SQLite
커뮤니티 사이트 Lobste.rs가 백엔드 데이터베이스를 SQLite로 전환함. 운영 복잡도를 낮추는 경량 인프라 선택이 다시 주목받는 흐름.
Shopify가 재고 예약용 Redis를 MySQL로 교체했더니 확장됐다
Shopify replaced Redis with MySQL for inventory reservations–and it scaled
Shopify가 재고 예약 시스템의 Redis 의존을 MySQL 기반으로 전환한 사례를 공유. 단일 데이터 계층으로 통합하면서도 대규모 트래픽과 일관성 요구를 충족한 확장 전략을 설명한다.
Oracle, Always Free ARM 한도를 OCPU 2개/12GB로 축소, 8월 18일 시행
Oracle cut its Always Free ARM limits to 2 OCPU / 12GB, enforced Aug 18
Oracle이 Always Free ARM 인스턴스의 무료 한도를 OCPU 2개, 메모리 12GB로 줄임. 2026년 8월 18일부터 적용.
Nine PBS, 클라우드 벤더 폐업으로 70년치 아카이브를 잃을 수 있어
Nine PBS could lose 70 years of archives after cloud vendor goes defunct
Nine PBS가 계약한 클라우드 스토리지 벤더의 폐업으로 70년 분량의 아카이브 접근권을 잃을 위기에 놓임. 방송사는 보존을 위해 소송에 나섰다.
Satellite Tracker – Starlink와 3만 개 위성의 실시간 지도
Satellite Tracker – Live Map of Starlink and 30k Satellites
Starlink와 약 3만 개 위성을 한 화면에서 추적하는 실시간 지도 서비스. 위성 궤도와 분포를 시각적으로 확인할 수 있다.
Precursor
Precursor
Cloudflare가 Precursor를 소개하는 글을 공개함. 네트워크/엣지 인프라 영역의 새 제품 또는 기능 발표로 보임.
768개의 서버를 하나처럼 보이게 만들기
Making 768 servers look like 1
대규모 서버 집합을 단일 시스템처럼 운영하는 인프라 추상화 사례. 분산 환경의 복잡도를 숨기고 운영 단위를 단순화하는 접근을 다룸.
Gentoo Bugzilla, AI 봇 스크래퍼 과부하로 폐쇄
Gentoo bugzilla closed due AI bot scraper overload
AI 봇 스크래퍼 트래픽이 Gentoo Bugzilla에 과부하를 일으켜 서비스를 닫은 사례. 자동 수집 트래픽이 운영 부담으로 이어짐.
Postgres에 CDC를 넣은 방법
How We Pushed CDC into Postgres
Postgres에서 Snowflake로의 복제·미러링을 위해 CDC를 엔지니어링한 사례. 데이터 변경을 안정적으로 흘려보내기 위한 구현과 운영 경험을 다룸.
Docker Sandboxes – AI 에이전트를 위한 일회성 격리 샌드박스
Docker Sandboxes – Disposable, isolated sandboxes for AI agents
AI 에이전트를 위한 격리된 일회성 실행 환경을 제공하는 Docker Sandboxes를 소개함. 실행 분리와 보안, 재현성 강화를 목표로 함.
Amazon, 국내 최대 오염원으로 부상
Amazon Is Creating the Biggest Pollution Source in the Country
Amazon의 데이터센터와 인프라 확장이 대규모 오염원으로 지목됨. 전력 사용과 배출 증가가 환경 부담을 키우는 흐름.
분산 시스템 엔지니어를 위한 ATProto
ATProto for Distributed Systems Engineers
ATProto를 분산 시스템 관점에서 설명하는 글로, 프로토콜의 구조와 설계 의도를 소개한다. 분산 소셜 네트워크와 상호운용성 논의에 필요한 배경을 정리한다.
Oxide에서의 Kubernetes: 고객 요구가 통합 방식을 어떻게 만들었나
Kubernetes on Oxide: How customer needs shaped our integrations
Oxide가 Kubernetes 통합을 고객 요구에 맞춰 설계한 과정을 소개. 운영 단순화와 기존 워크플로우 호환성을 동시에 맞추는 방향에 초점을 둠.
현대 워크로드로 15개의 “E-Waste” GPU 벤치마킹
Benchmarking 15 “E-Waste” GPUs with Modern Workloads
구형으로 분류된 15개 GPU를 현대 워크로드 기준으로 벤치마킹한 결과를 정리함. 저가 재활용 GPU의 실사용 성능과 한계를 비교 평가.
PlanetScale을 처음부터 만들기: 인프라
Let's Build PlanetScale from Scratch: Infrastructure
PlanetScale을 직접 구현하는 시리즈의 인프라 편. 데이터베이스 서비스의 기반 설계와 운영 요소를 다룬다.
NVIDIA 없는 하드웨어에서 CUDA를 돌리는 대안들
Alternative(s) to run CUDA on non-Nvidia hardware
NVIDIA GPU가 아닌 환경에서 CUDA 워크로드를 실행하기 위한 대체 경로와 호환성 계층이 다시 주목받음. CUDA 종속을 줄이려는 시도가 HPC와 AI 인프라 전반으로 확산되는 흐름.
PgBouncer 없이 Postgres를 운영하는 사람이 있을까
Does anyone run Postgres without PgBouncer?
Postgres 운영에서 PgBouncer의 필요성을 다시 묻는 글. 연결 풀링과 운영 단순성 사이의 트레이드오프를 짚는다.
Fedora 45 사우시지 팩토리
The Fedora 45 Sausage Factory
Fedora 45 배포판이 만들어지는 과정을 다룬 글. 릴리스 파이프라인과 패키징, 배포 준비 작업을 조명.
대다수 미국인, AI 데이터센터에 "내 뒷마당은 안 된다"
Most Americans say "not in my backyard" to AI data centers
AI 데이터센터 확산에 대한 지역 반대 정서가 미국에서 강하게 나타남. 교육 수준과 지역적 이익 인식이 수용성에 영향을 주는 흐름.
중고 GPU 클러스터의 가치를 아는 사람은 없다
Nobody knows what a used GPU cluster is worth
중고 GPU 클러스터의 실제 거래가를 산정하기 어렵다는 점을 다룬 글. 감가상각, 수요 변동, 성능 편차가 가격 형성을 복잡하게 만듦.
Danube의 사상 최저 수위로 Hungary 유일한 원자력 발전소 가동 중단
Danube's record low levels force shutdown of Hungary's only nuclear plant
Danube 강 수위가 기록적 저수준에 도달하며 Hungary의 유일한 원전이 멈춤. 냉각수 확보가 어려워진 여파로 에너지 운영이 흔들림.
Postgres 큐를 확장 가능하게 만드는 방법
Making Postgres queues scale
Postgres를 큐로 사용할 때의 확장 한계와 병목을 줄이는 방법을 다룸. 잠금 경합과 처리량 문제를 완화하는 설계가 핵심 주제다.
Show HN: 포크 가능한 VM 스냅샷과 전역 SQLite를 갖춘 Kedge 풀스택 클라우드
Show HN: Kedge – Full-stack cloud with forkable VM snapshots and global SQLite
Kedge가 포크 가능한 VM 스냅샷과 글로벌 SQLite를 제공하는 풀스택 클라우드로 소개됨. 개발 환경 복제와 상태 관리 단순화를 겨냥함.
Reticulum – 분산형 메시 네트워크
Reticulum – Decentralized Mesh Network
분산형 메시 네트워크 Reticulum을 소개한 글. 인터넷 인프라 없이도 로컬 및 저대역 환경에서 통신 가능한 오픈 네트워크 스택에 초점.
Cloudflare의 새로운 AI 트래픽 옵션
Cloudflare's new AI traffic options for customers
Cloudflare가 고객용 AI 트래픽 제어 옵션을 추가함. AI 봇과 크롤러 트래픽을 세분화해 콘텐츠 접근과 인프라 비용을 관리하려는 흐름.
HomeLab #1: MikroTik를 홈 라우터로 쓰기
HomeLab #1: MikroTik as a Home Router
MikroTik 장비를 가정용 라우터로 설정하는 홈랩 구성 사례. 네트워크 장비 선택과 홈 네트워킹 운영 경험을 공유함.
Intel은 마침내 ARM을 성능 대비 전력 효율에서 이길 수 있을까
Can Intel finally beat ARM on performance per Watt?
Intel과 ARM의 성능 대비 전력 효율 경쟁을 다룬 분석. 모바일과 저전력 컴퓨팅 시장에서 x86의 경쟁력 회복 가능성이 쟁점.
내 홈 서버의 죽음과 재탄생
The death and rebirth of my home server
홈 서버가 고장난 뒤 이를 다시 구축한 과정을 다룬 글. 자가 호스팅 환경의 장애와 복구 경험을 기록함.
GitHub.com 장애 발생
GitHub.com 장애 발생
GitHub.com 웹 환경과 API 트래픽에서 약 20% 오류가 발생해 원인 조사가 진행됨. 아카이브와 원시 저장소 콘텐츠 다운로드는 오류율이 약 50%까지 치솟았고, Pull Request와 Issues 등 여러 기능에서 성능 저하가 확인됨.
GitHub 또 장애인가? PR에 접근할 수 없음
GitHub 또 장애인가? PR에 접근할 수 없음
GitHub에서 Pull Request 접근 불가 문제가 발생해 재차 장애 가능성이 제기됨. 공식 Status 페이지는 정상으로 표시됐지만, 실제 서비스 상태와 안내가 엇갈린 상황이 보고됨.
Tell HN: 네임서버를 전환하면 Cloudflare가 분석 코드를 몰래 삽입함
Tell HN: 네임서버를 전환하면 Cloudflare가 분석 코드를 몰래 삽입함
Cloudflare 네임서버로 전환한 뒤 JavaScript 없는 사이트에 분석 스니펫이 삽입된 사례가 보고됨. 분석 기능을 끄려면 대시보드에서 사이트를 등록한 뒤 스니펫 비활성화가 필요했음.
플랫폼 엔지니어링은 여전히 중요함
플랫폼 엔지니어링은 여전히 중요함
Agentic Coding으로 코드 작성 비용이 낮아져도 재사용 가능한 플랫폼의 경제성은 여전히 유효하다는 주장. 전체 스택을 매번 새로 만드는 것보다 잘 만든 하위 플랫폼을 활용하는 편이 더 효율적이라고 설명함.
celld - 셀프호스팅 가능한 분산 Durable Objects
celld - 셀프호스팅 가능한 분산 Durable Objects
Deno가 공개한 오픈소스 런타임으로 Cloudflare Workers와 Durable Objects 모델을 자체 서버에서 실행할 수 있게 함. 기존 Wrangler 프로젝트 코드를 비교적 적은 변경으로 셀프호스팅하는 것이 목표.
Nine PBS, 기록 데이터 접근을 차단한 Iron Mountain 제소
Nine PBS, 기록 데이터 접근을 차단한 Iron Mountain 제소
Nine PBS가 Denver 데이터센터에 보관된 50TB 이상 자료 접근 차단 문제로 Iron Mountain Data Centers를 제소. OSS가 3월 6일 예고 없이 접근을 막은 뒤 사실상 운영이 중단됐다고 주장했다.
GPT-5.6 Sol을 초당 750토큰으로 가속하는 Ultrafast Mode
GPT-5.6 Sol을 초당 750토큰으로 가속하는 Ultrafast Mode
Cerebras와 OpenAI가 API의 새 서비스 계층인 Ultrafast Mode를 일부 고객에게 제한 공개함. GPT-5.6 Sol에서 품질 저하 없이 초당 최대 750개 출력 토큰을 제공한다.
PgBouncer 없이 Postgres를 운영하는 사람이 있나요?
PgBouncer 없이 Postgres를 운영하는 사람이 있나요?
Postgres는 연결 수가 많을 때 효율 관리가 어려워 외부 연결 풀러와 짧은 연결 전략이 여전히 필요하다는 내용. 조사한 관리형 Postgres 제공업체 18곳 중 16곳이 연결 풀러를 지원하며 대부분 PgBouncer를 기본 구성으로 제공.
Deutsche Bank, 유럽 최초의 외국계 위안화 청산은행으로 지정
Deutsche Bank, 유럽 최초의 외국계 위안화 청산은행으로 지정
중국이 Deutsche Bank에 유럽 내 위안화 청산 업무를 허가해, 외국계 은행이 해당 역할을 맡는 첫 사례가 됐다. 프랑크푸르트에서 위안화 청산을 수행하며 유럽 청산망의 역할 분담이 확대된다.
Tailscale이 데이터베이스 손상 원인을 16년 된 SQLite WAL-Reset 버그로 추적한 과정
Tailscale이 데이터베이스 손상 원인을 16년 된 SQLite WAL-Reset 버그로 추적한 과정
Tailscale이 6개월간의 데이터베이스 손상과 제어 평면 장애를 추적한 끝에 SQLite의 오래된 WAL-Reset 버그를 원인으로 찾아냄. 체크포인트 완료 처리와 실제 페이지 복사 사이의 드문 경쟁 조건이 데이터 영구 손실로 이어졌음.
Nvidia의 위험한 사업
Nvidia의 위험한 사업
Nvidia가 AI 데이터센터를 투자 자산처럼 만들기 위해 5,000억 달러 이상을 외부 자본으로 조달하려는 구상을 추진 중임. 대신 최대 25%의 잔존가치를 직접 보증해야 해 AI 인프라 투자의 재무 리스크가 커졌다는 분석이 나옴.
Postgres 내부로 CDC를 밀어 넣은 방법
Postgres 내부로 CDC를 밀어 넣은 방법
Snowflake가 외부 복제 도구에 맡기던 CDC를 Postgres 확장으로 옮겨 변경분을 Apache Iceberg 테이블로 직접 전송하는 Data Mirroring을 공개 미리보기로 선보임. 스키마 변경과 DML·DDL 트랜잭션, 스냅샷 처리까지 Postgres 내부에서 다루는 구조를 공개함.
Docker Sandboxes - AI 에이전트용 일회성 격리 환경
Docker Sandboxes - AI 에이전트용 일회성 격리 환경
AI 코딩 에이전트마다 전용 microVM을 띄워 호스트와 분리된 일회성 실행 환경을 제공. 패키지 설치, 설정 변경, 서비스 구동, Docker 컨테이너 실행을 샌드박스 안에서 처리.
Amazon이 추진하는 미국 최대 오염 시설
Amazon이 추진하는 미국 최대 오염 시설
Amazon이 텍사스 Pecos County의 AI 데이터센터 전력 공급을 위해 7.65GW 규모 가스 발전소를 추진. 초기에는 텍사스 전력망과 분리 운영 예정이며, 허가된 CO2 배출량은 연 3,300만 톤 수준.
Amazon 새 데이터센터, 미국에서 가장 오염이 심한 발전소를 갖출 예정
Amazon 새 데이터센터, 미국에서 가장 오염이 심한 발전소를 갖출 예정
Amazon이 Texas Pecos County 데이터센터 전력 확보를 위해 대규모 천연가스 발전소에 투자. 허가 기준으로 미국 단일 발전시설 중 가장 많은 온실가스를 배출할 수 있는 규모로 지적됨.
PlanetScale은 이전 백업을 복원해서 다음 백업을 만든다
PlanetScale은 이전 백업을 복원해서 다음 백업을 만든다
PlanetScale이 Postgres 백업을 만들 때 이전 백업을 임시 노드에 복원한 뒤 WAL을 재생해 최신 상태로 맞추는 방식을 소개함. 대규모 재복사 없이 S3와 임시 백업 노드로 백업 비용과 시간을 줄임.
StreamHub 확장: 하루 1,450억 이벤트 처리를 위해 Kinesis에서 Kafka로 전환
StreamHub 확장: 하루 1,450억 이벤트 처리를 위해 Kinesis에서 Kafka로 전환
Atlassian StreamHub가 하루 220억 건에서 1,500억 건 규모로 커지며 Kinesis 한계를 넘어서 Kafka로 이전함. 장기 보관 비용, 소비자 확장성, 멀티클라우드 대응을 위해 AWS MSK 기반 Kafka를 선택함.
내 서버는 이제 휴대폰이다
내 서버는 이제 휴대폰이다
사용하지 않던 CMF Phone 1을 홈 서버로 전환한 사례. Android가 하드웨어와 전원을 관리하고 Termux가 SSH, runit, Caddy, Cloudflared를 제공하며 Tailscale로 원격 접근을 구성했다.
Shopify가 재고 예약 시스템을 Redis에서 MySQL로 교체해 대규모 트래픽을 처리한 방법
Shopify가 재고 예약 시스템을 Redis에서 MySQL로 교체해 대규모 트래픽을 처리한 방법
결제 과정의 재고 중복 판매를 막는 예약 시스템을 Redis에서 MySQL로 이전해 2025년 피크 트래픽에서도 처리량과 정확성 목표를 달성. MySQL 8의 SKIP LOCKED와 1개 재고당 1행 구조를 활용해 경합을 줄이고 확장성을 확보.
DNS에서 도메인 판매 여부를 알리는 _for-sale 레코드
DNS에서 도메인 판매 여부를 알리는 _for-sale 레코드
RFC 10023이 운영 중인 도메인의 판매 가능 상태를 알리는 _for-sale TXT 레코드 규약을 제안함. 기존 웹·메일 서비스를 유지한 채 브로커와 자동화 서비스에 판매 신호를 노출할 수 있음.
Fastmail, EU 데이터 리전 제공
Fastmail, EU 데이터 리전 제공
이메일과 파일의 주 데이터 사본을 미국 대신 암스테르담의 자체 서버에 둘 수 있는 EU 리전을 제공. 가입 또는 설정 단계에서 리전을 선택할 수 있으며, 대형 클라우드가 아닌 Fastmail 자체 하드웨어와 소프트웨어로 운영됨.
xAI·SpaceX와 AI 인프라 구축 경쟁
xAI·SpaceX와 AI 인프라 구축 경쟁
xAI가 Memphis의 Colossus 데이터센터 무허가 가스터빈을 2027년 7월까지 철거하고 천연가스 발전소로 대체하기로 합의함. AI 데이터센터 확장 경쟁이 전력·환경 규제와 충돌하는 양상이 드러남.
Canva는 어떻게 수억 건의 사용자 세션을 빠르고 안전하게 유지할까?
Canva는 어떻게 수억 건의 사용자 세션을 빠르고 안전하게 유지할까?
Canva가 수억 건의 사용자 세션 검증 중 발생하는 게이트웨이 병목을 해결하기 위해, MySQL 취소 기록을 S3에 30분 단위 객체로 분할·16바이트로 압축하여 부하를 낮춤.
Andy Pavlo, ClickHouse Labs 설립 위해 ClickHouse 합류
Andy Pavlo, ClickHouse Labs 설립 위해 ClickHouse 합류
카네기멜론대의 Andy Pavlo가 ClickHouse에 합류하여 데이터베이스 연구 조직 ClickHouse Labs를 설립. 엔지니어링·고객·협력자와 긴밀히 협업하는 연구소로 운영 예정.
가져갈 수 없는 세션: 추론 API가 만드는 새로운 종속성
가져갈 수 없는 세션: 추론 API가 만드는 새로운 종속성
추론 API가 암호화된 추론 결과와 압축 상태, 서브에이전트 메시지를 공급자 내부에 가두며 세션 이식성을 약화시키고 있음. 사용자는 완전한 대화 기록이 아니라 일부만 보이는 사본에 의존하게 되는 구조가 문제로 지적됨.
AI 기업들이 전기기사와 목수를 수천 명씩 채용 중
AI 기업들이 전기기사와 목수를 수천 명씩 채용 중
AI 데이터센터 건설 급증으로 기술 기업들이 전기기사·목수 등 숙련 기능공 확보에 나섬. 교육기관과 노동조합에 수억 달러를 투입하며 대규모 현장 인력 경쟁이 심화됨.
매출 18%, 이익 57%… 아마존의 본체는 AWS다
매출 18%, 이익 57%… 아마존의 본체는 AWS다
아마존 매출은 리테일이 대부분이지만, 영업이익의 57%는 AWS가 창출하는 구조. 광고가 리테일 부문에 묶여 있어 쇼핑 사업의 실제 수익성이 과소평가된다는 분석.
평균은 아무 의미가 없다
평균은 아무 의미가 없다
새 캐시 계층 배포 후 평균 지연은 악화됐지만 중앙값은 개선되고 p99는 크게 악화돼, 단일 평균만으로 성패를 판단할 수 없음. 분포가 단봉에서 이봉으로 갈라져 롱테일 악화가 드러남.
탈옥한 Kindle에서 활용할 수 있는 더 많은 Tailscale 기능
탈옥한 Kindle에서 활용하는 더 많은 Tailscale 기능
탈옥한 Kindle용 Tailscale에 Tailscale SSH, 앱별 프록시, 일부 기기용 TUN 모드가 추가됨. 기존 Kindle은 사용자 공간 모드 한계로 KOReader가 tailnet 주소에 직접 연결하지 못했지만, 새 프록시 모드로 우회 가능.
Openship - 내장 CI/CD를 갖춘 셀프 호스팅 배포 플랫폼
Openship - 내장 CI/CD를 갖춘 셀프 호스팅 배포 플랫폼
저장소만 지정하면 빌드, 실행, 라우팅, TLS 종료까지 자동 처리하는 오픈소스 배포 플랫폼. 설정 파일 없이 package.json, lockfile, 프레임워크 설정을 읽어 스택과 빌드·시작 명령을 감지하는 push-to-deploy 방식.
Shipyard: Slack의 차세대 EC2 플랫폼 구축기
Shipyard: Slack의 차세대 EC2 플랫폼 구축기
Slack이 장기 실행 EC2 워크로드를 불변 AMI 기반 교체 배포로 전환한 사례. 컨테이너로 옮기기 어려운 서비스에도 현대적 배포 방식을 적용하고 공통 베이스 이미지 slack-zero 위에 서비스별 이미지를 쌓는 구조를 도입함.
Cerebras가 사내 지식 베이스를 구축한 방법
Cerebras가 사내 지식 베이스를 구축한 방법
Slack, 코드 저장소, 문서, 내부 데이터베이스를 직접 연결하는 Cerebras Knowledge를 구축해 출시 3개월 만에 직원·자동화·에이전트 문의 하루 15,000건 이상을 처리함. 데이터를 옮기지 않고 공통 스키마의 Postgres 임베딩 테이블로 통합하는 방식이 핵심.
Cloudflare, 고객별 AI 트래픽 제어 옵션 공개
Cloudflare, 고객별 AI 트래픽 제어 옵션 공개
Cloudflare가 모든 요금제 고객에게 AI 트래픽을 Search, Agent, Training으로 구분해 허용 또는 차단하는 세밀한 제어 기능을 제공. 사이트의 AI 사용 여부가 아니라 트래픽의 행위와 콘텐츠 용도를 기준으로 정책을 적용한다.
현대 하드웨어 시대에 마이크로커널을 다시 검토해야 할지도 모름
현대 하드웨어 시대에 마이크로커널을 다시 검토해야 할지도 모름
IOMMU와 공유 메모리의 보편화로 마이크로커널이 과거보다 현실적인 선택지가 됨. 드라이버와 서브시스템을 사용자 공간에 격리해 보안, 신뢰성, 모듈성을 높일 수 있음.
neko-master - 네트워크 트래픽 시각화 및 분석용 대시보드
neko-master - 네트워크 트래픽 시각화 및 분석용 대시보드
로컬 게이트웨이 환경 전용 트래픽 분석·시각화 대시보드. WebSocket 실시간 수집으로 밀리초 단위 지연을 모니터링하고, 미연결 시 HTTP 폴링으로 자동 폴백.
Postgres LISTEN/NOTIFY는 실제로 확장 가능함
Postgres LISTEN/NOTIFY는 실제로 확장 가능함
Postgres LISTEN/NOTIFY의 전역 배타적 잠금은 기본 구현의 병목이지만, 알림을 버퍼링해 일괄 전송하면 단일 서버에서 초당 최대 6만 건 수준까지 처리 가능함. 커밋 순서 보장을 위해 트랜잭션 커밋과 fsync 비용이 함께 고려됨.
중고 GPU 클러스터의 가치는 아무도 모른다
중고 GPU 클러스터의 가치는 아무도 모른다
xAI의 Colossus 같은 대규모 GPU 클러스터는 채무불이행 시 담보로 넘어갈 수 있지만, 실제 가치는 장비보다 운영 상태와 팀의 암묵지에 좌우됨. GPU 담보 금융이 확산되는 반면 가격 산정 인프라는 아직 부족하다고 지적함.
스타트업의 Postgres 생존 가이드
스타트업의 Postgres 생존 가이드
Hatchet의 2년간 프로덕션 경험을 바탕으로 초기 스키마와 쿼리 설계부터 대량 쓰기, 테이블 마이그레이션까지 운영 원칙을 정리했다. 인덱스와 ORDER BY 조정, 통계 기반 플래너 선택, 마이그레이션 리스크 관리가 핵심이다.
미국 5대 기술기업, 불투명한 AI 자금조달로 숨은 부채 2,475조원
미국 5대 기술기업, 불투명한 AI 자금조달로 숨은 부채 2,475조원
미국 5대 기술기업의 AI 투자 확대와 함께 데이터센터 임대, GPU 공급 계약에서 발생한 의무가 급증하며 숨은 부채가 약 1.65조 달러로 불어남. 공개 부채보다 더 큰 규모로 커지면서 재무 건전성과 자본 조달 구조에 대한 우려가 커지고 있음.
하루 15원으로 완전히 독립적인 웹사이트 운영하기
하루 15원으로 완전히 독립적인 웹사이트 운영하기
콘텐츠 원본과 게시 가능한 HTML·웹 자산을 자신의 장치에 보관해 정체성과 콘텐츠 통제권을 호스팅 사업자에 맡기지 않는 Hardcore IndieWeb 방식. HTML 미리보기 후 업로드하는 전통적 출판 흐름으로 CMS와 프레임워크 의존을 줄이는 접근을 제안함.
AWS 예상 청구액이 17억 달러로 표시됨, 평소 사용료는 5달러 미만
AWS 예상 청구액이 17억 달러로 표시됨, 평소 사용료는 5달러 미만
평소 월 사용료가 5달러 미만인 AWS 계정에서 이번 달 예상 청구액이 17억 달러로 표시되는 이상 현상이 발생함. 실제 사용량과 청구액의 괴리가 커 청구 추정 데이터 오류로 보고 긴급 확인에 들어감.
Patreon이 팬아웃으로 알림 시스템을 확장한 방법
Patreon이 팬아웃으로 알림 시스템을 확장한 방법
대형 크리에이터의 폭증하는 알림 트래픽이 기존 시스템의 타임아웃을 유발하자 수신자별 미리 생성 방식의 팬아웃 계층으로 재설계함. 인앱 피드, 푸시, 이메일을 분리 처리해 대규모 알림 처리의 안정성을 높임.
Show GN: Claude 공식 업타임 99.55%인데 6월 인시던트 45건 — 6월 AI 서비스 신뢰도 리포트
Show GN: Claude 공식 업타임 99.55%인데 6월 인시던트 45건 — 6월 AI 서비스 신뢰도 리포트
AIWatch가 Claude, OpenAI, Gemini 등 41개 AI 서비스의 업타임, 인시던트, 지연을 실시간 모니터링하는 6월 리포트를 공개함. Claude는 공식 업타임 99.55%였지만 6월 인시던트 45건이 보고됨.
S&P Global, Oracle 신용등급을 투자적격 최하단 BBB-로 하향
S&P Global, Oracle 신용등급을 투자적격 최하단 BBB-로 하향
S&P Global이 Oracle의 신용등급을 BBB-로 한 단계 하향함. AI 데이터센터 확장에 따른 부채와 자본 지출 부담이 커지며 2027 회계연도 투자 전망도 크게 상향 조정됨.
소프트웨어가 세상을 먹어 치웠고, 이제 하드웨어가 소프트웨어를 먹고 있다
소프트웨어가 세상을 먹어 치웠고, 이제 하드웨어가 소프트웨어를 먹고 있다
AI 시대에는 가치 중심이 SaaS 애플리케이션에서 반도체, 컴퓨팅, 데이터, 추론 플랫폼으로 이동하고 있다. CoWoS, HBM, 전력 같은 물리적 병목과 데이터 전환 비용으로 애플리케이션 계층은 더 얇아지고 있다.
순서대로, 한 번만, 빠르게
순서대로, 한 번만, 빠르게
Airbridge가 광고 이벤트를 실시간 매칭하는 과정에서 처리 속도뿐 아니라 순서 보장, 중복 방지, 유실 방지가 핵심 과제로 부각됨. 기존 Kafka 마이크로배치 기반 순차 처리의 장단점과 개선 방향을 다룸.
아일랜드 데이터센터, 국가 전력의 23% 소비
아일랜드 데이터센터, 국가 전력의 23% 소비
더블린 지역 전력망 제약에도 데이터센터 전력 사용이 전년 대비 10% 늘어 국가 계량 전력의 23%를 차지. 2015년 이후 사용량이 급증하며 전력 인프라 부담이 커짐.
lobste.rs, MariaDB에서 SQLite로 전환
lobste.rs, MariaDB에서 SQLite로 전환
lobste.rs가 MariaDB를 SQLite로 교체한 뒤 월요일 트래픽 급증도 안정적으로 처리함. CPU·메모리 사용량이 줄고 응답성도 빨라졌으며, 별도 MariaDB VPS 종료로 비용도 절반 수준으로 감소함.
Papermake - Typst 기반의 셀프 호스팅 가능한 PDF 문서 생성 서버
Papermake - Typst 기반의 셀프 호스팅 가능한 PDF 문서 생성 서버
Typst 템플릿으로 PDF를 생성하는 HTTP 기반 문서 생성 서버. 템플릿 중앙 관리, 버전 관리, Audit Trail, Docker Registry 유사 저장소를 제공함.
네트워킹과 인터넷을 제1원리부터 이해하기
네트워킹과 인터넷을 제1원리부터 이해하기
인터넷이 전기·빛·전파 신호를 통해 독립 사업자들의 장비를 거치며 데이터가 전달되는 구조를 제1원리 관점에서 설명함. Ethernet, IP, TCP, DNS, TLS 등 핵심 프로토콜의 역할을 순차적으로 정리함.
AI 토큰은 데이터센터를 어떻게 통과하는가
AI 토큰은 데이터센터를 어떻게 여행하는가
AI 추론이 전체 AI 컴퓨팅의 대부분을 차지하면서 토큰 처리 비용과 지연시간이 인프라 경제성을 좌우하는 핵심 변수가 됨. 요청은 토큰화부터 API 게이트웨이, 라우팅, KV 캐시, GPU·HBM, 네트워크까지 여러 계층을 거치며 비용이 누적됨.
NVIDIA·CoreWeave·Nebius가 만든 GPU 붐의 순환 금융 구조
NVIDIA·CoreWeave·Nebius가 만든 GPU 붐의 순환 금융 구조
CoreWeave와 Nebius가 최신 NVIDIA GPU 공급을 바탕으로 대형 장기 계약을 확보했지만, 이를 실제 데이터센터 용량으로 전환하려면 막대한 자본 지출이 필요함. Microsoft와 Meta의 네오클라우드 계약 확대가 GPU 붐의 순환 금융 의존도를 키우는 흐름으로 해석됨.
PgBouncer 처리량을 4배로 확장한 방법
PgBouncer 처리량을 4배로 확장한 방법
단일 스레드 PgBouncer 병목을 피하려고 다중 프로세스 플릿과 so_reuseport로 연결 분산을 구성함. 코어 수에 비례해 처리량을 4배까지 끌어올린 사례.
UPI 결제 한 건이 처리되는 과정
UPI 결제 한 건이 처리되는 과정
QR 스캔부터 승인 알림까지 2~3초 안에 끝나지만, 뒤에서는 앱과 은행, NPCI 중앙 스위치가 요청을 순차적으로 릴레이함. 결제 앱은 결제 의도만 전달하고 실제 자금 이동과 인증은 은행과 중앙 네트워크가 처리함.
SpaceX, 대역폭 100배 위해 Starlink 위성 10만 기 추가 발사 추진
SpaceX, 대역폭 100배 위해 Starlink 위성 10만 기 추가 발사 추진
SpaceX가 3세대 Starlink 위성 10만 기 배치를 추진하며 대역폭을 100배 수준으로 늘리려 함. 초저지연 대칭형 멀티기가비트 통신을 목표로 하며, FCC 인허가와 대규모 발사가 관건임.