io_uring의 SQ/CQ 링 버퍼 기반 비동기 I/O 원리와 io_uring_enter 배치 제출을 다루고, Linux 6.15의 epoll 통합·NAPI busy-poll·IORING_OP_URING_CMD를 통한 NVMe passthrough 최신 기능을 개관합니다.
NUMA 노드별 CPU affinity와 스레드 배치 정책을 다룹니다. numactl·libnuma로 CPU·메모리 정책을 지정하는 법, sub-NUMA clustering/NPS 환경의 배치 전략, 자동 NUMA 밸런싱과의 상호작용, 메모리 지역성과의 경계(Tr.04)를 정리합니다.
프로세스와 스레드의 자원 격리·통신 비용 차이를 clone() 플래그(CLONE_VM/FILES/SIGHAND) 수준에서 분석하고, fork(COW)와 pthread_create의 생성 비용을 비교하며, 저지연 서비스에서 장애 격리와 통신 비용을 기준으로 아키텍처를 선택하는 방법을 정리합니다.