뮤텍스가 느린 진짜 이유 - CPU 캐시 코히어런스로 이해하는 동시성 조정 비용과 거짓 공유
존 옌셋이 제인스트리트 강연에서 설명한 동시성 비용의 정체를 정리했다. 읽기만 하는 벤치마크에서 스레드를 늘릴수록 성능이 떨어지는 이유는 잠금 자체가 아니라 코어 사이를 오가는 캐시 라인에 있었다.
핵심 내용 읽기 →AI TOPIC
성능최적화 관련 핵심 뉴스와 활용 인사이트 4편을 최신순으로 모았습니다.

존 옌셋이 제인스트리트 강연에서 설명한 동시성 비용의 정체를 정리했다. 읽기만 하는 벤치마크에서 스레드를 늘릴수록 성능이 떨어지는 이유는 잠금 자체가 아니라 코어 사이를 오가는 캐시 라인에 있었다.
핵심 내용 읽기 →
학습이 느린 진짜 원인은 GPU가 아니라 데이터 파이프라인인 경우가 많다. 카네기멜런대 딥러닝 수업 실습에서 짚은 Dataset과 DataLoader의 역할 분담, 병목을 재는 방법, 속도를 끌어올리는 여덟 가지 기법을 정리했다.
핵심 내용 읽기 →
메모리에만 데이터를 두고 명령을 한 줄로 처리하는 레디스의 선택은 따로 보면 약점 같다. 그러나 이 선택들이 맞물릴 때 왜 가장 빠른 도구가 되는지, 지속성과 메모리 관리까지 설계 논리를 짚어본다.
핵심 내용 읽기 →
구글 클라우드의 라이브 진단 쇼에서 느린 축구 AI 앱을 코드가 아닌 관측성으로 분석한다. 오픈텔레메트리 계측과 클라우드 트레이스로 병목을 찾아 음성 합성을 병렬화해 응답을 80% 줄인 과정을 정리했다.
핵심 내용 읽기 →