뮤텍스가 느린 진짜 이유 - CPU 캐시 코히어런스로 이해하는 동시성 조정 비용과 거짓 공유
존 옌셋이 제인스트리트 강연에서 설명한 동시성 비용의 정체를 정리했다. 읽기만 하는 벤치마크에서 스레드를 늘릴수록 성능이 떨어지는 이유는 잠금 자체가 아니라 코어 사이를 오가는 캐시 라인에 있었다.
핵심 내용 읽기 →AI TOPIC
동시성 관련 핵심 뉴스와 활용 인사이트 3편을 최신순으로 모았습니다.

존 옌셋이 제인스트리트 강연에서 설명한 동시성 비용의 정체를 정리했다. 읽기만 하는 벤치마크에서 스레드를 늘릴수록 성능이 떨어지는 이유는 잠금 자체가 아니라 코어 사이를 오가는 캐시 라인에 있었다.
핵심 내용 읽기 →
GIL을 제거한 NoGIL 파이썬이 머신러닝을 얼마나 빠르게 하는지 라이브러리별 벤치마크로 검증한다. 순수 파이썬 연산은 약 3배, 판다스는 약 2.7배 빨라졌지만 넘파이·사이킷런 같은 네이티브 코드 기반 라이브러리는 거의 변화가 없었다.
핵심 내용 읽기 →
혼자 대화할 땐 초당 100~120토큰이지만 코드 에이전트처럼 동시 요청이 몰리면 이야기가 달라진다. Ollama와 llama.cpp의 차이, 동시성·병렬·다중 인스턴스로 로컬 LLM 처리량을 열 배 넘게 끌어올리는 방법을 정리했다.
핵심 내용 읽기 →