CXL이란? AI 서버의 메모리 구조를 바꾸는 차세대 인터커넥트
Server의 Memory는 오랫동안 CPU Socket에 직접 연결된 DRAM이라는 구조를 유지해왔습니다. 문제는 CPU가 지원하는 Memory Channel과 DIMM Slot 수에 한계가 있다는 점입니다. 더 많은 Memory가 필요하면 더 큰 DIMM을 쓰거나 CPU Socket 자체를 추가해야 했습니다. AI와 In-memory Database처럼 Memory Demand가 빠르게 증가하면서 이 구조의 비효율이 커지고 있습니다.
CXL(Compute Express Link): PCIe Physical Layer를 기반으로 CPU와 Accelerator, Memory Device 사이에 Cache Coherency와 Memory Semantics를 제공하는 Open Interconnect Standard입니다.
CXL이 PCIe와 다른 점은 무엇일까요?
PCIe는 Device를 연결하는 범용 I/O Standard입니다. SSD, NIC, GPU를 CPU에 연결하는 데 매우 널리 사용됩니다. CXL은 PCIe PHY를 활용하지만 그 위에 Memory와 Cache를 더 직접적으로 다룰 수 있는 Protocol을 추가합니다.
CXL.io: Device Discovery, Configuration과 일반 I/O를 담당하는 PCIe 기반 Protocol입니다. CXL.cache: Accelerator가 Host Memory를 Coherent하게 접근할 수 있도록 합니다. CXL.mem: CPU나 Host가 CXL Device의 Memory를 Load·Store에 가까운 Memory Semantic으로 접근하도록 합니다.
CXL Device Type을 이해하면 구조가 쉽습니다
Type 1 Device는 Memory가 없는 Accelerator로 Host Memory Cache Coherency가 중요하고, Type 2 Device는 Accelerator와 Local Memory를 모두 가지며 CXL.cache와 CXL.mem을 활용할 수 있습니다. Type 3 Device는 주로 Memory Expansion을 위한 Device로 CXL.mem이 핵심입니다.
AI Infrastructure에서 가장 빠르게 이해하기 쉬운 사례는 Type 3 CXL Memory Expander입니다. CPU의 DDR Channel 밖에 DDR5 Memory를 추가하고 PCIe/CXL Link를 통해 접근합니다.
왜 CXL이 필요한가요?
CPU의 Memory Channel은 Package Pin, Power와 Board Routing 때문에 무한정 늘릴 수 없습니다. Core 수는 증가하는데 Memory Channel이 비슷하게 늘지 않으면 Core당 Memory Bandwidth와 Capacity가 부족해질 수 있습니다.
CXL을 사용하면 PCIe Slot이나 EDSFF Form Factor를 통해 Memory를 추가할 수 있습니다. 더 나아가 여러 Host가 Memory Pool을 공유하고 Workload에 따라 Capacity를 동적으로 배분하는 Architecture도 가능합니다.
CXL 2.0부터 Memory Pooling이 중요해졌습니다
CXL 2.0은 Switching과 Memory Pooling을 추가했습니다. Switch를 통해 여러 Host와 여러 CXL Device를 연결하고, Memory Resource를 특정 Host에 할당했다가 필요에 따라 다른 Host로 재배치할 수 있습니다.
CXL 3.x는 Multi-level Switching과 Fabric, Memory Sharing을 강화했고, 2025년 공개된 CXL 4.0은 Data Rate를 128GT/s로 높여 Bandwidth를 다시 두 배로 확대했습니다.
| 세대 | 주요 특징 |
| CXL 1.x | Direct-attached Device, Cache·Memory Coherency |
| CXL 2.0 | Switching, Memory Pooling |
| CXL 3.x | 64GT/s, Multi-level Fabric, Memory Sharing |
| CXL 4.0 | 128GT/s, Bundled Port, Native x2, RAS 강화 |
CXL Memory는 HBM을 대체할까요?
대체하기 어렵습니다. HBM은 GPU 바로 옆에서 수 TB/s급 Bandwidth를 제공하는 최고성능 Memory입니다. CXL Memory는 PCIe/CXL Link를 통해 접근하기 때문에 Latency가 더 높고 Bandwidth도 HBM보다 낮습니다.
따라서 두 Memory는 경쟁보다 Tiering 관계에 가깝습니다. Hot Data와 Compute-critical Data는 HBM에 두고, 큰 Capacity가 필요한 KV Cache나 Warm Data는 CXL Memory를 활용하는 방식이 가능합니다.
CXL은 Memory Capacity 문제를 경제적으로 해결할 수 있습니다
Memory가 부족하다고 CPU Socket을 하나 더 추가하면 CPU Cost와 Power가 함께 늘어납니다. CXL Memory는 CPU를 추가하지 않고 Memory Capacity와 일부 Bandwidth를 확장할 수 있다는 것이 장점입니다.
또 CXL Pooling이 성숙하면 Server마다 Peak Capacity를 개별적으로 보유할 필요가 줄어들 수 있습니다. 사용하지 않는 Stranded Memory를 Pool로 묶어 필요한 Host에 배분하면 Data Center Memory Utilization을 높일 수 있습니다.
Software가 중요합니다
CXL Memory가 Hardware적으로 연결된다고 Application이 자동으로 최적성능을 내는 것은 아닙니다. Local DRAM과 CXL Memory의 Latency와 Bandwidth가 다르기 때문에 OS와 Runtime이 Data를 적절한 Tier에 배치해야 합니다.
NUMA Policy, Memory Tiering, Page Migration과 Application Awareness가 중요합니다. CXL의 장기적인 성공은 Hardware보다 Software가 Heterogeneous Memory를 얼마나 자연스럽게 관리하느냐에 크게 좌우될 수 있습니다.
2026년에는 실제 Deployment가 시작되고 있습니다
CXL은 오랫동안 Future Technology라는 평가를 받았지만 실제 Memory Controller와 Module, Switch 제품이 늘고 있습니다. Astera Labs의 Leo CXL Memory Controller는 CXL 2.0 기반 Memory Expansion·Pooling을 Production으로 제공하고 있고 Microsoft Azure M-series Preview에서도 CXL-attached Memory 평가가 시작됐습니다.
Samsung은 CXL 3.2와 PCIe 6를 지원하는 MD310 같은 CXL Memory Module을 공개해 256GB Capacity와 더 높은 Bandwidth를 제공하고 있습니다. 즉 Ecosystem이 Specification 단계에서 실제 Product 단계로 이동하고 있습니다.
투자 관점에서 볼 포인트
CXL Value Chain에는 DRAM 업체, CXL Memory Controller, Switch, Retimer와 Server Platform 업체가 연결됩니다. Memory Module이 늘면 DRAM Capacity Demand가 생길 수 있지만 Pooling이 Memory Utilization을 높이면 일부 Overprovisioning은 줄어들 수도 있습니다.
따라서 CXL을 “무조건 DRAM 수요를 늘리는 기술”로 보기보다 Memory Controller와 Switch Content가 새로 생기고, Memory가 Fixed Component에서 Composable Resource로 바뀌는 구조로 보는 것이 좋습니다.
핵심 정리
| 질문 | 답 |
| CXL이란? | PCIe PHY 위에서 Cache Coherency와 Memory Semantics를 제공하는 Interconnect입니다 |
| PCIe와 차이는? | PCIe I/O에 Memory·Cache Protocol을 추가합니다 |
| 가장 중요한 용도는? | Memory Expansion, Pooling, Accelerator Coherency입니다 |
| HBM을 대체하나? | 아닙니다. HBM은 고속 Tier, CXL은 Capacity·Flexibility Tier에 가깝습니다 |
| 최신 방향은? | CXL 3.x Fabric과 CXL 4.0 128GT/s로 Rack-scale Memory를 지향합니다 |
| 투자포인트는? | CXL Controller, Switch, DRAM, Retimer와 Cloud Deployment입니다 |
CXL의 핵심은 단순히 Memory를 더 꽂는 기술이 아닙니다. CPU에 고정돼 있던 Memory를 독립적으로 확장하고 공유할 수 있는 Resource로 바꾸는 것이 CXL이 Data Center Architecture에 주는 가장 큰 변화입니다.
curiouszip
댓글 0
첫 댓글을 남겨보세요.