InfiniBand and RoCE — The Network Foundation of GPU Clusters RDMA mechanics, Verbs API, lossless Ethernet, DCQCN, GPUDirect RDMA Posted on July 7, 2026 The Physical Limits of GPU Cluster Communication [Read More] Tags: Network InfiniBand RoCE RDMA HPC NCCL GPU-Cluster
GPU 아키텍처 #8: Ada Lovelace - 3세대 RT Core와 96MB L2 Opacity Micromap, Shader Execution Reordering, DLSS 3 Frame Generation Posted on July 7, 2026 시리즈 로드맵 [Read More] Tags: GPU Architecture CUDA NVIDIA AdaLovelace RayTracing TensorCore Computer-Architecture
GPU Architecture #8: Ada Lovelace — 3rd-Gen RT Cores and 96MB L2 Opacity Micromap Engine, Shader Execution Reordering, and DLSS 3 Frame Generation Posted on July 7, 2026 Series Roadmap [Read More] Tags: GPU Architecture CUDA NVIDIA AdaLovelace RayTracing TensorCore Computer-Architecture
GPU 아키텍처 #7: Hopper - Transformer Engine과 FP8 4세대 Tensor Core의 FP8 가속, Transformer Engine, Thread Block Cluster, GH200 Grace Hopper Posted on July 7, 2026 시리즈 로드맵 [Read More] Tags: GPU Architecture CUDA NVIDIA Hopper TensorCore Transformer Computer-Architecture
GPU Architecture #7: Hopper — Transformer Engine and FP8 4th-gen Tensor Cores with FP8, Transformer Engine, Thread Block Clusters, and GH200 Grace Hopper Posted on July 7, 2026 Series Roadmap [Read More] Tags: GPU Architecture CUDA NVIDIA Hopper TensorCore Transformer Computer-Architecture