AI Chip Architectures
Summary
This long-form article surveys AI accelerator architectures from multiple vendors, including NVIDIA GPUs, Google TPUs, AMD CDNA, Cerebras WSE, AWS Trainium, and Groq LPU. It analyzes compute architectures, memory hierarchies, scaling models (scale-up vs scale-out), and the associated software stacks, highlighting trade-offs and deployment economics. The piece also contrasts deterministic versus dataflow approaches and discusses ecosystem maturity and openness.