Dylan Patel (SemiAnalysis): Software-Hardware-Co-Design macht aus 2x hier und 2x dort 100x – indem Modelle, Kernel und Silizium gemeinsam optimiert werden.
DeepSeeks Architektur wurde auf Nvidias Hopper getrimmt, TPUs kämpfen damit. OpenAIs spärlichere und Anthropics dichtere Modelle verlangen unterschiedliche Hardware – der CUDA‑Graben war nie nur CUDA.
Dylan Patel (SemiAnalysis) argues software-hardware co-design turns 2x gains here and there into 100x: optimizing models, kernels, and silicon together.
DeepSeek's experts were shaped for Nvidia Hopper; TPUs struggle. OpenAI's sparser models and Anthropic's denser ones pull toward different hardware—the CUDA moat was never just about CUDA.