Baseten sammelte 13 Mrd. Dollar ein und wird zum AI‑Infra‑Decacorn, da Inferenz‑Optimierungen 20–200 % Leistungssteigerung ermöglichen.
Quantisierungsfehler können sich gegenseitig aufheben: Ein Experiment mit GLM‑5.2 steigerte den Durchsatz um 20 % ohne Qualitätsverlust.
Baseten raised a $13B round, becoming an AI infra decacorn as inference engineering drives 20–200% performance gains.
Quantization errors can cancel each other out; a GLM-5.2 experiment preserved quality while boosting throughput 20%.