LLM Inference Engineering : Quantization, KV-Cache Optimization, and High-Throughput Serving: A Production Engineer's Guide to INT4/INT8 Quantization, vLLM, TGI, Speculative Decoding, and Cost Optimization

Livre 11 sur 20: Production AI Engineering Series

Chatvariety Team

ISBN 13: 9798180985187
Edité par Independently Published Jun 2026, 2026
Langue: anglais
Etat : Neuf Couverture souple

Vendu par AHA-BUCH GmbH, Einbeck, Allemagne

Vendeur AbeBooks depuis 14 août 2006

Évaluation du vendeur 5 sur 5 étoiles Evaluation 5 étoiles, En savoir plus sur les évaluations des vendeurs

Afficher tous les articles du vendeur


Neuf(s) - Couverture souple

Etat : Neuf

Prix:
EUR 13
Expédition à EUR 60,63
Expédition depuis Allemagne vers Etats-Unis

Quantité disponible : 2 disponible(s)

Ajouter au panier