LLM Inference Engineering: Quantization, KV-Cache Optimization, and High-Throughput Serving: A Production Engineer's Guide to INT4/INT8 Quantization, ... (Production AI Engineering Series)

LLM Inference Engineering: Quantization, KV-Cache Optimization, and High-Throughput Serving: A Production Engineer's Guide to INT4/INT8 Quantization, ... (Production AI Engineering Series)

Independently published

Pages: 82, Paperback, Independently published

Compare prices (1 shop)

shop Price Action
7,47 GBP Go to shop

Similar products