
LOCAL LLM FIELD GUIDES
เลือก Local LLM อย่างมีหลักฐาน
เลือก hardware, model, quantization, KV cache, serving framework และ performance path สำหรับ local LLM
START HERE
เลือกจากคำถามที่กำลังแก้
Quantization: ลด VRAM ตรงไหน และแลกคุณภาพอย่างไรคู่มือเจาะลึกการเลือก 4-bit และ 8-bit Quantization ทั้งฝั่ง Weights และ KV Cache สรุปเทคนิค QAT, MXFP4, AWQ, GPTQ และ GGUF พร้อมวิธีคำนวณ VRAM ประเมินคุณภาพ และความเสี่ยงหลอนในงานจริงทำไม tok/s ของ LLM มักติด Memory Bandwidthเจาะลึก Roofline Model สำหรับ Local LLM: ทำไม Decode ถึงติด Memory Bandwidth ทำไม Prefill ถึงติด Compute (FLOPS) พร้อมวิธีแยกแยะ TTFT, TPOT, ITL และวิธีอ่านผล VRAM Calculator อย่างมืออาชีพเลือก Hardware สำหรับ Local LLM จากงาน ไม่ใช่แค่ชื่อ GPUคู่มือเลือกฮาร์ดแวร์สำหรับ Local LLM สรุปจุดเด่นและข้อจำกัดระหว่าง Apple Silicon Mac, NVIDIA CUDA และ AMD ROCm วิเคราะห์ VRAM, Memory Bandwidth, สเปก และราคาตลาดในไทยเพื่อการลงทุนที่คุ้มค่า