รวมบทความพื้นฐาน & อธิบาย ของ Local LLM ทั้งหมด 6 เรื่อง ภาษาไทย อ่านง่าย เหมาะกับคนที่อยากใช้ AI กับงานจริง
DeepSeek-V4-Flash-0731 โมเดลเขียนโค้ดที่วิธีรันอย่างเป็นทางการออกแบบมาสำหรับเซิร์ฟเวอร์ GPU มีคนย่อลงมาเป็นแพ็กเกจ 56.8 GB ที่รันบนแมค Apple Silicon เครื่องเดียวได้ วิธีย่อมีสองชั้น และแต่ละชั้นต้องแลกกับคุณภาพบางด้านที่ลดลงจริง
kimi-k3-in-c คือเอนจินภาษา C ที่รัน Kimi K3 โมเดลที่มีพารามิเตอร์ 2.78 ล้านล้านตัว บนซีพียูตัวเดียว โดยวัดแรมสูงสุดตอนรันได้ 8.24 กิกะไบต์ เบื้องหลังคือการไล่ตัวเลขลงมาสี่ขั้นจาก 5,560 กิกะไบต์ แลกกับความเร็วที่เหลือ 32.69 วินาทีต่อการเขียนหนึ่งโทเคน
สร้างระบบ RAG รันในเครื่องด้วย Ollama, ChromaDB และ LangChain ให้ AI ช่วยตอบคำถามจากคู่มือ PDF 2,111 หน้า โดยไม่ต้องส่งเอกสารออกไปคลาวด์ พร้อมสรุปวิธีติดตั้งและ 3 ปัญหาจริงที่พบระหว่างพัฒนา