ปรับแต่งโมเดลให้พอดีกับหน่วยความจำ
ขณะนี้โมเดลยังคงใช้ค่าตั้งต้นจากระบบ มีพฤติกรรมการตอบคำถามที่หลากหลายเกินไป มีข้อจำกัดด้านความยาวของบทสนทนา และอาจทำงานช้าลงในบางกรณี บทนี้จะสอนวิธีปรับแต่ง 3 ส่วนหลักเพื่อให้สอดคล้องกับความต้องการของเรา ได้แก่ นิสัยและพฤติกรรมการตอบคำถาม ขนาดความยาวหน่วยความจำบทสนทนา (Context) และวิธีตรวจสอบเมื่อระบบตอบช้าหรือมีข้อผิดพลาด
ปั้นนิสัยด้วย system prompt และ Modelfile
system prompt คือข้อกำหนดหรือคำสั่งที่ตัวโมเดลจะยึดถือในทุกบทสนทนา เช่น สั่งให้ตอบเป็นภาษาไทยเสมอ ตอบอย่างกระชับ หรือเน้นวิเคราะห์งานเอกสาร หากต้องการกำหนดค่านี้เป็นการถาวรใน Ollama สามารถทำได้โดยเขียนไฟล์ Modelfile ซึ่งทำหน้าที่เป็นเทมเพลตสำหรับสร้างโมเดลที่เราปรับแต่งเอง
มาทดลองสร้างโมเดลที่กำหนดระบบภาษาไทยจากโมเดลสาธิตของเล่มนี้ เริ่มจากเปิดโปรแกรมแก้ไขข้อความ แล้วสร้างไฟล์ชื่อ Modelfile (ไม่ต้องระบุนามสกุลไฟล์) โดยใส่เนื้อหาดังนี้
FROM qwen3.5:2b
PARAMETER temperature 0.7
SYSTEM """คุณคือโมเดลสนับสนุนงานสำนักงาน ตอบเป็นภาษาไทยเสมอ
ตอบตรงคำถาม กระชับ ถ้าไม่แน่ใจให้บอกว่าไม่แน่ใจ"""
สามบรรทัดนี้มีความหมายตรงไปตรงมา: FROM เลือกโมเดลตั้งต้น · PARAMETER temperature กำหนดความหลากหลายของคำตอบ (ค่าเริ่มต้น 0.8 ยิ่งสูง คำตอบยิ่งสร้างสรรค์ ยิ่งต่ำ คำตอบยิ่งนิ่งและคงเส้นคงวา) · SYSTEM คือคำสั่งประจำตัวที่ใส่ไว้ระหว่างเครื่องหมายคำพูดสามตัว
จากนั้นสร้างและเรียกใช้
ollama create thai-assistant -f Modelfile
ollama run thai-assistant
เท่านี้ก็จะมีโมเดลชื่อ เพิ่มขึ้นในระบบอีกหนึ่งตัว ซึ่งโมเดลนี้จะอยู่ในรายการที่แสดงเมื่อรันคำสั่ง เช่นเดียวกับโมเดลปกติ และสามารถลบได้ด้วยคำสั่ง เช่นกัน

ความคิดเห็น
ยังไม่มีความคิดเห็น
เป็นคนแรกได้เลย