ข่าว AILocal LLM
ทำไมการรันโมเดลในเครื่องถึงมาแรงในปีนี้
18 มิถุนายน 2569อ่าน 5 นาที
เมื่อไม่กี่ปีก่อน การจะรันโมเดลภาษาขนาดใหญ่ในเครื่องตัวเองยังเป็นเรื่องของคนที่มีการ์ดจอระดับเซิร์ฟเวอร์ แต่วันนี้ภาพเปลี่ยนไปมาก โมเดลตระกูลเล็กอย่าง Qwen และ Llama รุ่น 7B ถึง 14B ให้คุณภาพที่ใช้งานจริงได้บนแล็ปท็อปทั่วไป
อะไรเปลี่ยนไป
- โมเดลขนาดเล็กถูกฝึกได้ดีขึ้น คุณภาพต่อพารามิเตอร์สูงกว่าเดิมมาก
- เทคนิค quantization ทำให้โมเดลกินหน่วยความจำน้อยลงโดยคุณภาพแทบไม่ตก
- เครื่องมืออย่าง Ollama ทำให้การติดตั้งเหลือแค่ไม่กี่คำสั่ง
ผลที่ตามมาคือทีมเล็กและนักพัฒนาเดี่ยวเริ่มหันมาใช้โมเดลในเครื่องสำหรับงานที่อ่อนไหวเรื่องข้อมูล เพราะไม่ต้องส่งข้อมูลออกไปไหนเลย
ความเป็นส่วนตัวและการควบคุมข้อมูล คือเหตุผลที่หลายองค์กรเลือกรันโมเดลเอง แม้จะแลกกับการดูแลที่มากขึ้น
ถ้าคุณยังไม่เคยลอง คำแนะนำเรื่องการตั้งค่า Ollama กับ Qwen เป็นจุดเริ่มที่ดี ใช้เวลาไม่ถึงสิบนาทีก็มีโมเดลของตัวเองรันได้แล้ว