บริษัทมิสทรัล เอไอ (Mistral AI) สตาร์ตอัป AI จากกรุงปารีส ประเทศฝรั่งเศส เปิดตัวรุ่นทดลอง (พรีวิว) ของโมเดลภาษาขนาดใหญ่ Mistral Large 4 เมื่อวันที่ 6 ตุลาคม 2569 โมเดลนี้มีขนาด 1 ล้านล้านพารามิเตอร์ และมีชื่อเล่นว่า “Le Chonk” บริษัทระบุว่าเป็นโมเดลแบบเปิดน้ำหนัก (open-weight) ที่ทรงพลังที่สุดนอกประเทศจีน โดยนักพัฒนาเริ่มใช้งานผ่าน API ได้ทันที และบริษัทมีแผนเปิดให้ดาวน์โหลดน้ำหนักโมเดลในวันที่ 27 ตุลาคม
สเปกสำคัญของ Mistral Large 4
ข้อมูลจาก VentureBeat และ The Next Web สรุปจุดเด่นของโมเดลได้ดังนี้
- ขนาด: พารามิเตอร์รวม 1 ล้านล้านตัว แต่ใช้งานจริงครั้งละประมาณ 49,000 ล้านพารามิเตอร์ ด้วยสถาปัตยกรรมแบบ Mixture-of-Experts ที่เลือกเปิดใช้เฉพาะส่วนที่จำเป็น
- ข้อมูลเข้าและออก: รับได้ทั้งข้อความและรูปภาพ แต่ตอบกลับเป็นข้อความ
- ภาษา: ฝึกด้วยข้อมูลมากกว่า 160 ภาษา รวมถึงภาษาทางการทุกภาษาของสหภาพยุโรป
- การฝึก: ใช้ชิป Nvidia Grace Blackwell ราว 4,000 ตัว ฝึกตั้งแต่ศูนย์นานประมาณ 2 เดือน ในศูนย์ข้อมูลของบริษัทเองในยุโรป
- สัญญาอนุญาต: ใช้สัญญาอนุญาตเฉพาะของ Mistral ยังไม่เปิดเผยราคาค่าใช้ API
ท้าชนโมเดลโอเพนจากจีน
ในช่วงหลัง โมเดล AI แบบเปิดที่แข็งแกร่งที่สุดส่วนใหญ่มาจากบริษัทจีน Mistral จึงวางตำแหน่ง Large 4 เป็นทางเลือกจากยุโรป และนำผลทดสอบไปเทียบกับโมเดลจีนอย่าง DeepSeek V4 Pro, Qwen 3.8 Max, GLM-5.3 และ Kimi K3 ผลทดสอบเบื้องต้นที่บริษัทเปิดเผย เช่น คะแนนด้านการเขียนโค้ด DeepSWE อยู่ที่ 62% และด้านงานการเงิน FinWorkBench อยู่ที่ 67%
กีโยม ลองเปิล (Guillaume Lample) ผู้ร่วมก่อตั้งและหัวหน้านักวิทยาศาสตร์ของ Mistral กล่าวว่าโมเดลนี้อยู่แถวหน้าของโมเดลแบบเปิดน้ำหนัก และความสามารถด้านไซเบอร์จะช่วยให้องค์กรและรัฐบาลป้องกันตัวเองจากผู้ไม่หวังดีได้
เหตุผลที่บริษัทยังไม่ปล่อยน้ำหนักโมเดลทันที คือจะใช้เวลาราว 3 สัปดาห์ทดสอบร่วมกับนักพัฒนา ผู้เชี่ยวชาญด้านความปลอดภัยไซเบอร์ และหน่วยงานรัฐก่อน
สำหรับคนที่ไม่คุ้นกับคำศัพท์ “พารามิเตอร์” เปรียบได้กับจำนวนจุดเชื่อมต่อภายในสมองของโมเดล ยิ่งมีมากก็ยิ่งเก็บความรู้และรูปแบบภาษาได้มาก แต่ก็ต้องใช้พลังประมวลผลสูงตาม เทคนิค Mixture-of-Experts ช่วยแก้ปัญหานี้ด้วยการแบ่งโมเดลเป็นผู้เชี่ยวชาญย่อยหลายกลุ่ม แล้วเรียกใช้เฉพาะกลุ่มที่เกี่ยวข้องกับคำถามนั้น ๆ ทำให้ตอบได้เร็วขึ้นและประหยัดค่าใช้จ่ายกว่าการใช้ทั้งโมเดลพร้อมกัน
ทำไมเรื่องนี้สำคัญกับคนไทย
โมเดลแบบเปิดน้ำหนักหมายความว่า องค์กรสามารถดาวน์โหลดไปติดตั้งบนเซิร์ฟเวอร์ของตัวเอง ปรับแต่งให้เข้ากับงาน และเก็บข้อมูลไว้ในประเทศได้ แนวคิดนี้เรียกว่า “AI อธิปไตย” (sovereign AI) ซึ่งตรงกับความต้องการของหน่วยงานรัฐ ธนาคาร และโรงพยาบาลที่ต้องดูแลข้อมูลอ่อนไหว
อย่างไรก็ตาม โมเดลขนาด 1 ล้านล้านพารามิเตอร์ต้องใช้ฮาร์ดแวร์ราคาสูงในการรัน องค์กรไทยส่วนใหญ่จึงน่าจะเริ่มจากการทดลองผ่าน API ก่อน สิ่งที่ต้องติดตามต่อคือรายละเอียดสัญญาอนุญาตในวันที่ 27 ตุลาคม ว่าจะเปิดให้ใช้เชิงพาณิชย์ได้กว้างแค่ไหน และประสิทธิภาพกับภาษาไทยจะเป็นอย่างไรเมื่อมีผู้ทดสอบอิสระ





