เลือกอ่านตามหมวดหมู่
ข่าว

ข่าวและเหตุการณ์ล่าสุด

เทคโนโลยี

AI แกดเจ็ต และโลกดิจิทัล

ธุรกิจ

สตาร์ทอัพ การงาน เศรษฐกิจ

ไลฟ์สไตล์

อาหาร สุขภาพ การใช้ชีวิต

กีฬา

ทุกสนาม ทุกการแข่งขัน

บันเทิง

หนัง ดนตรี และศิลปะ

ความคิดเห็น

มุมมองจากคนในชุมชน

ท้องถิ่น

เรื่องใกล้ตัวในชุมชน

ท่องเที่ยว

ที่เที่ยวและทริปแนะนำ

บทความล่าสุด

Mistral เปิดตัว Large 4 โมเดล AI 1 ล้านล้านพารามิเตอร์

Mistral AI จากฝรั่งเศสเปิดพรีวิว Mistral Large 4 โมเดล 1 ล้านล้านพารามิเตอร์ ใช้ผ่าน API ได้แล้ว และจะเปิดน้ำหนักโมเดลให้ดาวน์โหลด 27 ต.ค.
ภาพประกอบ: ตู้เซิร์ฟเวอร์ในศูนย์ข้อมูล
ภาพ: Carl Lender / Wikimedia Commons (CC BY 2.0)

บริษัทมิสทรัล เอไอ (Mistral AI) สตาร์ตอัป AI จากกรุงปารีส ประเทศฝรั่งเศส เปิดตัวรุ่นทดลอง (พรีวิว) ของโมเดลภาษาขนาดใหญ่ Mistral Large 4 เมื่อวันที่ 6 ตุลาคม 2569 โมเดลนี้มีขนาด 1 ล้านล้านพารามิเตอร์ และมีชื่อเล่นว่า “Le Chonk” บริษัทระบุว่าเป็นโมเดลแบบเปิดน้ำหนัก (open-weight) ที่ทรงพลังที่สุดนอกประเทศจีน โดยนักพัฒนาเริ่มใช้งานผ่าน API ได้ทันที และบริษัทมีแผนเปิดให้ดาวน์โหลดน้ำหนักโมเดลในวันที่ 27 ตุลาคม

สเปกสำคัญของ Mistral Large 4

ข้อมูลจาก VentureBeat และ The Next Web สรุปจุดเด่นของโมเดลได้ดังนี้

  • ขนาด: พารามิเตอร์รวม 1 ล้านล้านตัว แต่ใช้งานจริงครั้งละประมาณ 49,000 ล้านพารามิเตอร์ ด้วยสถาปัตยกรรมแบบ Mixture-of-Experts ที่เลือกเปิดใช้เฉพาะส่วนที่จำเป็น
  • ข้อมูลเข้าและออก: รับได้ทั้งข้อความและรูปภาพ แต่ตอบกลับเป็นข้อความ
  • ภาษา: ฝึกด้วยข้อมูลมากกว่า 160 ภาษา รวมถึงภาษาทางการทุกภาษาของสหภาพยุโรป
  • การฝึก: ใช้ชิป Nvidia Grace Blackwell ราว 4,000 ตัว ฝึกตั้งแต่ศูนย์นานประมาณ 2 เดือน ในศูนย์ข้อมูลของบริษัทเองในยุโรป
  • สัญญาอนุญาต: ใช้สัญญาอนุญาตเฉพาะของ Mistral ยังไม่เปิดเผยราคาค่าใช้ API

ท้าชนโมเดลโอเพนจากจีน

ในช่วงหลัง โมเดล AI แบบเปิดที่แข็งแกร่งที่สุดส่วนใหญ่มาจากบริษัทจีน Mistral จึงวางตำแหน่ง Large 4 เป็นทางเลือกจากยุโรป และนำผลทดสอบไปเทียบกับโมเดลจีนอย่าง DeepSeek V4 Pro, Qwen 3.8 Max, GLM-5.3 และ Kimi K3 ผลทดสอบเบื้องต้นที่บริษัทเปิดเผย เช่น คะแนนด้านการเขียนโค้ด DeepSWE อยู่ที่ 62% และด้านงานการเงิน FinWorkBench อยู่ที่ 67%

กีโยม ลองเปิล (Guillaume Lample) ผู้ร่วมก่อตั้งและหัวหน้านักวิทยาศาสตร์ของ Mistral กล่าวว่าโมเดลนี้อยู่แถวหน้าของโมเดลแบบเปิดน้ำหนัก และความสามารถด้านไซเบอร์จะช่วยให้องค์กรและรัฐบาลป้องกันตัวเองจากผู้ไม่หวังดีได้

เหตุผลที่บริษัทยังไม่ปล่อยน้ำหนักโมเดลทันที คือจะใช้เวลาราว 3 สัปดาห์ทดสอบร่วมกับนักพัฒนา ผู้เชี่ยวชาญด้านความปลอดภัยไซเบอร์ และหน่วยงานรัฐก่อน

สำหรับคนที่ไม่คุ้นกับคำศัพท์ “พารามิเตอร์” เปรียบได้กับจำนวนจุดเชื่อมต่อภายในสมองของโมเดล ยิ่งมีมากก็ยิ่งเก็บความรู้และรูปแบบภาษาได้มาก แต่ก็ต้องใช้พลังประมวลผลสูงตาม เทคนิค Mixture-of-Experts ช่วยแก้ปัญหานี้ด้วยการแบ่งโมเดลเป็นผู้เชี่ยวชาญย่อยหลายกลุ่ม แล้วเรียกใช้เฉพาะกลุ่มที่เกี่ยวข้องกับคำถามนั้น ๆ ทำให้ตอบได้เร็วขึ้นและประหยัดค่าใช้จ่ายกว่าการใช้ทั้งโมเดลพร้อมกัน

ทำไมเรื่องนี้สำคัญกับคนไทย

โมเดลแบบเปิดน้ำหนักหมายความว่า องค์กรสามารถดาวน์โหลดไปติดตั้งบนเซิร์ฟเวอร์ของตัวเอง ปรับแต่งให้เข้ากับงาน และเก็บข้อมูลไว้ในประเทศได้ แนวคิดนี้เรียกว่า “AI อธิปไตย” (sovereign AI) ซึ่งตรงกับความต้องการของหน่วยงานรัฐ ธนาคาร และโรงพยาบาลที่ต้องดูแลข้อมูลอ่อนไหว

อย่างไรก็ตาม โมเดลขนาด 1 ล้านล้านพารามิเตอร์ต้องใช้ฮาร์ดแวร์ราคาสูงในการรัน องค์กรไทยส่วนใหญ่จึงน่าจะเริ่มจากการทดลองผ่าน API ก่อน สิ่งที่ต้องติดตามต่อคือรายละเอียดสัญญาอนุญาตในวันที่ 27 ตุลาคม ว่าจะเปิดให้ใช้เชิงพาณิชย์ได้กว้างแค่ไหน และประสิทธิภาพกับภาษาไทยจะเป็นอย่างไรเมื่อมีผู้ทดสอบอิสระ

แหล่งข่าวอ้างอิง

แชร์บทความนี้

ใส่ความเห็น

อีเมลของคุณจะไม่แสดงให้คนอื่นเห็น ช่องข้อมูลจำเป็นถูกทำเครื่องหมาย *