DeepSeek เปิดตัว V4.1 Flash อัปเกรดความฉลาดแต่ประหยัดค่าใช้จ่ายกว่าเดิม

DeepSeek ประกาศเปิดตัวโมเดลปัญญาประดิษฐ์รุ่นใหม่ล่าสุด DeepSeek V4.1 Flash ซึ่งถูกวางตำแหน่งเป็นโมเดลขนาดกลางที่มีประสิทธิภาพสูงกว่ารุ่น DeepSeek V4 Pro เดิมในแทบทุกด้าน โดยมาพร้อมกับจุดแข็งด้านต้นทุนการให้บริการที่ถูกลงอย่างมาก โดยเฉพาะในส่วนของค่าแคชที่ช่วยให้การประมวลผลประหยัดทรัพยากรหน่วยความจำได้ดีขึ้น
ประสิทธิภาพเทียบชั้นโมเดลแถวหน้า
จากการทดสอบประสิทธิภาพพบว่า DeepSeek V4.1 Flash สามารถทำคะแนนได้โดดเด่นกว่า DeepSeek V4 Pro ในเกือบทุกการทดสอบ โดยความสามารถของโมเดลรุ่นนี้ถือว่าอยู่ในระดับเดียวกับโมเดลชั้นนำอย่าง GLM-5.3, Kimi K3 และ Claude Opus 5
สถาปัตยกรรมและการลดภาระหน่วยความจำ
ในเชิงเทคนิค โมเดลรุ่นนี้ใช้สถาปัตยกรรมแบบ 552B-A8B/A16B โดยแบ่งการทำงานเป็นช่วง prefill (ประมวลพรอมต์) ที่ใช้พารามิเตอร์ 8B และช่วง decode (สร้างโทเค็น) ที่ใช้พารามิเตอร์ 16B นอกจากนี้ยังมีการนำเทคโนโลยี Compressed Sparse Attention 2 (CSA2) มาใช้งานร่วมกับ FP4 KV Caching ส่งผลให้หน่วยความจำที่ใช้ในการเก็บแคชเหลือเพียง 890 ไบต์ต่อโทเค็น ซึ่งถือว่าลดลงถึง 4 เท่าเมื่อเทียบกับรุ่น DeepSeek V4 Flash เดิม ความประหยัดแรมในระดับนี้ทำให้ค่าใช้จ่ายในการแคชลดลงเหลือเพียง 1/50 ของค่าอินพุตปกติ ช่วยให้การรันงานในรูปแบบ agentic มีต้นทุนที่ถูกลงอย่างมาก
การปรับเปลี่ยนบริการสำหรับผู้ใช้งาน API
ปัจจุบัน DeepSeek ได้เริ่มให้บริการโมเดล V4.1 Flash แล้ว โดยผู้ที่ใช้งาน API โดยตรงจะได้รับการปรับเปลี่ยนให้ใช้โมเดลรุ่นนี้แทนที่ DeepSeek V4 Pro โดยอัตโนมัติโดยไม่จำเป็นต้องตั้งค่าเพิ่มเติม สำหรับโครงสร้างราคา API อยู่ที่ 0.3/1.2 ดอลลาร์ต่อล้านโทเค็น และมีค่าแคชอยู่ที่ 0.006 ดอลลาร์ต่อล้านโทเค็น

