Call Me Thanut
newspaperข่าวสาร

DeepSeek V4 Flash โมเดลเปิดน้ำหนักที่ฉลาดระดับกลาง แต่ค่ารันถูกกว่ารุ่นเทียบเท่าหลายเท่า

10 ส.ค. 2026อ่าน 5 นาที
DeepSeek V4 Flash โมเดลเปิดน้ำหนักที่ฉลาดระดับกลาง แต่ค่ารันถูกกว่ารุ่นเทียบเท่าหลายเท่า
สารบัญ

สรุปให้ไว

ฉลาดระดับกลาง ไม่ใช่ frontier

ได้ 52 บนดัชนีความฉลาด (Artificial Analysis) เกาะกลุ่มรุ่น flash ทั่วไป

จุดขายคือราคา

ค่ารันต่องานถูกที่สุดในกลุ่มโมเดล 21 ตัวที่เอามาเทียบ

โครงสร้าง MoE

300B พารามิเตอร์รวม แต่ทำงานจริงแค่ 13B ต่อครั้ง คอนเทกซ์ 1M token

เปิดน้ำหนักจริง

โหลดได้บน Hugging Face ใบอนุญาต MIT เอาไปรันเองได้

01มันคืออะไร

DeepSeek V4 Flash (รุ่นย่อย 0731) เป็นโมเดลภาษาแบบ Mixture-of-Experts ที่มีพารามิเตอร์รวม 300 พันล้าน แต่เวลาทำงานจริงจะปลุกใช้แค่ราว 13 พันล้านต่อการตอบหนึ่งครั้ง คิดง่าย ๆ คือมีสมองก้อนใหญ่แต่หยิบใช้ทีละส่วน เลยได้ความสามารถระดับหนึ่งโดยไม่ต้องแบกต้นทุนของโมเดลก้อนโตทั้งก้อน มาพร้อม context window ขนาด 1 ล้าน token และน้ำหนักโมเดลถูกปล่อยขึ้น Hugging Face แล้วภายใต้ใบอนุญาต MIT ซึ่งเปิดกว้างพอจะเอาไปใช้ในงานเชิงพาณิชย์ได้

02เก่งแค่ไหน ถูกแค่ไหน

บนดัชนีความฉลาดรวม V4 Flash ทำได้ 52 คะแนน แปลว่าไม่ใช่รุ่นท็อป แต่ไปเกาะกลุ่มกับพวกโมเดล flash และรุ่นความสามารถปานกลางของค่ายอื่น ในด้านงาน agentic มันติดอันดับกลาง ๆ ของกลุ่มที่เอามาเทียบ จุดที่ทำให้มันน่าสนใจไม่ใช่คะแนนความฉลาด แต่คือเรื่องราคา เมื่อวัดต้นทุนต่อการทำงานหนึ่งงาน V4 Flash ออกมาถูกที่สุดในบรรดาโมเดลทั้งหมดที่เอามาเทียบ ทั้งที่มันใช้จำนวน output token ค่อนข้างเยอะเป็นอันดับต้น ๆ ด้วยซ้ำ พูดง่าย ๆ คือได้คะแนนพอ ๆ กับหลายรุ่น แต่จ่ายน้อยกว่ามาก

ตัวเลขที่ทำให้สะดุด

  • ราคาต่อ token จากต้นทาง

    DeepSeek ตั้งไว้ราว $0.14 ต่ออินพุตหนึ่งล้าน token และ $0.28 ต่อเอาต์พุตหนึ่งล้าน token

  • ผ่านผู้ให้บริการรายอื่น

    ผ่านตลาดกลางอย่าง OpenRouter เฉลี่ยถูกลงอีก ราว $0.08 อินพุต และ $0.25 เอาต์พุตต่อล้าน token

  • เทียบรุ่นความฉลาดใกล้กัน

    ถูกกว่าโมเดลเปิดบางตัวที่คะแนนต่ำกว่าอยู่หลายเท่า และให้คะแนนใกล้เคียงรุ่น flash ค่ายใหญ่ในราคาที่ต่ำกว่ามาก

  • ทดสอบเขียนโค้ดจริง

    โจทย์ทำแดชบอร์ดจัดการการเงินแบบ full-stack จากโฟลเดอร์เปล่า ได้แอปที่พอทำงานได้ ต้นทุนถูกเป็นอันดับต้น ๆ แต่ความเร็วอยู่กลาง ๆ ค่อนไปทางช้า

03จุดที่ต้องระวัง

คะแนน 52 บอกชัดว่านี่ไม่ใช่รุ่นเอาไว้สู้งานยาก ๆ ที่ต้องการเหตุผลลึก ถ้างานคุณคือแก้บั๊กซับซ้อนหรือวางสถาปัตยกรรมทั้งระบบ รุ่น frontier ยังคุ้มกว่าแม้จะแพงกว่า และจากการทดสอบเขียนโค้ด ผลลัพธ์ยัง "พอใช้" ไม่ใช่ "เนียนจบ" ต้องมีคนตรวจและแก้ต่อเสมอ ความช้าที่ค่อนไปทางกลาง ๆ ก็เป็นอีกจุดที่ต้องชั่งกับความถูก

04เกี่ยวอะไรกับเรา

ฟันธง: ลองได้ โดยเฉพาะงานที่ยิงซ้ำเยอะ ๆ แล้วต้นทุนต่อครั้งสำคัญกว่าความฉลาดสูงสุด เช่น สรุปเอกสารจำนวนมาก จัดหมวดข้อความ ดึงข้อมูลเป็นชุด หรือ workflow ที่ต้องเรียกโมเดลวันละหลายพันครั้ง ตรงนี้ค่ารันที่ถูกกว่าหลายเท่าเปลี่ยนเกมได้จริง วิธีเริ่มที่คุ้มคือใช้ V4 Flash เป็น "คนงานราคาถูก" รับงานปริมาณมากที่ตรวจง่าย แล้วเก็บโมเดลแพงไว้เฉพาะจุดตัดสินใจสำคัญ ส่วนงานที่ผลลัพธ์ผิดแล้วเสียหาย เช่น โค้ดขึ้น production หรือข้อมูลลูกค้า ต้องมี Human Gate ให้คนตรวจก่อนใช้เสมอ ไม่ว่าโมเดลจะถูกแค่ไหน