Call Me Thanut
clockอัปเดต

DeepSeek V4 Flash 0731 — โมเดลเดิม ขนาดเท่าเดิม แต่ทำงาน agent เก่งขึ้นเกือบเท่าตัว

31 ก.ค. 2026อ่าน 5 นาที
DeepSeek V4 Flash 0731 — โมเดลเดิม ขนาดเท่าเดิม แต่ทำงาน agent เก่งขึ้นเกือบเท่าตัว
สารบัญ

สรุปให้ไว

โมเดลเดิม จูนใหม่

V4 Flash 0731 ขนาดและสถาปัตยกรรมเท่ารุ่น preview ทุกอย่าง คะแนนที่เพิ่มมาจาก post-training ล้วน ๆ ไม่ใช่เพิ่มพารามิเตอร์

คะแนน agent กระโดด

Terminal Bench 2.1 จาก 61.8 เป็น 82.7 และแซงรุ่น Pro preview ของตัวเองครบทั้ง 9 benchmark

เสียบเข้า Codex ได้เลย

รองรับ Responses API format และปรับมาให้เข้ากับ harness แบบ Codex ตรง ๆ

ถูกและใกล้ได้ open weights

ราคาถูกตามสไตล์ DeepSeek, weights กำลังจะปล่อย และ V4 Pro ตัวเต็มตามมาเร็ว ๆ นี้

01มันคืออะไร

DeepSeek V4 Flash คือรุ่นเล็กของตระกูล V4 — โมเดลแบบ mixture-of-experts พารามิเตอร์รวมราว 284 พันล้าน active ราว 13 พันล้าน พร้อม context window 1 ล้าน token ออกแบบให้ "เร็วและถูก" ต่างจาก V4 Pro ที่เป็นตัวธงขนาด 1.6 ล้านล้านพารามิเตอร์

รอบนี้ DeepSeek เปิด API ตัวเต็มแบบ public beta ใช้ชื่อ build ว่า V4 Flash 0731 ตามวันที่ปล่อย จุดสำคัญคือ DeepSeek ย้ำชัดว่าโมเดลนี้ขนาดและสถาปัตยกรรมเท่ารุ่น preview เป๊ะ ของที่เพิ่มขึ้นมาทั้งหมดมาจากการจูน agent เพิ่ม ไม่ใช่การขยายโมเดล

02มีอะไรใหม่

งานสาย agent คือจุดที่เห็นผลชัดที่สุด บน Terminal Bench 2.1 คะแนนขยับจาก 61.8 ของรุ่น preview ไปที่ 82.7 ซึ่งอยู่เหนือ GLM 5.2 ที่ 81 และไล่จี้ Opus 4.8 ที่ 85 ทั้งที่เป็นโมเดลถูกกว่ามาก งานที่เคยทำได้แย่อย่าง DeepSWE ขยับจาก 7.3 เป็น 54.4 และ Cybergym จาก 38.7 เป็น 76.7 โดยรวมรุ่นใหม่นี้เอาชนะ V4 Pro preview ของตัวเองครบทั้ง 9 benchmark สาย agent และ coding ที่ประกาศ

อีกหมัดที่คนทำงานสาย dev จะชอบคือรองรับ Responses API format แบบ native และปรับมาให้เข้ากับ harness แบบ Codex ตรง ๆ แปลว่าเสียบเข้าเครื่องมือสาย Codex ได้โดยแทบไม่ต้องดัดแปลง

จุดที่ต้องรู้ก่อนใช้

  • อัปเดตเฉพาะ API

    รอบนี้อัปแค่ V4 Flash API เท่านั้น ส่วน V4 Pro API และตัวในแอปกับเว็บยังเป็นของเดิม ต้องเรียกผ่าน official API ถึงจะได้ตัวใหม่

  • คะแนนวัดในสนามของ DeepSeek เอง

    benchmark สาย agent รันบน harness ของ DeepSeek เองในโหมด minimal ผลในเครื่องมืออื่นอาจต่างออกไป

  • ยังไม่ใช่ตัวท็อป

    เก่งขึ้นจริงแต่ความเนี้ยบของภาพและ animation ยังกลาง ๆ งานระดับ frontier ยังเป็นของ Fable 5 และ Opus

  • open weights ใกล้มา

    เมื่อปล่อย weights จะเป็นคะแนน open-weight อันดับสองรองจาก Kimi K3 และประหยัด token กว่ารุ่นก่อนราว 12%

03เกี่ยวอะไรกับเรา

ถ้าทีมคุณใช้ agent ช่วยเขียนโค้ดและอยากคุมงบ นี่คือหนึ่งในตัวเลือกคุ้มที่สุดตอนนี้ — คะแนน agent อยู่ระดับ GLM 5.2 เสียบเข้าเครื่องมือสาย Codex ได้ทันที และราคาถูกกว่าโมเดล frontier หลายเท่า ฟันธง: **ลองได้เลย** สำหรับงาน agentic coding ที่เน้นความคุ้ม แต่ถ้างานต้องการคุณภาพสูงสุดหรือความเนี้ยบของ UI ให้ **รอ** V4 Pro ตัวเต็มที่กำลังจะตามมา

Human Gate ที่ต้องไม่ลืม: คะแนนที่สวยมาจากสนามทดสอบของผู้ผลิตเอง ก่อนย้ายงานจริงมาใช้ ให้เทสต์กับงานของคุณเองสักชุด แล้ววัด token กับคุณภาพเทียบของเดิมก่อนตัดสินใจ ต่อยอดได้โดยตั้งเป็นโมเดลสำรองใน workflow ให้สลับมาใช้ตอนงาน grunt work เพื่อประหยัดค่าโมเดลตัวแพง