OpenAI เปิดศึกราคา — หั่นค่า API GPT-5.6 Luna 80% พร้อมโหมด Soul เร็วขึ้น 2.5 เท่า
สารบัญ
สรุปให้ไว
หั่นราคาแรง
GPT-5.6 Luna ลดค่า API ลง 80% และ Terra ลด 20% ทำให้ Luna ถูกกว่า Soul ราว 25 เท่า
Soul เร็วขึ้น
เปิดโหมด Soul Fast ประมวลผลเร็วขึ้นถึง 2.5 เท่า ที่ราคาราวสองเท่าของโหมดปกติ
สะเทือนถึง sub-agent
ราคาใหม่มีผลใน Codex และ ChatGPT ด้วย งาน multi-agent จะกินโควตาน้อยลงมาก
มีของหลุด
checkpoint ปริศนาชื่อ MU3 โผล่ในสื่อโปรโมทแล้วถูกลบ หลายคนโยงว่าเป็นสัญญาณ GPT-6
01เกิดอะไรขึ้น
OpenAI ประกาศปรับปรุงประสิทธิภาพโมเดลแล้วส่งผลเป็นการหั่นราคา API รอบใหญ่ GPT-5.6 Luna ลดลง 80% ส่วน Terra ลด 20% ผลคือ Luna เหลือค่า input ราว 0.20 ดอลลาร์ต่อ 1 ล้าน token และค่า output ลดลงฮวบ ทำให้มันถูกกว่า Soul ประมาณ 25 เท่า ทั้งที่ยังให้ความฉลาดในระดับที่แข่งได้ ส่วน Terra อยู่ที่ราว 2 ดอลลาร์ต่อ 1 ล้าน token ฝั่ง input
จุดที่คนทำระบบ agent จะสนใจคือราคาใหม่นี้สะท้อนเข้าไปใน Codex และ ChatGPT ด้วย เพราะโมเดลกลุ่มนี้มักถูกใช้เป็น sub-agent เมื่อค่าต่อ token ถูกลง ระบบหลายเอเจนต์จึงทำงานได้มากขึ้นก่อนชนลิมิต
02Soul Fast กับหมัดสองด้าน
ปกติเวลาผู้ให้บริการทำ inference ให้เร็วขึ้น มักแลกมาด้วยราคาที่แพงขึ้นมาก แต่รอบนี้ OpenAI บอกว่าโหมด Soul Fast เร็วขึ้นได้ถึง 2.5 เท่าจากการประมวลผลปกติ ที่ราคาประมาณสองเท่า เท่ากับตีตลาดสองด้านพร้อมกัน — ด้านล่างด้วย Luna กับ Terra ที่ถูกและฉลาดพอใช้ และด้านบนด้วย Soul ที่เร็วขึ้น
มีรายงานว่า Luna Max เอาชนะ Opus 5 low, Sonnet 5 High และ Gemini 3.6 Flash ในหลายงาน ทั้งที่ราคาถูกกว่ามาก ภาพรวมคือสงครามราคาโมเดลเข้าสู่เฟสใหม่ โดย OpenAI ไล่บี้จุดแข็งเดิมของฝั่งจีนคือ "ความฉลาดราคาถูก" โดยตรง
อ่านเกมให้ขาด
- ★
Luna
ตัวถูกสุด เหมาะกับงาน sub-agent ปริมาณมากที่ไม่ต้องใช้ปัญญาระดับสูงสุด
- ★
Terra
กลาง ๆ ลดราคาน้อยกว่าแต่ก็ยังถูกลง
- ★
Soul Fast
เน้นความเร็ว เหมาะงานที่ผู้ใช้รอผลแบบเรียลไทม์ ยอมจ่ายเพิ่มเพื่อ latency ต่ำ
- ★
MU3 ที่หลุด
checkpoint ปริศนาโผล่สั้น ๆ ในสื่อโปรโมทส่วนขยาย Chrome แล้วถูกลบและอัปใหม่โดยตัดออก ยังไม่ยืนยันว่าใช่ GPT-6 แต่จังหวะตรงกับข่าวลือเปิดตัวเดือนสิงหาคม
03เกี่ยวอะไรกับเรา
สำหรับคนไทยที่รันสแตก agent เอง นี่คือข่าวดีเรื่องต้นทุน — โมเดลที่ใช้เป็น sub-agent ถูกลงหมายความว่าระบบหลายเอเจนต์ของคุณทำงานได้นานขึ้นก่อนหมดโควตา ฟันธง: **ลอง** ย้ายงาน grunt work ปริมาณมากไปที่ Luna หรือ Terra และเก็บ Soul Fast ไว้เฉพาะงานที่ต้องการความเร็ว
จุดที่ต้องระวัง: ราคาถูกลงไม่ได้แปลว่าคุณภาพเท่าเดิมกับงานของคุณเสมอ ให้เทสต์คุณภาพงานจริงก่อนสลับโมเดลถาวร และเรื่อง checkpoint ที่หลุดยังเป็นแค่ข่าวลือ อย่าเพิ่งวางแผนงานโดยอิงว่า GPT-6 จะมาชัวร์ ต่อยอดได้โดยตั้ง routing ให้เลือกโมเดลตามความยากของงาน เพื่อรีดต้นทุนต่อ token ให้ต่ำที่สุด