Call Me Thanut
newspaperข่าวสาร

OpenAI เปิดศึกราคา — หั่นค่า API GPT-5.6 Luna 80% พร้อมโหมด Soul เร็วขึ้น 2.5 เท่า

31 ก.ค. 2026อ่าน 5 นาที
OpenAI เปิดศึกราคา — หั่นค่า API GPT-5.6 Luna 80% พร้อมโหมด Soul เร็วขึ้น 2.5 เท่า
สารบัญ

สรุปให้ไว

หั่นราคาแรง

GPT-5.6 Luna ลดค่า API ลง 80% และ Terra ลด 20% ทำให้ Luna ถูกกว่า Soul ราว 25 เท่า

Soul เร็วขึ้น

เปิดโหมด Soul Fast ประมวลผลเร็วขึ้นถึง 2.5 เท่า ที่ราคาราวสองเท่าของโหมดปกติ

สะเทือนถึง sub-agent

ราคาใหม่มีผลใน Codex และ ChatGPT ด้วย งาน multi-agent จะกินโควตาน้อยลงมาก

มีของหลุด

checkpoint ปริศนาชื่อ MU3 โผล่ในสื่อโปรโมทแล้วถูกลบ หลายคนโยงว่าเป็นสัญญาณ GPT-6

01เกิดอะไรขึ้น

OpenAI ประกาศปรับปรุงประสิทธิภาพโมเดลแล้วส่งผลเป็นการหั่นราคา API รอบใหญ่ GPT-5.6 Luna ลดลง 80% ส่วน Terra ลด 20% ผลคือ Luna เหลือค่า input ราว 0.20 ดอลลาร์ต่อ 1 ล้าน token และค่า output ลดลงฮวบ ทำให้มันถูกกว่า Soul ประมาณ 25 เท่า ทั้งที่ยังให้ความฉลาดในระดับที่แข่งได้ ส่วน Terra อยู่ที่ราว 2 ดอลลาร์ต่อ 1 ล้าน token ฝั่ง input

จุดที่คนทำระบบ agent จะสนใจคือราคาใหม่นี้สะท้อนเข้าไปใน Codex และ ChatGPT ด้วย เพราะโมเดลกลุ่มนี้มักถูกใช้เป็น sub-agent เมื่อค่าต่อ token ถูกลง ระบบหลายเอเจนต์จึงทำงานได้มากขึ้นก่อนชนลิมิต

02Soul Fast กับหมัดสองด้าน

ปกติเวลาผู้ให้บริการทำ inference ให้เร็วขึ้น มักแลกมาด้วยราคาที่แพงขึ้นมาก แต่รอบนี้ OpenAI บอกว่าโหมด Soul Fast เร็วขึ้นได้ถึง 2.5 เท่าจากการประมวลผลปกติ ที่ราคาประมาณสองเท่า เท่ากับตีตลาดสองด้านพร้อมกัน — ด้านล่างด้วย Luna กับ Terra ที่ถูกและฉลาดพอใช้ และด้านบนด้วย Soul ที่เร็วขึ้น

มีรายงานว่า Luna Max เอาชนะ Opus 5 low, Sonnet 5 High และ Gemini 3.6 Flash ในหลายงาน ทั้งที่ราคาถูกกว่ามาก ภาพรวมคือสงครามราคาโมเดลเข้าสู่เฟสใหม่ โดย OpenAI ไล่บี้จุดแข็งเดิมของฝั่งจีนคือ "ความฉลาดราคาถูก" โดยตรง

อ่านเกมให้ขาด

  • Luna

    ตัวถูกสุด เหมาะกับงาน sub-agent ปริมาณมากที่ไม่ต้องใช้ปัญญาระดับสูงสุด

  • Terra

    กลาง ๆ ลดราคาน้อยกว่าแต่ก็ยังถูกลง

  • Soul Fast

    เน้นความเร็ว เหมาะงานที่ผู้ใช้รอผลแบบเรียลไทม์ ยอมจ่ายเพิ่มเพื่อ latency ต่ำ

  • MU3 ที่หลุด

    checkpoint ปริศนาโผล่สั้น ๆ ในสื่อโปรโมทส่วนขยาย Chrome แล้วถูกลบและอัปใหม่โดยตัดออก ยังไม่ยืนยันว่าใช่ GPT-6 แต่จังหวะตรงกับข่าวลือเปิดตัวเดือนสิงหาคม

03เกี่ยวอะไรกับเรา

สำหรับคนไทยที่รันสแตก agent เอง นี่คือข่าวดีเรื่องต้นทุน — โมเดลที่ใช้เป็น sub-agent ถูกลงหมายความว่าระบบหลายเอเจนต์ของคุณทำงานได้นานขึ้นก่อนหมดโควตา ฟันธง: **ลอง** ย้ายงาน grunt work ปริมาณมากไปที่ Luna หรือ Terra และเก็บ Soul Fast ไว้เฉพาะงานที่ต้องการความเร็ว

จุดที่ต้องระวัง: ราคาถูกลงไม่ได้แปลว่าคุณภาพเท่าเดิมกับงานของคุณเสมอ ให้เทสต์คุณภาพงานจริงก่อนสลับโมเดลถาวร และเรื่อง checkpoint ที่หลุดยังเป็นแค่ข่าวลือ อย่าเพิ่งวางแผนงานโดยอิงว่า GPT-6 จะมาชัวร์ ต่อยอดได้โดยตั้ง routing ให้เลือกโมเดลตามความยากของงาน เพื่อรีดต้นทุนต่อ token ให้ต่ำที่สุด