LLaDA 2.2-flash — โมเดล diffusion โอเพนซอร์สที่แก้คำผิดของตัวเองได้ระหว่างเขียน
สารบัญ
สรุปให้ไว
เขียนไม่เหมือนใคร
แทนที่จะไล่ทีละคำซ้ายไปขวา มันร่างข้อความทั้งก้อนแล้วเกลาให้คมขึ้นเรื่อย ๆ แบบภาพค่อย ๆ ชัด
แก้ตัวเองระหว่างทาง
มีท่า delete และ insert ในตัว ลบส่วนที่ผิดแล้วแทรกของใหม่กลางประโยคได้ ไม่ต้องเขียนใหม่ทั้งอัน
เร็วจริง
บนเทสต์เรียกใช้เครื่องมือ ทำได้ราว 703 โทเคนต่อวินาที ใกล้เคียงเร็วเป็นสองเท่าของโมเดลระดับเดียวกัน
ฟรี โอเพนซอร์ส Apache 2.0
โหลดน้ำหนักได้บน Hugging Face และ GitHub รองรับ context ยาว 128,000 โทเคน
01มันคืออะไร
โมเดลภาษาที่เราคุ้นส่วนใหญ่เขียนทีละคำจากซ้ายไปขวา เดาคำถัดไปแล้วต่อไปเรื่อย ๆ ได้ผลดีแต่ก็เหมือนพิมพ์ด้วยนิ้วเดียว LLaDA 2.2-flash ทำคนละแบบ มันเป็นโมเดลชนิด diffusion ที่ร่างข้อความทั้งก้อนออกมาก่อนแล้วค่อย ๆ เกลาให้คมขึ้นซ้ำแล้วซ้ำอีก นึกภาพรูปที่เปิดขึ้นมาเบลอ ๆ ก่อนแล้วค่อยชัดขึ้นทีละรอบ วิธีนี้เองที่ทำให้มันเร็ว
02เด่นตรงไหน
ท่าไม้ตายชื่อ Levenshtein editing ฟังดูยากแต่ไอเดียง่าย โมเดลมีคำสั่งพิเศษสองอันคือ delete กับ insert ระหว่างเขียนมันเลยย้อนกลับไปลบส่วนที่ผิดทิ้งแล้วเสียบของที่ถูกลงตรงกลางงานได้เลย โมเดลทั่วไปพอเขียนอะไรไปแล้วมักติดอยู่กับสิ่งนั้น แต่ตัวนี้แก้ตัวเองได้ระหว่างทาง เรื่องนี้สำคัญมากเวลาโมเดลทำงานแบบเอเจนต์ที่ต้องเดินหลายขั้น เพราะถ้าพลาดตรงขั้นสี่ โมเดลปกติจะลากความผิดนั้นไปจนจบ แต่ตัวนี้จับแล้วซ่อมได้เลย ลดโอกาสที่งานทั้งสายจะพังกลางคัน
LLaDA 2.2-flash แบบย่อ
- ★
วิธีเขียน
diffusion ร่างทั้งก้อนแล้วเกลา ไม่ใช่ไล่ทีละคำ
- ★
แก้ตัวเอง
มี delete/insert แก้กลางประโยคได้ระหว่างทำงาน
- ★
หน่วยความจำบริบท
รองรับยาวถึง 128,000 โทเคน ราวหนังสือเล่มเล็ก
- ★
สถาปัตยกรรม
mixture of experts ปลุกเฉพาะส่วนที่ต้องใช้ (block routing) ให้เร็วแม้ข้อความยาว
- ★
คะแนนทดสอบ
งานแก้บั๊กราว 49/100 และเรียกใช้เครื่องมือ (BFCL) ราว 61 พร้อมความเร็วราว 703 โทเคน/วินาที
- ★
สัญญาอนุญาต
Apache 2.0 โหลดน้ำหนักได้ฟรีบน Hugging Face และ GitHub
03เกี่ยวอะไรกับเรา
ถ้าคุณแค่อยากคุยกับ AI ถามตอบไม่กี่คำ ตัวนี้ไม่ใช่สิ่งที่ต้องรีบไปหา โมเดลยอดนิยมทั่วไปพอแล้ว แต่ถ้ากำลังสร้างเอเจนต์ที่ต้องทำงานจริงเป็นขั้น ใช้เครื่องมือ และวิ่งเองหลายรอบ ตัวนี้น่าจับตา จุดที่ทำให้ต่างคือความเร็วบวกความสามารถแก้ตัวเอง เพราะเอเจนต์ที่ต้องเดินร้อยขั้นรวด โมเดลที่เร็วเป็นเท่าตัวไม่ได้แค่ "รู้สึกลื่น" แต่มันเปลี่ยนว่างานแบบไหนถึงคุ้มจะสร้าง
โปรเจกต์ open-source
อยากลองเองไหม? โปรเจกต์นี้เป็น open-source โหลด repo ทางการมาลองได้เลย
ดูบน Hugging Face → →