แบรนด์
Claude
105 โพสต์
GLM 5.2 ผ่านเบนช์มาร์กอิสระ — โอเพนอันดับต้น หลอนต่ำสุด และรันที่บ้านได้แล้ว
หลังเปิดตัว GLM 5.2 มีข้อมูลจากหลายสำนักออกมา ทั้งขึ้นอันดับต้นของโอเพนบน AA Index, hallucination ต่ำสุดในกลุ่ม frontier, ติดอันดับ 3 บนเบนช์งานยาวที่เพิ่งสร้าง และชุมชนทำเวอร์ชันบีบอัดให้รันที่บ้านได้ใน 2 วัน
Claude Code 2.1.181 — ตั้งค่าในบรรทัดเดียวด้วย /config และแก้บั๊กไฟล์ว่างบนโฟลเดอร์ซิงก์
อัปเดตรายสัปดาห์ของ Claude Code มาพร้อม 39 การเปลี่ยนแปลง ไฮไลต์คือคำสั่ง /config ตั้งค่าในบรรทัดเดียว และการแก้บั๊กไฟล์ว่าง/ขาดบนโฟลเดอร์ OneDrive และ Google Drive
GLM 5.2 ขึ้นอันดับ 1 ดีไซน์เว็บบน Design Arena — โมเดลโอเพนตัวแรกที่แซงสาย Claude
หลังเปิดตัวด้วยตัวเลขผู้ผลิต รอบนี้ GLM 5.2 ขึ้นอันดับ 1 ดีไซน์เว็บ single-turn บน Design Arena แซงทั้งสาย Claude รวม Fable 5 ในราคาประมาณ 1/10 ของรุ่นพรีเมียม
Google DeepMind สะเทือน — สองหัวกะทิระดับโลกลาออกในสัปดาห์เดียว โมเดลร่วงอันดับ 5
คนเขียนเปเปอร์ Transformer และเจ้าของรางวัลโนเบล AlphaFold ลาออกจาก Google ในสัปดาห์เดียวกัน ขณะที่โมเดลที่ดีที่สุดของ Google ตกไปอันดับ 5 บนกระดานวัดความฉลาด
ponytail ภาคต่อ — เทสต์อิสระชี้ Opus 4.8 ประหยัด 53% เร็วขึ้น 71% แตะ 40,000 ดาวใน 7 วัน
หลังกระแสแรกของ ponytail รอบนี้มีคนรันเบนช์มาร์กอิสระ พบว่ายิ่งใช้โมเดลแพงอย่าง Opus 4.8 ยิ่งคุ้ม ประหยัด 53% เร็วขึ้น 71% และโค้ดน้อยลง 71%
Microsoft Copilot Co-work เปิดใช้ทั่วโลก — agent ทำงานยาวได้ แต่คิดเงินตามใช้จริง
Copilot Co-work เวอร์ชัน agent ที่รับงานยาว ๆ ไปทำเองในคลาวด์ เปิดใช้ทั่วไปแล้ว พร้อมเปลี่ยนมาคิดเงินตามการใช้งานจริง และมีข่าวว่า Microsoft กำลังส่อง DeepSeek เป็นตัวเลือกรุ่นประหยัด
Claude Design อัปเดต — จำแบรนด์ได้ แก้บนแคนวาส แล้วส่งตรงเข้า Claude Code
Anthropic อัปเดต Claude Design ให้จำสี ฟอนต์ โลโก้แบรนด์ได้อัตโนมัติ แก้งานบนแคนวาสได้ตรง ๆ และซิงค์กับ Claude Code เพื่อแปลงดีไซน์เป็นเว็บจริงโดยไม่ต้องเริ่มใหม่
สร้าง second brain ให้ Claude Code — 5 ระดับ เลือกให้พอดีกับงาน
คู่มือสร้างคลังความรู้ส่วนตัวให้ Claude Code จากไฟล์ markdown ธรรมดา ไล่ตั้งแต่ระดับ routing พื้นฐานไปจนถึง knowledge graph และระบบที่อัปเดตตัวเองตลอดเวลา พร้อมข้อห้ามเรื่องข้อมูลบริษัท
Claude Code 2.1.178 — ปิดช่องโหว่ sub-agent ขอสิทธิ์เกินตัว
เวอร์ชันใหม่ตรวจ sub-agent ก่อนปล่อยให้ทำงาน ปิดช่องที่ลูกทีมเคยขอสิ่งที่ตัวหลักถูกห้าม พร้อม wildcard สำหรับล็อก permission ระดับไฟล์
Anthropic ให้ Agent SDK กับ claude -p ใช้โควต้า subscription ต่อ ไม่คิดเงินเพิ่ม
Anthropic ยืนยันว่า Claude Agent SDK, claude -p และแอปของบุคคลที่สามที่สร้างบน Agent SDK จะดึงโควต้าจาก subscription ของผู้ใช้ต่อไป และไม่เดินหน้าแผนที่เคยพูดถึงว่าจะคิดเครดิตเพิ่ม $200 ตามราคา API สำหรับการใช้งานแบบนี้
agent ลงมือทำได้ แต่ทำนายผลไม่ได้ ทำไมต้องมี Human Gate
นักวิจัยกลุ่มหนึ่งเตือนว่า LLM สั่งงานเป็น agent ได้ แต่คาดเดาผลของการกระทำตัวเองไม่แม่น งานที่ย้อนคืนไม่ได้จึงต้องมีคนกั้นก่อนเสมอ
ponytail สกิลที่บังคับ Claude Code ให้เขียนโค้ดน้อยลง
ponytail เป็น open-source skill สำหรับ Claude Code ที่บังคับให้ตอบคำถามคัดกรอง 6 ข้อก่อนลงมือเขียนโค้ด เป้าหมายคือลด token และปริมาณโค้ดลง โดยตัวเลขทั้งหมดมาจาก repo เดียว ยังไม่มีใครยืนยันอิสระ
Gemini-SQL 2 ของ Google ขึ้นนำเบนช์มาร์ก BIRD ที่ 80% — ถามเป็นภาษาคน ได้ SQL ที่รันจริง
ระบบ text-to-SQL ตัวใหม่ของ Google ทำคะแนน 80.04% บนเบนช์มาร์ก BIRD ขึ้นอันดับหนึ่งของ single-model leaderboard แต่ยังไม่มี API หรือวันปล่อย
OpenRouter Fusion มีตัวเลขแล้ว — panel ราคาประหยัดเข้าใกล้ Fable 5 แต่ช้ากว่า
OpenRouter ปล่อยตัวเลขเบนช์มาร์ก Draco ของ Fusion ออกมา panel โมเดลถูก ๆ เข้าใกล้ Fable 5 ที่ราคาราวครึ่งเดียว แต่ต้องแลกกับความช้าและทดสอบแค่ด้านเดียว
หลังคำสั่งปิด Fable 5 - safeguard เปลี่ยนเป็น refuse แล้วสลับโมเดลให้เห็น ๆ
Anthropic ถอดกลไก "ตอบอ่อนลงเงียบ ๆ" ออกจาก Fable 5 แล้วเปลี่ยนเป็น refuse ตรง ๆ พร้อม fallback ไป Opus 4.8 ให้เห็นชัด บทเรียนคือถ้าผูกงานไว้กับโมเดลเดียว มันอาจปฏิเสธหรือสลับตัวกลางทางได้
รัฐบาลสหรัฐสั่งระงับ Claude Fable 5 และ Mythos 5 ทั้งหมด - บทเรียนเรื่องพึ่งโมเดลเดียว
Anthropic ถูกคำสั่ง export control ของรัฐบาลสหรัฐให้ปิดการเข้าถึง Fable 5 และ Mythos 5 สำหรับ foreign national ทุกคน จนต้องปิดให้ผู้ใช้ทั้งหมด เป็นครั้งแรกที่โมเดล frontier ถูกเรียกคืนด้วยเหตุผลความมั่นคง
GPT-5.6 กับ Fable 5 อาจเปิด price war - ผู้ใช้ได้ของถูกลง แต่ workflow ห้ามผูกกับของชั่วคราว
กระแส GPT-5.6 หลัง Fable 5 ทำให้การแข่งขัน frontier model เข้มขึ้น ทั้งความสามารถ coding/agentic/vision และข่าวเรื่องลดราคา token แต่ทีมต้องระวัง model ชั่วคราว ราคาโปร และ safeguard
ใช้ Claude Fable 5 ให้คุ้มต้องให้มันคิดงานยาก แล้วให้ worker ถูกทำงานซ้ำ
Fable 5 เหมาะกับ planning, review และงานยากที่ต้องเข้าใจ context ลึก ส่วนงานซ้ำควร delegate ให้โมเดลถูกกว่า พร้อม permission layer และ verification ที่ตรวจได้
Claude Fable 5 กับ Mythos 5 แรงขึ้นจริง แต่ไม่ควรใช้เป็น default ทุกงาน
Fable 5 และ Mythos 5 ถูกพูดถึงในฐานะรุ่นที่แรงมากสำหรับ coding, visual และ agentic work แต่ข้อจำกัดเรื่องราคา limit safeguard และ availability ทำให้ต้องใช้แบบมีแผน
Graphify + Obsidian ทำให้ Claude Code มี second brain แต่ต้องกักข้อมูลก่อนเทเข้าคลังหลัก
Graphify สร้าง knowledge graph จาก repo หรือ docs แล้ว export เป็น Obsidian vault ได้ เหมาะกับการให้ Claude Code เข้าใจ context ใหญ่ แต่ต้องมีขั้น quarantine ก่อนปนกับ vault หลัก