บทความและข่าวสาร
AI อัปเดต
สรุปข่าว รีวิว และวิธีใช้ AI แบบเจาะลึก เลือกช่วงสัปดาห์ที่อยากอ่านได้เลย
Muse Glimmer 30B โมเดล agent โอเพนของ Meta ที่ออกแบบมาให้รันในเครื่องแบบเปิดทิ้งไว้ทั้งวัน
- License เปิดกว้าง
- โหลดง่ายผ่าน LM Studio
- ต่อกับ agent ในเครื่องได้เลย
- มีรุ่นน้องตามมา
Grok Imagine Image 2.0 ของ xAI ทำงานเป็น engine แก้ภาพ แก้เฉพาะจุด รวมสามภาพอ้างอิง และต่อเป็นวิดีโอได้
xAI ปล่อย Imagine Image 2.0 (7 ส.ค. 2026) ที่ไม่ใช่แค่ generator แต่เป็น engine แก้ภาพ แก้ทีละองค์ประกอบ เขียนตัวอักษรในภาพคมขึ้น และส่งต่อเป็นวิดีโอ 1080p
Claude เริ่มฝังลายน้ำล่องหนในทุกข้อความที่โมเดลใหม่สร้าง ตั้งแต่ 2 สิงหาคม 2026
โมเดล Claude ที่ออกตั้งแต่ 2 ส.ค. 2026 จะฝังลายน้ำเชิงสถิติที่มองไม่เห็นลงในข้อความที่สร้าง ปิดไม่ได้ และตรวจได้ด้วยเครื่องมือ นี่คือสิ่งที่คนทำงานควรรู้
Hermes Agent รวมทูลเบราว์เซอร์ 12 ตัวเหลือโหมดเดียว ลด token ที่ใช้ browsing ลง 48–66%
อัปเดตฟรีของ Hermes Agent เปลี่ยนวิธีให้ agent คุมเบราว์เซอร์ จากสั่งทีละคลิกเป็นเขียนสคริปต์ทั้งงานทีเดียว ประหยัด token ได้เกือบครึ่งโดยความแม่นไม่ตก
Moonshot เล็งชิป Blackwell เพิ่ม เพื่อเทรน Kimi K4 ที่จะใหญ่กว่า K3
K3 เพิ่งออกได้ราวสองสัปดาห์และกลายเป็นโมเดลโอเพนซอร์สใหญ่สุดในโลกที่ราว 2.8 ล้านล้านพารามิเตอร์ ตอนนี้มีรายงานว่า Moonshot คุยเรื่อง K4 ที่จะใหญ่ขึ้นอีก แต่ติดปมการเข้าถึงชิป Nvidia Blackwell ภายใต้กฎคุมส่งออกของสหรัฐฯ
DeepSeek มี coding agent สายตรงแล้ว — Reasonix รันในเทอร์มินัล เน้นกดค่า token
เอกสาร API ของ DeepSeek เพิ่มหน้า integration สำหรับ Reasonix ซึ่งเป็น coding agent ที่คุยกับ DeepSeek โดยตรง ออกแบบให้ prefix cache อุ่นตลอดเพื่อกดค่า token ติดตั้งใน 2 นาทีด้วย NPX และเป็นโอเพนซอร์ส MIT
ChatGPT ไฮไลต์แล้วถามได้ทันที ดึงข้อมูลข้ามแท็บได้เอง
OpenAI ปล่อยอัปเดตให้ ChatGPT ทำงานกับเบราว์เซอร์ลื่นขึ้น ไฮไลต์ข้อความแล้วคลิกขวาถามได้เลย และให้ side chat อ้างอิงแท็บที่เปิดอยู่หรือสรุปวิดีโอที่กำลังดูได้โดยไม่ต้องก็อปวาง
Turbo Fieldfare — รัน Gemma 4 ขนาด 26B บน Mac ด้วยแรมแค่ราว 2GB โดยสตรีม expert จาก SSD
โปรเจกต์โอเพนซอร์สเขียนด้วย Swift/Metal ที่อาศัยสถาปัตยกรรม MoE ของ Gemma 4 กับ unified memory ของ Apple Silicon เก็บแค่ส่วนที่ต้องใช้ไว้ในแรม แล้วสตรีม expert ที่เหลือจาก SSD ทันเวลา
DeepSeek V4 Flash ออก GA แล้ว — เปิด weights ใต้ลิขสิทธิ์ MIT ใช้เชิงพาณิชย์ได้ ราคาต่อทาสก์ยังถูกมาก
จากเวอร์ชัน preview ตอนนี้ DeepSeek V4 Flash ขึ้นสถานะ generally available เต็มตัว เปิด weights ใต้ MIT ให้ใช้เชิงพาณิชย์ได้ พร้อมสกอร์ทดสอบชุดสุดท้ายและวิธีรันให้คุ้มระดับหลักเซนต์ต่อทาสก์
Google AI Studio อัปเดต managed agents — ใส่ hooks กัน agent ทำพลาด เปิดใช้ฟรีทั้งบน free tier
อัปเดตฝั่ง Gemini API ของ AI Studio ทำให้ยิง API ครั้งเดียวแล้ว agent ทำงานยาวจบเองในแซนด์บ็อกซ์ พร้อม hooks ที่ให้สคริปต์เราเบรกทุก tool call ก่อน/หลัง และเปิดให้ลองบน free tier
MiniMax H3 — โมเดลวิดีโอสาย omni ที่สร้างคลิป 2K พร้อมเสียงในตัว และเตรียมปล่อย open weights
MiniMax ปล่อย H3 รับได้ทั้ง text/image/video/audio แล้วสร้างคลิป 2K ยาวราว 15 วินาทีที่มีเสียงสเตอริโอมาในตัว แถมประกาศว่าจะเปิด weights ให้ดาวน์โหลดในไม่กี่วัน
ให้ AI เขียนโค้ดไว แล้วให้ AI อีกตัวตรวจก่อน merge — workflow Claude Code + ตัวรีวิวอัตโนมัติ
เมื่อทั้งทีมใช้ Claude Code/Cursor เขียนโค้ดเร็วขึ้น คอขวดใหม่คือการรีวิว วิธีแก้คือเสียบตัวรีวิว AI (CodeRabbit) ไว้ที่ด่านตรวจ ทั้งบนเครื่องก่อน commit และบน pull request ก่อน merge
Perplexity เปิด Projects บน Computer — ทีมทั้งทีมใช้ไฟล์ ความจำ และงานร่วมกันในที่เดียว
Perplexity ยกเครื่อง Computer จากเครื่องมือเดี่ยวเป็นระบบปฏิบัติการ agent แบบหลายคน ที่ทีมแชร์ไฟล์ ความจำ และเซสชันงานร่วมกัน ต่อ connector อย่าง Slack และ Salesforce ได้ทั้งทีม
DeepSeek V4 Flash 0731 — โมเดลเดิม ขนาดเท่าเดิม แต่ทำงาน agent เก่งขึ้นเกือบเท่าตัว
DeepSeek เปิด API ตัวเต็มของ V4 Flash รุ่น 0731 สถาปัตยกรรมและขนาดเท่ารุ่น preview เป๊ะ แต่จูน agent ใหม่จนคะแนน benchmark พุ่งแซงรุ่น Pro preview ของตัวเอง ในราคาถูกเหมือนเดิม
4 ปลั๊กอินฟรีที่โฆษณาว่าลด token ของ Claude Code 80% — ลองวัดจริงแล้วได้เท่าไร
RTK, Caveman, Ponytail และ Omniroot คือชุดเครื่องมือฟรีที่โฆษณาว่าลด token ของ Claude Code ได้ 60-90% แต่ผลทดสอบอิสระบอกว่าตัวเลขจริงบนงาน agent จริงห่างจากที่โฆษณาพอสมควร
OpenAI เปิดศึกราคา — หั่นค่า API GPT-5.6 Luna 80% พร้อมโหมด Soul เร็วขึ้น 2.5 เท่า
OpenAI ลดราคา API รุ่น GPT-5.6 Luna ลง 80% และ Terra 20% พร้อมเปิดโหมด Soul Fast ที่เร็วขึ้นถึง 2.5 เท่า จังหวะเดียวกับที่มี checkpoint ปริศนาโผล่หลุดในสื่อโปรโมทของตัวเอง
Claude Obsidian 2.0 — ปลั๊กอินฟรีที่ทำให้ Claude Code จำงานคุณได้ถาวรในโฟลเดอร์ Markdown
ปลั๊กอินโอเพนซอร์สฟรีที่เปลี่ยน Obsidian ให้เป็นสมองที่สองของ Claude Code โยนไฟล์ลงโฟลเดอร์แล้ว AI อ่าน เชื่อมโยง และจัดเก็บเป็นกราฟความรู้ Markdown ที่คุณเป็นเจ้าของเอง ทุกข้อมูลอ้างอิงแหล่งที่มา
Grok เปิด Build mode — พิมพ์ประโยคเดียว ได้แอปพร้อมลิงก์แชร์
xAI เพิ่มโหมด Build ให้ Grok สร้างเว็บ แอป เกม และแดชบอร์ดจากคำสั่งภาษาคนแล้วกดเผยแพร่เป็นลิงก์ได้เลย ตอนนี้ยังจำกัดเฉพาะแพ็กบนสุด SuperGrok Heavy
jcode — coding agent สาย Rust ที่กินแรมหลัก MB ไม่ใช่หลักร้อย
coding agent ตัวใหม่เขียนด้วย Rust เปิดหลายเซสชันพร้อมกันได้แบบไม่หน่วงเครื่อง ต่อกับ Claude, Codex, Gemini และโมเดลในเครื่องได้หมด แถมโอเพนซอร์ส MIT
Mindwalk — ดูย้อนหลังว่า AI เดินแตะไฟล์ไหนในโค้ดเราบ้าง บนแผนที่ 3 มิติ
เครื่องมือโอเพนซอร์สที่เอา log เซสชันของ Claude Code และ Codex มาเล่นย้อนหลังเป็นเมือง 3 มิติ เห็นชัดว่าเอเจนต์อ่านไฟล์ไหน แก้ไฟล์ไหน และแตะถูกที่หรือเปล่า
Gemini 4 เริ่มเทรนจริงแล้ว — Google ยืนยัน "รันพรีเทรนใหญ่สุดเท่าที่เคยทำ" พร้อมเช็กพอยต์ลับโผล่ทดสอบใน Arena
Google ยืนยันต่อสาธารณะว่าเริ่มพรีเทรนรุ่น Gemini 4 แล้ว และมีเช็กพอยต์ใหม่โผล่ทดสอบแบบ A/B ใน Gemini app กับ Arena โดยโชว์งานภาพ 3D และหน้าเว็บได้ดีขึ้นชัด แต่ทั้งหมดยังเป็นของยังไม่เสร็จ
GPT-5.6 SOL ปะทะ Claude Opus 5 — สองเรือธงคนละสไตล์ ที่สกอร์การ์ดวัดกันคนละสนาม
SOL เก่งสายลุยงานยาวและคุมเครื่องมือ ส่วน Opus 5 เก่งสายวางแผนและตรวจงานตัวเอง แต่กราฟ benchmark ของสองค่ายวัดกันคนละวันคนละคู่แข่ง อ่านหาผู้ชนะตรง ๆ ไม่ได้
Qwen Image Flash — โมเดลสร้างภาพ 4 สเต็ปจาก Alibaba ที่ Nvidia จูนต่อให้ ใช้เชิงพาณิชย์ได้
Qwen Image Flash กลั่นโมเดลภาพตัวเต็มให้เหลือแค่ 4 สเต็ป โดย Nvidia ปล่อยเวอร์ชันจูนต่อบน Hugging Face จุดเด่นคือใส่ตัวหนังสือในภาพให้อ่านออกได้ดีที่สุดในกลุ่มโมเดลรันในเครื่อง และเปิดใช้เชิงพาณิชย์ได้
Hermes 0.19 "Quicksilver" — เริ่มงานไวขึ้น ~80% ต่อกับ Antigravity ให้ตัวหนึ่งคิด อีกตัวลงมือ
Hermes รุ่น 0.19 ลดเวลาเริ่มงานจากราว 4.5 วินาทีเหลือไม่ถึง 1 และเพิ่มระบบกันงานหาย ส่วน Antigravity ของ Google เปิด CLI ให้ Hermes สั่งงานตรงได้ กลายเป็นคู่หูตัวคิด-ตัวลงมือ
Microsoft Mage-Flow — โมเดลสร้าง/แก้ภาพโอเพนซอร์ส 4B รันในเครื่องฟรี สั่งงานผ่าน AI agent ได้
Microsoft ปล่อย Mage-Flow โมเดลสร้างและแก้ภาพโอเพนซอร์สขนาด 4B ใบอนุญาต MIT รันในเครื่องได้ฟรี สั่งงานผ่าน agent อย่าง Claude Desktop ได้ และเคลมว่าสู้โมเดลเปิดที่ใหญ่กว่าหลายเท่า
Gemini Spark เปิดให้แพ็ก AI Pro ในสหรัฐฯ — เอเจนต์ที่ลงมือทำงานในอีเมลและปฏิทินให้เอง
Google ขยาย Gemini Spark เอเจนต์ที่รับเป้าหมายแล้วไปลงมือทำงานจริงในแอป Workspace จากแพ็กแพงสุดลงมาที่แพ็ก AI Pro ราคาเดือนละ 19.99 ดอลลาร์ในสหรัฐฯ พร้อมทำงานพร้อมกันได้ถึง 15 งาน
LLaDA 2.2-flash — โมเดล diffusion โอเพนซอร์สที่แก้คำผิดของตัวเองได้ระหว่างเขียน
Inclusion AI จาก Ant Group เปิด LLaDA 2.2-flash โมเดลภาษาแบบ diffusion ที่เขียนข้อความทั้งก้อนพร้อมกันแล้วเกลาซ้ำ ๆ ลบและแทรกแก้ระหว่างทางได้ ออกแบบมาเพื่อเป็นเอเจนต์ที่ทำงานหลายขั้นโดยไม่พังกลางคัน โหลดน้ำหนักได้ฟรีบน Hugging Face
Impeccable — สกิลโอเพนซอร์สที่สอนให้ AI เลิกออกแบบหน้าเว็บหน้าตาเหมือนกันไปหมด
Impeccable เป็นสกิลออกแบบโอเพนซอร์ส Apache 2.0 ที่ติดตั้งเข้า AI coding agent แล้วเติมคลังคำศัพท์ด้านดีไซน์ พร้อมตัวตรวจ 41 กฎที่จับ "หน้าตา AI slop" ได้โดยไม่ต้องเรียกโมเดลและไม่เสียโทเคน
Anthropic ลบ system prompt ของ Claude Code ทิ้งกว่า 80% — กฎ context engineering ใหม่ของ Claude 5
ทีม Claude Code ออกกฎ context engineering ชุดใหม่สำหรับโมเดลรุ่น Claude 5 พร้อมเผยว่าตัด system prompt ทิ้งกว่า 80% แล้วผลเทสต์โค้ดไม่ตก แนวคิดคือเลิกยัดกฎ แล้วให้โมเดลใช้วิจารณญาณแทน
Microsoft เปิด Flint — ภาษากลางให้ AI เอเจนต์วาดกราฟให้ตรงและสวยด้วยสเปกไม่กี่บรรทัด
Microsoft Research เปิดโอเพนซอร์ส Flint ภาษากลางสำหรับสร้างกราฟ แยกงาน "ความหมาย" ที่ AI ถนัดออกจากงาน "เรขาคณิต" ที่ AI มักพลาด แล้วให้คอมไพเลอร์คำนวณแกน สเกล สีเอง ผลคือกราฟที่เอเจนต์สร้างแล้วไม่พังกลางทาง