หมวดหมู่
Open Source
80 บทความ
Hermes Agent รวมทูลเบราว์เซอร์ 12 ตัวเหลือโหมดเดียว ลด token ที่ใช้ browsing ลง 48–66%
อัปเดตฟรีของ Hermes Agent เปลี่ยนวิธีให้ agent คุมเบราว์เซอร์ จากสั่งทีละคลิกเป็นเขียนสคริปต์ทั้งงานทีเดียว ประหยัด token ได้เกือบครึ่งโดยความแม่นไม่ตก
Muse Glimmer 30B โมเดล agent โอเพนของ Meta ที่ออกแบบมาให้รันในเครื่องแบบเปิดทิ้งไว้ทั้งวัน
Meta ปล่อยโมเดลเปิดน้ำหนัก 30B ที่เน้นงาน agent บนเครื่องตัวเอง เรียกทูลแม่น กู้สถานการณ์เมื่อพลาดได้ และรันได้บนเครื่องระดับแรม/การ์ด 24GB
Magnitude เอเจนต์โอเพนซอร์สที่รันทั้งโมเดลและ engine บนเครื่องคุณ ติดตั้งคำสั่งเดียวจบ
Magnitude เป็น AI agent โอเพนซอร์สที่รวมทั้งเอเจนต์ โมเดล และ inference engine ไว้ในตัวเดียว รันบนเครื่องคุณ 100% ไม่ต้องมี API key ไม่มีค่า token ติดตั้งด้วยคำสั่งเดียว
Liquid AI ปล่อย LFM2.5-2.6B โมเดลจิ๋วที่ฝึกมาให้ทำงานเป็น agent บนเครื่องตัวเอง
LFM2.5-2.6B เป็นโมเดลเปิดน้ำหนักขนาด 2.6B ที่ออกแบบมาให้รันบนเครื่องส่วนตัวและทำงานแบบ agent เรียกเครื่องมือได้ กินแรมไม่ถึง 2.5GB แต่เร็วระดับ 220 token ต่อวินาทีบนแล็ปท็อป
Orca ห้องนักบินโอเพนซอร์สสำหรับสั่งเอเจนต์ CLI หลายตัวพร้อมกัน แยก git worktree ไม่ชนกัน
Orca จาก Stably AI เป็น ADE โอเพนซอร์สที่รวมเอเจนต์ CLI กว่า 30 ตัวไว้ในแอปเดียว รันหลายตัวขนานกันบน git worktree แยกกัน ใช้ซับสคริปชันที่คุณมีอยู่แล้ว ฟรี MIT
Claude Obsidian 2.0 ให้ Claude Code มีหน่วยความจำจริง อ่าน เชื่อม และอ้างอิงโน้ตใน vault ให้เอง
ปลั๊กอินโอเพนซอร์สฟรีสำหรับ Claude Code อัปเดตเวอร์ชัน 2 ให้ Claude มีความจำถาวร วางไฟล์ลงโฟลเดอร์แล้ว AI อ่าน เชื่อมโยง และจำ กลายเป็น knowledge graph ของโน้ต Markdown ที่เราถือเอง โดยทุกคำตอบชี้กลับไปแหล่งจริง
Prime Agent จาก Prime Intellect เอเจนต์โอเพนซอร์สที่จำบทเรียนได้ ยิ่งใช้ยิ่งเก่งเอง
Prime Intellect ปล่อย Prime Agent เอเจนต์ในเทอร์มินัลที่เก็บบทเรียนทุกครั้งเป็นสกิลถาวร และใช้ context แบบตัวแปรแทนการยัดทุกอย่างเข้าหน่วยความจำ อ้างคะแนนทะลุมนุษย์บนหนึ่งในเทสต์ที่ยากที่สุด แต่ยังเป็นตัวเลขที่รายงานเอง
Hermes Agent อ่านหนังสือทั้งเล่มแล้วแปลงเป็น Skill ใช้ซ้ำได้ ประหยัด token หลายสิบเท่า
Hermes Agent เพิ่มคำสั่ง /arn ชี้ไปที่ไฟล์ PDF หรือ EPUB แล้วย่อยหนังสือทั้งเล่มเป็น skill ที่เรียกใช้ซ้ำได้ เปิดเฉพาะบทที่เกี่ยวเวลาถาม ใช้ token น้อยลงหลายสิบเท่า
สกิล I have ADHD สำหรับ Claude Code บังคับให้ AI ตอบสั้น ลงมือก่อน ตัดคำเกริ่นทิ้งทั้งหมด
ปลั๊กอินโอเพนซอร์ส I have ADHD สำหรับ Claude Code รีฟอร์แมตคำตอบให้ขึ้นต้นด้วยแอ็กชัน เป็นข้อ ตัดคำเกริ่นและคำปิดท้ายทิ้ง ติดตั้งสองนาที ใช้ได้กับ Codex และ DeepSeek ด้วย
Hermes Agent 0.20 Herald มาแล้ว คุยด้วยเสียงแบบขัดจังหวะได้ พร้อมโหมดอ้างอิงแหล่งที่ตรวจสอบได้
Nous Research ปล่อย Hermes Agent 0.20 ชื่อ Herald เพิ่มโหมดเสียงสตรีมที่พูดแทรกได้ โหมด grounded citations ที่ทุกคำอ้างมีแหล่งตรวจได้ ขยายลิมิตทูลจาก 90 เป็น 500 สเต็ป และเปิด plugin SDK
Qwen 3.8 Max — เรือธงใหม่ Alibaba 2.4 ล้านล้านพารามิเตอร์ ชูงานยาวหลายวัน เตรียมเปิด weights
Alibaba เปิดตัว Qwen 3.8 Max โมเดล MoE ที่เคลมว่าแรงสุดในไลน์ พารามิเตอร์รวม 2.4 ล้านล้าน เน้นงาน agent ที่รันต่อเนื่องหลายวัน และเตรียมปล่อย open weights รวมถึงรุ่นเล็ก 27B
Kimi K3 เรือธงใหม่จาก Moonshot — เปิด weights จริง แต่ไฟล์เกิน 1TB รันเองแทบไม่ไหว
Moonshot AI ปล่อย Kimi K3 โมเดล MoE ระดับ 2.8 ล้านล้านพารามิเตอร์ คอนเทกซ์ 1 ล้าน token และเปิด weights ให้โหลดฟรี แต่ตัวไฟล์ใหญ่เกิน 1TB ต้องใช้การ์ดระดับดาต้าเซ็นเตอร์ ทางเลือกจริงของคนทั่วไปคือใช้ผ่านเว็บ
Microsoft Fara 1.5 — โมเดลคุมเบราว์เซอร์ที่ "มองจอแล้วคลิก" รันในเครื่องได้ เปิด weights ใต้ MIT
Microsoft ปล่อยตระกูลโมเดล computer-use ที่ไม่ตอบแชต แต่มองภาพหน้าจอแล้วขยับเมาส์คลิกเอง ตัวเล็กสุดรันในเครื่องได้ พร้อมด่านความปลอดภัยที่หยุดถามก่อนทำสิ่งที่ย้อนคืนไม่ได้
Inkling Small — โมเดลเล็กลง 4 เท่า แต่คะแนนเกือบไม่ตก เปิด weights ใต้ Apache 2.0
Thinking Machines ย่อโมเดลเรือธง Inkling ลงเหลือขนาดราวหนึ่งในสี่ ภายในสองสัปดาห์ แต่คะแนน reasoning และ coding แทบไม่หาย แถมปล่อย weights ให้โหลดไปรันเองได้ฟรี
DeepSeek มี coding agent สายตรงแล้ว — Reasonix รันในเทอร์มินัล เน้นกดค่า token
เอกสาร API ของ DeepSeek เพิ่มหน้า integration สำหรับ Reasonix ซึ่งเป็น coding agent ที่คุยกับ DeepSeek โดยตรง ออกแบบให้ prefix cache อุ่นตลอดเพื่อกดค่า token ติดตั้งใน 2 นาทีด้วย NPX และเป็นโอเพนซอร์ส MIT
Turbo Fieldfare — รัน Gemma 4 ขนาด 26B บน Mac ด้วยแรมแค่ราว 2GB โดยสตรีม expert จาก SSD
โปรเจกต์โอเพนซอร์สเขียนด้วย Swift/Metal ที่อาศัยสถาปัตยกรรม MoE ของ Gemma 4 กับ unified memory ของ Apple Silicon เก็บแค่ส่วนที่ต้องใช้ไว้ในแรม แล้วสตรีม expert ที่เหลือจาก SSD ทันเวลา
4 ปลั๊กอินฟรีที่โฆษณาว่าลด token ของ Claude Code 80% — ลองวัดจริงแล้วได้เท่าไร
RTK, Caveman, Ponytail และ Omniroot คือชุดเครื่องมือฟรีที่โฆษณาว่าลด token ของ Claude Code ได้ 60-90% แต่ผลทดสอบอิสระบอกว่าตัวเลขจริงบนงาน agent จริงห่างจากที่โฆษณาพอสมควร
Claude Obsidian 2.0 — ปลั๊กอินฟรีที่ทำให้ Claude Code จำงานคุณได้ถาวรในโฟลเดอร์ Markdown
ปลั๊กอินโอเพนซอร์สฟรีที่เปลี่ยน Obsidian ให้เป็นสมองที่สองของ Claude Code โยนไฟล์ลงโฟลเดอร์แล้ว AI อ่าน เชื่อมโยง และจัดเก็บเป็นกราฟความรู้ Markdown ที่คุณเป็นเจ้าของเอง ทุกข้อมูลอ้างอิงแหล่งที่มา
Mindwalk — ดูย้อนหลังว่า AI เดินแตะไฟล์ไหนในโค้ดเราบ้าง บนแผนที่ 3 มิติ
เครื่องมือโอเพนซอร์สที่เอา log เซสชันของ Claude Code และ Codex มาเล่นย้อนหลังเป็นเมือง 3 มิติ เห็นชัดว่าเอเจนต์อ่านไฟล์ไหน แก้ไฟล์ไหน และแตะถูกที่หรือเปล่า
jcode — coding agent สาย Rust ที่กินแรมหลัก MB ไม่ใช่หลักร้อย
coding agent ตัวใหม่เขียนด้วย Rust เปิดหลายเซสชันพร้อมกันได้แบบไม่หน่วงเครื่อง ต่อกับ Claude, Codex, Gemini และโมเดลในเครื่องได้หมด แถมโอเพนซอร์ส MIT