หมวดหมู่
ข่าวสาร
97 บทความ
Continual Harness ทำให้ agent ปรับตัวเองระหว่างงาน — น่าสนใจมาก แต่ต้องมีเบรก
Continual Harness แสดงแนวทาง agent ที่เรียนรู้จากความผิดพลาด แก้ prompt สร้าง sub-agent และเก็บ memory ระหว่างทำงานต่อเนื่อง ประโยชน์ชัด แต่ถ้าใช้กับโลกจริงต้องมี log, rollback และ approval
Claude Code แบบฟรีผ่านเครดิตและ third-party — น่าดู แต่ต้องคิดต้นทุนระยะยาว
กระแส Claude Code ผ่านเครดิตหรือ third-party ทำให้หลายคนรู้สึกว่าใช้งานได้ถูกลง แต่ทีมที่ใช้จริงต้องคิดเรื่อง quota, policy และความต่อเนื่องของ provider
Codex บนมือถือเริ่มมีประโยชน์จริง — แต่ข่าว limit ลดเตือนว่าอย่าวาง workflow บนโปร launch
Codex เริ่มขยับจากเครื่องมือบนโต๊ะไปสู่การสั่งงานจากมือถือ แต่รายงานเรื่อง usage limit ลดลงทำให้ต้องคิดเรื่องต้นทุนและ quota ตั้งแต่แรก
Phantom Pulse ใช้ knowledge vault เป็นทางเข้า — AI workflow ต้องระวัง plugin มากขึ้น
เคส Phantom Pulse เตือนว่า note vault และ community plugin ไม่ใช่พื้นที่ปลอดภัยโดยอัตโนมัติ ยิ่งทีมใช้ vault เป็นสมองของ AI agent ยิ่งต้องมี policy ก่อน sync
Atlas ยกของหนักด้วย whole-body control — ข่าว humanoid ที่ควรดูเรื่อง deployment มากกว่าโชว์ท่า
Atlas รุ่นใหม่ถูกพูดถึงจากงานยกตู้เย็นหนักและรับมือ weight shift จุดที่น่าสนใจไม่ใช่ท่าทางแปลกตา แต่คือ sim-to-real, proprioception และชิ้นส่วนที่ซ่อมเปลี่ยนได้
OpenAI model แก้โจทย์คณิตเปิดค้าง 80 ปี — ถ้าตรวจสอบได้จริง นี่คือก้าวใหญ่ของ AI research
มีรายงานว่า internal OpenAI model สร้าง proof ใหม่สำหรับ unit distance problem ที่ค้างมาตั้งแต่ปี 1946 ประเด็นสำคัญไม่ใช่ AI แทนนักคณิตศาสตร์ แต่คือ AI อาจช่วยเปิดทางวิจัยที่ตรวจสอบได้
Anthropic จำกัด third-party Claude tools — บทเรียนคืออย่าผูก production workflow กับทางลัดที่ vendor ปิดได้
กระแสเรื่อง Anthropic จำกัดเครื่องมือ third-party รอบ Claude สะท้อนความเสี่ยงของ workflow ที่พึ่งเส้นทางไม่เป็นทางการมากเกินไป ทีมที่ใช้ agent หนักควรมี fallback และคุมต้นทุนให้ชัด
Karpathy เข้าร่วม Anthropic — สัญญาณว่า Claude Code อาจแข่งกันที่ context และวิธีทำงาน ไม่ใช่แค่โมเดล
Andrej Karpathy ย้ายเข้า Anthropic ไม่ใช่แค่ข่าวคนดังในวงการ AI แต่สะท้อนทิศทางว่า AI coding กำลังให้ความสำคัญกับ context, education และ wrapper รอบโมเดลมากขึ้น
LLMorphism คืออะไร — เมื่อเราเริ่มอธิบายสมองตัวเองเหมือน AI มากเกินไป
งานวิจัยแนว LLMorphism เตือนว่าเราอาจเริ่มมองความคิดมนุษย์เหมือน large language model มากเกินไป จากเดิมที่กลัวใส่ความเป็นมนุษย์ให้ AI ตอนนี้อาจกำลังลดความเป็นมนุษย์ของตัวเอง
ChatGPT Finance ต่อบัญชีเงินจริงได้แล้ว — ใช้ช่วยวิเคราะห์เงินได้ แต่ต้องระวังข้อมูลส่วนตัวมากขึ้น
OpenAI เริ่ม rollout ฟีเจอร์การเงินใน ChatGPT ให้ผู้ใช้บางกลุ่มต่อ bank, credit card, investment และ loan ผ่าน Plaid ได้ ประโยชน์ชัด แต่ความเสี่ยงข้อมูลก็ชัดกว่าเดิม
Anthropic เจอบทเรียนใหม่เรื่อง AI safety — ข้อมูลเล็กแต่ถูกทาง อาจลดพฤติกรรมเสี่ยงของ Claude ได้ดีกว่า
Anthropic ทดสอบพฤติกรรม self-preservation ของ Claude ใน sandbox แล้วพบว่าวิธีเทรนตรง ๆ ไม่พอ สิ่งที่น่าสนใจกว่าคือข้อมูลเล็กที่สอน reasoning แบบทั่วไปอาจช่วยให้โมเดลรับมือสถานการณ์เสี่ยงได้ดีขึ้น
Gemini 3.5 Flash และ Gemma 4 เริ่มโผล่ก่อน Google I/O — สัญญาณว่า Google กำลังเร่งทั้ง cloud และ local AI
ก่อนงาน Google I/O มีสัญญาณของ Gemini 3.5 Flash และ Gemma 4 หลายจุด ทั้งในแอป, Antigravity และ local model workflow ประเด็นหลักคือ Google กำลังรวมโมเดลเร็ว, agent platform และ on-device AI เข้าหากัน
Claude Max ให้เครดิตใช้งาน agent เพิ่ม $200 — แต่บาง workflow อาจแพงขึ้นกว่าเดิม
Anthropic เตรียมให้เครดิต programmatic usage กับ paid Claude plans แต่ประเด็นคือ third-party agent บางแบบอาจถูกคิดแบบ API rate แทน quota subscription เดิม คนใช้ Claude หนักต้องเช็กต้นทุนใหม่
Unitree GD01 หุ่นยนต์ mecha มีคนขับซื้อได้จริง — ภาพใหญ่ของ embodied AI เริ่มชัดขึ้น
Unitree เปิดตัว GD01 หุ่นยนต์ mecha สูง 2.7 เมตรพร้อม cockpit ให้คนนั่ง ราคาหลักหลายแสนดอลลาร์ เรื่องนี้ยังไม่ใช่ของใช้ทั่วไป แต่สะท้อนว่า embodied AI กำลังออกจากแล็บเร็วขึ้น
npm worm กลับมาแรง — กระทบ TanStack, Mistral และ Guardrails AI พร้อมกลไกลบเครื่อง
supply-chain attack รอบนี้ไม่ได้กระทบแค่แพ็กเกจเว็บทั่วไป แต่แตะ ecosystem ที่คนทำ AI และ dev ใช้จริง จุดเสี่ยงคือ agent ที่รัน install ให้เราโดยไม่มี policy ตรวจ dependency
Figure AI เดโมฟลีตหุ่นยนต์ฮิวแมนนอยด์ทำงานคลังสินค้าเต็มกะ 8 ชั่วโมง
Figure AI โชว์ฟลีตหุ่นยนต์ฮิวแมนนอยด์ทำงานคลังสินค้าต่อเนื่องเต็มกะ 8 ชั่วโมง ขับด้วยนิวรัลเน็ต Helix O2 ประมวลผล on-board ประสานงานกันเอง สลับแบตเตอรี่เอง และวินิจฉัยตัวเองได้ — บทความสรุปแบบ balanced ว่าทำอะไรได้จริง และทำไมยังต้องอ่านในฐานะเดโมของบริษัทเดียว
"ศึก Claude Code vs Codex ร้อนขึ้น เพิ่มลิมิตรายสัปดาห์ 50% แต่ค่า agent ภายนอกแยกบิลใหม่"
"Claude Code ประกาศเพิ่มลิมิตรายสัปดาห์ 50% หลัง OpenAI เปิดเกมแข่ง แต่อีกด้านคือดราม่าย้าย SDK, GitHub Actions และ agent ภายนอกไปคิดเงินแยกแบบเครดิต API ที่ผู้ใช้บอกเหมือนโดนลดโควตา 10-40 เท่า มาดูสองด้านว่ากระทบงานเราตรงไหน"
MAMMAL — โมเดล foundation ด้านชีววิทยาที่รวมเคมี พันธุกรรม และโปรตีนไว้ในตัวเดียว
MAMMAL เป็น foundation model หลายโหมดด้านชีววิทยาที่รวมเคมี พันธุกรรม และโครงสร้างโปรตีนไว้ในโมเดลเดียว เทรนด้วยข้อมูลราว 2 พันล้านตัวอย่าง ทำ state-of-the-art บน 11 benchmark ด้านค้นพบยา ทำนายยามะเร็งได้ตรงผลทดลองจริง และเอาชนะ AlphaFold 3 ในบางงานจับคู่ antibody — บทความนี้อธิบายแบบอ่านเข้าใจง่ายว่ามันคืออะไร ทำอะไรได้ และเกี่ยวอะไรกับเรา (ย้ำว่ายังเป็นงานวิจัย ไม่ใช่ของใช้ทั่วไป)
Omni โมเดลวิดีโอตัวใหม่ของ Google หลุดออกมา ก้าวกระโดดจาก V3.1 แต่กินโควตาหนัก
ต่อจาก thread ลีค Gemini ก่อน I/O คราวนี้มีคนได้สิทธิ์เข้าถึง "Omni" ในแอป Gemini โดยบังเอิญ ทำให้ผลงานหลุดออกมา ดูเหมือนก้าวกระโดดจาก V3.1 แต่ 2 คลิปกินโควตา ~86% ของแผน $20 ทั้งหมดยังเป็นลีค รอดูจริงราว I/O 19 พ.ค.
"Google Book" แล็ปท็อป AI-native ตัวแรกของ Google ที่ออกแบบรอบ Gemini
Google เปิดตัว "Google Book" แล็ปท็อปที่ออกแบบรอบ Gemini ผสาน Android กับ Chrome OS มากับ magic pointer, widget ที่ AI สร้างเอง และเชื่อมมือถือ Android — สรุปว่ามันคืออะไร เด่นตรงไหน และเกี่ยวอะไรกับงานเรา