Call Me Thanut

หมวดหมู่

ข่าวสาร

97 บทความ

Continual Harness ทำให้ agent ปรับตัวเองระหว่างงาน — น่าสนใจมาก แต่ต้องมีเบรก

Continual Harness ทำให้ agent ปรับตัวเองระหว่างงาน — น่าสนใจมาก แต่ต้องมีเบรก

Continual Harness แสดงแนวทาง agent ที่เรียนรู้จากความผิดพลาด แก้ prompt สร้าง sub-agent และเก็บ memory ระหว่างทำงานต่อเนื่อง ประโยชน์ชัด แต่ถ้าใช้กับโลกจริงต้องมี log, rollback และ approval

23 พ.ค. 2026อ่านต่อ →
Claude Code แบบฟรีผ่านเครดิตและ third-party — น่าดู แต่ต้องคิดต้นทุนระยะยาว

Claude Code แบบฟรีผ่านเครดิตและ third-party — น่าดู แต่ต้องคิดต้นทุนระยะยาว

กระแส Claude Code ผ่านเครดิตหรือ third-party ทำให้หลายคนรู้สึกว่าใช้งานได้ถูกลง แต่ทีมที่ใช้จริงต้องคิดเรื่อง quota, policy และความต่อเนื่องของ provider

23 พ.ค. 2026อ่านต่อ →
Codex บนมือถือเริ่มมีประโยชน์จริง — แต่ข่าว limit ลดเตือนว่าอย่าวาง workflow บนโปร launch

Codex บนมือถือเริ่มมีประโยชน์จริง — แต่ข่าว limit ลดเตือนว่าอย่าวาง workflow บนโปร launch

Codex เริ่มขยับจากเครื่องมือบนโต๊ะไปสู่การสั่งงานจากมือถือ แต่รายงานเรื่อง usage limit ลดลงทำให้ต้องคิดเรื่องต้นทุนและ quota ตั้งแต่แรก

22 พ.ค. 2026อ่านต่อ →
Phantom Pulse ใช้ knowledge vault เป็นทางเข้า — AI workflow ต้องระวัง plugin มากขึ้น

Phantom Pulse ใช้ knowledge vault เป็นทางเข้า — AI workflow ต้องระวัง plugin มากขึ้น

เคส Phantom Pulse เตือนว่า note vault และ community plugin ไม่ใช่พื้นที่ปลอดภัยโดยอัตโนมัติ ยิ่งทีมใช้ vault เป็นสมองของ AI agent ยิ่งต้องมี policy ก่อน sync

22 พ.ค. 2026อ่านต่อ →
Atlas ยกของหนักด้วย whole-body control — ข่าว humanoid ที่ควรดูเรื่อง deployment มากกว่าโชว์ท่า

Atlas ยกของหนักด้วย whole-body control — ข่าว humanoid ที่ควรดูเรื่อง deployment มากกว่าโชว์ท่า

Atlas รุ่นใหม่ถูกพูดถึงจากงานยกตู้เย็นหนักและรับมือ weight shift จุดที่น่าสนใจไม่ใช่ท่าทางแปลกตา แต่คือ sim-to-real, proprioception และชิ้นส่วนที่ซ่อมเปลี่ยนได้

22 พ.ค. 2026อ่านต่อ →
OpenAI model แก้โจทย์คณิตเปิดค้าง 80 ปี — ถ้าตรวจสอบได้จริง นี่คือก้าวใหญ่ของ AI research

OpenAI model แก้โจทย์คณิตเปิดค้าง 80 ปี — ถ้าตรวจสอบได้จริง นี่คือก้าวใหญ่ของ AI research

มีรายงานว่า internal OpenAI model สร้าง proof ใหม่สำหรับ unit distance problem ที่ค้างมาตั้งแต่ปี 1946 ประเด็นสำคัญไม่ใช่ AI แทนนักคณิตศาสตร์ แต่คือ AI อาจช่วยเปิดทางวิจัยที่ตรวจสอบได้

21 พ.ค. 2026อ่านต่อ →
Anthropic จำกัด third-party Claude tools — บทเรียนคืออย่าผูก production workflow กับทางลัดที่ vendor ปิดได้

Anthropic จำกัด third-party Claude tools — บทเรียนคืออย่าผูก production workflow กับทางลัดที่ vendor ปิดได้

กระแสเรื่อง Anthropic จำกัดเครื่องมือ third-party รอบ Claude สะท้อนความเสี่ยงของ workflow ที่พึ่งเส้นทางไม่เป็นทางการมากเกินไป ทีมที่ใช้ agent หนักควรมี fallback และคุมต้นทุนให้ชัด

21 พ.ค. 2026อ่านต่อ →
Karpathy เข้าร่วม Anthropic — สัญญาณว่า Claude Code อาจแข่งกันที่ context และวิธีทำงาน ไม่ใช่แค่โมเดล

Karpathy เข้าร่วม Anthropic — สัญญาณว่า Claude Code อาจแข่งกันที่ context และวิธีทำงาน ไม่ใช่แค่โมเดล

Andrej Karpathy ย้ายเข้า Anthropic ไม่ใช่แค่ข่าวคนดังในวงการ AI แต่สะท้อนทิศทางว่า AI coding กำลังให้ความสำคัญกับ context, education และ wrapper รอบโมเดลมากขึ้น

20 พ.ค. 2026อ่านต่อ →
LLMorphism คืออะไร — เมื่อเราเริ่มอธิบายสมองตัวเองเหมือน AI มากเกินไป

LLMorphism คืออะไร — เมื่อเราเริ่มอธิบายสมองตัวเองเหมือน AI มากเกินไป

งานวิจัยแนว LLMorphism เตือนว่าเราอาจเริ่มมองความคิดมนุษย์เหมือน large language model มากเกินไป จากเดิมที่กลัวใส่ความเป็นมนุษย์ให้ AI ตอนนี้อาจกำลังลดความเป็นมนุษย์ของตัวเอง

19 พ.ค. 2026อ่านต่อ →
ChatGPT Finance ต่อบัญชีเงินจริงได้แล้ว — ใช้ช่วยวิเคราะห์เงินได้ แต่ต้องระวังข้อมูลส่วนตัวมากขึ้น

ChatGPT Finance ต่อบัญชีเงินจริงได้แล้ว — ใช้ช่วยวิเคราะห์เงินได้ แต่ต้องระวังข้อมูลส่วนตัวมากขึ้น

OpenAI เริ่ม rollout ฟีเจอร์การเงินใน ChatGPT ให้ผู้ใช้บางกลุ่มต่อ bank, credit card, investment และ loan ผ่าน Plaid ได้ ประโยชน์ชัด แต่ความเสี่ยงข้อมูลก็ชัดกว่าเดิม

18 พ.ค. 2026อ่านต่อ →
Anthropic เจอบทเรียนใหม่เรื่อง AI safety — ข้อมูลเล็กแต่ถูกทาง อาจลดพฤติกรรมเสี่ยงของ Claude ได้ดีกว่า

Anthropic เจอบทเรียนใหม่เรื่อง AI safety — ข้อมูลเล็กแต่ถูกทาง อาจลดพฤติกรรมเสี่ยงของ Claude ได้ดีกว่า

Anthropic ทดสอบพฤติกรรม self-preservation ของ Claude ใน sandbox แล้วพบว่าวิธีเทรนตรง ๆ ไม่พอ สิ่งที่น่าสนใจกว่าคือข้อมูลเล็กที่สอน reasoning แบบทั่วไปอาจช่วยให้โมเดลรับมือสถานการณ์เสี่ยงได้ดีขึ้น

17 พ.ค. 2026อ่านต่อ →
Gemini 3.5 Flash และ Gemma 4 เริ่มโผล่ก่อน Google I/O — สัญญาณว่า Google กำลังเร่งทั้ง cloud และ local AI

Gemini 3.5 Flash และ Gemma 4 เริ่มโผล่ก่อน Google I/O — สัญญาณว่า Google กำลังเร่งทั้ง cloud และ local AI

ก่อนงาน Google I/O มีสัญญาณของ Gemini 3.5 Flash และ Gemma 4 หลายจุด ทั้งในแอป, Antigravity และ local model workflow ประเด็นหลักคือ Google กำลังรวมโมเดลเร็ว, agent platform และ on-device AI เข้าหากัน

16 พ.ค. 2026อ่านต่อ →
Claude Max ให้เครดิตใช้งาน agent เพิ่ม $200 — แต่บาง workflow อาจแพงขึ้นกว่าเดิม

Claude Max ให้เครดิตใช้งาน agent เพิ่ม $200 — แต่บาง workflow อาจแพงขึ้นกว่าเดิม

Anthropic เตรียมให้เครดิต programmatic usage กับ paid Claude plans แต่ประเด็นคือ third-party agent บางแบบอาจถูกคิดแบบ API rate แทน quota subscription เดิม คนใช้ Claude หนักต้องเช็กต้นทุนใหม่

16 พ.ค. 2026อ่านต่อ →
Unitree GD01 หุ่นยนต์ mecha มีคนขับซื้อได้จริง — ภาพใหญ่ของ embodied AI เริ่มชัดขึ้น

Unitree GD01 หุ่นยนต์ mecha มีคนขับซื้อได้จริง — ภาพใหญ่ของ embodied AI เริ่มชัดขึ้น

Unitree เปิดตัว GD01 หุ่นยนต์ mecha สูง 2.7 เมตรพร้อม cockpit ให้คนนั่ง ราคาหลักหลายแสนดอลลาร์ เรื่องนี้ยังไม่ใช่ของใช้ทั่วไป แต่สะท้อนว่า embodied AI กำลังออกจากแล็บเร็วขึ้น

15 พ.ค. 2026อ่านต่อ →
npm worm กลับมาแรง — กระทบ TanStack, Mistral และ Guardrails AI พร้อมกลไกลบเครื่อง

npm worm กลับมาแรง — กระทบ TanStack, Mistral และ Guardrails AI พร้อมกลไกลบเครื่อง

supply-chain attack รอบนี้ไม่ได้กระทบแค่แพ็กเกจเว็บทั่วไป แต่แตะ ecosystem ที่คนทำ AI และ dev ใช้จริง จุดเสี่ยงคือ agent ที่รัน install ให้เราโดยไม่มี policy ตรวจ dependency

15 พ.ค. 2026อ่านต่อ →
Figure AI เดโมฟลีตหุ่นยนต์ฮิวแมนนอยด์ทำงานคลังสินค้าเต็มกะ 8 ชั่วโมง

Figure AI เดโมฟลีตหุ่นยนต์ฮิวแมนนอยด์ทำงานคลังสินค้าเต็มกะ 8 ชั่วโมง

Figure AI โชว์ฟลีตหุ่นยนต์ฮิวแมนนอยด์ทำงานคลังสินค้าต่อเนื่องเต็มกะ 8 ชั่วโมง ขับด้วยนิวรัลเน็ต Helix O2 ประมวลผล on-board ประสานงานกันเอง สลับแบตเตอรี่เอง และวินิจฉัยตัวเองได้ — บทความสรุปแบบ balanced ว่าทำอะไรได้จริง และทำไมยังต้องอ่านในฐานะเดโมของบริษัทเดียว

14 พ.ค. 2026อ่านต่อ →
"ศึก Claude Code vs Codex ร้อนขึ้น เพิ่มลิมิตรายสัปดาห์ 50% แต่ค่า agent ภายนอกแยกบิลใหม่"

"ศึก Claude Code vs Codex ร้อนขึ้น เพิ่มลิมิตรายสัปดาห์ 50% แต่ค่า agent ภายนอกแยกบิลใหม่"

"Claude Code ประกาศเพิ่มลิมิตรายสัปดาห์ 50% หลัง OpenAI เปิดเกมแข่ง แต่อีกด้านคือดราม่าย้าย SDK, GitHub Actions และ agent ภายนอกไปคิดเงินแยกแบบเครดิต API ที่ผู้ใช้บอกเหมือนโดนลดโควตา 10-40 เท่า มาดูสองด้านว่ากระทบงานเราตรงไหน"

14 พ.ค. 2026อ่านต่อ →
MAMMAL — โมเดล foundation ด้านชีววิทยาที่รวมเคมี พันธุกรรม และโปรตีนไว้ในตัวเดียว

MAMMAL — โมเดล foundation ด้านชีววิทยาที่รวมเคมี พันธุกรรม และโปรตีนไว้ในตัวเดียว

MAMMAL เป็น foundation model หลายโหมดด้านชีววิทยาที่รวมเคมี พันธุกรรม และโครงสร้างโปรตีนไว้ในโมเดลเดียว เทรนด้วยข้อมูลราว 2 พันล้านตัวอย่าง ทำ state-of-the-art บน 11 benchmark ด้านค้นพบยา ทำนายยามะเร็งได้ตรงผลทดลองจริง และเอาชนะ AlphaFold 3 ในบางงานจับคู่ antibody — บทความนี้อธิบายแบบอ่านเข้าใจง่ายว่ามันคืออะไร ทำอะไรได้ และเกี่ยวอะไรกับเรา (ย้ำว่ายังเป็นงานวิจัย ไม่ใช่ของใช้ทั่วไป)

14 พ.ค. 2026อ่านต่อ →
Omni โมเดลวิดีโอตัวใหม่ของ Google หลุดออกมา ก้าวกระโดดจาก V3.1 แต่กินโควตาหนัก

Omni โมเดลวิดีโอตัวใหม่ของ Google หลุดออกมา ก้าวกระโดดจาก V3.1 แต่กินโควตาหนัก

ต่อจาก thread ลีค Gemini ก่อน I/O คราวนี้มีคนได้สิทธิ์เข้าถึง "Omni" ในแอป Gemini โดยบังเอิญ ทำให้ผลงานหลุดออกมา ดูเหมือนก้าวกระโดดจาก V3.1 แต่ 2 คลิปกินโควตา ~86% ของแผน $20 ทั้งหมดยังเป็นลีค รอดูจริงราว I/O 19 พ.ค.

13 พ.ค. 2026อ่านต่อ →
"Google Book" แล็ปท็อป AI-native ตัวแรกของ Google ที่ออกแบบรอบ Gemini

"Google Book" แล็ปท็อป AI-native ตัวแรกของ Google ที่ออกแบบรอบ Gemini

Google เปิดตัว "Google Book" แล็ปท็อปที่ออกแบบรอบ Gemini ผสาน Android กับ Chrome OS มากับ magic pointer, widget ที่ AI สร้างเอง และเชื่อมมือถือ Android — สรุปว่ามันคืออะไร เด่นตรงไหน และเกี่ยวอะไรกับงานเรา

13 พ.ค. 2026อ่านต่อ →