Call Me Thanut

หมวดหมู่

ข่าวสาร

97 บทความ

ลือ — "Claude Mythos" โมเดลลับที่ข่าวว่าทำงานนานจนวัดด้วยมาตรฐานเดิมไม่ได้

ลือ — "Claude Mythos" โมเดลลับที่ข่าวว่าทำงานนานจนวัดด้วยมาตรฐานเดิมไม่ได้

มีรายงาน (ยังไม่เป็นทางการ) ว่า Anthropic มีโมเดลขั้นสูงชื่อ Claude Mythos ที่ดันเกินเพดานการวัดของ METR แตะช่วงงานมนุษย์ ~16 ชม. — สรุปแบบระวัง ว่าอะไรเป็นแค่ข่าว/ลีก อะไรยังไม่ยืนยัน และมุมความมั่นคงไซเบอร์ที่เป็นดาบสองคม

12 พ.ค. 2026อ่านต่อ →
Anthropic ใช้ AI สัมภาษณ์คน 80,000 คน — พบว่าคนเรา "หวังและกลัว" AI ไปพร้อมกัน

Anthropic ใช้ AI สัมภาษณ์คน 80,000 คน — พบว่าคนเรา "หวังและกลัว" AI ไปพร้อมกัน

Anthropic ใช้ AI สัมภาษณ์ผู้คน 80,000 คนใน 159 ประเทศ เคลมว่าใหญ่ที่สุดในแบบนี้ ผลที่ออกมาน่าสนใจคือความหวังและความกลัวต่อ AI ไม่ได้แยกเป็นคนละฝ่าย แต่อยู่ในคนคนเดียวกัน บทความนี้สรุปสิ่งที่เจอ ตัวเลข 81% พร้อมข้อจำกัดเรื่องกลุ่มตัวอย่างที่เอนเอียง และมุมที่คนทำงานไทยเอาไปใช้ได้จริง

11 พ.ค. 2026อ่านต่อ →
"รวมโมเดลและงานวิจัย AI เปิดใหม่สัปดาห์นี้: ภาพ open-source ตัวแรง โมเดลเทรนบนชิป AMD และผล AlphaEvolve"

"รวมโมเดลและงานวิจัย AI เปิดใหม่สัปดาห์นี้: ภาพ open-source ตัวแรง โมเดลเทรนบนชิป AMD และผล AlphaEvolve"

"สรุปโมเดลและงานวิจัยเปิดใหม่รอบสัปดาห์: HiDream-O1 สายภาพ open-source, Zaya-1 ที่เทรนบนสแตก AMD ล้วน, Gemma 4 เร็วขึ้น, ผลจริงจาก AlphaEvolve และ MolmoAct 2 ฝั่ง robotics"

10 พ.ค. 2026อ่านต่อ →
รายงานชี้ Anthropic แซง OpenAI ในตลาดองค์กร — งาน coding กลายเป็นสมรภูมิหลัก

รายงานชี้ Anthropic แซง OpenAI ในตลาดองค์กร — งาน coding กลายเป็นสมรภูมิหลัก

มีรายงานหลายชิ้นว่า Anthropic ขึ้นนำ OpenAI ทั้งยอดใช้จ่ายองค์กรและ mindshare พร้อมตัวเลขรายได้และมูลค่าตลาดที่น่าจับตา — ตัวเลขส่วนใหญ่ยังเป็นรายงานที่ยังไม่ยืนยัน บทความนี้สรุปแบบ balanced ว่าเกิดอะไรขึ้น ทำไม coding คือจุดชี้ขาด และเกี่ยวอะไรกับคนทำงานไทย

9 พ.ค. 2026อ่านต่อ →
"Talkie โมเดล AI ที่เทรนด้วยข้อความก่อนปี 1931 เท่านั้น เพื่อทดสอบว่า AI เรียนรู้จริงไหม"

"Talkie โมเดล AI ที่เทรนด้วยข้อความก่อนปี 1931 เท่านั้น เพื่อทดสอบว่า AI เรียนรู้จริงไหม"

"Talkie คือ vintage model ขนาด 13B ที่เทรนด้วยข้อความอังกฤษก่อนปี 1931 ล้วน ๆ จุดประสงค์คือเลี่ยงข้อมูลเว็บยุคใหม่ปนเปื้อน เพื่อดูว่า AI เข้าใจและใช้เหตุผลจริง หรือแค่จำข้อมูลที่เคยเห็นมา"

8 พ.ค. 2026อ่านต่อ →
Google ทดสอบ "Remy" ผู้ช่วย Gemini ทำงานเชิงรุก 24/7 พร้อมเร่ง Gemma 4 ให้เร็วขึ้น ~3 เท่า

Google ทดสอบ "Remy" ผู้ช่วย Gemini ทำงานเชิงรุก 24/7 พร้อมเร่ง Gemma 4 ให้เร็วขึ้น ~3 เท่า

Google กำลังทดสอบภายในกับ "Remy" agent ของ Gemini ที่ทำงานเชิงรุกตลอด 24 ชั่วโมงข้ามแอป Gmail/Docs/Calendar/Drive/Search พร้อมอัปเดต Gemma 4 ให้ inference เร็วขึ้นราว 3 เท่าโดยอ้างว่าผลลัพธ์ไม่เพี้ยน

7 พ.ค. 2026อ่านต่อ →
Anthropic ดีล compute กับ SpaceX — rate limit ของ Claude Code เพิ่มเป็นสองเท่าทันที

Anthropic ดีล compute กับ SpaceX — rate limit ของ Claude Code เพิ่มเป็นสองเท่าทันที

คนใช้ Claude Code ได้ผลทันที rate limit รอบ 5 ชั่วโมงเพิ่มเป็นสองเท่า และยกเลิกการลดโควต้าช่วงพีค เบื้องหลังคือดีลเช่า data center ขนาดใหญ่จาก SpaceX เพื่อดึงพลังประมวลผลก้อนใหญ่เข้ามาเสริม

7 พ.ค. 2026อ่านต่อ →
หุ่นยนต์ฮิวแมนนอยด์เริ่มเดินลาดตระเวนในเมืองจริงที่จีน ราคาเริ่มหลักหมื่น

หุ่นยนต์ฮิวแมนนอยด์เริ่มเดินลาดตระเวนในเมืองจริงที่จีน ราคาเริ่มหลักหมื่น

ช่วงวันแรงงานที่ผ่านมา หลายเมืองในจีนนำหุ่นยนต์ฮิวแมนนอยด์ออกมาช่วยงานในที่สาธารณะจริง พร้อมกันกับราคาตัวเครื่องที่ลดลงเร็ว แต่ทั้งหมดยังอยู่ในช่วงนำร่อง ไม่ใช่ของใช้แพร่หลาย

6 พ.ค. 2026อ่านต่อ →
Gemini 3.2 Flash หลุดราคาและสเปกก่อน Google I/O

Gemini 3.2 Flash หลุดราคาและสเปกก่อน Google I/O

ต่อจากสัญญาณก่อน I/O คราวนี้มีตัวเลขราคาที่หลุดออกมาแล้ว พร้อมโค้ดเนม การทดสอบในแอป และเบาะแสโมเดลวิดีโอ "Omni" ทั้งหมดยังเป็นลีค รอดูจริงวันที่ 19 พ.ค.

6 พ.ค. 2026อ่านต่อ →
AI ช่วยเร่งงานวิจัยถอดรหัส quantum — กำแพงที่เคยสูง เริ่มเตี้ยลง

AI ช่วยเร่งงานวิจัยถอดรหัส quantum — กำแพงที่เคยสูง เริ่มเตี้ยลง

งานวิจัยใหม่ชี้ว่า AI ช่วยจูนอัลกอริทึมจนการ "ถอดรหัส" ด้วยควอนตัมคอมพิวเตอร์อาจใกล้เป็นจริงเร็วกว่าที่คิด แต่ยังไม่ผ่าน peer-review และคนยังเป็นคนคุมทิศทาง

5 พ.ค. 2026อ่านต่อ →
Meta เขียน React Compiler ใหม่ด้วย Rust และ AI เขียนโค้ดส่วนใหญ่

Meta เขียน React Compiler ใหม่ด้วย Rust และ AI เขียนโค้ดส่วนใหญ่

Meta พอร์ต React Compiler จาก TypeScript ไปเป็น Rust ด้วย PR ที่มีราว 330 commit และรายงานว่า AI เป็นคนเขียนโค้ดส่วนใหญ่ ตัวเลขความเร็วช่วงแรกดูดีแต่ยังเป็นค่า preliminary

5 พ.ค. 2026อ่านต่อ →
Google ปล่อยแอป Cosmo ผู้ช่วย AI บนเครื่อง แล้วถอดออกเงียบ ๆ

Google ปล่อยแอป Cosmo ผู้ช่วย AI บนเครื่อง แล้วถอดออกเงียบ ๆ

Google แอบปล่อยแอปทดลองชื่อ Cosmo ขึ้น Play Store เป็นผู้ช่วย AI ที่ทำงานบนเครื่องและอ่านหน้าจอเราได้ แล้วถอดออกอย่างรวดเร็วก่อนงาน I/O

4 พ.ค. 2026อ่านต่อ →
GitHub Copilot เปลี่ยนวิธีคิดเงินเป็นเครดิตตามการใช้จริง 1 มิ.ย.

GitHub Copilot เปลี่ยนวิธีคิดเงินเป็นเครดิตตามการใช้จริง 1 มิ.ย.

GitHub Copilot ยกเลิก premium request unit แล้วเปลี่ยนมาคิดเป็น AI credits ตามการใช้งานจริงตั้งแต่ 1 มิถุนายน ราคาแพ็กเกจเท่าเดิมแต่วิธีนับต้นทุนเปลี่ยนไป คนใช้ต้องคำนวณใหม่ก่อนบิลมา

3 พ.ค. 2026อ่านต่อ →
DeepMind โชว์ AI co-clinician คุยวิดีโอ ดูอาการ และทำคะแนนสูสีหมอจริง

DeepMind โชว์ AI co-clinician คุยวิดีโอ ดูอาการ และทำคะแนนสูสีหมอจริง

DeepMind เปิดตัว AI การแพทย์ที่คุยวิดีโอแบบ real-time สังเกตอาการคนไข้ และนำตรวจร่างกายได้ ผลทดสอบแบบ blind หมอจริงเลือกมันมากกว่า agent การแพทย์ตัวอื่น แต่ทีมวางตัวเองชัดว่าเป็น "ผู้ช่วย ไม่ใช่แทนหมอ"

3 พ.ค. 2026อ่านต่อ →
สัญญาณก่อน Google I/O — Gemini Flash ถูกอัปเงียบใน LM Arena

สัญญาณก่อน Google I/O — Gemini Flash ถูกอัปเงียบใน LM Arena

โมเดล Gemini 3 Flash ใน LM Arena ถูกสลับ build เงียบๆ ภายใต้ slug เดิม พร้อมกับการประกาศ retire รุ่นเก่าบน Vertex AI สองสัญญาณนี้อ่านรวมกันแล้วบอกว่ารุ่นใหม่กำลังจะมา จับตา Google I/O 19–20 พ.ค.

3 พ.ค. 2026อ่านต่อ →
AI agent ลบฐานข้อมูล production ทั้งหมดใน 9 วินาที เพราะ token ไม่จำกัดสิทธิ์

AI agent ลบฐานข้อมูล production ทั้งหมดใน 9 วินาที เพราะ token ไม่จำกัดสิทธิ์

Cursor agent ที่รัน Claude 4.6 เจอ token full-access ในโค้ด แล้วสั่งลบฐานข้อมูล production พร้อม backup ของสตาร์ทอัพรายหนึ่งหายเกลี้ยงโดยไม่ถามใครก่อน บทเรียนเรื่องสิทธิ์และ Human Gate ที่คนปล่อย agent ทำงานกับระบบจริงต้องอ่าน

2 พ.ค. 2026อ่านต่อ →
ทำไม ChatGPT พูดถึง goblin บ่อยผิดปกติ? เคสจริงที่อธิบาย reward hacking ได้เห็นภาพสุด

ทำไม ChatGPT พูดถึง goblin บ่อยผิดปกติ? เคสจริงที่อธิบาย reward hacking ได้เห็นภาพสุด

ผู้ใช้รายงานว่า ChatGPT แทรกคำว่า goblin ในบทสนทนาที่ไม่เกี่ยวอะไรเลย OpenAI สอบสวนแล้วพบว่าการใช้คำนี้พุ่งขึ้น 3,881% เพราะระบบให้รางวัลผิดจุดตอนเทรน — เคสนี้สอนเราว่าทำไมต้องตรวจงาน AI เสมอ

1 พ.ค. 2026อ่านต่อ →