หมวดหมู่
ข่าวสาร
85 บทความ
Gemini 4 เริ่มเทรนจริงแล้ว — Google ยืนยัน "รันพรีเทรนใหญ่สุดเท่าที่เคยทำ" พร้อมเช็กพอยต์ลับโผล่ทดสอบใน Arena
Google ยืนยันต่อสาธารณะว่าเริ่มพรีเทรนรุ่น Gemini 4 แล้ว และมีเช็กพอยต์ใหม่โผล่ทดสอบแบบ A/B ใน Gemini app กับ Arena โดยโชว์งานภาพ 3D และหน้าเว็บได้ดีขึ้นชัด แต่ทั้งหมดยังเป็นของยังไม่เสร็จ
Gemini Spark เปิดให้แพ็ก AI Pro ในสหรัฐฯ — เอเจนต์ที่ลงมือทำงานในอีเมลและปฏิทินให้เอง
Google ขยาย Gemini Spark เอเจนต์ที่รับเป้าหมายแล้วไปลงมือทำงานจริงในแอป Workspace จากแพ็กแพงสุดลงมาที่แพ็ก AI Pro ราคาเดือนละ 19.99 ดอลลาร์ในสหรัฐฯ พร้อมทำงานพร้อมกันได้ถึง 15 งาน
Claude Fable 5.1 หลุด — ลือจ่อออกสิงหาคม ราคาเท่าเดิม
มีรายงานหลุดถึงโมเดลใหม่ Claude Fable 5.1 ที่ว่ากันว่าจ่อเปิดตัวเดือนสิงหาคม ราคาคงเดิมเท่า Fable 5 แต่ทั้งหมดยังเป็นข่าวลือที่ Anthropic ยังไม่ยืนยัน
Claude Opus 5 มาแล้ว — แรงขึ้นชัดในราคาเท่าเดิม เข้าใกล้ Fable 5 แต่ถูกกว่า
Anthropic ปล่อย Opus 5 ราคาเท่ารุ่น 4.8 เดิม แต่คะแนนงานโค้ดแบบ agent และการให้เหตุผลกระโดดขึ้นชัด บนหลายเบนช์มาร์กเข้าใกล้ Fable 5 ในราคาที่ถูกกว่า
โมเดลลับ Cantus โผล่ใน Qoder — ตั้งราคาแพงกว่าเรือธง Qwen 3.8 Max ถึง 6 เท่า จนคนสงสัยว่าคืออะไร
Qoder แพลตฟอร์ม agentic coding ของ Alibaba เงียบ ๆ เพิ่มโมเดลลับชื่อ Cantus ที่ตั้งราคาแพงกว่าเรือธงตัวเองหลายเท่า พร้อมฟรีเทียร์และทดลอง pro 14 วันที่ให้ลอง Qwen 3.8 Max และ Kimi K3 ได้
Nvidia ปล่อย Nemotron 3 Embed 8B — ขึ้นที่ 1 บน RTEB ที่ 78.5% แซงโมเดล embedding ของ OpenAI
Nvidia เปิดตัว Nemotron 3 Embed 8B โมเดล embedding สำหรับงานค้นหาข้อมูล ขึ้นอันดับ 1 บน RTEB ที่ 78.5% พร้อมรุ่นย่อย 1B และรุ่นสำหรับชิป Blackwell รองรับ 32,000 token และ 34 ภาษา
Alibaba เปิดพรีวิว Qwen 3.8 — โมเดล 2.4 ล้านล้านพารามิเตอร์ที่ "มองเห็น" ได้ เคลมรองแค่ Fable 5
Alibaba เปิดพรีวิว Qwen 3.8 โมเดล 2.4 ล้านล้านพารามิเตอร์แบบ MoE ที่รับภาพ วิดีโอ และเอกสารได้ เคลมว่าแรงเป็นรองแค่ Fable 5 และบอกว่าจะปล่อย open weight เร็ว ๆ นี้ แต่ยังไม่มีคะแนนทดสอบยืนยัน
Anthropic ดึง Fable 5 เข้าแพลน Max/Team ถาวร — แต่ให้โควตาแค่ครึ่งเดียว ส่วน Pro/Standard ย้ายไปจ่ายตามใช้
เริ่ม 20 ก.ค. Fable 5 ถูกผูกเข้าแพลน Max และ Team Premium แบบถาวร แต่จำกัดโควตาไว้ที่ครึ่งเดียวของปกติ ส่วนคน Pro/Team Standard ต้องย้ายไปจ่ายแบบเครดิตตามใช้จริง
Kimi K3 เคาะราคาแล้ว $3/$15 ต่อล้าน token — ส่วน weights ต้องรอถึง 27 ก.ค.
ตอนเปิดตัวยังไม่บอกราคาและไม่บอกว่าจะปล่อย weights ไหม ตอนนี้ตัวเลขมาครบแล้ว ราคาอยู่ที่ $3/$15 ต่อล้าน token และ weights มีกำหนดปล่อย 27 ก.ค. แปลว่าวันนี้ยังโหลดมารันเองไม่ได้ ใครวางแผน self-host ต้องรอ
Grok CLI เปิดใช้ Grok 4.5 ฟรี — แต่เพิ่งมีรายงานว่ามันอัป repo ทั้งก้อนขึ้นคลาวด์ และแก้แบบเงียบ ๆ
xAI เปิดให้ใช้ Grok 4.5 ฟรีบน Grok CLI แค่มีบัญชี X ไม่ต้องมีบัตรหรือ API key แต่ก่อนหน้านั้นมีรายงานว่า CLI ส่ง git repo ทั้งก้อนขึ้น storage bucket โดยสวิตช์ความเป็นส่วนตัวหยุดมันไม่ได้
Kimi K3 มาแล้ว — ขึ้นที่ 1 สาย front-end แซง Fable 5 แต่ยังไม่บอกว่าเปิดโค้ดไหมและราคาเท่าไร
Moonshot ปล่อย Kimi K3 พารามิเตอร์ 2.5 ล้านล้าน context 1M token ขึ้นอันดับ 1 บน front-end arena และเด่นเรื่องงานยาวที่ทำเองจนจบ แต่สถานะ open source กับราคายังไม่ประกาศ
Meta Muse Spark 1.1 — โมเดลสาย agent ตัวแรกที่ Meta เปิดขายผ่าน API
Meta ปล่อย Muse Spark 1.1 โมเดล multimodal สาย agent context 1M token พร้อมเปิด Meta model API เป็นครั้งแรก ราคาถูกกว่าโมเดลระดับกลางของเจ้าอื่น แต่ผลทดสอบจริงยังไม่สม่ำเสมอ
GPT-5.6 มาแล้ว — OpenAI ปล่อยสามรุ่น Sol/Terra/Luna แรงระดับ Opus 4.8 จ่ายถูกกว่าครึ่ง
OpenAI ปล่อย GPT-5.6 ออกมาเป็นสามรุ่นแยกตามงาน — Sol แรงสุด, Terra ใช้ทุกวัน, Luna เร็วประหยัด ทำคะแนน coding agent สูสี Fable 5 แต่จ่ายถูกกว่าเกือบครึ่ง
Grok 4.5 มาแล้ว — โมเดลสายเร็ว ประหยัด token จาก xAI ที่ฝึกคู่กับ Cursor
xAI ปล่อย Grok 4.5 โมเดลที่เน้นงานโค้ด งาน agent และงานเอกสาร วางตัวเป็นสายเร็ว-ราคาถูก กิน token น้อยลงหลายเท่า และรับ context ได้ราว 500,000 token ต่อครั้ง
Claude Sonnet 5 ออกแล้ว — agentic ขึ้นชัด แต่ tokenizer ใหม่ทำให้คุ้มน้อยกว่าที่คิด
Anthropic ปล่อย Claude Sonnet 5 รุ่น agentic ที่สุดของสาย Sonnet เบนช์มาร์กไล่จี้ Opus 4.8 แต่ของจริงมีกับดักเรื่อง tokenizer ใหม่และส่วนต่างราคาที่บางจนน่าคิดว่าจะใช้แทน Opus คุ้มไหม
GPT-5.6 มาเป็นสามรุ่น Sol / Terra / Luna — เปิดราคาแล้ว แต่ system card มีเคสน่ากังวล
OpenAI เปิดรายละเอียด GPT-5.6 ครบขึ้น ทั้งสามรุ่นย่อยและราคาต่อ token พร้อม system card ที่บันทึกเคสโมเดลลบ VM ผิดตัวและก๊อปไฟล์ credential เอง
GPT-5.6 เปิดแบบ "อนุมัติทีละลูกค้า" — ยุคโมเดลใหม่ได้ใช้ทันทีกำลังจะจบ
มีรายงานว่ารัฐบาลสหรัฐฯ ขอให้ OpenAI ทยอยปล่อย GPT-5.6 แบบอนุมัติการเข้าถึงทีละลูกค้าในช่วง preview แทนเปิดสาธารณะทันที นับเป็นครั้งแรกที่โมเดลแนวหน้าของสหรัฐฯ ออกแบบมี "คิว" และอาจกลายเป็นบรรทัดฐานใหม่หลังดราม่า Fable 5
Anthropic กล่าวหา Alibaba ทำ distillation attack ครั้งใหญ่ — 25,000 บัญชี ดูดความสามารถ Claude
Anthropic กล่าวหากลุ่มที่เชื่อมโยงกับ Alibaba ว่าสร้างบัญชีปลอมเกือบ 25,000 บัญชี ดูดบทสนทนาจาก Claude ราว 28.8 ล้านครั้ง เพื่อกลั่นความสามารถด้านโค้ดและ agent มาเทรนโมเดลคู่แข่ง พร้อมระบุชื่อแล็บจีนอีกหลายเจ้า และส่งจดหมายถึงรัฐสภาให้เร่งจัดการ
หลุดโมเดลเสียง OpenAI "Bidi 1" — พูดและฟังพร้อมกัน ขัดจังหวะได้เหมือนคุยกับคน
มีคนพบโมเดลเสียงใหม่ของ OpenAI ชื่อ Bidi 1 โผล่ในการทดสอบกับผู้ใช้บางกลุ่ม จุดเด่นคือพูดและฟังได้พร้อมกัน รับการขัดจังหวะกลางประโยคโดยไม่ค้าง และสลับงานทันที ยังไม่เป็นทางการ ถือเป็นข่าวหลุด แต่ถ้าจริงจะเปลี่ยนวิธีคุยกับ AI ด้วยเสียง
OpenAI ออกชิป Jalapeño ของตัวเอง — ออกแบบมาเพื่อ inference เพื่อกดต้นทุนต่อ token
OpenAI จับมือ Broadcom เปิดชิป Jalapeño ที่ออกแบบมาเฉพาะงาน inference (จังหวะที่โมเดลตอบ) เป้าหมายคือทำให้คำตอบเร็วและถูกลง ลดการพึ่ง Nvidia แต่ตอนนี้ยังเป็นแค่ข่าวประกาศ ตัวเลขทั้งหมดยังไม่มีผลทดสอบจริง