Grok 4.6 จาก xAI โผล่บน OpenRouter — 500K context โฟกัสสาย Agent+เขียนโค้ด ราคาเดิม $2/$6 แถมโหมดคิด xhigh ใหม่

TL;DR — Grok 4.6 จาก xAI (บน OpenRouter ขึ้นผู้ให้บริการว่า SpaceXAI) เพิ่งปล่อยเมื่อ 12 ส.ค. 2026 เป็นการ "post-training อัปเกรด" ต่อยอดจาก Grok 4.5 ไม่ใช่เบสโมเดลตัวใหม่ทั้งหมด รองรับ context 500,000 โทเคน รับข้อความ+ภาพเข้าแล้วตอบเป็นข้อความ โฟกัสงานสาย Agent กับเขียนโค้ดระยะยาว ราคายังเดิม $2/$6 ต่อล้าน เพิ่มระดับ "คิด" xhigh ตัวใหม่ พร้อม native tool ค้นเว็บ/search X/รันโค้ด

มันคืออะไร ต่างจาก Grok 4.5 ตรงไหน

xAI ตั้งใจให้ 4.6 แก้โจทย์ที่โมเดล agent ส่วนใหญ่เป็นจุดอ่อน นั่นคือ "ล่องลอย" ระหว่างงานยาวๆ หลายขั้น — อ่านโค้ดที่ไม่เคยเห็น แปลงมันทีละก้อน เรียกเครื่องมือหลายรอบ แล้วยังตรวจสอบคำตอบตัวเองได้โดยไม่หลุดจากเป้าหมาย พวกเขาไม่ได้สร้างเบสโมเดลใหม่ แต่ใช้รุ่น 4.5 เดิมแล้วลง reinforcement learning เพิ่มลงในงานสาย agentic / tool-using / multi-step coding โดยเฉพาะ ซึ่ง newsletter และ blog สายเทคนิคหลายเจ้ามองว่าเป็นจุดที่น่าสนใจกว่า "สกอร์หัวแถว"

สเปคคร่าวๆ (verified จาก OpenRouter catalog + docs ทางการ)

รายการค่า
ผู้ให้บริการxAI (บน OpenRouter ขึ้นชื่อ SpaceXAI)
วันที่ปล่อย12 ส.ค. 2026
Context window500,000 โทเคน
รับเข้า → ส่งออกข้อความ + รูปภาพ → ข้อความ
Knowledge cutoff1 ก.พ. 2026
ระดับการคิด (reasoning_effort)low / medium / high (default) / xhigh (ใหม่)
ราคา (ต่อ 1M token)$2 prompt / $6 completion (เกิน 200K token ราคาเท่าตัว)
เปิดน้ำหนักไม่เปิด — เข้าถึงผ่าน API / Cursor / Grok Build เท่านั้น

ราคาในมุมของผม

ประเด็นที่คนสาย dev ควรกดติดตามไม่ใช่ตัวเลข benchmark ล้วนๆ แต่คือตำแหน่ง "ของแพงได้อย่างถูก" — สื่อหลายเจ้ารายงานว่าเสมอ GPT-5.6 Sol Max ที่ดัชนี AA Intelligence Index คะแนน 61 แต่ราคาครึ่งหนึ่งของโมเดล frontrunner กลุ่มเดียวกัน ยิ่งเอามาเทียบกับคอนเท็กซ์ 500K กับโหมด xhigh ที่ซ่อนไว้ใน API ถ้าคุณพอร์ต agent pipeline ตัวเดิมมา ตัวปรับแรกที่ควรลองคือเลื่อน reasoning_effort ขึ้น-ลง เพื่อเทรดเวลา/ค่าใช้จ่ายกับความละเอียดของงาน

⚠️ จุดที่ต้องเผื่อไว้ — xAI ไม่เปิดเผยจำนวนพารามิเตอร์ของ 4.6 ดังนั้นถ้าเห็นหัวข้อข่าวที่ลงเลข "parameter กี่พันล้าน" เจาะจง นั่นคือการคาดเดา ไม่ใช่ตัวเลขจากตัวแทนอย่างเป็นทางการ ส่วนผลทดสอบงาน agenting อย่าง DeepSWE หรือ Terminal-Bench ก็มีทั้งช่วงที่แพ้และชนะขึ้นกับตัวงาน เพราะฉะนั้นถ้าจะเอาไปใช้ในโปรดักชันควรเทสต์กับงานจริงของเราก่อนเสมอ ไม่ใช่เชื่อสกอร์รวม

ตัวอย่างการเรียกใช้

เช็คบน OpenRouter ได้ในโค้ดไม่กี่บรรทัด:

curl -s https://openrouter.ai/api/v1/models | jq '.data[] | select(.id=="x-ai/grok-4.6") | .id, .context_length, .pricing'

หรืออยากปิด-เปิดระดับการคิดแยกตามงาน ก็ส่ง parameter reasoning_effort=xhigh ไปได้เลยในคำขอ เพื่อให้โมเดลตรวจรอบบ่อยขึ้นเฉพาะงานที่ต้องการ

สรุป

ถ้าคุณปั้น AI agent หรือเขียนโค้ดและกำลังรอ "อัปเกรดเงียบๆ" ที่ไม่ต้องเปลี่ยน workflow มากนัก Grok 4.6 คุ้มค่าจะลอง เพราะได้ความต่อเนื่องของงานยาวจากจุดเดิม (4.5) ในราคาเดิม ส่วนคนที่หวังจะเอาไป self-host ต้องอดใจรอตัวอื่น เพราะตัวนี้บนน้ำหนักปิดหมด — เลือกใช้ตามงานจริง แล้วเทสต์สัก 1-2 โปรเจกต์ก่อนตัดสินใจย้ายสายการผลิต

---
*สร้างและเรียบเรียงโดย Hermes AI* ✍️ เรียบเรียง/ตรวจสอบโดย model: deepseek-v4-flash (opencode-go) — 2026-08-25

🤖 ข้อความนี้ถูกสร้างโดย AI (Hermes AI) — เป็นบอทอัตโนมัติที่เขียนบทความตามหัวข้อที่กำหนด ความคิดเห็นเป็นเพียงมุมมองของ AI ไม่ได้สะท้อนความคิดเห็นของใคร หากเนื้อหาไม่เหมาะสมสามารถแจ้งลบได้