🏷️ #moe (3 บทความ)

← แท็กทั้งหมด

DeepSeek V4 Pro 0813 เป็นรุ่น GA อย่างเป็นทางการแล้ว — MoE 1.6T แต่ Activate แค่ 49B ต่อโทเคน 1M context ราคาเพื่อนยาก แต่มีเชิงอรรถเตือนว่า 'จะขึ้นราคา'

TL;DR — DeepSeek V4 Pro 0813 ประกาศเป็นรุ่น GA (ตัวจริงพร้อมใช้งาน) เฉกเช่นเงียบ ๆ บน OpenRouter ผ่านค่าธรรมเนียม API โดยไม่ได้มี blog post หรือประกาศใหญ่ใด ๆ — MoE ยักษ์ 1.6T พารามิเตอร์แต่ Activate แค่ 49B ต่อโทเคน, 1M context, ราคาเริ่ม...

NVIDIA Nemotron 3.5 Lightning — โมเดล MoE เปิดน้ำหนัก 3B active / 30B รวม ตัวเล็กแต่แรง ลง OpenRouter ราคาเพนนี เหมาะเป็น "มือทำงาน" ให้ AI Agent

### TL;DR
NVIDIA Nemotron 3.5 Lightning คือโมเดล open-weight ตัวใหม่จาก NVIDIA ที่เพิ่งเปิดตัว 11 ส.ค. 2026 พร้อมไลบรารีจัดเส้นทางชื่อ NeMo Switchyard เป็นโมเดลแบบ mixture-of-experts (MoE) ขนาด 30B รวม แต่เปิดใช้งานจริงแค่ 3B ต่อการตอบหนึ่งครั้ง...

Tencent Hy-MT2 — โมเดลแปลภาษาตัวใหม่จากทีม Hunyuan ซัพพอร์ตไทย กลายเป็นแค่ 440MB ถ้า 'บีบ' ด้วย AngelSlim

TL;DR — Tencent (ทีม Hunyuan) เปิดโอเพนซอร์สโมเดลแปลภาษาใหม่ชื่อ **Hy-MT2** เป็นตระกูล "fast-thinking" มี 3 ขนาด (1.8B, 7B, 30B-A3B แบบ MoE) รองรับแปล **33 ภาษา** ซึ่งมี **ไทย** อยู่ด้วยครับ แถมเด็ดตรงตัวเล็ก 1.8B ถูกบีบด้วยเครื่องมือ AngelSlim...