KM
RTX 5090 · Blackwell

RTX 5090 คืออะไร

การ์ดจอแยก (discrete GPU) เรือธงของ NVIDIA สถาปัตยกรรม Blackwell เน้น ความเร็วดิบ — แบนด์วิดท์ ~1.8 TB/s เร็วกว่า DGX Spark มาก แต่จำกัดที่ VRAM 32GB เก่งงาน AI บนโมเดลที่ใส่ได้ในการ์ด + เล่นเกม/เรนเดอร์

0
CUDA cores
0 GB
GDDR7 VRAM
0.00 TB/s
แบนด์วิดท์
0 TOPS
AI compute (FP4)
0 W
TGP (rated)
$0
MSRP
สถาปัตยกรรม / ไดBlackwell · GB202 · TSMC 4NP
CUDA cores21,760
Tensor cores (Gen 5)680 — FP4 native
Boost / Base clock2.41 / 2.01 GHz
หน่วยความจำ32 GB GDDR7 · 512-bit
แบนด์วิดท์1,792 GB/s (1.79 TB/s)
AI compute (FP4, sparse)3,352 AI TOPS
TGP (rated)575W · peak ~901W
ระบบไฟที่ต้องใช้1000W (PSU ขั้นต่ำ 850W)
ราคา (MSRP)$1,999 (ม.ค. 2025)

ตัวเลขยืนยันจากหน้าทางการ NVIDIA — “3,352 AI TOPS” เป็น FP4 (sparse) · 575W เป็นค่า rated ค่าพีคที่วัดได้จริงแตะ ~901W (transient <1ms)

แก่นของการเลือก

เร็วแต่จุน้อย ↔ จุเยอะแต่ช้า

ทั้งคู่เป็น Blackwell เหมือนกัน แต่คนละโลก — เลือกตาม ขนาดโมเดล ที่จะรันเป็นหลัก ถ้าใส่ใน 32GB ได้ → 5090 เร็วกว่าชัด ถ้าใส่ไม่ได้ → DGX Spark คือทางเลือกในเครื่องที่ทำได้

RTX 5090 — “เร็วแต่จุน้อย
1.79 TB/s · 32 GB

แบนด์วิดท์มหาศาล → decode เร็วสุดบนโมเดลที่ใส่ได้ใน 32GB + เล่นเกม/เรนเดอร์

DGX Spark — “จุเยอะแต่ช้า
273 GB/s · 128 GB

unified memory 128GB → รัน/ไฟน์จูนโมเดลใหญ่ที่ 5090 ใส่ไม่ลง

≤ 32GB + เกม → RTX 509070B–235B / ไฟน์จูน → DGX Spark
01 · เทียบสเปค

เทียบสเปคแบบเห็นภาพ

กดเลือกตัวชี้วัด — แท่งยาวกว่า = มากกว่า (สเกลสัมพัทธ์ต่อตัวชี้วัด) สังเกตว่าแต่ละเครื่องชนะคนละด้าน

RTX 50901,792 GB/s
DGX Spark273 GB/s
ผู้นำตัวชี้วัดนี้: RTX 5090คอขวดของงาน decode (สร้าง token ทีละตัว) — RTX 5090 นำ ~6.5×
02 · ลองเอง

โมเดลนี้ใส่ลงเครื่องไหนได้

เลือกโมเดล + ความละเอียด → ดูว่าหน่วยความจำพอใน 32GB (5090) และ 128GB (Spark) ไหม นี่คือหัวใจของการเลือก: ขนาดโมเดล เป็นตัวตัดสิน ไม่ใช่ความเร็ว

ต้องใช้หน่วยความจำ ≈ 40.3 GB (70B × 0.5 ไบต์ × 1.15)

RTX 509032 GB
32 / 32 GB — เกิน!

✗ OOM — เกินไป ~8 GB

DGX Spark128 GB
40 / 128 GB

✓ ใส่ได้ (เหลือ ~88 GB)

ประมาณการ = พารามิเตอร์ × ไบต์/พารามิเตอร์ × 1.15 (เผื่อ KV-cache/activation) — ค่าจริงต่างตาม context length & engine · DGX Spark ต่อ 2 เครื่อง (ConnectX-7) รันได้ถึง ~405B

03 · เบนช์มาร์กจริง

GPT-OSS 20B — เมื่อโมเดลใส่ได้ทั้งคู่

เบนช์มาร์กอิสระจาก LMSYS ผ่าน Ollama — โมเดลใส่ได้ใน 32GB ทั้งคู่ จึงเป็นการแข่งความเร็วล้วน RTX 5090 เร็วกว่า ~4.1× เพราะแบนด์วิดท์สูงกว่า ~6.5×

Prefill (prompt processing) · 5090 เร็วกว่า ~4.1×
RTX 50908,519 tps
DGX Spark2,053 tps
Decode (token generation) · 5090 เร็วกว่า ~4.1×
RTX 5090205 tps
DGX Spark49.7 tps

📌 บนโมเดลที่ ใส่ไม่ลง 32GB (เช่น 70B–235B) RTX 5090 ทำไม่ได้เลย — DGX Spark ชนะโดยปริยายเพราะ “รันได้” (ดูหัวข้อ โมเดลนี้ใส่ลงเครื่องไหน)

04 · พลังงาน

575W เป็นแค่ค่า rated — ของจริงพีคสูงกว่า

RTX 5090 ระบุ TGP 575W (sustained) แต่ค่าที่รีวิวเวอร์วัดได้พุ่งสูงกว่ามากช่วง transient จึงต้องใช้ PSU 1000W+ ส่วน DGX Spark ทั้งเครื่องกินแค่ 240W

RTX 5090 — โปรไฟล์พลังงาน (วัดจริง)

gaming เฉลี่ย 450–560W
transient 650–740W
peak ~901W

▲ 575W rated TGP · peak ~901W (TechPowerUp/Igor’s Lab, <1ms)

DGX Spark — ทั้งเครื่อง

240W ทั้งเครื่อง

▲ SoC 140W · ทั้งเครื่อง (PSU) 240W

05 · เลือกเครื่องไหน

สถานการณ์ของคุณคืออะไร

คลิกสถานการณ์ที่ใกล้เคียงที่สุด แล้วดูคำแนะนำ — RTX 5090 คือเครื่องมือความเร็ว ส่วน DGX Spark คือเครื่องมือความจุ

↑ เลือกสถานการณ์เพื่อดูคำแนะนำ