מחשבון קיבולת
AI מקומי
תכננו הרצת Qwen3.8, Qwen3.5 ו-Gemma 4 על Apple Silicon (מ-M1 עד M6, כולל M5 Ultra) ועל NVIDIA RTX. העריכו משקל דגם, מטמון KV, מקביליות בטוחה, תקרת פענוח ויחס זיכרון למחיר לפני הרכישה.
נתוני הקיבולת והפענוח הם אומדני תכנון שמרניים. הזיכרון האחוד משותף ל-macOS וליישומים; התוצאה בפועל תלויה בקובץ, בזמן הריצה, בהקשר, באצווה ובמצב התרמי. חישוב KV משתמש בתצורות הטקסט הרשמיות: מטמון קשב מלא שגדל עם ההקשר ומטמון ההחלקה של Gemma שמוגבל ל-1,024 טוקנים (בהנחה שמרנית של K ו-V נפרדים). מצב רקורסיבי של Qwen, מקרני ראייה, MTP והקצאות זמן ריצה אינם כלולים בסכום.
פירוט
חריצי סוכנים
💡 המלצות
🤖 בחירת דגם
🖥️ חומרה
⚖️ כימות (Quantization) וזמן ריצה
Qwen3.8 משתמש בגדלים מדויקים של ארטיפקטי המקור. GGUF מתאים ל-llama.cpp/Ollama; MLX דורש ארטיפקט שהומר, ויש לבדוק את גודלו הסופי. כרטיס הדגם הרשמי. אומדן פענוח מוצג רק כאשר החומרה, זמן הריצה ונתיב הארטיפקט המיוצג תואמים.
🔀 מקביליות והקשר
טבלת עזר ל-2026 — Qwen3.8-27B ב-Q4_K_M
| חומרה | זיכרון | רוחב פס | מחיר בארה״ב | GB / $1K | התאמה ל-2 × 16k | פענוח משוער |
|---|---|---|---|---|---|---|
| M6 mini · 16 GB | 16 GB | 153 GB/s | $899 | 17.80 | ❌ OOM | ~8 t/s |
| M6 mini · 24 GB | 24 GB | 170 GB/s | $1,099 | 21.84 | ✅ צפוף | ~9 t/s |
| M6 mini · 32 GB | 32 GB | 170 GB/s | $1,299 | 24.63 | ✅ טוב | ~9 t/s |
| M5 Ultra · 96 GB | 96 GB | 1,200 GB/s | $5,499 | 17.46 | ✅ מרווח | ~63 t/s |
| M5 Ultra · 256 GB | 256 GB | 1,200 GB/s | $9,499 | 26.95 | ✅ מרווח | ~63 t/s |
| M5 Ultra · 512 GB | 512 GB | 1,200 GB/s | טרם פורסם | לא זמין | ✅ מרווח | ~63 t/s |
| M4 Max · 128 GB | 128 GB | 546 GB/s | לא במעקב | לא זמין | ✅ מרווח | ~29 t/s |
מקורות: ארכיטקטורת Qwen, גדלי קובצי GGUF שנצפו, והודעת ההשקה של Apple מ-25 באוגוסט.
המחירים הם מחירי מערכת מלאה בארה״ב לפני מס, נכון ל-30 באוגוסט 2026. מחיר M5 Ultra עם 512GB טרם פורסם והזמינות מתחילה בסוף אוקטובר.
נתוני הפענוח הם אומדני רוחב-פס למכשיר יחיד בהנחת יעילות 87% ב-llama.cpp, ולא בנצ׳מרקים נמדדים. פענוח בכמה GPU אינו זמין כאומדן, מפני שטופולוגיית PCIe/NVLink אינה מצדיקה חיבור של רוחבי הפס של הכרטיסים. הנתונים אינם כוללים את מקרן הראייה או קובץ MTP האופציונליים.
צריך עזרה בתכנון תשתית AI מקומית לצוות שלך?
דבר עם Dataxad