الأجهزةالدليل 2 من 2
ماك أم PC لتشغيل النماذج محلياً
آخر تحقّق من المصادر في .
أنت على وشك أن تدفع مالاً حقيقيّاً في حاسوب، وتريده أن يشغّل نماذج اللغة على مكتبك أنت. فريق يقول لك: اشترِ Mac؛ وفريق يقول: اشترِ PC ببطاقة رسوميّات كبيرة. وكلا الفريقين محقّ في شيء، ولا أحد منهما يقول لك في ماذا. هذا الدليل يضع الاثنين جنباً إلى جنب، بالأرقام التي ينشرها صانعوهما، ويريك أين يفوز كلّ واحد — كي تختار بحسب النماذج التي تريد تشغيلها، لا بحسب الفريق الذي صادف أن قرأت له أوّلاً.
رقمان يحسمان الأمر، ودليل الأجهزة الأوّل في هذا الموقع، أيّ جهاز يشغّل نموذجاً محلّيّاً، يشرحهما على الجهاز الذي عندك. الأوّل هو الذاكرة: النموذج ملفّ، ولا يعمل إلّا إذا اتّسع هذا الملفّ في ذاكرة الجزء الذي ينفّذ العمل — الذاكرة الموحّدة في جهاز Mac، أو ذاكرة بطاقة الرسوميّات نفسها في حاسوب PC. والثاني هو عرض نطاق الذاكرة: كم غيغابايت في الثانية يمكن قراءتها من تلك الذاكرة، وهو ما يحدّد سرعة خروج الكلمات من نموذج اتّسع.
وهذه المرّة لن تقرأ جهازك. ستكتب ملفّاً قصيراً واحداً يحمل أحجام ملفّات أحد عشر نموذجاً كما هي منشورة، ومواصفات ثمانية أجهزة كما هي منشورة — أربع تهيئات من Mac وأربع بطاقات رسوميّات من NVIDIA — ويطبع ما يتّسع في كلّ جهاز، وأقصى سرعة يمكن أن يبلغها كلّ واحد. لا شيء فيه مقيس في هذا الموقع. كلّ حجم وكلّ مواصفة مقتبس من صفحة صانعه، والمصدر مسمّى أدناه، والملفّ لا يفعل إلّا الحساب عليها. ولهذا أيضاً تكون مخرجاته واحدة على كلّ حاسوب، وحاسوبك منها.
ولا يوجد في هذه الصفحة أيّ سعر. فالسعر يتغيّر من أسبوع إلى أسبوع ومن بلد إلى آخر؛ أمّا ذاكرة الجهاز وعرض نطاقها فلا يتغيّران بعد أن يُباع. خذ الرقمين اللذين يعطيك إيّاهما هذا الدليل إلى المتجر، وقلّص القائمة بهما، ثمّ قارن الأسعار هناك، بين الأجهزة التي بقيت.
بنهاية هذا الدليل ستقدر
- تكتب قائمة النماذج التي تريد تشغيلها، وتقول كم ذاكرة يحتاج كلّ واحد منها، بملفّ واحد تشغّله بنفسك.
- تقول أيّ جهاز من ثمانية أجهزة حاليّة — أربع تهيئات من Mac وأربع بطاقات رسوميّات من NVIDIA — يستطيع حمل كلّ نموذج من أحد عشر نموذجاً شائعاً، وأيّها لا يستطيع.
- تحسب أقصى سرعة تسمح بها ذاكرة كلّ جهاز لنموذج وهو يكتب، وتشرح لماذا تسبق بطاقةُ رسوميّات تحمل النموذجَ جهازَ Mac يحمله، ولماذا يسبق Mac بطاقةً لا تحمله.
- تختار بين Mac وPC بالترتيب الصحيح: بأكبر نموذج تحتاجه أوّلاً، ثمّ بالسرعة.
قبل أن تبدأ
تحتاج شيئين، ولا يكلّفك أيّ منهما شيئاً.
- Node.js إصدار 22 أو أحدث. شغّل
node --version. يطبع إصداراً مثلv24.14.1، وهو الإصدار الذي جاءت منه المخرجات في هذه الصفحة. إن طبع رسالة خطأ، نزّل Node.js من موقعه الرسميّ. - طرفيّة في مجلّد فارغ. شغّل
mkdir mac-or-pcثمّcd mac-or-pc. الملفّ الذي ستكتبه لا يقرأ شيئاً من حاسوبك ولا يرسل شيئاً إلى أيّ مكان: بلا مفتاح، وبلا شبكة، وبلا تثبيت. ولا مفتاح هنا تحتاج إلى إبعاده عن الشيفرة، لا على ويندوز ولا على Mac، لأنّ لا شيء هنا يطلب مفتاحاً.
ولا تحتاج جهاز Mac ولا بطاقة رسوميّات لتتبع هذا الدليل. فالملفّ يجيب عن ثمانية أجهزة الأرجح أنّك لا تملكها، وهذا هو المقصود: أن تقرّر قبل أن تشتري.
الخطوة 1 — اكتب النماذج والذاكرة التي يحتاجها كلّ منها
أنشئ ملفّاً اسمه compare.mjs وضع فيه هذا:
models// The download size of each model at the size Ollama serves by default, as its library page lists
// it (the guide cites each). A file this size has to sit in memory to run.
const models = [
['llama3.2:1b', 1.3],
['llama3.2:3b', 2.0],
['qwen3:4b', 2.5],
['gemma3:4b', 3.3],
['llama3.1:8b', 4.9],
['qwen3:8b', 5.2],
['gemma3:12b', 8.1],
['qwen3:14b', 9.3],
['gemma3:27b', 17],
['qwen3:32b', 20],
['llama3.1:70b', 43],
];
// The rule of thumb of this site's first hardware guide, not a measurement: a model's file should
// take no more than three quarters of the memory it lives in, leaving the rest for the text it holds.
const fits = (sizeGb, memoryGb) => sizeGb <= memoryGb * 0.75;
console.log('model file needs at least');
for (const [name, sizeGb] of models) {
console.log(`${name.padEnd(15)} ${(sizeGb.toFixed(1) + ' GB').padEnd(9)} ${(sizeGb / 0.75).toFixed(1)} GB`);
}
المخرجات
model file needs at least
llama3.2:1b 1.3 GB 1.7 GB
llama3.2:3b 2.0 GB 2.7 GB
qwen3:4b 2.5 GB 3.3 GB
gemma3:4b 3.3 GB 4.4 GB
llama3.1:8b 4.9 GB 6.5 GB
qwen3:8b 5.2 GB 6.9 GB
gemma3:12b 8.1 GB 10.8 GB
qwen3:14b 9.3 GB 12.4 GB
gemma3:27b 17.0 GB 22.7 GB
qwen3:32b 20.0 GB 26.7 GB
llama3.1:70b 43.0 GB 57.3 GB
شغّله بالأمر node compare.mjs. يرجع جدول من أحد عشر صفّاً. هذا ما طبعه، وهكذا تقرؤه.
model file needs at least— ثلاثة أعمدة: اسم النموذج كما تكتبه Ollama، وحجم ملفّه، وأقلّ ذاكرة يحتاجها جهاز ليحمله بحسب قاعدة هذا الدليل.llama3.2:1b 1.3 GB 1.7 GB— أصغر نموذج في القائمة. ملفّ بحجم 1.3 غيغابايت يريد ذاكرة لا تقلّ عن 1.7 غيغابايت: 1.3 مقسومة على 0.75.qwen3:8b 5.2 GB 6.9 GB— منتصف القائمة، ونموذج شائع يبدأ به كثيرون. يريد 6.9 غيغابايت. والخطوة 3 تستعمله بوصفه النموذج الذي يستطيع كلّ جهاز حمله.qwen3:14b 9.3 GB 12.4 GB— آخر صفّ يحتاج أقلّ من 16 غيغابايت. تذكّره: هو أكبر نموذج يحمله جهاز بـ16 غيغابايت.gemma3:27b 17.0 GB 22.7 GBوqwen3:32b 20.0 GB 26.7 GB— أوّل صفّين يحتاجان أكثر من 16 غيغابايت. وعلى هذين الاثنين تدور الخطوة 2.llama3.1:70b 43.0 GB 57.3 GB— الأكبر. يريد أكثر من 57 غيغابايت من الذاكرة في مكان واحد.
القاعدة في الشيفرة اسمها fits، والتعليق فوقها يقول ما هي: قاعدة تقريبيّة لا قياس. ملفّ النموذج يجب ألّا يأخذ أكثر من ثلاثة أرباع الذاكرة التي يقيم فيها؛ والربع الأخير للنصّ الذي يحتفظ به النموذج وهو يعمل، وللنظام من حوله. والعمود الثالث هو القاعدة نفسها مقلوبة — حجم الملفّ مقسوماً على 0.75 — لتقرأ منه الذاكرة التي تبحث عنها قبل أن تنظر إلى أيّ جهاز.
والأحجام ليست مقيسة هنا أيضاً. تُدرِج مكتبة Ollama نموذج llama3.2:1b بحجم 1.3 غيغابايت وllama3.2:3b بحجم 2.0 غيغابايت. وتُدرِج qwen3:4b بحجم 2.5 غيغابايت ، وqwen3:8b بحجم 5.2 ، وqwen3:14b بحجم 9.3 ، وqwen3:32b بحجم 20. وتُدرِج gemma3:4b بحجم 3.3 غيغابايت ، وgemma3:12b بحجم 8.1 ، وgemma3:27b بحجم 17. وتُدرِج أخيراً llama3.1:8b بحجم 4.9 غيغابايت وllama3.1:70b بحجم 43. وكلّ رقم منها هو حجم الصيغة المضغوطة التي تقدّمها المكتبة افتراضيّاً، ولهذا يكون نموذج بثمانية مليارات مُعامِل ملفّاً بنحو 5 غيغابايت؛ ودليل الأجهزة الأوّل يشرح هذا الضغط، واسمه التكميم، في فقرة واحدة.
وإن لم يكن النموذج الذي تريده في القائمة، فابحث عن حجمه في صفحته من المكتبة وأضف صفّاً. الجدول لا يحتاج إلّا اسماً وحجماً.
الخطوة 2 — ضعها أمام ثمانية أجهزة
أضف هذا تحت شيفرة الخطوة 1، في الملفّ نفسه:
machines// Each machine's memory and memory bandwidth, as its maker's page states them (the guide cites
// each). On a Mac the memory is unified: all of it is where the model lives. On a PC it is the
// graphics card's own memory; the rest of the PC's memory is not counted here.
const machines = [
['Mac mini M6', 16, 153],
['Mac mini M6', 32, 170],
['MacBook Pro M5 Pro', 48, 307],
['MacBook Pro M5 Max', 128, 614],
['PC + RTX 5070', 12, 672],
['PC + RTX 5070 Ti', 16, 896],
['PC + RTX 5080', 16, 960],
['PC + RTX 5090', 32, 1792],
];
console.log('machine memory bandwidth models that fit largest that fits');
for (const [name, memoryGb, bandwidthGbs] of machines) {
const fitting = models.filter(([, sizeGb]) => fits(sizeGb, memoryGb));
const [largest, largestGb] = fitting.at(-1);
console.log(
`${name.padEnd(20)} ${(memoryGb + ' GB').padEnd(7)} ${(bandwidthGbs + ' GB/s').padEnd(11)} ` +
`${(fitting.length + ' of ' + models.length).padEnd(16)} ${largest} (${largestGb} GB)`,
);
}
المخرجات
machine memory bandwidth models that fit largest that fits
Mac mini M6 16 GB 153 GB/s 8 of 11 qwen3:14b (9.3 GB)
Mac mini M6 32 GB 170 GB/s 10 of 11 qwen3:32b (20 GB)
MacBook Pro M5 Pro 48 GB 307 GB/s 10 of 11 qwen3:32b (20 GB)
MacBook Pro M5 Max 128 GB 614 GB/s 11 of 11 llama3.1:70b (43 GB)
PC + RTX 5070 12 GB 672 GB/s 7 of 11 gemma3:12b (8.1 GB)
PC + RTX 5070 Ti 16 GB 896 GB/s 8 of 11 qwen3:14b (9.3 GB)
PC + RTX 5080 16 GB 960 GB/s 8 of 11 qwen3:14b (9.3 GB)
PC + RTX 5090 32 GB 1792 GB/s 10 of 11 qwen3:32b (20 GB)
شغّل node compare.mjs مرّة أخرى. يُطبع جدول الخطوة 1 أوّلاً، ثمّ جدول ثانٍ، صفّ لكلّ جهاز. هذا ما طبعه:
machine memory bandwidth models that fit largest that fits— لكلّ جهاز: الذاكرة التي يستطيع النموذج أن يقيم فيها، وسرعة قراءتها، وكم نموذجاً من الأحد عشر يتّسع فيها بحسب القاعدة، وأكبر نموذج منها.Mac mini M6 16 GB 153 GB/s 8 of 11 qwen3:14b (9.3 GB)— جهاز Mac mini كما يأتي، بـ16 غيغابايت. ثمانية من الأحد عشر تتّسع، حتى qwen3:14b.Mac mini M6 32 GB 170 GB/s 10 of 11 qwen3:32b (20 GB)— جهاز Mac mini نفسه مهيّأً بـ32 غيغابايت. يتّسع نموذجان آخران، gemma3:27b وqwen3:32b؛ ولا يبقى خارجه إلّا نموذج السبعين ملياراً. وعرض النطاق تحرّك أيضاً، من 153 إلى 170.MacBook Pro M5 Pro 48 GB 307 GB/s 10 of 11 qwen3:32b (20 GB)— الـ48 غيغابايت تحمل العشرة نفسها التي تحملها الـ32. وفي هذه القائمة لا تشتري الستّة عشر غيغابايت التي بينهما أيّ نموذج جديد، لأنّ النموذج التالي، llama3.1:70b، يحتاج 57.3. ما تشتريه هو عرض النطاق، وهذه هي الخطوة 3.MacBook Pro M5 Max 128 GB 614 GB/s 11 of 11 llama3.1:70b (43 GB)— الجهاز الوحيد في القائمة الذي يحمل الأحد عشر كلّها.PC + RTX 5070 12 GB 672 GB/s 7 of 11 gemma3:12b (8.1 GB)— الأقلّ. فـqwen3:14b يحتاج 12.4 غيغابايت، والبطاقة فيها 12.PC + RTX 5070 Ti 16 GB 896 GB/s 8 of 11 qwen3:14b (9.3 GB)وPC + RTX 5080 16 GB 960 GB/s 8 of 11 qwen3:14b (9.3 GB)— الثمانية نفسها التي يحملها Mac mini بـ16 غيغابايت، لا أكثر ولا أقلّ.PC + RTX 5090 32 GB 1792 GB/s 10 of 11 qwen3:32b (20 GB)— أكبر بطاقة تحمل بالضبط ما يحمله Mac mini بـ32 غيغابايت.
والآن اقرأ الأعمدة لا الصفوف. عند الذاكرة نفسها يحمل Mac والبطاقة النماذج نفسها تماماً: 16 غيغابايت تحمل ثمانية في الحالتين، و32 تحمل عشرة في الحالتين. فما تستطيع تشغيله يقرّره حجم الذاكرة التي تجمعها في مكان واحد، وفي هذه القائمة تصل أجهزة Mac إلى 128 غيغابايت بينما تقف أكبر بطاقة عند 32. أمّا سرعة التشغيل فهي عمود عرض النطاق، وهناك كلّ بطاقة تسبق كلّ Mac: أبطأ بطاقة في القائمة، بـ672 غيغابايت في الثانية، أسرع من أسرع Mac، بـ614.
والمواصفات مأخوذة من صفحات صانعيها أنفسهم. صفحة المقارنة عند NVIDIA تضع بطاقاتها جنباً إلى جنب، بادئةً بـRTX 5090 ثمّ RTX 5080 ثمّ RTX 5070 Ti ثمّ RTX 5070، بهذا الترتيب. وبالترتيب نفسه تُدرِج ذاكرتها القياسيّة: 32 و16 و16 و12 غيغابايت من نوع GDDR7 ، وعرض نطاق ذاكرتها: 1792 و960 و896 و672 غيغابايت في الثانية.
وتُدرِج مواصفات Mac mini من Apple شريحة M6 بعرض نطاق ذاكرة 153 غيغابايت في الثانية ، وذاكرة موحّدة 16 غيغابايت تُهيَّأ إلى 24 أو 32 غيغابايت، بعرض نطاق 170 غيغابايت في الثانية. ولهذا لجهاز Mac mini صفّان بعرضَي نطاق مختلفين: جهاز الستّة عشر غيغابايت كما يأتي، وتهيئة الاثنين والثلاثين. وتُدرِج مواصفات MacBook Pro من Apple شريحة M5 Pro بعرض نطاق 307 غيغابايت في الثانية ، وشريحة M5 Max بـ460 غيغابايت في الثانية مع معالج رسوميّات من 32 نواة، و614 مع معالج من 40 نواة. والصفحة نفسها تُدرِج الـ48 غيغابايت تهيئةً لـM5 Pro، والـ128 غيغابايت تهيئةً لـM5 Max بمعالج الأربعين نواة وحده — ولهذا يحمل صفّ الـ128 غيغابايت الرقم 614 لا 460.
وصفوف PC الأربعة تعدّ ذاكرة البطاقة ولا شيء غيرها. فللحاسوب ذاكرة نظام خاصّة به أيضاً، والتعليق في الشيفرة يقول إنّها متروكة عمداً؛ وأوّل خطأ شائع أدناه يشرح السبب.
الخطوة 3 — احسب أقصى سرعة يستطيع كلّ جهاز أن يكتب بها
أضف هذا تحت شيفرة الخطوة 2:
speed-ceiling// This guide's estimate, not a measurement: to write each token the model reads its whole file from
// memory once, so memory bandwidth divided by the file size is the most tokens per second that
// memory could allow. Real runs come in under it. A model that does not fit gets no number.
const picks = ['qwen3:8b', 'gemma3:27b'];
console.log(`ceiling in tokens per second ${picks.map((pick) => pick.padEnd(14)).join('')}`.trimEnd());
for (const [name, memoryGb, bandwidthGbs] of machines) {
const cells = picks.map((pick) => {
const [, sizeGb] = models.find(([model]) => model === pick);
return fits(sizeGb, memoryGb) ? `${Math.floor(bandwidthGbs / sizeGb)} t/s` : 'does not fit';
});
console.log(`${name.padEnd(29)}${cells.map((cell) => cell.padEnd(14)).join('')}`.trimEnd());
}
المخرجات
ceiling in tokens per second qwen3:8b gemma3:27b
Mac mini M6 29 t/s does not fit
Mac mini M6 32 t/s 10 t/s
MacBook Pro M5 Pro 59 t/s 18 t/s
MacBook Pro M5 Max 118 t/s 36 t/s
PC + RTX 5070 129 t/s does not fit
PC + RTX 5070 Ti 172 t/s does not fit
PC + RTX 5080 184 t/s does not fit
PC + RTX 5090 344 t/s 105 t/s
شغّل node compare.mjs مرّة ثالثة. بعد الجدولين يأتي جدول ثالث، لنموذجين: qwen3:8b، الذي يحمله كلّ جهاز، وgemma3:27b، الذي لا يحمله إلّا أربعة. وكلّ رقم فيه سقفٌ بالرموز في الثانية — t/s، والرمز كلمة أو جزء من كلمة.
Mac mini M6 29 t/s does not fit— جهاز Mac mini بـ16 غيغابايت يستطيع أن يكتب بـqwen3:8b بما لا يزيد على 29 رمزاً في الثانية، ولا يستطيع حمل gemma3:27b أصلاً.Mac mini M6 32 t/s 10 t/s— ومع 32 غيغابايت يتّسع gemma3:27b، بسقف 10.MacBook Pro M5 Pro 59 t/s 18 t/sوMacBook Pro M5 Max 118 t/s 36 t/s— لشريحة M5 Max ضعف عرض نطاق M5 Pro، 614 مقابل 307، وضعف سقفها على qwen3:8b، 118 مقابل 59.PC + RTX 5070 129 t/s does not fitوPC + RTX 5070 Ti 172 t/s does not fitوPC + RTX 5080 184 t/s does not fit— على qwen3:8b تسبق كلّ بطاقة كلّ Mac، وأصغر بطاقة منها. وعلى gemma3:27b لا رقم لأيّ من الثلاث، لأنّ لا واحدة منها تحمله.PC + RTX 5090 344 t/s 105 t/s— أعلى سقف على النموذجين، وعلى gemma3:27b أكثر من عشرة أضعاف سقف Mac mini بـ32 غيغابايت: 105 مقابل 10.
والحساب في الشيفرة، والتعليق فوقه يقول صراحةً إنّه تقدير هذا الدليل وليس قياساً. فلكي يكتب النموذج كلّ رمز، يقرأ أرقامه كلّها من الذاكرة مرّة واحدة. فإن كانت الذاكرة تسلّم 153 غيغابايت في الثانية والملفّ 5.2 غيغابايت، فأقصى ما يمكن أن يُقرأ به الملفّ 29 مرّة في الثانية: 153 مقسومة على 5.2 تساوي 29.4، والشيفرة تقرّب إلى الأدنى. والتشغيل الحقيقيّ يأتي دون سقفه، لأنّ الجهاز يفعل لكلّ رمز أكثر من قراءة الملفّ. فالسقوف لمقارنة الأجهزة بعضها ببعض، لا وعداً بما ستراه.
وهل هذا هو الشكل الصحيح؟ اختبار منشور يقول نعم. ففي مناقشة على مشروع llama.cpp جدولٌ لشرائح Apple وهي تولّد النصّ بنموذج واحد. وفيه تولّد شريحة M4 بعرض نطاق 120 غيغابايت في الثانية ومعالج رسوميّات من 10 أنوية 24.11 رمزاً في الثانية عند Q4_0 ، وتولّد شريحة M5 Max بعرض نطاق 614 غيغابايت في الثانية ومعالج من 40 نواة 119.92 رمزاً في الثانية. ومن الشريحة الأولى إلى الثانية يكبر عرض النطاق 5.1 مرّة (614 مقسومة على 120)، وتكبر الرموز في الثانية 5.0 مرّات (119.92 مقسومة على 24.11). السرعة تبعت عرض النطاق تقريباً بالضبط. غير أنّ ذلك الجدول يقيس نموذجاً غير نماذج الخطوة 3 — Llama 2 7B، كما يسمّيه عنوان رسمه البيانيّ — فلا تُوضع أرقامه أمام صفوف الخطوة 3. ما ينتقل منه هو النسبة، والنسبة هي بالضبط ما يفترضه السقف.
القاعدة الوحيدة
الذاكرة تقرّر أيّ النماذج تستطيع تشغيلها؛ وعرض النطاق يقرّر بأيّ سرعة تعمل. جهاز Mac يبيعك الأولى: في هذه القائمة، ذاكرة في مكان واحد أكثر من أيّ بطاقة. وبطاقة الرسوميّات تبيعك الثانية: عرض نطاق أعلى من أيّ Mac، حتى حافّة ذاكرتها ولا بايت بعدها.
فاختر بهذا الترتيب. جد أكبر نموذج تحتاجه في جدول الخطوة 1، واترك من جدول الخطوة 2 الأجهزة التي تحمله وحدها، ثمّ خذ من بينها أعلى سقف في الخطوة 3.
| أكبر نموذج تحتاجه | الأجهزة التي تحمله في هذه القائمة | أعلى سقف بينها |
|---|---|---|
| حتى qwen3:14b، أي 9.3 غيغابايت | كلّها إلّا RTX 5070، فذاكرتها الـ12 تقف عند gemma3:12b | RTX 5090، ثمّ RTX 5080 و5070 Ti: 344 و184 و172 رمزاً في الثانية على qwen3:8b |
| gemma3:27b أو qwen3:32b، بين 17 و20 غيغابايت | RTX 5090، وMac mini بـ32 غيغابايت، وMacBook Pro بشريحة M5 Pro أو M5 Max | RTX 5090: 105 رموز في الثانية على gemma3:27b، مقابل 36 لأفضل Mac |
| llama3.1:70b، أي 43 غيغابايت | MacBook Pro بشريحة M5 Max و128 غيغابايت، وحده | هو الوحيد، فهو الخيار الوحيد |
الصفّ الأوّل هو حيث تفوز البطاقة بلا نقاش: بطاقات الستّة عشر غيغابايت تحمل النماذج الثمانية نفسها التي يحملها Mac mini بـ16 غيغابايت، بسقوف أعلى بنحو ستّة أضعاف. والصفّ الأخير هو حيث يفوز Mac بلا نقاش: لا بطاقة في القائمة تحمل النموذج أصلاً. أمّا الصفّ الأوسط فهو الذي يستحقّ التفكير، والجواب فيه يتوقّف على مقدار ما تهتمّ بالسرعة هناك.
متى تستخدمه ومتى لا
| الحالة | القرار | السبب |
|---|---|---|
| أكبر نموذج تحتاجه 9.3 غيغابايت أو أقلّ، أي qwen3:14b أو أصغر | حاسوب PC ببطاقة 16 غيغابايت | تحمل النماذج الثمانية نفسها التي يحملها Mac mini بـ16 غيغابايت، بسقف بين 172 و184 رمزاً في الثانية مقابل 29 على qwen3:8b |
| تحتاج gemma3:27b أو qwen3:32b، والسرعة تهمّك | حاسوب PC ببطاقة RTX 5090 | تحملهما، بـ105 رموز في الثانية على gemma3:27b مقابل ما بين 10 و36 على أجهزة Mac التي تحمله |
| تحتاج llama3.1:70b على جهاز واحد | MacBook Pro بشريحة M5 Max و128 غيغابايت | هو الجهاز الوحيد في هذه القائمة الذي يحمله؛ ولا بطاقة هنا فيها أكثر من 32 غيغابايت |
| تختار بحسب AI TOPS أو عدد الأنوية | لا | هذه تتبع سرعة قراءة موجِّهك، لا سرعة كتابة الجواب |
| تريد Mac mini بـ16 غيغابايت لنماذج أكبر من 9.3 غيغابايت | لا | يحمل ثمانية من الأحد عشر، كما تفعل بطاقة بـ16 غيغابايت؛ هيّئه بـ32 أو اختر جهازاً آخر |
| تريد أن تتعلّم بنماذج صغيرة قبل أن تشتري | ابدأ بالجهاز الذي عندك | أوّل ستّة نماذج في الخطوة 1 تحتاج 6.9 غيغابايت أو أقلّ؛ ودليل الأجهزة الأوّل يقرأ ما يحمله جهازك |
مصطلحات مرّت معنا
- الذاكرة الموحّدة — بركة الذاكرة الواحدة في Mac، يتقاسمها المعالج وأنوية الرسوميّات؛ ويقيم النموذج فيها مباشرةً.
- ذاكرة بطاقة الرسوميّات — الذاكرة التي على بطاقة الرسوميّات في PC، منفصلة عن ذاكرة نظام الحاسوب؛ وعلى PC يجب أن يتّسع النموذج فيها ليعمل بسرعة البطاقة.
- عرض نطاق الذاكرة — كم غيغابايت في الثانية يمكن قراءتها من الذاكرة، ويُكتب GB/s؛ وهو الرقم الذي يحدّد سرعة كتابة نموذج اتّسع.
- التهيئة — أحد أحجام الذاكرة التي يعرضها الصانع لجهاز واحد؛ فالـ16 والـ32 غيغابايت في Mac mini تهيئتان بعرضَي نطاق.
- الرمز وt/s — الرمز كلمة أو جزء من كلمة؛ وt/s تعني الرموز في الثانية، أي السرعة التي يكتب بها النموذج.
- سقف السرعة — تقدير هذا الدليل: عرض النطاق مقسوماً على حجم ملفّ النموذج، أي أقصى عدد من الرموز في الثانية تسمح به الذاكرة. والتشغيل الحقيقيّ يأتي دونه.
- قاعدة الأرباع الثلاثة — قاعدة هذا الدليل التقريبيّة: ملفّ النموذج يجب ألّا يأخذ أكثر من ثلاثة أرباع الذاكرة التي يقيم فيها.
- رقم AI TOPS — تريليونات العمليّات في الثانية، رقم قدرة الحوسبة في البطاقة؛ وهو يتبع سرعة قراءة الموجِّه، لا سرعة كتابة الجواب.
- معالجة الموجِّه وتوليد النصّ — قراءة ما أعطيته للنموذج، وكتابة الجواب؛ الأولى تعتمد على الحوسبة، والثاني على عرض النطاق.
- التكميم — تخزين أرقام النموذج ببتّات أقلّ كي يصغر الملفّ؛ وهو سبب أن يكون نموذج بثمانية مليارات مُعامِل ملفّاً بخمسة غيغابايت.
الخلاصة
اختر بأكبر نموذج تحتاجه أوّلاً: عند 16 أو 32 غيغابايت يحمل Mac والبطاقة النماذج نفسها، ولا يحمل نموذجاً بـ43 غيغابايت في هذه القائمة إلّا Mac. ثمّ، بين الأجهزة التي تحمله، يحدّد عرض النطاق السرعة، وكلّ بطاقة في القائمة أسرع من كلّ Mac. وقارن الأسعار في النهاية، وبين الأجهزة التي اجتازت الاثنين وحدها.
ما تغيّر مؤخراً
لم يتغيّر أيّ مصدر من مصادر هذا الدليل منذ آخر فحص.