Ollama
Ollama 0.40 يشغّل النماذج المدعومة على MLX تلقائيّاً في أجهزة Apple Silicon
فُحص آلياً على صفحة Ollama في .
يغيّر Ollama 0.40.0 المحرّك الذي يشغّل نماذجك على جهاز Mac بمعالج Apple Silicon: كلّ نموذج تدعم بيئةُ التشغيل MLX بنيتَه صار يعمل على MLX تلقائيّاً. والإصدار الذي يثبّته التحديث هو v0.40.1، وتاريخه 7 تشرين الأول الساعة 23:22. أمّا صفحة v0.40.0 فتحمل تاريخاً أقدم، 25 أيلول الساعة 03:31 ، لأنّ GitHub يؤرّخ الإصدار باليوم الذي فُتحت فيه صفحته، وهذه فُتحت يوم كان الإصدار ما يزال تجريبياً. والمحرّك هنا هو البرنامج الذي يحمّل ملفّ النموذج في الذاكرة ويحسب منه الإجابات. إن كنت تستخدم Ollama على Mac بمعالج Apple Silicon، فهذا هو الإصدار الذي يتبدّل فيه المحرّك تحت عدد من النماذج الشائعة دون أن تطلب ذلك؛ أمّا على أيّ جهاز آخر، فالخبر الرئيسي في هذا الإصدار لا يخصّك.
ما الذي تغيّر
تقولها ملاحظة الإصدار في عنوانها: النماذج تعمل على MLX افتراضيّاً في أجهزة Apple Silicon. والذي يحسم الأمر بنيةُ النموذج لا اسمه — والبنية هي التصميم الداخلي الذي تشترك فيه عائلة كاملة من النماذج: كلّ بنية تدعمها بيئة التشغيل MLX تنتقل إليها. ومثال الصفحة نفسها هو qwen3.8، تنزّله وتشغّله بالأمرين المعتادينollama pull qwen3.8 وollama run qwen3.8. وتسمّي الصفحة بعده gemma4 وqwen3.6 وqwen3.5.
ويأتي معها نوعان آخران من النماذج. الأوّل نماذج القرار — Nimble وtev1 وclef وclef-flash — وقد صارت متاحة على MLX أيضاً ؛ وهي نماذج لا تكتب لك نصّاً، بل تُرجع خيارات واحتمالات ودرجات. والثاني نموذج تضمين: صارت MLX تدعم embeddinggemma-2 ، ونموذج التضمين هو الذي يحوّل المقطع من النصّ إلى أرقام، كي يجد البحثُ في مستنداتك المقاطعَ القريبة في المعنى لا في اللفظ فقط. وتختم الصفحة القائمة بنيّة لا بموعد: سيواصل المشروع اختبار نماذج إضافية وتفعيلها.
أمّا v0.40.1 فقائمة قصيرة من التغييرات فوقه. وفيها سطر واحد عن MLX: تخلّى المشروع عن تعديل يخصّ Metal كان يحمله بنفسه، بعد أن صار التعديل جزءاً من المشروع الأصلي. والباقي يخصّ أجهزة أخرى وأجزاء أخرى من Ollama: إصلاح لقراءة رأس clef بعد حدّ 2GiB على Windows ، وصار ملفّ البيان يتجنّب الروابط الرمزية على Windows ، واختفت خطوة الحساب من إعداد البداية في سطر الأوامر ، وصار الخادم يمرّر واجهتَي الاستخدام والرصيد السحابيّتين.
ما كان قبل ذلك
ليست MLX جديدة على Ollama. فالصفحة تعرض تغييراتها على أنّها التغييرات منذ v0.35.1 ، وذلك الإصدار حدّث llama.cpp ومحرّك MLX كليهما — أي أنّ Ollama كان يحمل محرّكين من قبل، والذي غيّره 0.40.0 هو المحرّك الذي يحصل عليه النموذج المدعوم افتراضيّاً على Apple Silicon. ونموذجان من نماذج القرار وصلا قبله بقليل: أضاف 0.35.1 دعم Clef وClef Flash، نموذجَي القرار مفتوحَي المصدر من Cloudflare، عبر/v1/systemone. ولا تقول الصفحات على أيّ محرّك كان كلّ واحد من هذه النماذج يعمل قبل 0.40.0.
ما معناه لك
إن كان عندك Mac بمعالج Apple Silicon، فالتحديث هو الخطوة كلّها: لا شيء عليك أن تفعّله. النموذج الذي تدعم MLX بنيته ينتقل إليها وحده. وإن كنت تشغّل qwen3.8 ، أو gemma4 أو qwen3.6 أو qwen3.5 ، أو أحد نماذج القرار ، أو embeddinggemma-2 ، فنموذجك في القائمة التي تسمّيها الصفحة. وإن لم يكن نموذجك مذكوراً، فالصفحة لا تعطي قائمة كاملة بالبُنى المدعومة — بل تقول فقط إنّ نماذج أخرى ستُفعَّل بعد اختبارها.
حدّث مباشرة إلى 0.40.1 ولا تتوقّف عند 0.40.0: فهو الأحدث بين الاثنين، وسطره عن MLX هو التغيير الوحيد فيه الذي يمسّ MLX.
وكي تفحص التغيير بنفسك، ابدأ بما لا تعطيك إيّاه الصفحة: لا تذكر أيّ أمر يُظهر على أيّ محرّك يعمل النموذج المحمَّل. فافحص ما تستطيع رؤيته. قبل أن تحدّث، شغّل النموذج الذي تستخدمه أكثر من غيره — ollama run qwen3.8إن كنت تتبع مثال الصفحة — بسؤال واحد تحتفظ به، وسجّل كم تستغرق الإجابة وكم من الذاكرة يستهلك الجهاز؛ وبعد التحديث أعد السؤال نفسه. الصفحة لا تعطي أرقاماً للسرعة، فقياساك هذان هما كلّ ما ستملكه. أمّا ما يحدّد السرعة على Mac — كم من الذاكرة فيه وبأيّ سرعة تُقرأ — فيشرحه دليلناماك أم PC لتشغيل النماذج محلياً، ويريك دليل أيّ جهاز يشغّل نموذجاً محلّيّاً كيف تقرأ هذين الرقمين على الجهاز الذي بين يديك.
وإن ساء شيء بعد التحديث، فاعرف أين تتوقّف الصفحات: لا تذكر أيّ منهما إعداداً يعيد النموذج عن MLX، ولا طريقة تختار بها المحرّك بنفسك. ما تقوله هو أنّ العمل مستمرّ، وأنّ نماذج أخرى ما زالت قيد الاختبار والتفعيل. فإن صار نموذج تعتمد عليه أبطأ بعد التحديث، أو صارت إجاباته مختلفة، فاحتفظ بملاحظاتك قبل التحديث وبعده، وأبلغ المشروع بها مع اسم النموذج ورقم الإصدار الذي حدّثت إليه.
وإن كنت تستخدم embeddinggemma-2 للبحث في مستنداتك، وعندك فهرس بنيته قبل التحديث، فالصفحة لا تقول شيئاً عن بقاء الأرقام التي يُنتجها كما هي على MLX. أعد تضمين بضعة مقاطع وقارنها بالمحفوظة قبل أن تخلط القديم بالجديد في فهرس واحد.
المصدر
صفحتا الإصدار على GitHub: Ollama v0.40.0 وOllama v0.40.1؛ ولما كان قبلهما: Ollama v0.35.1 وOllama v0.35.0.