Neurohive→ المصدر

Bonsai 27B от PrismML: модель Qwen3-27B впервые запустили на смартфоне

PrismML, стартап исследователей Caltech, представил Bonsai 27B — первую 27-миллиардную языковую модель, запущенную прямо на смартфоне. В основе — 1-битные и тернарные веса модели Qwen3.6-27B: сжатие в 9.4–14.2 раза при сохранении 90–95% качества. Тернарная версия (5.9 ГБ) работает на ноутбуке со скоростью ~26 токенов/с, а 1-битная умещается в 3.9 ГБ и запускается на телефоне.

معالج بواسطة الذكاء الاصطناعي من Neurohive؛ بتحرير Hamidun News
Bonsai 27B от PrismML: модель Qwen3-27B впервые запустили на смартфоне
المصدر: Neurohive. كولاج: Hamidun News.
◐ استمع للمقال

قدّمت شركة PrismML الناشئة، التي أسّسها باحثون من معهد كاليفورنيا للتكنولوجيا (Caltech)، نموذج Bonsai 27B — وهو أول نموذج لغوي في العالم يضم 27 مليار معامل ويعمل بنجاح على هاتف ذكي. تعتمد هذه التقنية على أوزان أحادية البت وثلاثية القيم، مما يتيح ضغط نموذج Qwen3.6-27B بمعدل 9.4 إلى 14.2 مرة مع الحفاظ على 90–95% من الجودة الأصلية.

كيف يعمل Bonsai 27B

لا يُعدّ Bonsai 27B بنيةً معماريةً جديدة، بل هو نسخة محسّنة بصورة فائقة من نموذج Qwen3.6-27B مفتوح المصدر من Alibaba. أصدرت PrismML نسختين بدرجات متفاوتة من التكميم: ثلاثية القيم (تأخذ الأوزان فيها القيم –1 أو 0 أو +1) وثنائية (–1 و+1 فقط). تُعرف هذه الطريقة بالتكميم ما بعد التدريب — إذ تُضغط الأوزان الأصلية بعد انتهاء التدريب دون الحاجة إلى إعادة تدريب من الصفر.

المواصفات التفصيلية للنسختين:

  • النسخة ثلاثية القيم: 5.9 جيجابايت، بسرعة نحو 26 رمزاً في الثانية على حاسوب محمول قياسي
  • النسخة أحادية البت (الثنائية): 3.9 جيجابايت، تتناسب مع ذاكرة الوصول العشوائي في الهاتف الذكي
  • نسبة ضغط الأوزان: 9.4–14.2 مرة مقارنةً بالنموذج الأصلي
  • الحفاظ على الجودة: 90–95% من أداء Qwen3.6-27B الكامل
  • المطوّر: PrismML (أسّسها باحثون من Caltech)

يبلغ حجم النموذج الأصلي Qwen3.6-27B بصيغة fp16 أكثر من 50 جيجابايت ويستلزم وجود GPU خادم. أما النسخة أحادية البت من Bonsai 27B فهي أصغر بـ 13 مرة.

لماذا تُغيّر الأوزان أحادية البت قواعد اللعبة

في نماذج اللغة القياسية، يُخزَّن كل معامل بـ 16 أو 32 بتاً. يعني التحوّل إلى تمثيل أحادي البت أن «الوزن» هو حرفياً صفر أو واحد. يُقلّص هذا التحوّل حجم الذاكرة المستخدمة بصورة جذرية ويُسرّع عملية الاستدلال على الأجهزة التي لا تمتلك GPU مخصصة.

وفقاً لنشر PrismML، فإن هذا النهج تحديداً هو ما أتاح تشغيل النموذج على هاتف ذكي عادي دون الاتصال بالسحابة — وهو أمر كان يُعدّ مستحيلاً قبل عام واحد فقط لنماذج بحجم 27 مليار معامل. في السابق، كانت LLMs المحمولة محدودة بنماذج تتراوح بين 1 و7 مليارات معامل، كـ Gemma 2B من Google وPhi-3.5-mini من Microsoft.

«يُظهر

Bonsai 27B أن الحدود بين الحوسبة السحابية والحوسبة الطرفية (edge) تتلاشى بسرعة»، وفقاً للإعلان الرسمي لشركة PrismML.

نُشرت كلتا نسختي النموذج في وصول مفتوح على منصة Hugging Face، ويمكن للمطورين البدء بالتجربة الآن.

ما الذي يعنيه هذا

يُعدّ تشغيل نموذج بـ 27 مليار معامل على هاتف ذكي عتبةً تكنولوجيةً مهمة: ستتمكن نماذج اللغة القوية من العمل على مليارات الأجهزة الموجودة دون الحاجة إلى بنية تحتية سحابية، مع الحفاظ الكامل على خصوصية البيانات وفي وضع عدم الاتصال. بهذه النتيجة، أكّدت PrismML أن التكميم أحادي البت تحوّل من فكرة أكاديمية إلى أداة عملية.

الأسئلة الشائعة

هل يمكن تشغيل Bonsai 27B على iPhone أو Android؟

النسخة أحادية البت ذات الحجم البالغ 3.9 جيجابايت تعمل على هاتف ذكي عادي دون الاتصال بالسحابة — وهذا بالضبط ما أثبتته PrismML في إعلانها.

كيف يختلف Bonsai 27B عن Qwen3.6-27B؟

Bonsai 27B هو Qwen3.6-27B بأوزان مضغوطة بصورة فائقة. طبّقت PrismML التكميم أحادي البت والثلاثي، مما أتاح تقليص حجم النموذج بمعدل 9.4–14.2 مرة مع الحفاظ على 90–95% من جودة النموذج الأصلي.

ZK
Hamidun News
أخبار الذكاء الاصطناعي بدون ضوضاء. اختيار تحريري يومي من أكثر من 50 مصدر. منتج من جمال حميدون، رئيس الذكاء الاصطناعي في Alpina Digital.

هل تحتاج إلى ذكاء اصطناعي يعمل داخل شركتك — وليس فقط في موجز الأخبار؟

أبني ذكاءً اصطناعياً جاهزاً للإنتاج للشركات — أنظمة CRM مخصّصة، أدوات داخلية، وكلاء مستقلون، أتمتة سير العمل. ملك لك، مصمّم وفق عمليتك، دون رسوم لكل مستخدم. من إعداد جمال خميدون، مدير المنتجات في AlpinaGPT (منصة ذكاء اصطناعي، أكثر من 6000 مستخدم).

ما رأيك؟
جارٍ تحميل التعليقات…