مستويات ذكاء هواتف AI من L1 إلى L4: كيف تفهم معيار الصين وتختبر الهاتف؟
دليل عربي عملي يشرح GB/Z 177-2026 لهواتف AI، أسماء L1 إلى L4 الرسمية، الفرق بين الإرشاد والاعتماد، وطريقة اختبار قابلة للتكرار مع مثال FoneClaw على Android.
- GB/Z 177-2026 إطار إرشادي صيني لذكاء المحطات الطرفية، ونطاق الجزء الثالث منه هو المحطات المحمولة، وليس شهادة اعتماد عامة لأي هاتف باسم تجاري.
- المستويات الرسمية هي L1 响应级، وL2 工具级، وL3 辅助级، وL4 协同级؛ وترتفع درجة الذكاء من الاستجابة إلى التعاون، مع بقاء L4 مجالًا يحتاج توضيحًا لاحقًا مع نضج الصناعة.
- اختبار ذكاء الهاتف يجب أن يفصل بين إنجاز المهمة، التحكم، التحقق من الحالة، الاسترداد، والتكرار بدل الاكتفاء بعرض تجريبي واحد.
- وفق أحدث معلومات FoneClaw المتاحة وقت تحديث هذا المقال، يمكن استخدام FoneClaw كمسار Android مستقل ومحكوم لاختبار الوصول العائم، سياق الشاشة بطلب المستخدم، استمرارية المهام، الموافقات، الإيقاف، والاسترداد دون منحه مستوى رسميًا.
ما هو GB/Z 177-2026 وما نطاقه؟
عندما نتحدث عن مستويات ذكاء هواتف AI من L1 إلى L4 في 2026، فنحن لا نتحدث عن شعار تسويقي جديد فقط. الصين نشرت في 30 أبريل 2026 سلسلة GB/Z 177-2026 الخاصة بتدرج ذكاء المحطات الطرفية المدعومة بالذكاء الاصطناعي. بحسب سجلات SAMR الرسمية، يغطي الجزء الأول إطار المرجع، ويغطي الجزء الثاني المتطلبات العامة، بينما يحدد الجزء الثالث نطاق المحطات المحمولة.
النقطة الأولى التي يجب تثبيتها هي أن GB/Z وثيقة إرشادية للتقييس الوطني، وليست في حد ذاتها إعلانًا بأن كل هاتف يحمل وصف AI أصبح معتمدًا عند مستوى معين. لذلك، إذا قرأت أن جهازًا ما “يشبه L3” أو “يقترب من L4”، فالسؤال الصحيح هو: ما نطاق الاختبار؟ أي جزء من السلسلة يُستخدم؟ وما الدليل القابل للتكرار على سلوك الهاتف؟
يوضح إعلان MIIT عن سلسلة تدرج ذكاء المحطات الطرفية أن البنية تتبع نمط 2+N، أي وثائق عامة مع امتدادات حسب فئات الأجهزة. أول دفعة تغطي سبع فئات من المحطات، والهواتف تقع داخل نطاق المحطات المحمولة في الجزء الثالث. هذا مهم للقارئ العربي لأن كلمة “هاتف AI” أصبحت فضفاضة: أحيانًا تعني مساعد دردشة، وأحيانًا نموذجًا على الجهاز، وأحيانًا وكيلًا ينفذ خطوات عبر التطبيقات.
في هذا الدليل نترجم الإطار إلى اختبار عملي للمستخدم والمطوّر. لن نمنح أي منتج مستوى رسميًا، ولن نحول الأمثلة إلى شهادة. هدفنا أن تفهم كيف تقرأ معيار هواتف الذكاء الاصطناعي، ثم تختبر الهاتف أو الوكيل بطريقة قابلة للإعادة.
شرح مستويات L1 إلى L4 دون مبالغة
الأسماء الرسمية للمستويات كما وردت في إعلان MIIT هي: L1 响应级، وL2 工具级، وL3 辅助级، وL4 协同级. يمكن شرحها عربيًا كالتالي: مستوى الاستجابة، مستوى الأداة، مستوى المساعدة، ومستوى التعاون. الإعلان يوضح أن درجة الذكاء ترتفع كلما تقدمنا في السلم، لكن ذلك لا يعطينا وحده قائمة عتبات رقمية يمكن تطبيقها على كل هاتف دون سياق.
L1، أو مستوى الاستجابة، هو نقطة البداية. الهاتف أو المساعد يفهم طلبًا مباشرًا ويرد عليه. قد يجيب عن سؤال، يلخص نصًا، أو يشرح صورة. هذه قدرة مفيدة، لكنها تبقى قريبة من “السؤال والجواب”. إذا توقفت التجربة عند الرد دون لمس حالة الجهاز أو تنفيذ خطوة، فهي لا تكفي وحدها للحديث عن مسار وكيل متقدم.
L2، أو مستوى الأداة، يضيف استعمال أدوات محددة. هنا يبدأ الهاتف في تنفيذ أمر مقيد: فتح تطبيق، تشغيل إعداد، التقاط لقطة شاشة، ضبط منبه، أو البحث داخل مصدر. الفرق عن L1 أن النتيجة ليست نصًا فقط؛ هناك أداة تعمل ضمن حدود معروفة. في المقابل، وجود أداة واحدة ناجحة لا يعني أن الهاتف أصبح قادرًا على تخطيط مهام طويلة.
L3، أو مستوى المساعدة، هو المستوى الذي يهم معظم من يبحثون عن هاتف AI بمستوى L3. الفكرة العملية هي أن النظام يستطيع مساعدة المستخدم عبر سياق ومراحل، لا تنفيذ أمر واحد منعزل فقط. قد يفهم ما يظهر على الشاشة، يقترح خطوة لاحقة، ينتقل بين تطبيقات مدعومة، يطلب موافقة عند الحاجة، ويتابع المهمة إذا تغيرت الحالة. لكن أي ادعاء عن L3 يحتاج اختبارات متكررة، لا عرضًا واحدًا في مؤتمر.
L4، أو مستوى التعاون، هو طموح أعلى: تعاون أعمق بين المستخدم والوكيل والبيئة الرقمية. MIIT نفسه يقول إن L4 سيجري توضيحه وتحسينه أكثر مع تطور الصناعة. لذلك نتعامل مع هاتف AI بمستوى L4 بحذر عملي: نبحث عن أدلة تعاون متكرر، تحكم واضح، واسترداد عند الفشل، ولا نفترض أن الاسم وحده يثبت النضج.
| المستوى | الاسم الرسمي | المعنى العملي للقارئ | ما لا يثبته وحده |
|---|---|---|---|
| L1 | 响应级 | يرد على طلب أو سؤال ويعطي نتيجة مفهومة. | لا يثبت قدرة تنفيذ عبر الهاتف. |
| L2 | 工具级 | يستخدم أداة محددة ضمن نطاق واضح. | لا يثبت تخطيطًا طويلًا أو متابعة سياق. |
| L3 | 辅助级 | يساعد عبر خطوات وسياق وأدوات مدعومة. | لا يثبت تعاونًا شاملًا في كل التطبيقات. |
| L4 | 协同级 | يتجه نحو تعاون أعمق بين المستخدم والوكيل والبيئة. | لا يثبت تعريفًا نهائيًا مكتملًا في 2026. |
الفرق بين المساعدة المفيدة والتعاون الحقيقي
الحد بين L3 وL4 هو أكثر جزء يسهل تضخيمه. كثير من العروض تبدو ذكية لأنها تنجح في مهمة مصممة بعناية: اقرأ شاشة، افتح تطبيقًا، اكتب ردًا، ثم اعرض النتيجة. هذا قد يكون مثالًا جيدًا على مساعدة عملية، لكنه لا يكفي لإثبات تعاون واسع. مستوى التعاون يحتاج ثباتًا عبر حالات متعددة، لا نجاحًا داخل مسار محفوظ.
عند اختبار هاتف AI بمستوى L3، ابحث عن ثلاث علامات. الأولى أن الهاتف يفهم السياق دون أن تضطر إلى إعادة شرح كل شيء. الثانية أنه يقسم المهمة إلى خطوات مفهومة ويعرف متى يحتاج أداة ومتى يحتاج تأكيدًا. الثالثة أنه يستطيع متابعة المهمة إذا توقفت خطوة بسبب إذن ناقص أو شاشة مختلفة. إذا توفرت هذه العلامات في مهام متنوعة، فأنت أمام مساعدة جدية يمكن تقييمها.
L4 يضيف سؤالًا أصعب: هل يتعاون الوكيل مع المستخدم بدل أن ينفذ سلسلة أوامر فقط؟ التعاون يعني أن يشرح حدود ما يعرفه، يقترح طريقًا، يطلب اختيارًا عندما تتعدد النتائج، يتراجع عن خطوة خطرة، ويحتفظ بسياق مفيد دون جعل المستخدم يفقد السيطرة. لهذا قالت MIIT إن L4 سيحتاج توضيحًا وتحسينًا مع تطور الصناعة؛ فالسوق لم يستقر بعد على طريقة واحدة لقياس التعاون الكامل.
إذا كنت تريد خلفية أوسع عن معنى الهاتف الوكيل في 2026 بعيدًا عن لغة المعايير، فدليل هاتف ذكاء اصطناعي وكيل: شرح عملي لتغير هواتف 2026 يشرح التحول من المساعد الذي يجيب إلى الهاتف الذي يساعد في إنجاز خطوة. في هذه الصفحة نبقي التركيز على كيف تُحوّل مستويات L1 إلى L4 إلى أسئلة اختبار واضحة.
اختبار عملي لذكاء هاتف AI
اختبار ذكاء الهاتف لا يبدأ بسؤال صعب، بل بإعداد ثابت. استخدم الجهاز نفسه، الحساب نفسه، اللغة نفسها، اتصال الشبكة نفسه، ونفس الأذونات قدر الإمكان. اكتب المهمة قبل التنفيذ، وسجل ما حدث بعد كل محاولة. الهدف ليس إنتاج رقم واحد، بل فصل خمسة أدلة: هل اكتملت المهمة؟ هل كان التحكم واضحًا؟ هل تحقق الهاتف من الحالة؟ هل استطاع الاسترداد؟ وهل يمكن تكرار النتيجة؟
هذا الاختبار الميداني لا يساوي تقييم مطابقة رسميًا ولا يمنح شهادة. لكنه يمنح المستهلك والمطوّر طريقة عادلة للمقارنة بين الهواتف والمساعدات ووكلاء Android. إذا أردت تصميم معيار أوسع لوكلاء Android تحديدًا، فلدينا دليل منفصل: معيار تقييم وكيل هاتف Android: كيف نختبر الوكلاء في 2026؟. هنا نعرض نسخة مختصرة قابلة للاستخدام مع أي هاتف AI.
| المهمة | ما تختبره | طريقة التنفيذ | ما تسجله |
|---|---|---|---|
| سؤال معرفة مباشر | L1: الاستجابة | اطلب شرح رسالة أو تلخيص فقرة ظاهرة. | دقة الرد، وضوحه، وهل احتاج معلومات غير متاحة. |
| أمر أداة بسيط | L2: الأداة | اطلب فتح تطبيق أو إنشاء منبه أو التقاط لقطة شاشة. | نجاح الأداة، الصلاحية المطلوبة، وحالة النتيجة بعد التنفيذ. |
| مهمة شاشة حالية | انتقال من L2 إلى L3 | اعرض صفحة أو تطبيقًا، ثم اطلب تفسيرًا وخطوة لاحقة. | هل فهم السياق؟ هل فصل بين القراءة والفعل؟ |
| مهمة متعددة الخطوات | L3: المساعدة | اطلب فتح تطبيق، تجهيز مسودة، ثم انتظار موافقتك. | استمرارية المهمة، نقطة الموافقة، ومنع التنفيذ غير المقصود. |
| فشل مقصود في الإذن | الاسترداد | اسحب إذنًا مطلوبًا أو استخدم حالة جهاز ناقصة. | هل شرح السبب؟ هل فتح مسار إصلاح؟ هل أكمل بعد الاسترداد؟ |
| سيناريو تعاون | قرب L4 دون ادعاء رسمي | أعطه هدفًا فيه خيارات ومخاطر، مثل ترتيب رسالة وموعد وتذكير. | هل سأل عند الغموض؟ هل عرض بدائل؟ هل حافظ على التحكم؟ |
عند قراءة النتائج، لا تجمع كل شيء في “نجح” أو “فشل”. هاتف قد يجيب جيدًا في L1 ويفشل في الاسترداد. مساعد قد يفتح تطبيقًا بسرعة لكنه لا يتحقق من النتيجة. وكيل قد يطلب موافقة لكنه لا يحافظ على المهمة بعد الرجوع من شاشة الإعدادات. هذا الفصل هو جوهر الاختبار الجيد.
تقييم الأذونات والموافقات والإيقاف والاسترداد
معيار هواتف الذكاء الاصطناعي يصبح مفيدًا عندما ننظر إلى التحكم بجدية. الذكاء ليس سرعة الرد فقط، ولا عدد الأدوات فقط. الهاتف الذي ينفذ خطوات على جهاز المستخدم يتعامل مع رسائل، إعدادات، صور، تقويم، مواقع، واتصالات. لذلك تحتاج كل مهمة مؤثرة إلى حدود أذونات وموافقة واضحة ومسار إيقاف واسترداد.
ابدأ من الأذونات. هل يشرح الهاتف لماذا يحتاج إذنًا؟ هل يوجهك إلى الإعداد الصحيح؟ هل يعرف أنه لا يستطيع المتابعة دون صلاحية محددة؟ ثم انتقل إلى الموافقات. إرسال رسالة، حذف عنصر، تعديل إعداد حساس، أو إنشاء حدث في التقويم ليست مثل تلخيص نص. كل خطوة ذات أثر خارجي يجب أن تعرض ما سيحدث قبل أن يحدث.
الإيقاف مهم مثل التنفيذ. إذا بدأ الوكيل مهمة طويلة، هل يمكنك إيقافها؟ وإذا أوقفتها، هل يوضح أين توقفت؟ وإذا عدت بعد دقيقة، هل يستطيع المتابعة دون تكرار خطوة خطرة؟ هذه الأسئلة تقيس جودة التعاون العملي أكثر من اختبار إجابة واحدة.
الاسترداد هو الدليل الذي يكشف المنتج الناضج. عندما تفشل لقطة شاشة، أو ينقص إذن، أو يتغير التطبيق، يجب أن يسجل الاختبار طريقة تعامل النظام مع الفشل: هل يخمن؟ هل يعترف بالحد؟ هل يعرض خطوة إصلاح؟ هل يتحقق بعد الإصلاح؟ لشرح تصميم الموافقة والاسترداد من زاوية تجربة المستخدم، يقدّم دليل واجهة موافقة وكيل الذكاء الاصطناعي على الهاتف: الثقة والسبب والاسترداد إطارًا عمليًا مفيدًا.
استخدام FoneClaw كمسار اختبار Android محكوم
نحن في FoneClaw نبني من هذه الزاوية تحديدًا: كيف يتحول فهم الهاتف إلى إجراء Android مدعوم مع بقاء المستخدم في الصورة؟ لا نستخدم مستويات L1 إلى L4 كلقب نمنحه لأنفسنا، ولا نعامل اختبارًا ميدانيًا كشهادة. ما نفعله هو توفير مسار يمكن للقارئ أن يختبر عليه عناصر ملموسة: الوصول العائم، سياق الشاشة بطلب المستخدم، استمرارية المهمة، الأذونات، الموافقات، الإيقاف، والاسترداد.
وفق أحدث معلومات FoneClaw المتاحة وقت تحديث هذا المقال، يوفّر FoneClaw مساعدًا عائمًا قابلًا للتحريك يمكن استخدامه من فوق تطبيقات Android المدعومة. عندما يريد المستخدم إدخال ما يظهر أمامه في المهمة، يتم إرفاق سياق الشاشة الحالية بطلب منه، لا كالتقاط خفي مستمر. هذه نقطة مهمة في اختبار ذكاء الهاتف: السياق يجب أن يكون مفيدًا، لكنه يجب أن يبقى مفهومًا للمستخدم.
في التنفيذ، نركز على استمرار المهمة بين واجهة FoneClaw الرئيسية والمساعد العائم، وعلى أن تكون الموافقة جزءًا من سير العمل عند الخطوات المؤثرة. إذا احتاجت المهمة إذنًا، يعمل المسار على توجيه المستخدم واسترداد الإذن بدل إسقاط المهمة بصمت. وإذا احتاج المستخدم إلى التوقف، يجب أن يرى حالة يمكن فهمها والعودة منها. هذه التفاصيل هي ما تعلمناه من بناء وكيل هاتف يومي: الفشل المنظم أفضل من نجاح مبهم.
تعرض صفحة ميزات FoneClaw القدرات الحالية بلغة المنتج، لكن الاختبار العملي أبسط: اختر مهمة قابلة للرجوع. افتح تطبيقًا، راجع شاشة، جهز مسودة دون إرسال، أو غيّر إعدادًا يمكن إرجاعه مثل وضع عدم الإزعاج لمدة قصيرة. سجل هل ظهر السياق، هل عرف FoneClaw القدرة المناسبة، هل طلب الموافقة، وهل تحقق من الحالة بعد التنفيذ.
إذا أردت فهم البنية الأوسع التي تجعل وكيل نظام التشغيل عمليًا، فدليل أساس وكيل نظام التشغيل في 2026: ثلاث طبقات يحتاجها وكيل الهاتف العملي يضع طبقة النموذج وطبقة الأدوات وطبقة التحكم في مكانها. في هذا المقال، نستخدم FoneClaw كمثال غير مصنف رسميًا على مسار Android محكوم يمكن إدخاله في اختبارك.
اختيار أو بناء هاتف AI اعتمادًا على الدليل
إذا كنت مشتريًا، لا تبدأ من عبارة “هاتف AI بمستوى L3” أو “هاتف AI بمستوى L4” وحدها. اسأل عن الجزء المرجعي: هل الحديث عن GB/Z 177.3 للمحطات المحمولة؟ هل يوجد نطاق اختبار معلن؟ هل تتكرر النتائج على جهازك ولغتك ومنطقتك وحسابك؟ وهل تختلف التجربة بعد تحديث النظام أو تغيير الأذونات؟
إذا كنت تبني منتجًا، حوّل المستويات إلى متطلبات قابلة للملاحظة. L1 يحتاج ردًا واضحًا. L2 يحتاج أداة وحدود أذونات. L3 يحتاج سياقًا، تفكيك مهمة، متابعة، وموافقة. L4 يحتاج تعاونًا أعمق، ومع ذلك يبقى في 2026 مجالًا يتطور تعريفه. لا تجعل التسويق يسبق الدليل؛ اجعل الدليل يقود الرسالة.
- اربط أي مستوى باسم الجزء والنطاق الذي تتحدث عنه.
- اختبر ست مهام على الجهاز والحساب واللغة والمنطقة نفسها.
- سجل الإنجاز والتحكم والتحقق والاسترداد والتكرار كلًا على حدة.
- افصل بين مساعد يجيب، أداة تنفذ، ووكيل يتابع مهمة.
- أعد الاختبار بعد تحديثات النظام أو التطبيق أو الأذونات.
الخلاصة العملية: GB/Z 177-2026 يمنح السوق لغة أفضل للحديث عن ذكاء الهواتف، لكنه لا يغني عن اختبار واضح. أفضل قرار في 2026 هو أن تطلب دليلًا: ماذا فعل الهاتف، كيف طلب الإذن، متى طلب الموافقة، كيف تعافى، وهل أعاد النتيجة نفسها عند التكرار؟ عندها تصبح مستويات ذكاء هواتف AI من L1 إلى L4 أداة فهم، لا مجرد ملصق.