تحليل التكلفة
📅 2026-09-28 ⏱️ 12 دقائق Dean Dean

تكلفة رموز وكيل الذكاء الاصطناعي لكل مهمة: صيغة قياس عملية

دليل عملي لحساب تكلفة رموز وكيل الذكاء الاصطناعي لكل مهمة مكتملة، مع سجل افتراضي، احتساب المحاولات الفاشلة، وقياس أثر تنفيذ Android المدعوم دون افتراض توفير ثابت.

رسم تصوري لهاتف ذكي يعرض مسار مهمة على الجهاز مع حلقات تفكير سحابية ودروع ومخطط هابط زخرفي
📋 النقاط الرئيسية
  • احسب تكلفة وكيل الذكاء الاصطناعي لكل مهمة مكتملة، لا لكل محاولة؛ اقسم التكلفة المقاسة على النتائج التي تم التحقق منها فعلاً.
  • ابنِ السجل من فئات غير متداخلة: إدخال غير مخزن مؤقتاً، قراءة من الذاكرة المؤقتة، إخراج قابل للفوترة، ورسوم أدوات أو تخزين عند وجودها فقط.
  • في المثال الافتراضي: 3.34 دولار لكل 100 محاولة و90 مهمة مكتملة تعطي نحو 0.0371 دولار لكل مهمة مكتملة، مع احتساب المحاولات الفاشلة مسبقاً.
  • تنفيذ الهاتف محلياً قد يغير عدد النداءات والسياق والمحاولات، لكنه لا يعني صفراً من استدعاءات النموذج أو معالجة محلية بالكامل أو توفيراً مضموناً.

قس التكلفة لكل مهمة مكتملة

تكلفة رموز وكيل الذكاء الاصطناعي لكل مهمة لا تُقاس بسعر مليون رمز فقط. القياس المفيد هو: كم دفعت مقابل نتيجة تم التحقق منها؟ المهمة المكتملة قد تكون مسودة وضعت في حقل صحيح، أو حدث تقويم حُفظ وفتحته للمراجعة، أو مسار خريطة ظهر بالوجهة الصحيحة. أما المحاولة التي توقفت بسبب إذن مفقود أو شاشة تغيرت فهي جزء من التكلفة، لكنها ليست نتيجة مكتملة.

الصيغة المختصرة: إجمالي التكلفة المقاسة ÷ عدد المهام المكتملة التي تحققت منها. إجمالي التكلفة قد يشمل استخدام النموذج، رسوم أدوات خارجية، رسوم تخزين أو ذاكرة مؤقتة إن كان المزود يحاسب عليها، واشتراكاً أو رصيداً إذا كنت تريد توزيعه على حجم استخدام معروف. لا تضف رسماً مرتين: إذا كانت رسوم معينة مشمولة في الاشتراك أو في فئة إخراج محددة، لا تعيد حسابها كتكلفة مستقلة.

في FoneClaw، تنفيذ Android المدعوم يساعدك على تعريف “المهمة المكتملة” بوضوح: هل النص في الحقل الصحيح؟ هل بقي الإرسال منفصلاً؟ هل ظهرت النتيجة على الشاشة؟ لتحديد نهاية المهمة على الهاتف، يفيدك دليل أتمتة مهام Android متعددة الخطوات: نية واضحة، تأكيد، تحقق واسترداد.

ابنِ سجل التكلفة من استخدام المزود

ابدأ من أرقام الاستخدام التي يعطيها مزود النموذج. توضح وثائق Gemini لاحتساب الرموز أن النصوص والوسائط مثل الصور يمكن أن تدخل في حساب الرموز، وأن استخدام الاستجابة قد يتضمن حقولاً فعلية للإدخال والإخراج والتفكير والسياق المخزن مؤقتاً. كما تذكّر وثائق تسعير Gemini API بأن الأسعار تختلف حسب النموذج والوسيط وفئة الخدمة، وأن بعض فئات الإخراج قد تشمل رموز التفكير، وأن التخزين المؤقت أو grounding قد يحاسب منفصلاً حسب المزود.

الصيغة القابلة لإعادة الاستخدام هي: تكلفة النموذج = (رموز الإدخال غير المخزنة مؤقتاً ÷ 1,000,000 × سعرها لكل مليون) + (رموز قراءة الذاكرة المؤقتة ÷ 1,000,000 × سعرها لكل مليون) + (رموز الإخراج القابلة للفوترة ÷ 1,000,000 × سعرها لكل مليون). بعد ذلك أضف الرسوم الإضافية منفصلة، مثل إنشاء الذاكرة المؤقتة أو تخزينها أو أداة خارجية أو حصة اشتراك موزعة، فقط إذا كانت تنطبق على حسابك.

لذلك استخدم فئات غير متداخلة. اجمع الإدخال غير المخزن مؤقتاً مرة واحدة. اجمع قراءات الذاكرة المؤقتة في خانة منفصلة؛ هذه الكمية تعني عدد الرموز المقروءة من الذاكرة المؤقتة، لا عدد الطلبات. اجمع الإخراج القابل للفوترة كما يعرّفه المزود. وإذا كان المزود يحاسب على إنشاء ذاكرة مؤقتة أو تخزينها أو استخدام أداة خارجية، فأضفها فقط عندما تظهر في سياستك أو فاتورتك.

تشرح وثائق Claude عن التخزين المؤقت للمطالبات الفرق بين كتابة الذاكرة المؤقتة وقراءتها والإدخال العادي غير المخزن. هذا مهم لأن إعادة استخدام السياق قد تظهر بسعر مختلف، لكنها ليست مجانية تلقائياً ولا تتحقق إلا عندما تنطبق شروط المزود. إذا تغيرت البادئة أو لم يثبت المزود إصابة الذاكرة المؤقتة، فلا تسجل وفراً مفترضاً.

عامل الصور ولقطات الشاشة بالطريقة نفسها: إذا حولها المزود إلى رموز إدخال، فهي ضمن الإدخال ولا تضف رسماً ثانياً للصورة إلا إذا كانت هناك فئة منفصلة في الفاتورة. وإذا كان الإخراج يتضمن رموز التفكير، لا تحاسب التفكير مرة أخرى خارج الإخراج.

أعد حساب دفعة افتراضية واحدة

هذا مثال حسابي افتراضي للتعليم فقط، وليس سعراً من Google أو Claude أو FoneClaw. افترض أن لديك 100 محاولة لتنفيذ مهمة منخفضة المخاطر، وأن كل النداءات والمحاولات الفاشلة وإعادة المحاولة محسوبة مسبقاً في أرقام الاستخدام التالية.

البندالكميةسعر افتراضيالتكلفة
إدخال غير مخزن مؤقتاً1,000,000 رمز2.00 دولار لكل مليون2.00 دولار
قراءات من الذاكرة المؤقتة200,000 رمز0.20 دولار لكل مليون0.04 دولار
إخراج قابل للفوترة150,000 رمز8.00 دولارات لكل مليون1.20 دولار
إجمالي استخدام النموذج——3.24 دولار
رسم أداة خارجي افتراضي——0.10 دولار
الإجمالي——3.34 دولار

إذا انتهت 90 محاولة فقط بنتيجة تم التحقق منها، فالحساب هو: 3.34 ÷ 90 = نحو 0.0371 دولار لكل مهمة مكتملة. لا تضف المحاولات الفاشلة مرة أخرى لأنها موجودة بالفعل داخل إجمالي الرموز. ولا تضف رسوم كتابة أو تخزين للذاكرة المؤقتة هنا لأن المثال لم يضعها؛ في حساب حقيقي، أضفها إذا كان مزودك يحاسب عليها.

هذا النوع من السجل يمنع الاستنتاجات السريعة. قد تبدو المحاولة الواحدة رخيصة، لكن عدد المحاولات المكتملة هو الذي يحدد تكلفة النتيجة. وإذا لم تكتمل أي مهمة، فمؤشر “التكلفة لكل مهمة مكتملة” غير معرّف، وليس صفراً.

ما الذي يمكن أن يغيره تنفيذ الهاتف؟

تنفيذ الهاتف في FoneClaw يعني أن خطوات Android المدعومة تتم على الجهاز بينما يساعد النموذج المكوّن في الفهم والتخطيط. هذا قد يغير عدد النداءات، وحجم السياق، وعدد المحاولات، لكنه لا يثبت أن الاستدلال كله محلي أو أن المهمة مجانية. إذا استخدمت نموذجاً متصلاً عبر الإنترنت، فقد يعالج السياق الذي تقدمه.

مثال عملي: عندما تكون الشاشة مدعومة، يمكن قراءة الحالة الظاهرة، ثم وضع نص في حقل تحرير واضح. إدخال النص لا يرسل، ولا يضغط زر الإرسال، ولا يتجاوز إذن التطبيق. بعد تغير الشاشة يجب استخدام حالة حديثة بدلاً من الاعتماد على قراءة قديمة. هذا الوضوح قد يقلل التخمين وإعادة التخطيط في بعض المهام، لكن القياس الحقيقي يأتي من سجل المزود والنتيجة التي تحققت منها.

المقارنة مع السحابة ليست أن “كل وكلاء السحابة لا يستطيعون الفعل”. بعضهم يملك أدوات وخدمات حقيقية. في FoneClaw، عندما تكون المهمة ضمن إجراءات Android المدعومة، يمكن تنفيذ خطوة على الهاتف مثل قراءة شاشة مدعومة أو إدخال نص في حقل ظاهر مع بقاء الإرسال منفصلاً. لفهم مكان معالجة البيانات والثقة بين الجهاز والسحابة، راجع الثقة في وكيل الذكاء الاصطناعي: التحكم من هاتف Android أم الاعتماد على السحابة؟.

كذلك لا تفترض أن شجرة الواجهة النصية أرخص دائماً من لقطة شاشة. التكلفة تعتمد على المزود، طريقة الترميز، المهمة، وحجم السياق. ما تستطيع فعله هو قياس المسارين بالطريقة نفسها.

نفّذ فحصاً صغيراً قابلاً للتكرار

للحصول على رقم مفيد، اختر مهمة واحدة منخفضة المخاطر وكررها عشر مرات في كل إعداد تريد مقارنته. مثال: تجهيز مسودة في تطبيق ملاحظات أو حقل رسالة دون إرسال. استخدم نفس الهاتف، نفس التطبيق، نفس النص الأولي، ونفس تعريف النجاح: “النص الصحيح ظهر في الحقل الصحيح، وبقي الإرسال منفصلاً”.

  1. سجل عدد المحاولات الكلي وعدد المهام المكتملة فعلاً.
  2. احتفظ باستخدام المزود إن كان متاحاً: إدخال غير مخزن، قراءة ذاكرة مؤقتة، إخراج، تفكير، صور أو سياق شاشة.
  3. سجل الرسوم الأخرى: أدوات خارجية، تخزين مؤقت، اشتراك موزع فقط إذا قررت طريقة توزيع واضحة.
  4. اكتب وقت المستخدم في المراجعة والتصحيح، ولا تخلطه مع الرموز إلا إذا حولته إلى تكلفة بطريقة ثابتة.
  5. سجل عدد الموافقات المطلوبة والإخفاقات: إذن مفقود، شاشة تغيرت، حقل غير واضح، أو نتيجة غير مؤكدة.
  6. إذا أردت قياس الطاقة، فاقس الزيادة بالواط-ساعة ثم استخدم: الواط-ساعة ÷ 1000 × سعر الكيلوواط-ساعة المحلي.

لا تحذف فحوص المستلم أو إذن التطبيق لتخفيض رقم التكلفة. هذه الفحوص جزء من المهمة الآمنة، خصوصاً عندما يخرج النص إلى شخص آخر. لتمييز النية عن الإجراء المدعوم على Android، راجع تحكم وكيل الذكاء الاصطناعي في هاتف Android: من النية إلى التنفيذ الموثوق.

قلل الهدر دون حذف فحوص الأمان

أفضل تخفيض للتكلفة يبدأ من إدخال واضح وسياق محدود. لا ترسل سجل محادثة كاملاً إذا كانت المهمة تحتاج آخر رسالة فقط. استخدم ذاكرة مؤقتة عندما يؤكد المزود استخدامها، ولا تفترضها. افحص فشل الخطوة قبل إعادة المحاولة؛ تكرار طلب فاشل قد يضاعف الرموز دون نتيجة.

على الهاتف، احفظ الخطوات المتكررة عندما تكون مدعومة وقابلة للمراجعة، لكن لا تفترض أن سير العمل المحفوظ يلغي كل استدعاءات النموذج لاحقاً. الموافقات على الرسائل أو الأفعال المؤثرة ليست هدراً؛ هي جزء من تكلفة نتيجة آمنة. إذا فشلت مهمة أو أصبحت نتيجتها غير مؤكدة، فدليل تشخيص فشل وكيل الهاتف واستعادته: دليل تشغيل لمهام Android وFoneClaw يساعدك على فحص الحالة قبل دفع تكلفة محاولة أخرى.

الخلاصة: احسب التكلفة لكل نتيجة مكتملة، قس المحاولات الفاشلة، وفرّق بين تنفيذ الهاتف واستدلال النموذج. لمعرفة قدرات Android الحالية التي نوفرها، راجع ميزات FoneClaw.