Google تخفض كلفة تشغيل الوكلاء بنموذجي Gemini Flash جديدين
أتاحت Google نموذجي Gemini Flash جديدين بأسعار أقل موجهة لتشغيل الوكلاء والمهام عالية الحجم، ما يفتح اختبارًا عمليًا لتكلفة المهمة بالعربية.
استمع لهذا المقال
بصوت ليلى (Layla)
ماذا حدث: في إشارة متأخرة من نافذة 72 ساعة، أتاحت Google في 21 يوليو نموذجي Gemini 3.6 Flash وGemini 3.5 Flash-Lite للمطورين والمؤسسات والمستخدمين. تقول الشركة إن 3.6 Flash يستهلك رموز إخراج أقل بنسبة 17% من 3.5 Flash في مؤشر Artificial Analysis، وتضع سعره عند 1.50 دولار لكل مليون رمز إدخال و7.50 دولارات لكل مليون رمز إخراج. أما Flash-Lite فسعره 0.30 دولار للإدخال و2.50 دولار للإخراج لكل مليون رمز، وتقول Google إنه يولد 350 رمز إخراج في الثانية وفق المؤشر نفسه.
العدسة: التحول الاقتصادي المنافسة تنتقل من ترتيب النماذج على الاختبارات إلى تكلفة المهمة المكتملة وسرعة تشغيلها على نطاق واسع. هذا يضغط على موردي النماذج ويمنح المؤسسات مساحة أكبر لتقسيم العمل بين نموذج رئيس ووكلاء أخف.
من يتأثر: فرق المنتجات والبرمجيات ومراكز الاتصال والتجارة الإلكترونية والمؤسسات التي تشغل البحث الآلي ومعالجة الوثائق بكميات كبيرة.
ما يعنيه للمنطقة: يمكن للشركات العربية اختبار خدمات كثيفة الطلب بالعربية بتكلفة أقل، لكن أرقام المورد لا تكفي لإثبات الجودة المحلية. القياس يجب أن يشمل دقة العربية وعدد استدعاءات الأدوات وزمن المهمة وتكلفتها الكاملة.
خطوة عملية: شغل عينة من 100 مهمة حقيقية على النموذج الحالي وFlash-Lite، ثم قارن تكلفة المهمة الصحيحة لا سعر الرمز وحده قبل تغيير مسار الإنتاج.
المصدر: https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/