كشفت Google عن Gemini 3.8 Live وGemini 3.8 Live Extended Thinking، اللذين يواصلان المحادثة أثناء تنفيذ استدعاءات الأدوات وAPI في الخلفية. يركز النموذج القياسي على قابلية التوسع وكفاءة التكلفة، بينما يركز Extended Thinking على الاستدلال المعقد ومتعدد الخطوات. توفر النماذج اكتشاف اللغة والتبديل بينها وتوليد الصوت ومعالجة الصور بـ97 لغة. وعرضت التجارب أمثلة على التكيف مع العمل والشطرنج والتطوير باستخدام React والحجوزات. وبينما تفوق Extended Thinking على منافسيه مسجلاً 82.6 نقطة في Speech to Speech Quality Index، حل النموذج القياسي في المركز الثاني في Speech Agent Arena. النماذج متاحة عبر Gemini API وGoogle AI Studio، وفي معاينة خاصة ضمن Gemini Enterprise؛ كما ستصل إلى Search Live وGemini Live وWorkspace. وتتضمن الأصوات SynthID. ويبلغ سعر الدقيقة للنموذج القياسي 0.005 دولار للمدخلات و0.018 دولار للمخرجات.
لماذا هذا مهم
قد يتيح عدم انقطاع المحادثة أثناء استخدام الأدوات وAPI في الخلفية تنفيذ التفاعلات الصوتية، مثل الحجوزات وتطوير البرمجيات وسير العمل المؤسسي، بسلاسة أكبر. ويتيح الهيكل القائم على إصدارين للمطورين الاختيار بين التكلفة وقابلية التوسع في الاستخدام واسع النطاق، وقدرة الاستدلال في المهام متعددة الخطوات. ويشير نقل القدرات متعددة اللغات والقدرات البصرية إلى Search وWorkspace ومنتجات Gemini إلى أن هذا التطور لا يهم مستخدمي API وحدهم، بل شريحة أوسع تستخدم خدمات Google. ورغم أن مقاييس الأداء المعلنة توفر أساساً للمقارنة، فإنها لا تكشف بمفردها مدى اتساق التجارب في ظروف الاستخدام الفعلية. كما أن الإفصاح عن سعر الإصدار القياسي فقط يترك تكلفة استخدام Extended Thinking غير واضحة.
خلفية
Google ليس اسماً جديداً في أرشيف FikirPilot: فقد نشرنا خلال آخر 90 يوماً 41 خبراً ورد فيه هذا الاسم؛ وكان أحدثها بتاريخ 15 سبتمبر 2026.