وسعت جوجل قدرات مساعدها للذكاء الاصطناعي، مع الكشف عن Gemini 3.8 Live ونسخة Gemini 3.8 Live Extended Thinking، في تحديث يستهدف تطوير المحادثات الصوتية، وتحسين فهم المدخلات المرئية، وتعزيز قدرة النماذج على تنفيذ المهام التي تتطلب عدة خطوات.
وتأتي النماذج الجديدة ضمن توجه جوجل لتغيير طريقة تفاعل المستخدمين مع الذكاء الاصطناعي، بحيث لا تقتصر التجربة على تقديم إجابات مباشرة، وإنما تمتد إلى تنفيذ المهام في الخلفية مع استمرار المستخدم في إجراء المحادثة.
Gemini 3.8 Live.. محادثة أكثر طبيعية
يركز Gemini 3.8 Live على جعل الحوار مع الذكاء الاصطناعي أكثر انسيابية، مع القدرة على التعامل مع المدخلات الصوتية والمرئية بصورة شبه فورية.
وبحسب جوجل، يستطيع النموذج معالجة المحتوى المرئي أثناء استمرار المستخدم في الحديث، إلى جانب تشغيل الأدوات واستدعاء واجهات برمجة التطبيقات في الخلفية دون الحاجة إلى إيقاف المحادثة.
وتتيح هذه الآلية للمستخدم طرح طلب ثم مواصلة الحديث، بينما يعمل Gemini على تنفيذ المهمة المطلوبة، بدلًا من الانتظار حتى انتهاء عملية المعالجة.
ما هو Gemini 3.8 Live Extended Thinking؟
كشفت جوجل أيضًا عن Gemini 3.8 Live Extended Thinking، وهي نسخة تستهدف المهام التي تحتاج إلى استدلال متعدد المراحل ومعالجة أكبر قبل الوصول إلى النتيجة.
وتشمل الاستخدامات الأكثر تعقيدًا أدوات جوجل التي تعتمد على التفاعل مع المحتوى، مثل Gmail Live للبحث داخل رسائل البريد الإلكتروني، وDocs Live لإنشاء النصوص وتعديلها، بالإضافة إلى Keep Live لإنشاء الملاحظات.
وبدأ طرح نسخة Extended Thinking ضمن تجربة Gemini Live، بما يوسع نطاق المهام التي يمكن تنفيذها من خلال المحادثات الصوتية.
الذكاء الاصطناعي يواصل الحوار أثناء تنفيذ المهام
من أبرز التغييرات التي تقدمها النسخة الجديدة إمكانية معالجة المهام والتحدث مع المستخدم في الوقت نفسه.
وعندما يحتاج الطلب إلى وقت إضافي، يمكن للنظام إبلاغ المستخدم بأنه يعمل على المهمة، مع تقديم إشارات صوتية حول سير العملية، ما يسمح باستمرار الحوار بدلًا من توقفه لحين اكتمال المعالجة.
وتبرز أهمية هذه الخاصية عند التعامل مع طلبات متعددة المراحل أو المهام التي تتطلب استخدام أدوات خارجية في الخلفية.
نتائج Gemini 3.8 Live في اختبارات الأداء
استندت جوجل في عرض قدرات النماذج الجديدة إلى نتائج مجموعة من اختبارات الأداء المتخصصة.
وقالت الشركة إن Gemini 3.8 Live Extended Thinking حقق 82.6 في مؤشر جودة تحويل الكلام إلى كلام التابع لـArtificial Analysis، كما سجل 68.6% في اختبار قدرة الوكلاء الذكيين على إتمام المهام.
وفي اختبار مخصص للمهام المصرفية الصوتية، حقق النموذج 35.1%، بينما بلغت نتيجته 97.7% في اختبار Big Bench Audio لقياس قدرات الاستدلال الصوتي.
وتقيس هذه الاختبارات جوانب مختلفة من أداء نماذج الذكاء الاصطناعي الصوتية، مع اختلاف طبيعة المهام والمنهجيات المستخدمة في كل اختبار.
Gemini 3.8 Live يدعم 97 لغة
أضافت جوجل إلى النموذج الجديد إمكانية الانتقال بين اللغات أثناء المحادثة، إذ يستطيع التعرف على التغيير بين 97 لغة مدعومة والتعامل معه ضمن الحوار نفسه.
وتمنح هذه الخاصية المستخدمين مرونة أكبر عند الانتقال بين أكثر من لغة خلال المحادثة، دون الحاجة إلى تغيير إعدادات اللغة يدويًا في كل مرة.
دمج Gemini 3.8 Live مع خدمات جوجل
لا يقتصر استخدام النماذج الجديدة على تطبيق Gemini، إذ توسع جوجل نطاق توظيفها داخل مجموعة من خدماتها.
ويظهر ذلك في Gmail Live وDocs Live وKeep Live، إلى جانب دمج Gemini 3.8 Live في تجربة البحث المباشر ضمن وضع الذكاء الاصطناعي في محرك بحث جوجل.
ومن خلال هذا الدمج، تسعى الشركة إلى جعل البحث والتعامل مع المعلومات أكثر اعتمادًا على الحوار الطبيعي، بدلًا من الاقتصار على كتابة استعلام ثم قراءة النتائج.
أبرز استخدامات Gemini 3.8 Live
إجراء محادثات صوتية أكثر طبيعية مع الذكاء الاصطناعي.
تحليل المدخلات المرئية بصورة شبه فورية.
تنفيذ المهام في الخلفية أثناء استمرار المحادثة.
التعامل مع المهام التي تتطلب عدة مراحل من الاستدلال.
إنشاء المستندات وتحريرها.
البحث التفاعلي داخل البريد الإلكتروني.
إنشاء الملاحظات وتنظيمها.
الانتقال بين 97 لغة أثناء المحادثة.
استخدام الذكاء الاصطناعي بطريقة حوارية داخل البحث.
الفرق بين Gemini 3.8 Live وExtended Thinking
يركز Gemini 3.8 Live على المحادثات السريعة والطبيعية، مع التعامل مع الصوت والصورة وتنفيذ المهام أثناء استمرار الحوار.
أما Gemini 3.8 Live Extended Thinking فيركز بصورة أكبر على المهام المعقدة التي تحتاج إلى استدلال متعدد الخطوات، وبالتالي يتعامل مع الاستخدامات التي تتطلب معالجة أعمق قبل الوصول إلى النتيجة.