أطلقت جوجل مساء يوم 15 سبتمبر 2026 نموذجين صوتيين جديدين تحت اسم Gemini 3.8 Live وGemini 3.8 Live Extended Thinking، وصنّفتهما بأنهما «أكثر نماذج الحوار الحي تقدماً» لديها حتى الآن. النموذجان يضيفان تفكيراً متوازياً أثناء الحديث، وتنقّلاً تلقائياً بين 97 لغة منها العربية، وتنفيذاً للمهام في الخلفية دون مقاطعة المحادثة — والنموذجان متاحان الآن عبر تطبيق Gemini وSearch Live وGoogle Workspace وواجهة البرمجة.
المصدر الرسمي: تدوينة جوجل الرسمية عن Gemini 3.8 Live بتاريخ 15 سبتمبر 2026.
الإعلان منشور على المدونة الرسمية لجوجل بتوقيع فريق Gemini Audio. ولك أن تفهم حجم الخطوة من رقم واحد: النموذج الأقوى في الإطلاق، Extended Thinking، حلّ في المركز الأول عالمياً على مؤشر Artificial Analysis لجودة الكلام-إلى-الكلام بنقاط 82.6 — قبل كل المنافسين في القائمة.

الفرق بين النموذجين الجديدين
جوجل أطلقت نموذجين لا واحداً، ولكل منهما وظيفة:
- Gemini 3.8 Live: مصمّم للتوسّع وكفاءة التكلفة، ويجمع بين ذكاء المحادثة وحوار طبيعي سلس مع «تأصيل بصري» — أي أنه يرى ما تُريه له من كاميرا أو شاشة أثناء الحديث ويستوعبه لحظياً.
- Gemini 3.8 Live Extended Thinking: النموذج الأثقل، بُني للمهام عالية التعقيد والاستدلال متعدد الخطوات. أهم ما يميزه أنه «يفكّر ويتكلم في آن واحد»: يعترف بطلبك بعبارات لفظية مبكرة مثل «دعني أتحقق من ذلك»، ثم يسرد تقدّم المهام صوتياً خطوة خطوة بينما تعمل الأدوات في الخلفية.
بعبارة عملية: الأول محادث ذكي سريع، والثاني وكيل صوتي يستطيع أن يدير حجوزات ومكالمات وأدوات متعددة دون أن يصمت منتظراً إنهاء كل مهمة.
الأرقام الرسمية من المصدر الأولي
من إعلان جوجل الرسمي مباشرة:
- المركز الأول على مؤشر Artificial Analysis لجودة الكلام-إلى-الكلام (82.6 نقطة) لنموذج Extended Thinking.
- الأول في إنجاز المهام الوكيلة بنسبة 68.6% على معيار tau-Voice، و35.1% على معيار Sierra لخدمات المصارفة tau-Voice-banking.
- 97.7% على معيار Big Bench Audio للاستدلال الصوتي.
- المركز الثاني لنموذج 3.8 Live في Speech Agent Arena حسب تفضيلات المستخدمين.
- على معيار ServiceNow EVA-Bench لقياس الوكلاء الصوتيين، يدفع النموذجان حدود الكفاءة إلى الأمام بموازنة الدقة وجودة المحادثة معاً.
هذه أرقام جوجل نفسها المنقولة عن تقييمات مستقلة (Artificial Analysis وSpeech Agent Arena)، لكن قارئها الذكي يتذكر دائماً أن اختيار المعايير نفسه بيد الشركة المعلنة.
العربية ضمن 97 لغة — وهذا مهم
النموذج «يكتشف وينتقل تلقائياً بين 97 لغة مدعومة أثناء المحادثة الواحدة» كما تقول جوجل، والعربية موجودة في القائمة الرسمية للغات واجهة Live API المحدثة. عملياً هذا يعني أن بإمكانك بدء الحديث بالعربية والانزلاق إلى مصطلح إنجليزي ثم العودة، دون تغيير الإعدادات ودون أن «يتلعثم» النموذج.
لصانع المحتوى العربي، المحادثة الصوتية بالعربية أسرع بكثير من الكتابة على الهاتف، وهي أساس سير عمل كامل: تسجيل الأفكار صوتياً، وتوليد مسودات المنشورات، وتلخيص الاجتماعات، وصياغة عناوين الفيديو وأوصافه. وقد غطّينا سابقاً كيف توظّف هذه المزايا في دليلنا لإنتاجية Gemini Live الصوتية، ثم في وصول أوضاع Live إلى Gmail وDocs وKeep. الجديد اليوم أن المحرك تحت الغطاء صار أجيالاً أذكى وأسرع.
أين تجرب النموذجين الآن؟
- للجميع: Gemini 3.8 Live داخل Search Live (البحث الصوتي الحي) بدءاً من يوم الإطلاق.
- Extended Thinking للجميع: داخل تطبيق Gemini في وضع Live، وفي Gmail وKeep لجميع مشتركي Google AI، وفي Docs لمشتركي Google AI Pro وUltra داخل Workspace.
- للمطورين: النموذجان متاحان في Gemini API وGoogle AI Studio منذ يوم الإطلاق.
- للشركات: معاينة خاصة داخل Gemini Enterprise، مع وصول قريب لمنصة خدمة العملاء.
ويعمل مع واجهة Live API شركاء بنية تحتية مثل Agora وLangChain وLiveKit وPipecat وVercel، ما يعني أن موجة تطبيقات صوتية جديدة ستبني على النموذجين خلال الأسابيع المقبلة — وشركات مثل Salesforce وGenspark وLumeris أعلنت بالفعل عن تبكّيها المبكر.

ماذا يعني هذا لك كصانع محتوى؟
1. عصف ذهني صوتي بلا مصادرة: مع Extended Thinking يمكنك أن تطلب أثناء حديثك: «جهّز لي خطة محتوى لأسبوع وحلّل أداء العناوين الأخيرة» — يستجيب فوراً بعبارات انتقالية، ثم يسرد النتائج تباعاً بينما تعمل الأدوات. جوجل عرضت العرض الحي لبناء خطط أعمال وأدوات تسويق كاملة عبر الكلام وحده.
2. تأصيل بصري أثناء الحديث: النموذج يعالج المدخلات البصرية شبه لحظياً. ترفع كاميرا هاتفك على تصميم أو مسودة فيديو وتناقشه صوتياً — حالة مثالية لمراجعة التصاميم أو تدريب نفسك على تقديم فيديو.
3. وسم SynthID لكل الصوت المولّد: كل الصوت الذي تنتجه منتجات جوجل مشفّر بعلامة SynthID غير المرئية. لو كنت تصنع بودكاست أو تعليقاً صوتياً بالعربية عبر هذه النماذج، فاعلم أن المخرجات تحمل علامة قابلة للكشف — وهو اتجاه عام في الصناعة يتقاطع مع سياسات الوسم التي شرحناها في تغطيات سابقة.
4. لا تنتظر الاستوديو: هذه ليست ميزة خارقة، لكنها تخفض كلفة تجربة «المحتوى الصوتي»: جرب تسجيل حلقة بودكاست قصيرة بالعربية عبر المحادثة الصوتية، ثم حرّر النص الناتج في أداة كتابة عربية متخصصة مثل ARWriter لتحويله إلى مقال أو نشرة بريدية.
مقارنة سريعة
- مقابل Gemini 3.8 Flash (نصي): الفلاش للنصوص والمهام الكتابية السريعة، وLive للحوار الصوتي اللحظي — استخدامان متكاملان لا متنافسان.
- مقابل الوضع الصوتي في ChatGPT: جوجل ترفع سقف «التفكير أثناء الكلام» وتنفيذ الأدوات في الخلفية، والمتصدرية على مؤشر مستقل تُحسب لها؛ لكن التوفر الفعلي لكل ميزة يختلف بالباقة والمنصة، والاختبار الشخصي هو الحكم.
- مقابل مساعدات الهاتف التقليدية: الفارق لم يعد في فهم الأوامر بل في الاستمرارية: مهام خلفية + رؤية لحظية + تعدد لغات داخل جلسة واحدة.
ثلاث تجارب عملية تبدأ بها اليوم
لا تحتاج خطة معقدة لتقيس القيمة الجديدة على عملك؛ هذه ثلاث تجارب مدتها أقل من ربع ساعة لكل منها:
تجربة 1 — تدوين صوتي عربي لحظي: افتح وضع Live في تطبيق جوجل وتحدث بالعربية عن موضوع منشوك القادم: لماذا تكتبه، لمن، وما الجديد فيه. اطلب في النهاية تلخيص النقاط في قائمة. بفضل الانتقال التلقائي بين اللغات يمكنك نطق المصطلحات الأجنبية داخل جملتك العربية وسيتفهمها السياق. الناتج: مسودة هيكل جاهزة للتحرير النصي.
تجربة 2 — مراجعة بصرية للتصاميم: اعرض على الكاميرا صورة مصغّرة (ثمبنيل) اقترحتها لفيديوك واسأل: أي عنصر يلفت النظر أولاً؟ هل النص مقروء من بعيد؟ التأصيل البصري اللحظي يعني أنك تناقش الشيء نفسه الذي تراه أنت والنموذج معاً — تدريب مجاني على عين التصميم.
تجربة 3 — مهمة خلفية أثناء الحديث: ابدأ محادثة واطلب من Extended Thinking مهمة تحتاج وقتاً — جمع أفكار عناوين لعشرة منشورات مرتبة حسب زاوية كل منها — ثم واصل حديثك عن موضوع آخر. لاحظ كيف يعترف بالطلب فوراً ويعود بالنتيجة سارداً تقدّمه. هذه الازدواجية هي الفرق الجوهري عن الأجيال السابقة التي كانت تصمت أثناء العمل.
حدود وعيوب يجب ذكرها بصدق
- أفضل نموذج (Extended Thinking) مقيد جزئياً بالباقات: داخل Docs لمشتركي AI Pro وUltra فقط، وفي Workspace بزنس قريباً — أي أن «الجميع» لا يحصل على كل شيء يوم واحد.
- إتاحة النسخة للمؤسسات ما تزال «معاينة خاصة»، لا إطلاقاً عاماً.
- الأرقام القياسية منقولة عن جهات مستقلة لكن باختيار جوجل للمعايير، والفروق الصغيرة بين المراكز الأولى لا تُحسّ في الاستخدام اليومي غالباً.
- الوسم المائي SynthID يعني أن الصوت المولّد قابل للتعريف — ميزة للشفافية، لكنها قيد على من يريد تمرير الصوت كمسجّل بشرياً.
- جودة العربية الفعلية في السرد الطويل واللهجات المحلية لم تُقيَّم في الإعلان نفسه؛ قيّمها بنفسك في مهامك النموذجية قبل الاعتماد عليها.
أسئلة شائعة عن Gemini 3.8 Live
ما هو Gemini 3.8 Live الجديد من جوجل؟
هو نموذج حوار صوتي حي أعلنت عنه جوجل في 15 سبتمبر 2026، مع نسخة أقوى اسمها Gemini 3.8 Live Extended Thinking، ويمكنه فهم ما تراه الكاميرا لحظياً وتنفيذ مهام في الخلفية أثناء الحديث معك.
هل يدعم Gemini 3.8 Live اللغة العربية؟
نعم، العربية من بين 97 لغة مدعومة ينتقل بينها النموذج تلقائياً أثناء المحادثة الواحدة، بحسب القائمة الرسمية للغات واجهة Live API.
ما الفرق بين Gemini 3.8 Live وExtended Thinking؟
3.8 Live نموذج المحادثة السريعة الموجّه للتوسع وكفاءة التكلفة، بينما Extended Thinking مبني للمهام المعقدة والاستدلال متعدد الخطوات، ويفكّر ويتكلم في وقت واحد مع سرد تقدّم المهام صوتياً.
هل Gemini 3.8 Live مجاني؟
Gemini 3.8 Live متاح للجميع داخل Search Live، وExtended Thinking متاح في تطبيق Gemini وفي Gmail وKeep لمشتركي Google AI، أما داخل Docs فيتطلب اشتراك Google AI Pro أو Ultra داخل Workspace.
متى يمكنني استخدام Gemini 3.8 Live؟
التدرج بدأ يوم الإطلاق 15 سبتمبر 2026: Search Live للجميع، والتطبيق وWorkspace حسب الباقة، وواجهة البرمجة متاحة للمطورين منذ اليوم الأول.
الخلاصة
Gemini 3.8 Live ينقل المساعد الصوتي من «يجيب بسرعة» إلى «يعمل بينما تتكلم»: رؤية لحظية، و97 لغة بينها العربية، ومهام خلفية بلا مقاطعة، وميزات تدريج من مؤشرات مستقلة. لصانع المحتوى، أسرع طريقة للاستفادة هي دمجه في سير عملك القائم: فكّر بصوتك بالعربية، ثم حوّل المخرجات إلى محتوى مصقول عبر أدوات ARWriter — من الفكرة المنطوقة إلى المقال والمنشور الجاهز للنشر.