قامت Google بتحديث Gemini Audio ببعض نماذج Gemini 3.5 الجديدة، حيث قدمت إمكانات نسخ جديدة تكتشف تلقائيًا المصطلحات المتخصصة وأكثر من 85 لغة. تم تصميم Gemini 3.5 Live و3.5 Live Experimental و3.5 Transcribe لتوفير دقة أفضل لميزات الذكاء الاصطناعي التي يتم التحكم فيها بالصوت من Google، دون مواجهة ضوضاء الخلفية أو عند مقاطعة كلامك.
يعد Gemini 3.5 Transcribe إضافة جديدة تمامًا لعائلة Gemini، ويأتي تقديمها بينما لا نزال ننتظر قيام Google بإصدار الإصدار الجوزاء 3.5 برو نموذج ذلك وعدت بطرحها في يونيو. تقول Google إن الإصدار 3.5 Transcribe “يمثل تقدمًا كبيرًا عن نموذج النسخ السابق الخاص بنا، Chirp 3،” خاصة فيما يتعلق بالأداء متعدد اللغات ومعدلات الخطأ في الصياغة.
يسمح نموذج النسخ للمستخدمين “بالتحرير بشكل طبيعي بصوتك فقط”، وفقًا لجوجل، ويمكنه تنسيق النص تلقائيًا وإزالة كلمات الحشو مثل “um” و”uh”. يمكن للمستخدمين توفير مفردات مخصصة للنموذج، مما يسمح لـ 3.5 Transcribe بتكييف النسخ تلقائيًا مع متطلبات التدقيق الإملائي الفريدة والمصطلحات المتخصصة لمنع تحرير هذه الكلمات يدويًا. ويمكنه أيضًا إسناد الكلام لما يصل إلى ثلاثة مكبرات صوت في الصوت المسجل مسبقًا، إلى جانب توفير الطوابع الزمنية على مستوى الكلمة.
يتم إطلاق Transcribe جنبًا إلى جنب مع 3.5 Live و3.5 Live Experimental، والتي تعتمد على تقنية التعرف على الكلام الحالية التي تعمل على تشغيل وضع الدردشة الصوتية في الجوزاء. يعد Gemini 3.5 Live أفضل في التعامل مع المقاطعات في منتصف الجملة، والتعرف على اللغة، والمعالجة المرئية المباشرة، بينما يذهب Gemini 3.5 Live Experimental إلى أبعد من ذلك من خلال سرد تقدمه خطوة بخطوة في الوقت الفعلي بينما يتعامل مع التفكير في مهام أكثر تعقيدًا.
سيتم طرح تحديثات Gemini Audio هذه بدءًا من اليوم باللغة الإنجليزية لجميع مستخدمي تطبيق macOS Gemini، وميزة إملاء Rambler على Android في بلدان ولغات محددة. وهو متاح أيضًا للمطورين في المعاينة العامة في Gemini API عبر AI Studio وAntigravity. تقول Google أن دعم Chrome سيأتي قريبًا.


