Simon Willison→ المصدر

قدمت OpenAI GPT-Live — ChatGPT الصوتي المحدّث مع دعم GPT-5.5

في 8 يوليو 2026، قدمت OpenAI GPT-Live — وضع صوتي محدّث من ChatGPT بهندسة معمارية هجينة. يمكن للنموذج الجديد تفويض الاستعلامات المعقدة (البحث على الويب، والتحليل العميق، والحسابات) إلى نموذج GPT-5.5 القوي مع الحفاظ على تدفق محادثة طبيعي وسلس. يبدأ الإطلاق كمعاينة على iPhone. كانت النسخة السابقة تعتمد على GPT-4o مع معلومات فقط حتى عام 2024.

معالج بواسطة الذكاء الاصطناعي من Simon Willison؛ بتحرير Hamidun News
قدمت OpenAI GPT-Live — ChatGPT الصوتي المحدّث مع دعم GPT-5.5
المصدر: Simon Willison. كولاج: Hamidun News.
◐ استمع للمقال

قدمت OpenAI GPT-Live — نسخة محدثة من ChatGPT الصوتي مع دعم GPT-5.5

في 8 يوليو 2026، أطلقت OpenAI GPT-Live — نسخة محدثة من نموذج الوضع الصوتي لـ ChatGPT. يستخدم النظام الجديد معمارية هجينة: نموذج GPT-Live الرئيسي يجري محادثة في الوقت الفعلي، بينما يتم تفويض المهام المعقدة تلقائياً إلى نموذج GPT-5.5 القوي. هذا تحسين طال انتظاره من قبل المستخدمين الذين أمضوا سنوات يطلبون تحديث قدرات الصوت في التطبيق.

ما الذي تغير في ChatGPT الصوتي

كانت النسخة السابقة من وضع صوت ChatGPT مبنية على نموذج من عصر GPT-4o مع معلومات حالية فقط حتى عام 2024. لقد حدّ ذلك بشكل كبير من التطبيقات العملية للأسئلة الحالية والمهام التحليلية المعقدة والأحداث المعاصرة. اشتكى العديد من المستخدمين من فائدة منخفضة لوضع الصوت كأداة للتحليل العميق والعصف الذهني.

نموذج GPT-Live الجديد يصلح هذه المشاكل. يوضح تحسينات جوهرية في فهم السياق والقدرة على التفكير وطبيعية المحادثة. وفقاً لمن حصلوا على وصول المعاينة، النموذج الجديد قادر وأكثر إثارة للاهتمام بشكل كبير للتفاعل معه.

  • الإطلاق: 8 يوليو 2026
  • المنصة: وصول المعاينة في تطبيق iPhone
  • المعمارية: هجينة (GPT-Live الرئيسي + GPT-5.5 للمهام المعقدة)
  • المعرفة محدثة مقابل عام 2024
  • النسخة السابقة: نموذج من عصر GPT-4o

كيف تعمل المعمارية الهجينة

الابتكار الرئيسي في GPT-Live هو في التوزيع الذكي للحمل الحسابي. للإجابات البسيطة والسريعة، يستخدم النظام قدراته الخاصة، مما يحافظ على تدفق محادثة سلس بدون تأخيرات ملحوظة. يعتبر غياب التأخيرات حاسماً لوضع الصوت، حيث حتى التأخيرات القصيرة تدمر شعور الحوار.

ومع ذلك، عندما يسأل المستخدم سؤالاً يتطلب البحث عبر الإنترنت أو التحليل العميق أو الحسابات المعقدة، يتم إعادة توجيه الطلب إلى GPT-5.5 — آخر نموذج حدود من OpenAI. يتم بعد ذلك إرجاع النتيجة إلى سياق المحادثة، ويستمر GPT-Live في الحوار كما لو أن شيئاً لم يحدث.

"بالنسبة للأسئلة التي تتطلب البحث عبر الإنترنت أو التحليل العميق أو

العمل الأكثر تعقيداً، فإنها توكل المهمة إلى نموذج الحدود الأحدث لدينا في الخلفية وتعيد النتيجة إلى سياق المحادثة. بينما يعمل GPT-Live، يستمر في التحدث معك والحفاظ على سلاسة المحادثة."

يسمح هذا النهج بدمج سرعة المعالجة المحلية مع القوة الفكرية لنموذج الحدود. تعد OpenAI بتحديث نموذج GPT-Live الأساسي مع إطلاق نماذج حدود جديدة.

الأخطاء في المعاينة والانطباعات الأولى

تلقى المحلل التقني Simon Willison وصول المعاينة لعدة أسابيع وترك النموذج الجديد انطباعاً. ومع ذلك، تم اكتشاف خطأ سلوكي مثير للاهتمام خلال فترة المعاينة: كان النموذج أحياناً يضحك في لحظات غير مناسبة — رداً على ملاحظات لم تكن نكتاً. شعر ذلك مثل سلوك فظ وسافل. استجاب المطورون وطبقوا تصحيحات، وبعدها أصبح هذا السلوك أقل احتمالاً.

استمرت أطول محادثة مع النموذج الجديد بالضبط ساعة واحدة — خلال نزهة مع كلب، عندما كان المستخدم يصور الطيور بالتزامن. هذا يوضح الإمكانيات للنمط كرفيق للتأمل الممتد.

ما يعنيه هذا

يوضح GPT-Live فئة جديدة من مساعدي الذكاء الاصطناعي الصوتي: سريع بما يكفي للحوار الطبيعي، لكن قادر على استدعاء نماذج قوية عندما تكون هناك حاجة للعمق. هذا يعني أن وضع الصوت أصبح أخيراً أداة مفيدة حقاً للتحليل المعقد والتفكير. قد تصبح النهج الهجينة المعيار للتطبيقات المحمولة: نماذج محلية للسرعة، حوسبة سحابية للذكاء.

ZK
Hamidun News
أخبار الذكاء الاصطناعي بدون ضوضاء. اختيار تحريري يومي من أكثر من 50 مصدر. منتج من جمال حميدون، رئيس الذكاء الاصطناعي في Alpina Digital.

هل تريد التوقف عن قراءة الذكاء الاصطناعي والبدء باستخدامه؟

AI News هو موجز منسق لأخبار الذكاء الاصطناعي. تعلمك Hamidun Academy استخدام الذكاء الاصطناعي في عملك.

ما رأيك؟
جارٍ تحميل التعليقات…