جميع الموديلات
OpenAI

GPT-Live 1

الواجهة الأمامية الصوتية مزدوجة الاتجاه OpenAI للمحادثة الطبيعية التي تقوم بتفويض التفكير والإجراءات الأعمق إلى وكيل الواجهة الخلفية المنفصل.

نظرة عامة على اللغة الإنجليزية البسيطة

ما هو GPT-Live 1 في الواقع

يستمع GPT-Live 1 ويتحدث في نفس الوقت، لذلك يمكنه التعامل مع التوقفات المؤقتة والاعترافات والانقطاعات وضجيج الخلفية دون إجبار كل تبادل على التحولات الصارمة. كما يوفر أيضًا النصوص ونص الاستجابة جنبًا إلى جنب مع الصوت المباشر.

تفصل الهندسة المعمارية المحادثة عن العمل الأعمق. يقوم GPT-Live 1 بإدارة التجربة الصوتية بينما يتعامل نموذج الاستجابات أو الوكيل الذي يتم تشغيله بواسطة التطبيق مع أدوات الاستدلال والأدوات المعتمدة. وبالتالي فإن سعر الصوت المنشور لا يشمل استخدام نموذج الواجهة الخلفية، والأدوات، والاتصال الهاتفي، والبنية التحتية للتطبيقات.

جيد مناسب ل

  • خدمة العملاء الطبيعية وجدولة المكالمات
  • واجهات صوتية يجب أن تستمر في التحدث أثناء سير العمل
  • الفرق التي ترغب في اختيار وكيل الواجهة الخلفية أو تشغيله

مقارنة الفئة

الحقائق التي تهم نماذج صوت

هذه مواصفات منشورة من قبل الموفر، وليست درجات معيار Cody. اتبع المصادر المرتبطة للحدود الحالية والاستثناءات الخاصة بنقطة النهاية.

أساس السعر
0.05 دولار / دقيقة صوتية + استخدام الواجهة الخلفيةسعر رمزي أو حرفي أو دقيق لمسار الوصول المدرج.
وضع التفاعل
واجهة أمامية صوتية مزدوجة كاملة مع واجهة خلفية مفوضةسلوك تحويل الكلام إلى كلام، أو الصوت إلى الصوت، أو تحويل النص إلى كلام.
الكمون المنشور
لم يتم نشرهالقياس الذي ينشره المزود مع الاستثناءات المذكورة؛ ليس اختبار Cody.
اللغات
لهجات ولهجات ولغات متعددة؛ القائمة الدقيقة لم تنشرتغطية لغوية موثقة من قبل المزود أو علامة واضحة غير منشورة.
الأدوات والتحكم
الاستجابات أو تفويض العميل لوكلاء وأدوات الواجهة الخلفيةميزات استدعاء الوظائف الأصلية أو الاستدلال أو التحكم في الكلام.
السياق أو حد الإدخال
لم يتم نشرهالرمز المميز الموثق أو عدد الأحرف المسموح به حيث يكون ذا معنى.

الوصول إلى واجهة برمجة التطبيقات والموفر

أين يمكن الحصول على GPT-Live 1

التوفر

المناطق ومرحلة الوصول

متاح من خلال Live API الخاص بـ OpenAI للمتصفح والخادم والتطبيقات الصوتية الهاتفية.

الوصول المباشر يتبع قائمة الدول المدعومة المباشرة لـ OpenAI؛ طبقة API المجانية غير مدعومة لهذا النموذج.

تحقق من التوفر المباشر

البيانات والتدريب

الطريق مهم.

يقول OpenAI أن محتوى واجهة برمجة التطبيقات (API) لا يُستخدم للتدريب بشكل افتراضي. قد يتم الاحتفاظ بسجلات مراقبة إساءة الاستخدام الافتراضية لمدة تصل إلى 30 يومًا، مع توفر عناصر تحكم إضافية للمؤسسات المؤهلة.

هذه قراءة موجزة لمواد المزود المذكورة، وليست نصيحة قانونية. يمكن أن تحتوي بوابة الطرف الثالث على شروط تخزين وتوجيه وتدريب وإقامة مختلفة من واجهة برمجة التطبيقات المباشرة الخاصة بصانع النموذج.

اقرأ سياسة المزود

الأسئلة المتداولة

الأسئلة الشائعة حول GPT-Live 1

ما هو GPT-Live 1؟

الواجهة الأمامية الصوتية مزدوجة الاتجاه OpenAI للمحادثة الطبيعية التي تقوم بتفويض التفكير والإجراءات الأعمق إلى وكيل الواجهة الخلفية المنفصل. يستمع GPT-Live 1 ويتحدث في نفس الوقت، لذلك يمكنه التعامل مع التوقفات المؤقتة والاعترافات والانقطاعات وضجيج الخلفية دون إجبار كل تبادل على التحولات الصارمة. كما يوفر أيضًا النصوص ونص الاستجابة جنبًا إلى جنب مع الصوت المباشر.

متى تم إصدار GPT-Live 1؟

تم إصدار GPT-Live 1 على 10 سبتمبر 2026 وفقًا لمواد الموفر المذكورة.

أين يمكنني الوصول إلى GPT-Live 1؟

متاح من خلال Live API الخاص بـ OpenAI للمتصفح والخادم والتطبيقات الصوتية الهاتفية. مسارات الوصول المدرجة في هذا الدليل هي OpenAI.

كم تكلفة GPT-Live 1؟

0.05 دولار/دقيقة صوتية. تتم محاسبة الجلسات الصوتية بالثانية دون تقريب الدقيقة الكاملة. يتم إصدار فواتير لنموذج الواجهة الخلفية واستخدام الأداة بشكل منفصل، كما هو الحال مع البنية التحتية للاتصالات الهاتفية والتطبيقات.

أين يتوفر GPT-Live 1؟

متاح من خلال Live API الخاص بـ OpenAI للمتصفح والخادم والتطبيقات الصوتية الهاتفية. الوصول المباشر يتبع قائمة الدول المدعومة المباشرة لـ OpenAI؛ طبقة API المجانية غير مدعومة لهذا النموذج.

هل يتم استخدام بيانات GPT-Live 1 API الخاصة بي للتدريب؟

يقول OpenAI أن محتوى واجهة برمجة التطبيقات (API) لا يُستخدم للتدريب بشكل افتراضي. قد يتم الاحتفاظ بسجلات مراقبة إساءة الاستخدام الافتراضية لمدة تصل إلى 30 يومًا، مع توفر عناصر تحكم إضافية للمؤسسات المؤهلة. تنتمي السياسة إلى مسار الموفر وشروط الحساب، لذا تحقق منها مرة أخرى قبل استخدام الإنتاج.

المقارنات ذات الصلة

مقارنات مباشرة

  1. GPT-Live 1 vs GPT-Realtime-2.1

    نموذج OpenAI للاستدلال المنطقي لتحويل الكلام إلى كلام في الوقت الفعلي لوكلاء الصوت الذين يستخدمون الأدوات والذين يحتاجون أيضًا إلى سياق النص والصورة.

    فتح المقارنة الكاملة
  2. GPT-Live 1 vs Gemini 3.1 Flash Live Preview

    نموذج معاينة الصوت إلى الصوت الخاص بـ Google للحوار منخفض زمن الوصول مع الوعي متعدد الوسائط والتفكير وتأريض البحث واستدعاء الوظائف.

    فتح المقارنة الكاملة
  3. GPT-Live 1 vs Eleven v3 Conversational

    نموذج ElevenLabs المعبّر لتحويل النص إلى كلام في الوقت الفعلي للحوار الطبيعي والتوصيل العاطفي والعلامات الصوتية وأكثر من 70 لغة.

    فتح المقارنة الكاملة
  4. GPT-Live 1 vs Inworld Realtime TTS-2

    أحدث نموذج تعبيري لتحويل النص إلى كلام في العالم في الوقت الفعلي، مصمم لتذكر تسليم المحادثة والتحدث بأكثر من 100 لغة.

    فتح المقارنة الكاملة
  5. GPT-Live 1 vs Grok Voice Think Fast 2.0

    نموذج SpaceXAI الحالي لتحويل الكلام إلى كلام في الوقت الفعلي لوكلاء المحادثة دون الثانية مع إمكانية الوصول إلى الأداة.

    فتح المقارنة الكاملة