GPT-Live 1
الواجهة الأمامية الصوتية مزدوجة الاتجاه OpenAI للمحادثة الطبيعية التي تقوم بتفويض التفكير والإجراءات الأعمق إلى وكيل الواجهة الخلفية المنفصل.
الواجهة الأمامية الصوتية مزدوجة الاتجاه OpenAI للمحادثة الطبيعية التي تقوم بتفويض التفكير والإجراءات الأعمق إلى وكيل الواجهة الخلفية المنفصل.
نظرة عامة على اللغة الإنجليزية البسيطة
يستمع GPT-Live 1 ويتحدث في نفس الوقت، لذلك يمكنه التعامل مع التوقفات المؤقتة والاعترافات والانقطاعات وضجيج الخلفية دون إجبار كل تبادل على التحولات الصارمة. كما يوفر أيضًا النصوص ونص الاستجابة جنبًا إلى جنب مع الصوت المباشر.
تفصل الهندسة المعمارية المحادثة عن العمل الأعمق. يقوم GPT-Live 1 بإدارة التجربة الصوتية بينما يتعامل نموذج الاستجابات أو الوكيل الذي يتم تشغيله بواسطة التطبيق مع أدوات الاستدلال والأدوات المعتمدة. وبالتالي فإن سعر الصوت المنشور لا يشمل استخدام نموذج الواجهة الخلفية، والأدوات، والاتصال الهاتفي، والبنية التحتية للتطبيقات.
مقارنة الفئة
هذه مواصفات منشورة من قبل الموفر، وليست درجات معيار Cody. اتبع المصادر المرتبطة للحدود الحالية والاستثناءات الخاصة بنقطة النهاية.
الوصول إلى واجهة برمجة التطبيقات والموفر
التوفر
متاح من خلال Live API الخاص بـ OpenAI للمتصفح والخادم والتطبيقات الصوتية الهاتفية.
الوصول المباشر يتبع قائمة الدول المدعومة المباشرة لـ OpenAI؛ طبقة API المجانية غير مدعومة لهذا النموذج.
تحقق من التوفر المباشرالبيانات والتدريب
يقول OpenAI أن محتوى واجهة برمجة التطبيقات (API) لا يُستخدم للتدريب بشكل افتراضي. قد يتم الاحتفاظ بسجلات مراقبة إساءة الاستخدام الافتراضية لمدة تصل إلى 30 يومًا، مع توفر عناصر تحكم إضافية للمؤسسات المؤهلة.
هذه قراءة موجزة لمواد المزود المذكورة، وليست نصيحة قانونية. يمكن أن تحتوي بوابة الطرف الثالث على شروط تخزين وتوجيه وتدريب وإقامة مختلفة من واجهة برمجة التطبيقات المباشرة الخاصة بصانع النموذج.
اقرأ سياسة المزودالأسئلة المتداولة
الواجهة الأمامية الصوتية مزدوجة الاتجاه OpenAI للمحادثة الطبيعية التي تقوم بتفويض التفكير والإجراءات الأعمق إلى وكيل الواجهة الخلفية المنفصل. يستمع GPT-Live 1 ويتحدث في نفس الوقت، لذلك يمكنه التعامل مع التوقفات المؤقتة والاعترافات والانقطاعات وضجيج الخلفية دون إجبار كل تبادل على التحولات الصارمة. كما يوفر أيضًا النصوص ونص الاستجابة جنبًا إلى جنب مع الصوت المباشر.
تم إصدار GPT-Live 1 على 10 سبتمبر 2026 وفقًا لمواد الموفر المذكورة.
متاح من خلال Live API الخاص بـ OpenAI للمتصفح والخادم والتطبيقات الصوتية الهاتفية. مسارات الوصول المدرجة في هذا الدليل هي OpenAI.
0.05 دولار/دقيقة صوتية. تتم محاسبة الجلسات الصوتية بالثانية دون تقريب الدقيقة الكاملة. يتم إصدار فواتير لنموذج الواجهة الخلفية واستخدام الأداة بشكل منفصل، كما هو الحال مع البنية التحتية للاتصالات الهاتفية والتطبيقات.
متاح من خلال Live API الخاص بـ OpenAI للمتصفح والخادم والتطبيقات الصوتية الهاتفية. الوصول المباشر يتبع قائمة الدول المدعومة المباشرة لـ OpenAI؛ طبقة API المجانية غير مدعومة لهذا النموذج.
يقول OpenAI أن محتوى واجهة برمجة التطبيقات (API) لا يُستخدم للتدريب بشكل افتراضي. قد يتم الاحتفاظ بسجلات مراقبة إساءة الاستخدام الافتراضية لمدة تصل إلى 30 يومًا، مع توفر عناصر تحكم إضافية للمؤسسات المؤهلة. تنتمي السياسة إلى مسار الموفر وشروط الحساب، لذا تحقق منها مرة أخرى قبل استخدام الإنتاج.
المقارنات ذات الصلة
نموذج OpenAI للاستدلال المنطقي لتحويل الكلام إلى كلام في الوقت الفعلي لوكلاء الصوت الذين يستخدمون الأدوات والذين يحتاجون أيضًا إلى سياق النص والصورة.
فتح المقارنة الكاملةنموذج معاينة الصوت إلى الصوت الخاص بـ Google للحوار منخفض زمن الوصول مع الوعي متعدد الوسائط والتفكير وتأريض البحث واستدعاء الوظائف.
فتح المقارنة الكاملةنموذج ElevenLabs المعبّر لتحويل النص إلى كلام في الوقت الفعلي للحوار الطبيعي والتوصيل العاطفي والعلامات الصوتية وأكثر من 70 لغة.
فتح المقارنة الكاملةأحدث نموذج تعبيري لتحويل النص إلى كلام في العالم في الوقت الفعلي، مصمم لتذكر تسليم المحادثة والتحدث بأكثر من 100 لغة.
فتح المقارنة الكاملةنموذج SpaceXAI الحالي لتحويل الكلام إلى كلام في الوقت الفعلي لوكلاء المحادثة دون الثانية مع إمكانية الوصول إلى الأداة.
فتح المقارنة الكاملة