بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.
واجهة API خاصة لتحويل الكلام إلى نص على خادم VPS — متعددة اللغات، سريعة، متوافقة مع OpenAI.
قيد التحقق
التثبيت التلقائي لهذا الحل جاهز ويخضع حاليًا لاختباراتنا على خادم حقيقي. سيُفتح الطلب فور اكتمال التحقق.
Whisper هو نموذج التعرف على الكلام مفتوح المصدر من OpenAI، يُنشر هنا كواجهة REST API مستضافة ذاتيًا عبر خلفية faster-whisper بـ CTranslate2. يُفرّغ على خادمك ملفات صوتية بـ99 لغة، ويترجم إلى الإنجليزية، ويعيد توقيتات على مستوى الكلمة — كل ذلك دون إرسال بيت واحد إلى خدمة طرف ثالث. يعمل نموذج `base` بأريحية على خادم بنواة معالج واحدة وـ1 غيغابايت RAM.
دليل محسّن لخوادم VPS Cloud من ServOrbit.
افتح لوحة تحكم ServOrbit، واذهب إلى السوق ← الذكاء الاصطناعي ← Whisper، وانقر نشر. يسحب Docker الصورة ويشغّل الحاوية في أقل من دقيقتين. يُنزّل البدء الأول أيضًا أوزان نموذج التعرف على الكلام (~270 ميغابايت لـ base)؛ التنزيل مخزَّن مؤقتًا لذا تكون عمليات إعادة التشغيل اللاحقة فورية.
بعد التثبيت، استخدم العنوان المُعروض في منطقة العميل. واجهة Swagger UI متاحة في /docs للاختبار التفاعلي. نقطة النهاية الرئيسية هي POST /asr: أرفق ملفك الصوتي واضبط معامل output على txt أو json أو srt أو vtt أو tsv حسب الصيغة المطلوبة.
من طرفية أو تطبيقك، أرسل طلبًا:
`
curl -F "[email protected]" "https://عنوانك/asr?output=txt"
ستستلم التفريغ الكامل كنص عادي. لمقاطع مؤرَّخة زمنيًا، أضف output=json`.
النموذج الافتراضي هو base (سريع، ~140 ميغابايت). لتحسين الدقة، بدّل إلى small (أفضل للصوت المشوَّش، ~500 ميغابايت) بتحديث متغير البيئة ASR_MODEL. يتعامل خادم بـ2 غيغابايت RAM مع small بأريحية. تواصل مع الدعم لتغيير حجم خادمك.
نقطة النهاية متوافقة مع OpenAI Whisper: أي مكتبة أو أداة قادرة على استدعاء واجهة OpenAI للتفريغ يمكن توجيهها إلى نقطة نهايتك الخاصة بدلًا من ذلك. حدّث الرابط الأساسي وأزل أي مفتاح API — تُدار المصادقة على مستوى الوكيل العكسي من قِبل ServOrbit.
task (transcribe أو translate).تصفّح مركز المساعدة والأسئلة الشائعة، أو راسل فريقنا — الدعم بـ العربية والفرنسية والإنجليزية.