بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

Whisper

واجهة API خاصة لتحويل الكلام إلى نص على خادم VPS — متعددة اللغات، سريعة، متوافقة مع OpenAI.

1 غيغابايت كحد أدنى (نموذج base)، 2 غيغابايت موصى به (نموذج small) ذاكرة عشوائية 1 vCPU قيد التحقق

قيد التحقق

التثبيت التلقائي لهذا الحل جاهز ويخضع حاليًا لاختباراتنا على خادم حقيقي. سيُفتح الطلب فور اكتمال التحقق.

Whisper هو نموذج التعرف على الكلام مفتوح المصدر من OpenAI، يُنشر هنا كواجهة REST API مستضافة ذاتيًا عبر خلفية faster-whisper بـ CTranslate2. يُفرّغ على خادمك ملفات صوتية بـ99 لغة، ويترجم إلى الإنجليزية، ويعيد توقيتات على مستوى الكلمة — كل ذلك دون إرسال بيت واحد إلى خدمة طرف ثالث. يعمل نموذج `base` بأريحية على خادم بنواة معالج واحدة وـ1 غيغابايت RAM.

الميزات الرئيسية

واجهة REST متوافقة مع OpenAI: POST /asr، إخراج بصيغ txt وjson وsrt وvtt وtsv.
خلفية faster-whisper بـ CTranslate2: أسرع بـ4 مرات من Whisper الأصلي على وحدة المعالجة المركزية.
دعم 99 لغة — العربية، الفرنسية، الإنجليزية، الدارجة وأكثر — في نموذج واحد.
توقيتات على مستوى الكلمة والمقطع، جاهزة لتوليد الترجمات.
لا فوترة بالدقيقة ولا بيانات تغادر خادمك.
اختيار النموذج عبر متغير البيئة ASR_MODEL: tiny أو base أو small أو medium أو large-v3.

متى تستخدم هذا الحل؟

1

تفريغ الاجتماعات والمقابلات

2

ترجمة البودكاست والوسائط

3

الصوت إلى نص للأدوات الداخلية

نشر Whisper على خادم VPS الخاص بك

دليل محسّن لخوادم VPS Cloud من ServOrbit.

01

النشر من السوق

افتح لوحة تحكم ServOrbit، واذهب إلى السوق ← الذكاء الاصطناعي ← Whisper، وانقر نشر. يسحب Docker الصورة ويشغّل الحاوية في أقل من دقيقتين. يُنزّل البدء الأول أيضًا أوزان نموذج التعرف على الكلام (~270 ميغابايت لـ base)؛ التنزيل مخزَّن مؤقتًا لذا تكون عمليات إعادة التشغيل اللاحقة فورية.

02

الوصول إلى الواجهة API

بعد التثبيت، استخدم العنوان المُعروض في منطقة العميل. واجهة Swagger UI متاحة في /docs للاختبار التفاعلي. نقطة النهاية الرئيسية هي POST /asr: أرفق ملفك الصوتي واضبط معامل output على txt أو json أو srt أو vtt أو tsv حسب الصيغة المطلوبة.

03

تفريغ أول ملف

من طرفية أو تطبيقك، أرسل طلبًا: ` curl -F "[email protected]" "https://عنوانك/asr?output=txt" ستستلم التفريغ الكامل كنص عادي. لمقاطع مؤرَّخة زمنيًا، أضف output=json`.

04

تغيير النموذج عند الحاجة

النموذج الافتراضي هو base (سريع، ~140 ميغابايت). لتحسين الدقة، بدّل إلى small (أفضل للصوت المشوَّش، ~500 ميغابايت) بتحديث متغير البيئة ASR_MODEL. يتعامل خادم بـ2 غيغابايت RAM مع small بأريحية. تواصل مع الدعم لتغيير حجم خادمك.

05

الدمج في خط الأنابيب

نقطة النهاية متوافقة مع OpenAI Whisper: أي مكتبة أو أداة قادرة على استدعاء واجهة OpenAI للتفريغ يمكن توجيهها إلى نقطة نهايتك الخاصة بدلًا من ذلك. حدّث الرابط الأساسي وأزل أي مفتاح API — تُدار المصادقة على مستوى الوكيل العكسي من قِبل ServOrbit.

الأسئلة الشائعة

يتعرف النموذج على 99 لغة تشمل العربية والفرنسية والإنجليزية والإسبانية والدارجة وكثير غيرها. يتولى النموذج ذاته التفريغ والترجمة إلى الإنجليزية، مُحددًا عبر معامل task (transcribe أو translate).

بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.

لا يمكن طلب Whisper بعد.

التثبيت التلقائي لهذا الحل جاهز ويخضع حاليًا لاختباراتنا على خادم حقيقي. سيُفتح الطلب فور اكتمال التحقق.

بحاجة إلى مساعدة؟

تصفّح مركز المساعدة والأسئلة الشائعة، أو راسل فريقنا — الدعم بـ العربية والفرنسية والإنجليزية.