[{"data":1,"prerenderedAt":94},["ShallowReactive",2],{"seo-verification":3,"marketplace-app-ar-whisper":6},{"google":4,"bing":5},"EycwPY2XMyTkVzas3n1ygeNJFGAH513qrMjfDljzsMQ","",{"slug":7,"name":8,"description":9,"phase":10,"unavailableReason":11,"docsUrl":12,"logo":13,"github":13,"tagline":14,"longDescription":15,"features":16,"useCases":23,"steps":33,"faq":49,"specs":65,"compatibleOs":71,"relatedApps":72,"relatedPosts":88,"category":91},"whisper","Whisper","واجهة API مفتوحة المصدر لتفريغ الصوت، مستضافة ذاتيًا: حوّل تسجيلاتك إلى نص مؤرَّخ زمنيًا عبر REST، بخصوصية كاملة على خادمك.",2,"awaiting_qa","https:\u002F\u002Fservorbit.com\u002Fblog\u002Fheberger-whisper-vps",null,"واجهة API خاصة لتحويل الكلام إلى نص على خادم VPS — متعددة اللغات، سريعة، متوافقة مع OpenAI.","Whisper هو نموذج التعرف على الكلام مفتوح المصدر من OpenAI، يُنشر هنا كواجهة REST API مستضافة ذاتيًا عبر خلفية faster-whisper بـ CTranslate2. يُفرّغ على خادمك ملفات صوتية بـ99 لغة، ويترجم إلى الإنجليزية، ويعيد توقيتات على مستوى الكلمة — كل ذلك دون إرسال بيت واحد إلى خدمة طرف ثالث. يعمل نموذج `base` بأريحية على خادم بنواة معالج واحدة وـ1 غيغابايت RAM.",[17,18,19,20,21,22],"واجهة REST متوافقة مع OpenAI: POST \u002Fasr، إخراج بصيغ txt وjson وsrt وvtt وtsv.","خلفية faster-whisper بـ CTranslate2: أسرع بـ4 مرات من Whisper الأصلي على وحدة المعالجة المركزية.","دعم 99 لغة — العربية، الفرنسية، الإنجليزية، الدارجة وأكثر — في نموذج واحد.","توقيتات على مستوى الكلمة والمقطع، جاهزة لتوليد الترجمات.","لا فوترة بالدقيقة ولا بيانات تغادر خادمك.","اختيار النموذج عبر متغير البيئة ASR_MODEL: tiny أو base أو small أو medium أو large-v3.",[24,27,30],{"title":25,"description":26},"تفريغ الاجتماعات والمقابلات","أرسل تسجيلات الاجتماعات السرية مباشرةً إلى نقطة نهايتك الخاصة واسترجع نصًا مؤرَّخًا. لا تغادر بيانات الموارد البشرية أو القانونية بنيتك التحتية.",{"title":28,"description":29},"ترجمة البودكاست والوسائط","عالج رفع الصوت من جهة الخادم واستلم ملفات ترجمة SRT. ادمج نقطة النهاية في نظام إدارة المحتوى أو خط أنابيب الوسائط لأتمتة توليد الترجمة بتكلفة هامشية صفرية.",{"title":31,"description":32},"الصوت إلى نص للأدوات الداخلية","ادمج واجهة REST في نظام إدارة علاقات العملاء أو بطاقات الدعم أو أدوات التدوين. دع الوكلاء يملون، ودع واجهة API تُفرّغ — بتكلفة شهرية ثابتة بدلًا من فوترة بالدقيقة.",[34,37,40,43,46],{"title":35,"body":36},"النشر من السوق","افتح لوحة تحكم ServOrbit، واذهب إلى السوق ← الذكاء الاصطناعي ← Whisper، وانقر نشر. يسحب Docker الصورة ويشغّل الحاوية في أقل من دقيقتين. يُنزّل البدء الأول أيضًا أوزان نموذج التعرف على الكلام (~270 ميغابايت لـ base)؛ التنزيل مخزَّن مؤقتًا لذا تكون عمليات إعادة التشغيل اللاحقة فورية.",{"title":38,"body":39},"الوصول إلى الواجهة API","بعد التثبيت، استخدم العنوان المُعروض في منطقة العميل. واجهة Swagger UI متاحة في `\u002Fdocs` للاختبار التفاعلي. نقطة النهاية الرئيسية هي `POST \u002Fasr`: أرفق ملفك الصوتي واضبط معامل `output` على txt أو json أو srt أو vtt أو tsv حسب الصيغة المطلوبة.",{"title":41,"body":42},"تفريغ أول ملف","من طرفية أو تطبيقك، أرسل طلبًا:\n```\ncurl -F \"audio_file=@recording.mp3\" \"https:\u002F\u002Fعنوانك\u002Fasr?output=txt\"\n```\nستستلم التفريغ الكامل كنص عادي. لمقاطع مؤرَّخة زمنيًا، أضف `output=json`.",{"title":44,"body":45},"تغيير النموذج عند الحاجة","النموذج الافتراضي هو `base` (سريع، ~140 ميغابايت). لتحسين الدقة، بدّل إلى `small` (أفضل للصوت المشوَّش، ~500 ميغابايت) بتحديث متغير البيئة `ASR_MODEL`. يتعامل خادم بـ2 غيغابايت RAM مع `small` بأريحية. تواصل مع الدعم لتغيير حجم خادمك.",{"title":47,"body":48},"الدمج في خط الأنابيب","نقطة النهاية متوافقة مع OpenAI Whisper: أي مكتبة أو أداة قادرة على استدعاء واجهة OpenAI للتفريغ يمكن توجيهها إلى نقطة نهايتك الخاصة بدلًا من ذلك. حدّث الرابط الأساسي وأزل أي مفتاح API — تُدار المصادقة على مستوى الوكيل العكسي من قِبل ServOrbit.",[50,53,56,59,62],{"q":51,"a":52},"ما اللغات التي يُفرّغها Whisper؟","يتعرف النموذج على 99 لغة تشمل العربية والفرنسية والإنجليزية والإسبانية والدارجة وكثير غيرها. يتولى النموذج ذاته التفريغ والترجمة إلى الإنجليزية، مُحددًا عبر معامل `task` (transcribe أو translate).",{"q":54,"a":55},"أي نموذج أختار لخادم بـ1 غيغابايت RAM؟","يعمل نموذج `base` (الافتراضي) بأريحية على 1 غيغابايت RAM ونواة معالج واحدة. يُقدّم دقة جيدة للكلام الواضح. للتسجيلات المشوشة أو اللغات منخفضة الموارد، يُناسب `small` خادمًا بـ2 غيغابايت. يتطلب `large-v3` 8 غيغابايت RAM ويُوصى به لخطط VPS بوحدة GPU.",{"q":57,"a":58},"هل توجد واجهة ويب لرفع الملفات؟","يُنشر Whisper كواجهة REST API مع Swagger UI في `\u002Fdocs` للاختبار التفاعلي. لا يتضمن تطبيق ويب منفردًا لرفع الملفات. يمكنك استدعاء الواجهة من واجهتك الخاصة، أو من أدوات مثل n8n أو Make، أو مباشرةً من سطر الأوامر بـ curl.",{"q":60,"a":61},"هل يمكن استخدامه بديلًا عن واجهة OpenAI Whisper API؟","نعم. نقطة النهاية متوافقة مع OpenAI: أي مكتبة أو تكامل يستهدف واجهة OpenAI للتفريغ يمكن إعادة توجيهه إلى نسختك الخاصة بتغيير الرابط الأساسي فحسب. لا يلزم مفتاح API من جهة الخادم — يُدار الوصول بواسطة الوكيل العكسي.",{"q":63,"a":64},"هل تغادر ملفاتي الصوتية الخادم؟","لا. تُعالَج الملفات الصوتية محليًا كليًا على خادم VPS الخاص بك. لا تُرسل بيانات إلى OpenAI أو أي طرف ثالث. تُحتجز الملفات في الذاكرة أثناء المعالجة ولا تُخزَّن على القرص بعد إعادة التفريغ.",{"version":66,"license":67,"ram":68,"cpu":69,"disk":70},"faster-whisper \u002F CTranslate2","MIT","1 غيغابايت كحد أدنى (نموذج base)، 2 غيغابايت موصى به (نموذج small)","1 vCPU","5 غيغابايت كحد أدنى (ذاكرة مؤقتة للنموذج)",[],[73,82],{"name":74,"slug":75,"categorySlug":76,"categoryName":77,"categoryColor":78,"logo":79,"tagline":80,"description":81},"Open WebUI","open-webui","ia","الذكاء الاصطناعي","text-purple-400 bg-purple-500\u002F10","https:\u002F\u002Fcdn.jsdelivr.net\u002Fgh\u002Fselfhst\u002Ficons\u002Fsvg\u002Fopen-webui.svg","واجهة ويب لنماذج اللغة لديك — Ollama وOpenAI وMistral — مستضافة على خادمك الخاص.","واجهة ويب للتفاعل مع نماذج اللغة المحلية أو البعيدة. بياناتك تبقى على بنيتك التحتية — دون أي طرف ثالث.",{"name":83,"slug":84,"categorySlug":76,"categoryName":77,"categoryColor":78,"logo":85,"tagline":86,"description":87},"Dify","dify","https:\u002F\u002Fcdn.jsdelivr.net\u002Fgh\u002Fselfhst\u002Ficons\u002Fsvg\u002Fdify.svg","أنشئ تطبيقات نماذج اللغة الكبيرة بالسحب والإفلات — روبوتات محادثة ووكلاء وخطوط معالجة RAG — دون واجهة خلفية.","أنشئ تطبيقات نماذج اللغة الكبيرة بصريًا: روبوتات محادثة ووكلاء RAG وخطوط معالجة — دون كتابة أي شيفرة خلفية.",[89,90],"heberger-open-webui","heberger-ollama-vps",{"key":76,"slug":76,"name":77,"objective":92,"icon":93,"color":78},"بناء واستضافة وتشغيل حلول الذكاء الاصطناعي.","ai",1786485885313]