مهندس Backend - منصة الذكاء الاصطناعي الصوتي
Hams.ai
3–5 سنوات خبرة
"بصفتك مهندس باك إند، ستقوم ببناء الأنظمة الأساسية التي تقف خلف وكلاء الصوت الذكيين لدينا. ستقوم بتصميم خطوط المعالجة اللحظية التي تعالج الكلام المباشر، وتنسق المحادثات المدعومة بنماذج اللغات الكبيرة، وتدير جلسات الصوت المتزامنة على نطاق واسع، وتضمن أن كل مكالمة سريعة وموثوقة وذكية. هذا يعني العمل العملي مع معالجة الصوت اللحظية، وخطوط تحويل الكلام إلى نص والنص إلى كلام، وتنسيق نماذج اللغات الكبيرة، والاتصالات الهاتفية (SIP/Asterisk)، والبنية التحتية الموزعة للباك إند. ستعمل يوميًا مع Python وFastAPI وPipecat وLiveKit (WebRTC) وCelery وPostgreSQL وRedis وKubernetes.
ما الذي ستفعله
بناء وتحسين خطوط معالجة الصوت الذكية اللحظية — التعرف على الكلام (STT)، ومعالجة نماذج اللغات الكبيرة، وتركيب الكلام (TTS) التي تعمل في حلقات زمنية أقل من ثانية
تصميم وصيانة خدمات الباك إند التي تدير جلسات وكلاء الصوت، وتوجيه المكالمات، والتكامل مع الاتصالات الهاتفية (SIP/Asterisk)
تصميم أنظمة تنسيق متعددة الوكلاء — تدفقات المحادثة، وتسليم الوكلاء، وتمرير السياق بين وكلاء الصوت الذكيين
بناء وتوسيع البنية التحتية للتعامل مع آلاف المكالمات الصوتية المتزامنة بزمن استجابة منخفض
تطوير وتحسين طبقات الاتصال اللحظي القائمة على WebSocket وWebRTC
تنفيذ وإدارة معالجة المهام الموزعة لحملات الاتصال الجماعية، وتحليلات المكالمات، والتحليل الذكي بعد المكالمة
تصميم وتحسين وصيانة قواعد بيانات PostgreSQL، وذاكرة التخزين المؤقت Redis، وطوابير الرسائل
تنفيذ المراقبة عبر خطوط معالجة الصوت: تتبع زمن الاستجابة، ومقاييس جودة المكالمات، والتتبع الموزع (OpenTelemetry، Sentry)
التعامل مع تصحيح الأخطاء في الإنتاج لأنظمة الصوت اللحظية — تشخيص مشاكل جودة الصوت، وارتفاعات زمن الاستجابة، وفشل الجلسات
العمل عن كثب مع فرق الذكاء الاصطناعي والمنتج وDevOps لإطلاق ميزات الصوت الذكية من البداية إلى النهاية
من أنت
إتقان قوي للغة Python مع فهم عميق لـ async/await وأنماط التزامن اللحظي
خبرة في بناء أنظمة باك إند إنتاجية باستخدام FastAPI أو أطر عمل غير متزامنة مماثلة
فهم عميق لـ PostgreSQL، وتصميم قواعد البيانات العلائقية، وأنماط ORM
خبرة في الأنظمة اللحظية — WebSockets، والبث، وخطوط معالجة الصوت، أو الاتصالات منخفضة الزمن
خبرة عملية في معالجة المهام الموزعة (Celery، Redis)
الراحة في امتلاك الأنظمة الإنتاجية من البداية إلى النهاية، من التصميم إلى النشر إلى الاستجابة للحوادث
الازدهار في بيئات سريعة الخطى وعالية المسؤولية حيث يكون الصوت الذكي هو المنتج الأساسي
ميزات إضافية مرغوبة
خبرة في الصوت الذكي، أو الذكاء الاصطناعي للمحادثة، أو معالجة الكلام (STT، TTS، VAD)
خبرة في أنظمة الاتصالات الهاتفية (SIP، Asterisk، WebRTC)
الإلمام بتنسيق الذكاء الاصطناعي/نماذج اللغات الكبيرة (OpenAI، LangChain، LangGraph، Pipecat، Livekit)
خبرة في أطر عمل الصوت اللحظية أو منصات الروبوتات الصوتية
خبرة في البنية التحتية السحابية (AWS، GCP، Kubernetes)
قواعد البيانات المتجهة وأنماط RAG لوكلاء الصوت المدعومين بالمعرفة"
Delivery Hero SE
قبل شهرين
Delivery Hero SE
Confidential Company
قبل ٤ أشهر
Confidential Company