في المكتب دوام كامل
--
Intellias

تفاصيل الوظيفة

ما ستفعله

تصميم وتنفيذ أطر تقييم آلية لسير عمل الوكلاء المعتمدة على LangGraph وأنابيب الت orchestration.

تطوير مجموعات التقييم أثناء البناء تغطي سلوك الوكيل، دقة اختيار الأداة، جودة التفكير وجودة الناتج النهائي.

إنشاء منهجيات تقييم تجمع بين أساليب التقييم الحاسمة deterministic مع تقنيات التقييم على أساس LLM كقاض.

بناء مقلاع اختبارات لرسومات LangGraph والعُقَد وانتقالات الحالة ومسارات تنفيذ الوكيل.

تصميم محاكيات محادثة متعددة الجولات للتحقق من الاحتفاظ بالسياق، واستخدام الذاكرة، وتناسق سير العمل.

تعريف والحفاظ على مقاييس الاعتمادية، بما في ذلك pass@k ومنهجيات pass^k، لقياس معدلات النجاح والتناسق السلوكي.

تنفيذ بوابات نشر CI/CD التي تمنع الإصدارات تلقائياً عندما لا تُلبَّ معايير التقييم.

تطوير عمليات التحقق لبيئات الإصدار التجريبي، ومقارنات وضع الظل، وتدفقات الإنتاج المحكومة.

دمج تقويمات AWS AgentCore (وضع التقييم عند الطلب وعلى الإنترنت) ضمن اختبارات مستمرة وعمليات ضمان الجودة.

تحويل حوادث الإنتاج، فشلها، وسلوك الوكيل غير المتوقع إلى حالات اختبار الانحدار.

إقامة مقاييس التقييم، معايير الجودة، ومعايير القبول لإصدارات الوكلاء.

التعاون مع مهندسي AI وفرق المنصة وأصحاب المصلحة في المنتج لتحسين موثوقية وأداء الوكلاء.

تحديد آليات الرصد والتغذية المرتدة التي تربط سلوك الإنتاج بتحسينات إطار الاختبار.

إعداد وثائق لاستراتيجيات التقييم، مناهج التقدير، بوابات النشر، ومعايير الجودة.

ما تحتاجه لهذا الدور

المهارات:

• بنية نظام Agentic AI (تنسيق وكلاء، تفويض متعدد الوكلاء، استخدام الأدوات، إدارة الذاكرة/الحالة)

• أطر تنسيق الوكلاء (LangGraph, Strands, AutoGen, CrewAI، أو ما يماثلها — عمق على مستوى الإنتاج في واحد على الأقل)

• أنماط تكامل الوكيل إلى الأداة والوكيل إلى الوكيل (استدعاء الدوال، MCP، A2A، أو بروتوكولات مماثلة)

• بنية تطبيق LLM (خطوط RAG، هندسة الطلب/السياق، توجيه النماذج، تقييم مخرجات LLM)

• حوكمة الوكيل والضوابط التشغيلية (التفويض/الانفاذ السياسي للإجراءات المستقلة، الهوية للعوامل غير البشرية)

 

الخبرة:

• أكثر من 6 سنوات خبرة في عمارة البرمجيات، بما في ذلك أكثر من سنتين في هندسة أنظمة ذكاء اصطناعي مدعومة بنماذج لغة كبيرة أو أنظمة وكيلية في الإنتاج

• خبرة عملية مع واحد على الأقل من أطر تنسيق الوكلاء (LangGraph، Strands، AutoGen، CrewAI، أو ما يعادلها)، مع تحمل قرارات الهندسة، وليس فقط التنفيذ

• خبرة في تصميم تكامل الوكيل إلى أداة على مستوى المنصة (طبقة أداة/تكامل تستخدمها عدة وكلاء أو فرق، وليست توصيل أداة مخصصة لوكيل واحد)

• خبرة في هندسة اثنين على الأقل من ما يلي لأنظمة وكيلية: بيئة التشغيل/التنفيذ، تكامل الأداة/البوابة، الهوية والإنفاذ السياسي، الرصد والتقييم

• خبرة مثبتة في تقديم بنية للحوكمة أو المراجعة التقنية (ARB، مجلس مراجعة التصميم، أو ما يعادلها)

 

مرغوب فيه:

• خبرة عملية مع AWS Bedrock AgentCore (وقت التشغيل، البوابة، السجل، السياسة، التقييم، الرصد)

• خبرة مع أطر السياسة كرمز للوصول إلى الوكلاء (Cedar، OPA، أو مشابه) • الإلمام ببروتوكولات MCP وA2A

• دور معماري سابق يغطي عدة مجالات منصة في بيئة مؤسسة، منضبطة، أو محكومة بشدة

• خبرة في معايير هوية الوكيل (مثلاً اتحاد الهوية غير البشرية، MS Entra Agent ID أو ما يعادله)

• Architecture للراصد والتقييم خاصة بأنظمة وكيلية (تتبع تفكير الوكيل متعدد الخطوات، مراقبة الجودة/السلامة)

• بنية سحابية تدعم تشغيلات الوكيل المدار (AWS مفضل — الشبكات، IAM، الحوسبة المدارة)

المتقدم المرغوب فيه


وظائف مشابهة

حول Intellias
مصر, القاهرة
تكنولوجيا المعلومات والخدمات