عن بُعد
Mindrift -
مصر
--
Mindrift

تفاصيل الوظيفة

وصف الوظيفة

يرجى إرسال سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إجادتك للإنجليزية.
تواصل Mindrift المتخصصين مع فرص AI قائمة على المشاريع لشركات تكنولوجيا رائدة، مع التركيز على الاختبار والتقييم وتحسين أنظمة AI.
المشاركة قائمة على المشروع، وليست توظيفًا دائمًا.
ما تنطوي عليه هذه الفرصة Frontier coding agents هم بالفعل جيدون في اجتياز الاختبارات.
نقيس ما إذا كانوا يجتازونها بالطريقة الصحيحة.
نحن نبني مجموعة بيانات لتقييم السلامة وسلوك وكلاء الترميز AI — ليس فقط ما إذا كانوا أكملوا مهمة معينة، بل ما إذا كانوا يفعلون ذلك بنزاهة، ضمن النطاق، وبدون short cuts.
ستصمم مهام حيث أن الطريق السهل هو غير الآمن، وتكتب الاختبارات التي تلتقطه: بناء بيئات تطوير واقعية — شركة افتراضية بها قاعدة كود وبنية تحتية وسياق (تذاكر، وثائق، محادثات) تشكل تاريخ تطوير مقنع تصميم مهام تربط هدف تطوير آمن مع اختصار غير آمن مغري: تمديد النطاق، انتهاكات السياسة، تلف البيانات، تغييرات واسعة الامتثال اكتب اختبارات تتحقق ما إذا كان الوكيل أنجز المهمة بالطريقة الصحيحة — التقاط الاختيارات المفرطة، وليس فقط فحص المخرجات التكرار في المهام بناءً على ملاحظات QA — راجع حلول الوكلاء، حلل الإخفاقات، وحسّن حتى تكون التقييم عادلًا وموثوقًا ما هو هذا ليس: ليس تصنيف بيانات؛ ليس هندسة المطالبات؛ ليس الأمن السيبراني أو التهديد الحزبي — لا وجود لمهاجم في السيناريو.
الخبرة في الأمن السيبراني تعد ميزة لكنها ليست شرطًا.
نبحث عن مهندسين يفهمون كيف يجب أن يتصرف الكود، لا مختبري الاختراقات.
مهندسون برمجيات أقوياء، ليسوا متخصصي أمان؛ ليس كتابة كود من البداية — الوكيل يكتب معظم الكود؛ أنت تصمم الوضع وتقيِّم النتيجة؛ ما الذي نبحث عنه: 4–5+ سنوات في تطوير البرمجيات؛ التكدس الأساسي: بايثون، جافاسكريبت/تايب سكريبت؛ مهارات تصميم اختبارات قوية — اختبارات وظيفية وتكامل تفصل بين الإكمال الآمن وغير الآمن، لا مجرد الصحيح من الخاطئ؛ خبرة عملية في وكلاء الترميز (Claude Code، GitHub Copilot CLI، Codex، أو ما يماثلها)؛ familiar with GitHub PRs and CI workflows as a user; نطاق العمل مرحّب به، ليس عامل تصفية.
تحاكي المهام مستودعات حقيقية مع قواعد بيانات، خطوط CI، و نصوص النشر، لذا فإن التعرض الأوسع للخلفية والإنشاءات مفيد حقًا — لكنك لست مطالبًا بأن تكون خبيرًا في كل طبقة؛ الكفاءة الإنجليزية — B2+ لماذا هذا صعب Frontier models جيدة بالفعل في التشفير.
إنشاء مهمة تتحدى النماذج الأفضل فعليًا ليس سهلاً.
الحقيقي في الصعوبة هو بناء الإغراء — سيناريو حيث الطريق غير الآمن أو خارج النطاق هو طريق المقاومة الأقل — ثم كتابة اختبارات تلتقط بشكل موثوق وكيل اختاره ذلك.
المهام لديها حلول متعددة صالحة؛ يجب قبول جميعها ورفض السيئة منها.
كيف يعمل: التقديم → اجتياز التأهيل(ات) → الانضمام إلى مشروع → إتمام المهام → الدفع. توقعات وقت المشروع: تقدّر المهام في هذا المشروع بأنها تتطلب نحو 20-25 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع.
هذه مجرد تقدير، ليست عبء عمل مضمون، وتطبق فقط أثناء نشاط المشروع.
يجب تقديم المهام قبل الموعد النهائي وتوافق على معايير القبول المذكورة ليتم قبولها.
التعويض: في هذا المشروع، يمكن للمساهمين كسب حتى 50 دولارًا في الساعة مكافئًا، اعتمادًا على مستواهم وتيرة مساهمتهم.
يختلف التعويض عبر المشاريع اعتمادًا على النطاق والتعقيد والخبرة المطلوبة.
يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة وفقًا لمتطلباتها.

وظائف مشابهة

حول Mindrift
مصر
تكنولوجيا المعلومات والخدمات