وظائف مطورين بايثون في سلطنة عمان
١٢٨ وظائف شاغرة
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسين كبار ماهرين في جمع البيانات باستخدام بايثون للانضمام إلى مشروع Tendem ودفع سير عمل جمع البيانات المتخصصة ضمن نظامنا الهجين بين الذكاء الاصطناعي والبشر.</p>
<p>في هذه الوظيفة، كملاح AI – هكذا نطلق على هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي والخبرة في المجال والتحكم في الجودة لتقديم نتائج دقيقة وقابلة للت行动.</p>
<p>هذه الفرصة الجزئية عن بُعد مثالية للمحترفين التقنيين ذوي الخبرة العملية في جمع البيانات من الويب، واستخراج البيانات ومعالجتها.</p>
<h4>ما الذي نفعله</h4>
<p>تتصل منصة Mindrift المتخصصين بمشاريع AI من كبار رواد التكنولوجيا. مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذا دور حر لمشروع Tendem. كمهندس كبير لجمع البيانات باستخدام بايثون، ستتعامل مع مهام جمع البيانات التي تتطلب دقة تقنية في الاستخراج والمعالجة عبر الويب، باستخدام أدوات مختلفة مثل Apify وOpenRouter المقدمين بجانب أساليبك الميدانية الخاصة.</p>
<h4>المسؤوليات الأساسية:</h4>
<li>امتلاك سير عمل استخراج البيانات من البداية للنهاية عبر مواقع وب معقدة، لضمان التغطية الكاملة والدقة وتوفير مجموعات بيانات منظمة وموثوقة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) بجانب سير عمل مخصص لتسريع جمع البيانات والتحقق وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، مع تكييف الأساليب حسب الحاجة للتعامل مع المحتوى المعروض جافا سكريبت وسلوك الموقع المتغير.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق، وضبط الاتساق بين المصادر، والالتزام بمواصفات التنسيق، والتحقق النظامي قبل التسليم.</li>
<li>توسعة عمليات الجمع لبيانات كبيرة باستخدام دفعات فعالة أو توازي المعالجات، مراقبة الإخفاقات، والحفاظ على الاستقرار في مواجهة تغييرات طفيفة في بنية الموقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة لا تقل عن 5 سنوات في هندسة البيانات، جمع البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو المجالات التقنية ذات الصلة ميزة إضافية.</li>
<li>يجب أن يكون لدى المرشحين قاعدة تقنية قوية وخبرة عملية في التفاعل الشفري، الأتمتة، وتدفقات العمل المدعومة بالذكاء الاصطناعي. نبحث عن متخصصين يستطيعون حل مشاكل غير بسيطة، العمل بثقة مع نماذج اللغة الكبيرة، وجمع البيانات من مصادر متعددة بشكل منظم وتحققها. نهج منهجي ومفصل والقدرة على العمل بشكل مستقل أساسيان.</li>
<li>خبرة قوية في جمع البيانات من الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثله)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>قدرة مثبتة على استخراج البيانات من هياكل معقدة (التسلسلات، الصفحات المؤرشفة، HTML غير المتسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق من الصحة، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مكافحة الروبوتات وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية سحابية (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من سير العمل الحقيقي.</li>
<li>خبرة ميدانية مع إطارات LLM مثل LangChain، OpenRouter، أو ما شابهها مطبقة في مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والتزام بسلامة البيانات.</li>
<li>أخلاق عمل ذاتية التوجيه مع القدرة على حل المشكلات بشكل مستقل.</li>
<li>وجود رابط لحساب GitHub ميزة إضافية.</li>
<li>إتقان الإنجليزية: مستوى أعلى من المتوسط (B2) أو ما فوقه (مطلوب).</li>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، من المتوقع أن تستغرق المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير، ليس عبء عمل مضمون، ويطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب ما يصل إلى 37 دولارًا في الساعة مكافئًا، اعتمادًا على مستواهم وإيقاع مساهمتهم.</p>
<p>يتفاوت التعويض عبر المشاريع اعتمادًا على النطاق، التعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات ربح مختلفة استنادًا إلى متطلباتها.</p></p><p></p>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>تريد Mindrift مهندسي استخراج بيانات كبيرين في بايثون عاليي المهارة للانضمام إلى مشروع Tendem وتوجيه سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين الذي يجمع بين الذكاء الاصطناعي والبشر.<br> في هذا الدور، كملاح AI – هكذا نُشير إلى هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتعاملون مع المهام التكرارية، بينما تقدم التفكير النقدي، والخبرة الميدانية، وضوابط الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.<br> هذه الفرصة العمل عن بُعد بدوام جزئي مثالية للمتخصصين التقنيين ذوي الخبرة العملية في استخراج البيانات من الويب، واستخراج ومعالجة البيانات.<br> ماذا نفعل؟ تدعم منصة Mindrift المتخصصين في مشاريع الذكاء الاصطناعي من كبار مبتكري التكنولوجيا.<br> مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرة العالم الحقيقي من جميع أنحاء العالم.<br> هذه دور مستقل لمشروع Tendem.<br> كـكبير مهندسي استخراج البيانات باستخدام بايثون، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج البيانات من الويب ومعالجتها، مستخدمًا أدوات متنوعة مثل Apify المفتوحة وروتر المفتوح إلى جانب أساليبك المبتكرة الخاصة.<br> المسؤوليات الأساسية: امتلاك سير عمل استخراج البيانات من البداية إلى النهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.<br> الاستفادة من الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير عمل مخصص لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.<br> ضمان استخراج موثوق من المصادر الديناميكية والتفاعلية، وتعديل الأساليب حسب الحاجة للتعامل مع المحتوى المعروض بجافا سكريبت وسلوك المواقع المتغير.<br> فرض معايير جودة البيانات من خلال فحوص التحقق، وضوابط الاتساق بين المصادر، والالتزام بمواصفات التنسيق، والتحقق النظامي قبل التسليم.<br> توسيع عمليات الاستخراج لبيانات كبيرة باستخدام دفعات فعالة أو توازي، رصد الإخفاقات، والحفاظ على الاستقرار أمام تغييرات طفيفة في بنية المواقع.<br> المتطلبات: خبرة لا تقل عن 5+ سنوات في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).<br> شهادة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو مجالات تقنية ذات صلة تعتبر ميزة إضافية.<br> يجب أن يتمتع المرشحون بقاعدة تقنية قوية وخبرة عملية في التهيئة النصية، الأتمتة، وسير العمل بمساعدة الذكاء الاصطناعي.<br> نحن نبحث عن متخصصين يمكنهم حل مشكلات غير تافهة، والعمل بثقة مع نماذج اللغة الكبيرة، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بشكل منهجي.<br> نهج منهجي، دقيق في التفاصيل، والقدرة على العمل بشكل مستقل أمران أساسيان.<br> خبرة قوية في استخراج البيانات عبر بايثون (BeautifulSoup، Selenium أو ما يشابهها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات، وإثبات القدرة على استخراج البيانات من هياكل معقدة (التدرجات، الصفحات المؤرشفة، HTML غير المتسق). خلفية قوية في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets) وإثبات التعامل مع آليات مكافحة الروبوتات وهياكل المواقع الديناميكية على نطاق واسع، وخبرة مع بنية سحابية (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من سير العمل الحقيقي، وخبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يشابهها) المطبقة على مهام الأتمتة، واهتمام عالي بالتفاصيل والتزام بدقة البيانات، وأخلاقيات العمل ذاتية التوجيه مع القدرة على استكشاف المشكلات بشكل مستقل. وجود رابط GitHub ميزة إضافية. الكفاءة في الإنجليزية: مستوى أعلى من المتوسط (B2) أو أعلى (مطلوب). توقعات الوقت للمشروع: بالنسبة لهذا المشروع، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة في الأسبوع أثناء فترات النشاط، بناءً على متطلبات المشروع.<br> هذه تقديرات وليست عبء عمل مضمون، وتطبق فقط أثناء تفعيل المشروع.<br> التعويض: يمكن للمساهمين في هذا المشروع أن يكسبوا حتى 37 دولارًا في الساعة كحد أقصى، اعتمادًا على مستوى مساهمتهم وسرعتهم في العمل.<br> يتفاوت التعويض عبر المشاريع اعتمادًا على النطاق والتعقيد والخبرة المطلوبة.<br> يرجي ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.<br></span> </div>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسي سكرابنج بيانات بايثون من المستوى العالي للانضمام إلى مشروع Tendem وقيادة تدفقات سكرابنج البيانات المتخصصة ضمن نظامنا الهجين الذي يجمع بين الذكاء الاصطناعي والبشر.</p>
<p>في هذا الدور، كقائد AI – هكذا نطلق على هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي وخبرة المجال وجودة العمل لتقديم نتائج دقيقة وقابلة للإجراء.</p>
<p>هذه الفرصة الجزئية عن بُعد مثالية للمهنيين التقنيين ذوي الخبرة العملية في سكرابنج الويب واستخراج البيانات ومعالجتها.</p>
<h4>ماذا نفعل</h4>
<p>تربط منصة Mindrift المتخصصين بمشروعات الذكاء الاصطناعي من رواد التكنولوجيا الكبار. هدفنا هو فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذه وظيفة عمل حر لمشروع Tendem. كمهندس سكرابنج بيانات بايثون كبير، ستتعامل مع مهام سكرابنج البيانات التي تتطلب دقة تقنية في الاستخراج والمعالجة من الويب، باستخدام أدوات مختلفة مثل Apify وOpenRouter المقدمة إلى جانب أساليبك الإبداعية الخاصة.</p>
<h4>المسؤوليات الرئيسية:</h4>
<li>تملك تدفقات استخراج البيانات من البداية للنهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) بجانب تدفقات عمل مخصصة لتسريع جمع البيانات، والتحقق والتuneka من تنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، وتكييف الأساليب عند الحاجة لمعالجة المحتوى المولَّد جافا سكريبت وتغير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق، ضوابط الاتساق عبر المصادر، الالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>تكبير عمليات السكرابنج لمجموعات بيانات كبيرة باستخدام حِزم فعالة أو تشارك متوازي، رصد الإخفاقات، والحفاظ على الاستقرار مقابل تغييرات طفيفة في هيكل المواقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة لا تقل عن 5+ سنوات في هندسة البيانات أو سكرابنج الويب أو الأتمتة أو تطوير البرمجيات (مطالب بها).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة أو الرياضيات التطبيقية أو علوم الحاسوب أو مجالات تقنية ذات صلة تعتبر ميزة.</li>
<li>ينبغي أن يمتلك المرشحون أساساً تقنياً قوياً وخبرة عملية في البرمجة والأتمتة وتدفقات العمل المدعومة بالذكاء الاصطناعي. نبحث عن متخصصين يمكنهم حل مشكلات غير بسيطة، والعمل بثقة مع LLMs، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بشكل منهجي. نهج منهجي وتفصيلي والقدرة على العمل المستقل ضرورية.</li>
<li>خبرة قوية في سكرابنج الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثلها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>قدرة مثبتة على استخراج البيانات من هياكل معقدة (هرميات، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات البيانات المنظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مضاد الروبوت وبُنى المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية السحابة (AWS أو ما يعادلها) والتعبئة بالحاويات (Docker) كجزء من سير العمل الحقيقي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) مطبقة في مهام الأتمتة.</li>
<li>انتباه قوي للتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاقيات عمل ذاتية وتوجيه ذاتي مع القدرة على استكشاف المشكلات بشكل مستقل.</li>
<li>رابط GitHub ميزة إضافية.</li>
<li>إتقان اللغة الإنجليزية: مستوى عالي (B2) أو أعلى (مطلوب).</li>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، يُقدَّر أن تتطلب المهام نحو 10–20 ساعة أسبوعياً خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير، وليس عبئ عمل مضمون، ويُطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب ما يصل إلى 37 دولارًا في الساعة كمعادل، حسب مستواهم وسرعتهم في الإسهام.</p>
<p>يتفاوت التعويض عبر المشاريع اعتماداً على النطاق والتعقيد والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة وفقاً لمتطلباتها.</p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسي استخراج بيانات باستخدام بايثون من المستوى الكبير للانضمام إلى مشروع Tendem وتطوير سير عمل مخصص لاستخراج البيانات ضمن نظامنا الهجين بين الذكاء الاصطناعي والبشر.</p>
<p>في هذا الدور، كـ"طيار ذكاء اصطناعي" — هكذا نُشير إلى هذا المنصب في Mindrift — ستتعاون مع عوامل Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي، وخبرة المجال، ومراقبة الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة العمل عن بُعد بدوام جزئي مناسبة للمهنيين التقنيين ذوي الخبرة العملية في سحب البيانات من الويب واستخراجها ومعالجتها.</p>
<h4>ما نفعله</h4>
<p>منصة Mindrift تربط المتخصصين بمشروعات الذكاء الاصطناعي من روّاد التقنية الكبار. مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذه وظيفة حرة لمشروع Tendem. كمهندس استخراج بيانات بايثون كبير، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج ومعالجة الويب، باستخدام أدوات مثل Apify وOpenRouter المقدمة إلى جانب أساليبك الإبداعية.</p>
<h4>المسؤوليات الأساسية:</h4>
<li>امتلاك سير عمل استخراج بيانات من البداية حتى النهاية عبر مواقع معقدة، مع التأكد من التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.</li>
<li>الاستفادة من الأدوات الداخلية (Apify، OpenRouter) بجانب سير عمل مخصص لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع مراعاة المتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، مع تكييف الأساليب حسب الحاجة للتعامل مع محتوى يتم عرضه بواسطة JavaScript وتغير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوص التحقق، وضوابط الاتساق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق النظامي قبل التسليم.</li>
<li>توسيع عمليات السحب لبيانات كبيرة باستخدام دفعات فعالة أو توازي، ومراقبة الإخفاقات، والحفاظ على الاستقرار ضد تغييرات بسيطة في بنية الموقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة ذات صلة لا تقل عن 5+ سنوات في هندسة البيانات، سحب البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو مجالات تقنية ذات صلة تعتبر ميزة.</li>
<li>يجب أن يمتلك المرشحون أساساً تقنياً قوياً وخبرة عملية في البرمجة النصية، الأتمتة، وتدفقات العمل المعتمدة على الذكاء الاصطناعي. نبحث عن متخصصين يستطيعون حل مشاكل غير تافهة، العمل بثقة مع LLMs، وجمع وهيكلة والتحقق من البيانات من مصادر متنوعة بشكل منهجي. نهج منهجي ومفصلية في العمل والقدرة على العمل بشكل مستقل أساسية.</li>
<li>خبرة قوية في سحب البيانات من الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثله)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر وكلاء.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (الأسياء الهرمية، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق من صحة البيانات، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مُثبتة في التعامل مع آليات مضاد الروبوت وبُنى المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية السحابة (AWS أو ما يعادلها) والتعبئة بالحاويات (Docker) كجزء من سير عمل حقيقي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو مشابهة) مطبقة على مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والالتزام برقابة جودة البيانات.</li>
<li>أخلاقيات عمل مستقلة مع القدرة على حل المشكلات بشكل مستقل.</li>
<li>رابط إلى GitHub يعتبر ميزة.</li>
<li>إتقان الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب).</li>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة أسبوعياً خلال فترات النشاط، وفقاً لمتطلبات المشروع. هذا تقدير وليس عبء عمل مضمون، ويسري فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين أن يربحوا حتى ما يعادل 37 دولاراً في الساعة، اعتماداً على مستواهم وسرعتهم في المساهمة.</p>
<p>يتفاوت التعويض عبر المشاريع حسب النطاق والتعقيد والخبرة المطلوبة. ويرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات ربح مختلفة وفقاً لمتطلباتها.</p></p><p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسي استخراج بيانات بايثون متمرسين من المستوى العالي للانضمام إلى مشروع Tendem وقيادة سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين بين AI والبشر.</p>
<p>في هذه الوظيفة، بكونك طيار AI – هكذا نطلق على هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي، والخبرة المجال، ومراقبة الجودة لتقديم نتائج دقيقة وفعالة.</p>
<p>هذه الفرصة عن بُعد بدوام جزئي مثالية للمهنيين التقنيين ذوي الخبرة العملية في استخراج البيانات من الويب، واستخراجها، ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>تربط منصة Mindrift الخبراء بمشروعات AI من رواد التكنولوجيا الكبار. مهمتنا هي فتح潜力 AI التوليدي من خلال الاستفادة من الخبرة العملية من جميع أنحاء العالم.</p>
<p>هذا دور مستقل لمشروع Tendem. بصفتي مهندس استخراج بيانات بايثون كبير، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية في الاستخراج والمعالجة عبر الويب، باستخدام أدوات متعددة مثل Apify وOpenRouter التي نوفرها بالإضافة إلى نهجك الحصيف الخاص.</p>
<h4>المسؤوليات الرئيسية:</h4>
<ul>
<li>امتلاك تدفقات استخراج البيانات من البداية إلى النهاية عبر مواقع ويب معقدة، لضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير عمل مخصص لتسريع جمع البيانات والتحقق وتنفيذ المهام مع الالتزام بالمتطلبات المعرفة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، مع تعديل الأساليب حسب الحاجة للتعامل مع المحتوى المعروض بجافا سكريبت وسلوك الموقع المتغير.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق، وضوابط الاتساق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات التنقيب للبيانات لمجموعات كبيرة باستخدام تجميع فعال أو توازي، رصد الفشل، والحفاظ على الاستقرار أمام تغييرات بسيطة في هيكل الموقع.</li>
</ul>
<h4>المتطلبات:</h4>
<ul>
<li>خبرة لا تقل عن 5+ سنوات ذات صلة في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>شهادة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو المجالات التقنية ذات الصلة تعتبر ميزة.</li>
<li>ينبغي أن يمتلك المرشحون قاعدة تقنية قوية وخبرة عملية في التهيئة النصية، الأتمتة، وتدفقات العمل المعتمدة على AI. نحن نبحث عن متخصصين يستطيعون حل مشاكل غير تافهة، والعمل بثقة مع LLMs، وجمع البيانات من مصادر متعددة وهيكلتها والتحقق منها بشكل منهجي. نهج منهجي وتفصيلي وقدرة على العمل بشكل مستقل ضروريان.</li>
<li>خبرة قوية في استخراج البيانات باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثله)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (التسلسلات، الصفحات المؤرشفة، HTML غير المتسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>إثبات خبرة في مواجهة آليات مضاد الروبوتات وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية سحابية (AWS أو ما يعادلها) وتحديد الحاويات (Docker) كجزء من تدفقات العمل الحقيقية.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) مطبقة على مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاقيات عمل ذاتية التوجيه مع القدرة على استكشاف المشاكل بشكل مستقل.</li>
<li>رابط إلى GitHub ميزة.</li>
<li>إتقان اللغة الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب).</li>
</ul>
<h4>توقعات زمن المشروع</h4>
<p>بالنسبة لهذا المشروع، من المقدر أن تتطلب المهام حوالي 10–20 ساعة أسبوعياً خلال المراحل النشطة، بناءً على متطلبات المشروع. هذه تقدير، ليس حتمياً، وهو صالح فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب ما يصل إلى ما يعادل 37 دولاراً في الساعة، وذلك حسب مستوى الفرد وتيرة مساهمته.</p>
<p>يتفاوت التعويض عبر المشاريع حسب النطاق، التعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة وفقاً لمتطلباتها.</p></p><p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسين رائدين في كاشف البيانات بايثون ذو خبرة عالية للانضمام إلى مشروع Tendem ودفع سير عمل كاشف البيانات المتخصص ضمن نظامنا الهجين للذكاء الاصطناعي والبشر.</p>
<p>في هذا الدور، كطيار ذكاء اصطناعي – هكذا نُشير إلى هذا الدور في Mindrift – ستت collaboration مع وكلاء Tendem الذين يتعاملون مع مهام متكررة، في حين تقدم التفكير النقدي، والخبرة الميدانية، وضمان الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة الدولية الجزئية عن بعد مثالية للمهنيين التقنيين ذوي الخبرة العملية في جلب البيانات عبر الإنترنت، واستخراجها ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>منصة Mindrift توصل المتخصصين بمشروعات الذكاء الاصطناعي من كبار مبتكري التقنية. هدفنا هو فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذه وظيفة عمل حر لمشروع Tendem. كمهندس كاشف بيانات بايثون رائد، ستتعامل مع مهام كاشف البيانات التي تتطلب دقة تقنية في الاستخراج والمعالجة عبر الويب، باستخدام أدوات مختلفة مثل Apify وOpenRouter المقدمين إلى جانب أساليبك العملية.</p>
<h4>المسؤوليات الرئيسية:</h4>
<li>امتلاك سلاسل استخراج البيانات من النهاية إلى النهاية عبر مواقع ويب معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات بيانات منظمة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير عمل مخصص لتسريع جمع البيانات والتحقق وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان الاستخراج الموثوق من مصادر ويب ديناميكية وتفاعلية، مع تكييف الأساليب حسب الحاجة للتعامل مع المحتوى المولّد بجافا سكريبت وتغير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال عمليات تحقق والتحقق من التناسق بين المصادر والالتزام بمواصفات التنسيق والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات الكشط لبيانات كبيرة باستخدام دفعات فعالة أو التوازي، مراقبة الفشل، والحفاظ على الاستقرار أمام تغييرات بسيطة في بنية المواقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة لا تقل عن 5+ سنوات في هندسة البيانات، كَتشّاف الويب، التشغيل الآلي، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو مجالات تقنية ذات صلة تعتبر ميزة.</li>
<li>ينبغي أن يكون لدى المرشحين أساس تقني قوي وخبرة عملية في التهيئة البرمجية، التشغيل الآلي، وتدفقات عمل بمساعدة الذكاء الاصطناعي. نبحث عن متخصصين يمكنهم حل مشكلات غير تافهة، العمل بثقة مع نماذات اللغة الكبيرة، وجمع وتنظيم والتحقق من البيانات من مصادر متنوعة بشكل منهجي. نهج منهجي دقيق والقدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في استخراج البيانات عبر بايثون (BeautifulSoup، Selenium أو ما يماثلها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>قدرة مثبتة على استخراج البيانات من هياكل معقدة (هرميات، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق، تقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مضادات الروبوت وبنيات المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية السحابة (AWS أو ما يعادلها) والحاويات (Docker) كجزء من سير عمل حقيقي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) مطبقة في مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاقيات عمل موجهة ذاتياً مع القدرة على استكشاف الأخطاء بشكل مستقل.</li>
<li>رابط إلى GitHub ميزة إضافية.</li>
<li>إتقان اللغة الإنجليزية: مستوى أعلى من المتوسط (B2) أو أعلى (مطلوب).</li>
<h4>توقعات زمن المشروع</h4>
<p>لهذا المشروع، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة أسبوعيًا خلال المراحل النشطة، اعتمادًا على متطلبات المشروع. هذا تقدير، وليس عبء عمل مضمون، وهو ينطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين أن يكسبوا حتى ما يعادل 37 دولارًا في الساعة، وفقًا لمستوى مشاركتهم وسرعتهم في الإسهام.</p>
<p>يختلف التعويض عبر المشاريع حسب النطاق والتعقيد والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.</p></p><p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسي استخراج بيانات بايثون رفيعي المستوى للانضمام إلى مشروع Tendem وتحريك سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين AI + البشري.</p>
<p>في هذه الدور، بكمثال طيار AI – هذا هو المصطلح الذي نستخدمه لهذه الوظيفة في Mindrift – ستتعاون مع وكلاء Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي، وخبرة المجال، ومراقبة الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة عن بُعد بدوام جزئي مثالية للمهنيين التقنيين ذوي الخبرة العملية في استخراج الويب، واستخراج البيانات، ومعالجتها.</p>
<h4>ما الذي نفعله</h4>
<p>منصة Mindrift تربط المتخصصين بمشاريع AI من روّاد التقنية الكبار. مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذه وظيفة حُرّة لمشروع Tendem. كمهندس استخراج بيانات بايثون كبير، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج ومعالجة الويب، باستخدام أدوات متنوعة مثل Apify وOpenRouter التي نوفرها إلى جانب طرقك الخاصة المعتمدة على الموارد.</p>
<h4>المسؤوليات الأساسية:</h4>
<ul>
<li>امتلاك سير عمل استخراج البيانات من البداية إلى النهاية عبر مواقع ويب معقدة، لضمان التغطية الكاملة، والدقة، وتوصيل مجموعات البيانات المنظمة بشكل موثوق.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير العمل المخصص لتسريع جمع البيانات والتحقق والقيام بالمهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان الاستخراج الموثوق من المصادر الديناميكية والتفاعلية للويب، مع تكييف الأساليب حسب الحاجة لمعالجة المحتوى المعروض بجافا سكريبت وتغير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق، وضوابط التوافق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات الاستخراج لبيانات كبيرة باستخدام دفعات فعالة أو توازي، ومراقبة الفشل، والحفاظ على الاستقرار أمام تغييرات طفيفة في بنية الموقع.</li>
</ul>
<h4>المتطلبات:</h4>
<ul>
<li>خبرة لا تقل عن 5+ سنوات ذات صلة في هندسة البيانات، استخراج الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو مجالات تقنية ذات صلة تعتبر ميزة.</li>
<li>يجب أن يمتلك المتقدمون قاعدة تقنية قوية وخبرة عملية في البرمجة النصية، الأتمتة، وسير العمل بمساعدة AI. نبحث عن متخصصين يستطيعون حل مشاكل غير تافهة، العمل بثقة مع LLMs، وجمع البيانات من مصادر متعددة وتنظيمها والتحقق منها بشكل منهجي. نهج منظّمي، دقيق، والقدرة على العمل بشكل مستقل أساسية.</li>
<li>خبرة قوية في استخراج البيانات باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثله)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>قدرة مثبتة على استخراج البيانات من هياكل معقدة (هرم، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مضاد الروبوت وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية السحابة (AWS أو ما يعادلها) والحاويات (Docker) كجزء من سير العمل الواقعي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يشابهها) مطبقة على مهام الأتمتة.</li>
<li>اهتمام عالي بالتفاصيل والالتزام بدقة البيانات.</li>
<li>أخلاقيات عمل ذاتي التوجيه مع القدرة على استكشاف المشكلات بشكل مستقل.</li>
<li>رابط إلى GitHub ميزة إضافية.</li>
<li>إتقان اللغة الإنجليزية: المستوى المتوسط العالي (B2) أو أعلى (مطلوب).</li>
</ul>
<h4>توقعات زمن المشروع</h4>
<p>لهذا المشروع، من المقدر أن تستغرق المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذه تقديرات وليست عبء عمل مضمون، وتطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب حتى 37 دولارًا في الساعة كمعادل، بحسب مستواهم وتكريسهم للإسهام.</p>
<p>يتفاوت التعويض عبر المشاريع حسب النطاق، التعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.</p></p><p></p>
<p><h4>تبحث Mindrift عن مهندسي استخراج بيانات بايثون ذوي مهارات عالية للانضمام إلى مشروع Tendem وقيادة تدفقات عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين AI + الإنسان.</h4>
<p>في هذا الدور، كملاح AI – هكذا نطلق على هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتعاملون مع المهام المتكررة، بينما توفر التفكير النقدي، وخبرة المجال، وضمان الجودة لتقديم نتائج دقيقة وقابلة للاستخدام.</p>
<p>هذه الفرصة العمل عن بُعد بدوام جزئي مناسبة للمهنيين الفنيين ذوي الخبرة العملية في استخراج البيانات من الويب، واستخراجها، ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>تربط منصة Mindrift المتخصصين بمشاريع AI من أبرز مبتكري التكنولوجيا. مهمتنا هي إطلاق إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرة العالم الحقيقي من جميع أنحاء العالم.</p>
<p>هذا دور مستقل لمشروع Tendem. كمهندس بايثون كبير في استخراج البيانات، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية للاستخراج والمعالجة عبر الويب، باستخدام أدوات مختلفة مثل Apify وOpenRouter التي نوفرها جنبًا إلى جنب مع أساليبك المواردية.</p>
<h4>المسؤوليات الأساسية:</h4>
<ul>
<li>امتلاك تدفقات استخراج البيانات من البداية إلى النهاية عبر مواقع معقدة، لضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) إلى جانب تدفقات عمل مخصصة لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان الاستخراج الموثوق من مصادر الويب الديناميكية والتفاعلية، وتكييف الأساليب حسب الحاجة للتعامل مع المحتوى المعروض بواسطة JavaScript وتغير سلوك الموقع.</li>
<li>فرض معايير جودة البيانات من خلال فحص التحقق، والتحكم في الاتساق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنتظم قبل التسليم.</li>
<li>تكبير عمليات الخدش للبيانات لمجموعات بيانات كبيرة باستخدام دفعات فعالة أو توازي، ورصد الإخفاقات، والحفاظ على الاستقرار مقابل تغييرات بسيطة في بنية الموقع.</li>
</ul>
<h4>المتطلبات:</h4>
<ul>
<li>خبرة 5+ سنوات على الأقل ذات صلة في هندسة البيانات، أو استخراج البيانات من الويب، أو التشغيل الآلي، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو مجالات تقنية ذات صلة تعتبر ميزة.</li>
<li>ينبغي أن يمتلك المرشحون أساسًا تقنيًا قويًا وخبرة عملية في البرمجة النصية، والتشغيل الآلي، وتدفقات العمل المدعومة بالذكاء الاصطناعي. نحن نبحث عن متخصصين يمكنهم حل مشكلات غير بسيطة، والعمل بثقة مع نماذات اللغة الكبيرة، وجمع البيانات وتنظيمها والتحقق منها من مصادر متنوعة بشكل منهجي. نهج منهجي ومهتم بالتفاصيل والقدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في استخراج البيانات من الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يشابه)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير غير المحدود) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>القدرة المثبتة على استخراج البيانات من هياكل معقدة (هرميات، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مضادات BOT وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية سحابية (AWS أو ما يعادلها) وتعبئة حاويات (Docker) كجزء من تدفقات العمل الحقيقية.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يشابه) aplicada للمهام التشغيلية.</li>
<li>اهتمام قوي بالتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاقيات عمل ذاتية التوجيه مع القدرة على استكشاف المشكلات بشكل مستقل.</li>
<li>إتقان الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب).</li>
</ul>
<p>رابط إلى GitHub ميزة إضافية.</p>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، وفقًا لمتطلبات المشروع. هذا تقدير، وليس عبء عمل مضمون، ويسري فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين أن يكسبوا حتى 37 دولارًا في الساعة مكافئ، اعتمادًا على مستواهم وإيقاع مساهمتهم.</p>
<p>يتفاوت التعويض عبر المشاريع تبعًا للنطاق، والتعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة اعتمادًا على متطلباتها.</p></p><p></p>
<p><h4>تبحث Mindrift عن مهندسين متمرسين في استخراج البيانات من الويب بلغة بايثون للانضمام إلى مشروع Tendem وتوجيه سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين AI + الإنسان.</h4>
<p>في هذا الدور، كطيار ذكاء اصطناعي – بهذا الوصف نُطلق على هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي والخبرة في المجال وضوابط الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة عن بُعد بدوام جزئي مثالية للمحترفين التقنيين الذين يمتلكون خبرة عملية في استخراج البيانات من الويب، واستخراج البيانات ومعالجتها.</p>
<h4>ما نفعله</h4>
<p>منصة Mindrift تربط المتخصصين بمشروعات AI من مبتكري التكنولوجيا الكبار. مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرة العالم الواقعي من جميع أنحاء العالم.</p>
<p>هذا دور مستقل لمشروع Tendem. كمهندس استخراج بيانات بايثون أول ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية في الاستخراج والمعالجة من الويب، باستخدام أدوات متنوعة مثل Apify وOpenRouter المقدمة بجانب منهجياتك المبدعة.</p>
<h4>المسؤوليات الأساسية:</h4>
<ul>
<li>امتلاك تدفقات عمل استخراج البيانات من البداية للنهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة وتوصيل مجموعات بيانات منظمة بشكل موثوق.</li>
<li>استخدام الأدوات الداخلية (Apify، OpenRouter) إلى جانب مسارات عمل مخصصة لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المعرفة.</li>
<li>ضمان استخراج موثوق من مصادر الويب الديناميكية والتفاعلية، وتكييف الأساليب حسب الحاجة للتعامل مع محتوى يعمل بجافاسكريبت وسلوك الموقع المتغير.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق والتحكم في الاتساق عبر المصادر والالتزام بمواصفات التنسيق والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات السحب لبيانات كبيرة باستخدام دفعات فعالة أو توازي، رصد الإخفاقات والحفاظ على الاستقرار أمام تغييرات بسيطة في بنية الموقع.</li>
</ul>
<h4>المتطلبات:</h4>
<ul>
<li>خبرة لا تقل عن 5+ سنوات في هندسة البيانات، وتصفح الويب، والأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>شهادة بكالوريوس أو ماجستير في الهندسة أو الرياضيات التطبيقية أو علوم الحاسوب أو مجالات تقنية ذات صلة ميزة إضافية.</li>
<li>ينبغي أن يمتلك المرشحون أساساً تقنياً قوياً وخبرة عملية في التجميل، والأتمتة، وتدفقات العمل المعتمدة على الذكاء الاصطناعي. نبحث عن متخصصين يمكنهم حل مشكلات غير تافهة، والعمل بثقة مع LLMs، وجمع وتنظيم والتحقق من البيانات من مصادر متنوعة بطريقة منهجية. نهج منهجي وتفاصيلية والقدرة على العمل بشكل مستقل أمور أساسية.</li>
<li>خبرة قوية في استخراج البيانات باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثلها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (هرمات، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية صلبة في تنظيف البيانات وتطبيعها والتحقق منها، وتقديم بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مكافحة الروبوتات وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية سحابية (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من تدفقات العمل الحقيقية.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يماثلها) مطبقة على مهام الأتمتة.</li>
<li>انتباه عالي للتفاصيل والالتزام بدقة البيانات.</li>
<li>أخلاق عمل ذاتي التوجيه مع القدرة على استكشاف الأخطاء بشكل مستقل.</li>
<li>إجادة الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب).</li>
</ul>
<p>رابط GitHub ميزة إضافية.</p>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، من المتوقع أن تتطلب المهام نحو 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير وليس عبئ عمل مضمون، ويطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب حتى 37 دولارًا في الساعة مكافئ، اعتماداً على مستوى مشاركتهم وتقدمهم.</p>
<p>يتفاوت التعويض بين المشاريع حسب النطاق والتعقيد والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها.</p></p><p></p>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>تبحث Mindrift عن مهندسين سينيور مختصين في استخراج البيانات بالبايثون للانضمام إلى مشروع Tendem ودفع دوائر عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين بين الذكاء الاصطناعي والبشر.<br> في هذا الدور، كـ AI Pilot – هذا هو المصطلح المستخدم لهذا الدور في Mindrift – ستتعاون مع عملاء Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي والخبرة الميدانية وسيطرة الجودة لتسليم نتائج دقيقة وقابلة للتنفيذ.<br> هذه الفرصة العمل عن بُعد بدوام جزئي مثالية للمتخصصين التقنيين ذوي الخبرة العملية في استخراج البيانات من الويب، واستخراج البيانات ومعالجتها.<br> ماذا نفعل؟ تربط منصة Mindrift بين المتخصصين ومشاريع الذكاء الاصطناعي من روّاد التقنية العالميين.<br> مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال استقطاب الخبرة الواقعية من جميع أنحاء العالم.<br> هذا دور مستقل لمشروع Tendem.<br> كمهندس بيانات سينيور في استخراج البيانات باستخدام بايثون، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لاستخراج البيانات من الويب ومعالجتها، باستخدام أدوات متعددة مثل Apify وOpenRouter المقدمة إلى جانب أساليبك الإبداعية الخاصة.<br> المسؤوليات الرئيسية: امتلاك سير عمل استخراج البيانات من البداية حتى النهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المنظمة.<br> استغلال الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير عمل مخصص لتسريع جمع البيانات والتحقق منها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.<br> ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، مع تعديل النهج حسب الحاجة للتعامل مع محتوى جافا سكريبت والسلوك المتغير للمواقع.<br> فرض معايير جودة البيانات من خلال فحوصات التحقق، وضوابط الاتساق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق النظامي قبل التسليم.<br> توسيع عمليات الاستخراج لبيانات كبيرة باستخدام دفعات فعالة أو ازدواجية المعالجة، ورصد الإخفاقات، والحفاظ على الاستقرار أمام تغييرات بسيطة في بنية المواقع.<br> المتطلبات: خبرة لا تقل عن 5+ سنوات في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).<br> شهادة بكالوريوس أو ماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو المجالات التقنية ذات الصلة إضافة ممتازة.<br> يجب أن يمتلك المتقدمون أساساً تقنياً قوياً وخبرة عملية في البرمجة النصية، الأتمتة، وسير عمل مدعوم بالذكاء الاصطناعي.<br> نبحث عن متخصصين يمكنهم حل مشاكل غير تافهة، والعمل بثقة مع LLMs، وجمع البيانات من مصادر متنوعة وتنظيمها والتحقق منها بشكل منهجي.<br> نهج منهجي وتفصيلي والقدرة على العمل بشكل مستقل أمور أساسية.<br> خبرة قوية في استخراج البيانات من الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثلها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات، قدرة مثبتة على استخراج البيانات من هياكل معقدة (التسلسلات، الصفحات المؤرشفة، HTML غير متناسق) خلفية قوية في تنظيف البيانات وتطبيعها والتحقق منها، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets) خبرة مطلوبة في التعامل مع آليات مضادة للروبوت وهياكل مواقع ديناميكية على نطاق واسع خبرة مع بنية سحابية (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من سير عمل حقيقي خبرة عملية مع أطر LLMs (LangChain، OpenRouter، أو ما يماثلها) عند تطبيقها على مهام الأتمتة اهتمام قوي بالتفاصيل والتزام بدقة البيانات عمل ذاتي في العمل مع القدرة على حل المشكلات بشكل مستقل إضافة إلى خبرة عملية مع أطر LangChain، OpenRouter أو ما يماثلها عند تطبيقها على الأتمتة اهتمام قوي بالتفاصيل والالتزام بدقة البياناتKKK</span> </div>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسين خبراء في حصد البيانات باستخدام بايثون للانضمام إلى مشروع Tendem ودفع تدفقات عمل حصد بيانات متخصصة ضمن نظامنا الهجين AI + البشر.</p>
<p>في هذا الدور، كطيار ذكاء اصطناعي – هكذا نطلق عليه هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي، والخبرة في المجال، وضمان الجودة لتوفير نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة بدوام جزئي عن بُعد مناسبة للمهنيين التقنيين ذوي الخبرة العملية في حصد الويب، واستخراج البيانات ومعالجتها.</p>
<h4>ما نفعله</h4>
<p>منصة Mindrift تربط المتخصصين بمشاريع الذكاء الاصطناعي من رواد التكنولوجيا الكبار. هدفنا هو فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذا دور مستقل لمشروع Tendem. بصفك مهندس حصد بيانات بايثون كبير، ستتعامل مع مهام حصد البيانات التي تتطلب دقة تقنية لاستخراج البيانات من الويب ومعالجتها، مستخدما أدوات متعددة مثل Apify وOpenRouter التي نوفرها جنبًا إلى جنب مع أساليبك المواردية الخاصة.</p>
<h4>المسؤوليات الرئيسية:</h4>
<li>امتلاك تدفقات استخراج البيانات من النهاية إلى النهاية عبر مواقع معقدة، لضمان التغطية الكاملة والدقة والتسليم الموثوق ببيانات منظمة.</li>
<li>استخدام أدوات داخلية (Apify، OpenRouter) بجانب تدفقات عمل مخصصة لتسريع جمع البيانات، التحقق منها، وتنفيذ المهام مع الوفاء بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، وتكييف الأساليب حسب الحاجة لمعالجة المحتوى المعروض جافاسكريبت وسلوك الموقع المتغير.</li>
<li>فرض معايير جودة البيانات من خلال فحوصات التحقق، وضوابط الاتساق بين المصادر، والالتزام بتنسيقات البيانات، والتحقق المنهجي قبل التسليم.</li>
<li>تواؤم عمليات الحصد مع مجموعات بيانات كبيرة باستخدام دفعات فعالة أو توازي، رصد الفشلات، والحفاظ على الاستقرار أمام تغييرات بسيطة في بنية المواقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة لا تقل عن 5+ سنوات ذات صلة في هندسة البيانات، حصد الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو المجالات التقنية ذات الصلة ميزة إضافية.</li>
<li>يجب أن يمتلك المرشحون أساسًا تقنيًا قويًا وتجربة عملية في البرمجة النصية، الأتمتة، وتدفقات العمل المدعومة بالذكاء الاصطناعي. نحن نبحث عن متخصصين يمكنهم حل مشكلات غير تافهة، والعمل بثقة مع نماذج اللغة الكبيرة، وجمع البيانات وتنظيمها والتحقق منها من مصادر متعددة بشكل منهجي. نهج منهجي ودقيق مع القدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في حصد الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثله)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>قدرة مثبتة على استخراج البيانات من هياكل معقدة (الهرميات، الصفحات المؤرشفة، HTML غير المتسق).</li>
<li>خلفية راسخة في تنظيف البيانات وتطبيعها والتحقق منها، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مكافحة الروبوتات وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع بنية سحابية (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من سير العمل الحقيقي.</li>
<li>خبرة عملية مع أطر العمل LLM (LangChain، OpenRouter، أو ما شابه) مطبقة في مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاق عمل ذاتي وتوجيه ذاتي مع ability على استكشاف المشاكل بشكل مستقل.</li>
<li>رابط إلى GitHub ميزة إضافية.</li>
<li>إتقان اللغة الإنجليزية: مستوى أعلى من المتوسط (B2) أو أعلى (مطلوب).</li>
<h4>توقعات زمن المشروع</h4>
<p>للمشروع هذا، من المتوقع أن تتطلب المهام نحو 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير، ليس عبئ عمل مضمون، ويطبق فقط طوال فترة نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين أن يكسبوا حتى ما يعادل 37 دولاراً في الساعة، اعتمادًا على مستوى المساهمة وسرعتها.</p>
<p>يتفاوت التعويض عبر المشاريع اعتماداً على النطاق والتعقيد والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة وفقًا لمتطلباتها.</p></p><p></p>
<h2 class="h5">وصف العمل</h2>
<div class="t-break" data-jb-field="description">
<span>تبحث Mindrift عن مهندسين كبار في استخراج البيانات باستخدام بايثون مع خبرة عالية للانضمام إلى مشروع Tendem وقيادة سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين الذي يجمع بين الذكاء الاصطناعي والبشري.<br> في هذه الدور، كملاح AI – هذا هو المصطلح الذي نستخدمه لهذا الدور في Mindrift – ستت collaboration مع عملاء Tendem الذين يتولون المهام المتكررة، بينما توفر التفكير التحليلي والخبرة الميدانية ورقابة الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.<br> هذه الفرصة بدوام جزئي عن بُعد مثالية للمهنيين الفنيين ذوي الخبرة العملية في تقنيات استخراج الويب، واستخراج البيانات ومعالجتها.<br> ما نفعله منصة Mindrift تربط المتخصصين بمشاريع الذكاء الاصطناعي من كبار مبتكري التكنولوجيا.<br> مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرات العالم الواقعي من مختلف أنحاء العالم.<br> هذا دور مستقل لمشروع Tendem.<br> كـمطور بيانات بايثون كبير لاستخراج البيانات، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة فنية في استخراج البيانات من الويب ومعالجتها، باستخدام أدوات متنوعة مثل Apify وOpenRouter المقدمة بجانب أساليبك الموثوقة الخاصة.<br> المسؤوليات الرئيسية: امتلاك سير عمل استخراج البيانات من البداية إلى النهاية عبر مواقع ويب معقدة، لضمان التغطية الكاملة والدقة وتسليم مجموعات بيانات مُهيكلة تشغيلياً وموثوقة.<br> الاستفادة من الأدوات الداخلية (Apify, OpenRouter) بجانب سير عمل مخصص لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.<br> ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، وتكييف الأساليب وفق الحاجة للتعامل مع المحتوى المعروض بجافا سكريبت وسلوك الموقع المتغير.<br> فرض معايير جودة البيانات من خلال فحوصات التحقق والضوابط التوافقية عبر المصادر المختلفة والالتزام بمواصفات التنسيق والتحقق المنهجي قبل التسليم.<br> توسيع عمليات الاستخراج لبيانات كبيرة باستخدام تجميع فعال أو توازي، مراقبة الإخفاقات، والحفاظ على الاستقرار أمام تغييرات بسيطة في بنية الموقع.<br> المتطلبات: خبرة عملية لا تقل عن 5 سنوات في هندسة البيانات أو استخراج البيانات من الويب أو الأتمتة أو تطوير البرمجيات (مطلوب).<br> درجة البكالوريوس أو الماجستير في الهندسة أو الرياضيات التطبيقية أو علوم الكمبيوتر أو المجالات التقنية ذات الصلة تعتبر ميزة إضافية.<br> يجب أن يكون لدى المرشحين أساس تقني قوي وخبرة عملية في البرمجة النصية، والأتمتة، وتدفقات العمل المدعومة بالذكاء الاصطناعي.<br> نبحث عن متخصصين يمكنهم حل مشاكل غير تافهة والعمل بثقة مع النماذج الكبيرة جدًا (LLMs)، وجمع البيانات وهيكلتها والتحقق منها من مصادر متنوعة بشكل منهجي.<br> نهج منهجي يركز على التفاصيل والقدرة على العمل بشكل مستقل أمران أساسيان.<br> خبرة قوية في استخراج الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يشابهها)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير غير المحدود) وواجهات برمجة التطبيقات عبر البروكسيات. إثبات القدرة على استخراج البيانات من هياكل معقدة (التسلسلات، الصفحات المؤرشفة، HTML غير المتسق) خلفية صلبة في تنظيف البيانات وتطبيعها والتحقق منها، وتوفير مجموعات بيانات مهيكلة (CSV، JSON، Google Sheets) خبرة في التعامل مع آليات مضاد الروبوت وهياكل المواقع الديناميكية على نطاق واسع الخبرة مع بنية سحابية (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من سير عمل حقيقي خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يشابهها) مطبقة في مهام الأتمتة اهتمام قوي بالتفاصيل والتزام بدقة البيانات العمل الذاتي مع القدرة على استكشاف المشكلات بشكل مستقل وجود رابط إلى GitHub ميزة إضافية مستوى اللغة الإنجليزية: فوق المتوسط (B2) أو أعلى (مطلوب) توقعات الوقت للمشروع بالنسبة لهذا المشروع، تُقدَّر المهام عادةً بحوالي 10–20 ساعة في الأسبوع خلال الفترات النشطة، بناء على متطلبات المشروع.<br> هذه تقديرات وليست عبء عمل مضمون، وتطبق فقط أثناء نشاط المشروع.<br> التعويض: يمكن أن يحصل المساهمون في هذا المشروع على ما يصل إلى 37 دولارًا للساعة كمعادل، اعتماداً على مستوى مساهمتهم وسرعتهم في الإسهام.<br> يتفاوت التعويض عبر المشاريع باختلاف النطاق والتعقيد والخبرة المطلوبة.<br> يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة اعتماداً على متطلباتها.<br></span> </div>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسي استخراج بيانات بايثون ذوي المهارات العالية للانضمام إلى مشروع Tendem ودفع تدفقات عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين بين AI والبشر.</p>
<p>في هذا الدور، كمُلاح AI – هكذا نسمي هذا الدور في Mindrift – ستتعاون مع عملاء Tendem الذين يتولون المهام المتكررة، بينما توفِّر التفكير النقدي والخبرة الميدانية وضبط الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة عن بُعد بدوام جزئي مناسبة للمهنيين التقنيين الذين لديهم خبرة عملية في استخراج البيانات من الويب، واستخراج البيانات ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>تتصل منصة Mindrift المتخصصين بمشروعات AI من رواد التقنية الكبرى. مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذه وظيفة مستقلة لمشروع Tendem. كمهندس بيانات بايثون أول لاستخراج البيانات، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية في استخراج البيانات من الويب ومعالجتها، باستخدام أدوات مختلفة مثل Apify المقدمة وOpenRouter إلى جانب أساليبك المبدعة.</p>
<h4>المسؤوليات الأساسية:</h4>
<li>امتلاك تدفقات عمل استخراج البيانات من النهاية إلى النهاية عبر مواقع ويب معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق للمجموعات البيانية المنظمة.</li>
<li>استخدام الأدوات الداخلية (Apify، OpenRouter) جنبًا إلى جنب مع تدفقات عمل مخصصة لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان الاستخراج الموثوق من المصادر الديناميكية والتفاعلية مع تعديل الأساليب حسب الحاجة لمعالجة المحتوى المعروض جافاسكريبت وتغير سلوك المواقع.</li>
<li>فرض معايير جودة البيانات من خلال فحوص التحقق، وضوابط التناسق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات الاستخراج لمجموعات بيانات كبيرة باستخدام تجميع فعال أو ت_parallelization، ورصد的 الفشل، والحفاظ على الاستقرار أمام تغييرات طفيفة في بنية الموقع.</li>
<h4>المتطلبات:</h4>
<li>خبرة لا تقل عن 5+ سنوات في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو مجالات تقنية ذات صلة ميزة.</li>
<li>يفترض أن لدى المرشحين أساسًا تقنيًا قويًا وخبرة عملية في البرمجة النصية، الأتمتة، وتدفقات العمل المدعومة بالذكاء الاصطناعي. نبحث عن متخصصين يمكنهم حل مشكلات غير تافهة، والعمل بثقة مع نماذات اللغة الكبيرة، وجمع البيانات وهيكلتها والتحقق منها من مصادر متنوعة منهجيًا. نهج منظومي وتفصيلي و القدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في استخراج البيانات من الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما يماثله)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير غير المحدود) وواجهات برمجة التطبيقات عبر البروكسيات.</li>
<li>قدرة مثبتة على استخراج البيانات من هياكل معقدة (التسلسلات الهرمية، الصفحات المؤرشفة، HTML غير المتسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق من صحتها، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مضاد الروبوت وبنى المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة مع البنية التحتية السحابية (AWS أو ما يعادلها) والتعبئة بالحاويات (Docker) كجزء من سير العمل الحقيقي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يماثلها) مطبقة في مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاقيات عمل ذاتية التوجيه مع القدرة على استكشاف الأخطاء بشكل مستقل.</li>
<li>رابط إلى GitHub ميزة إضافية.</li>
<li>إتقان الإنجليزية: مستوى أعلى من المتوسط (B2) أو ما فوقه (مطلوب).</li>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير، ليست عبء عمل مضمون، ويسري فقط طالما كان المشروع نشطًا.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب حتى 37 دولارًا في الساعة مكافئ، اعتمادًا على مستواهم وتيرتهم في المساهمة.</p>
<p>يتفاوت التعويض عبر المشاريع وفقًا للنطاق، والتعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات ربح مختلفة بناءً على متطلباتها.</p></p><p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسين كبار في استخراج البيانات باستخدام بايثون ذوي مهارات عالية للانضمام إلى مشروع Tendem ودفع مسارات عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين الذي يجمع بين الذكاء الاصطناعي والبشر.</p>
<p>في هذا الدور، كقائد AI – هكذا نسلط الضوء على هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي والخبرة في المجال والتحكم بالجودة لتقديم نتائج دقيقة وعملية.</p>
<p>هذه الفرصة عن بُعد بدوام جزئي مثالية للمهنيين التقنيين ذوي الخبرة العملية في استخراج الويب، واستخراج البيانات، ومعالجتها.</p>
<h4>ما الذي نقوم به</h4>
<p>تربط منصة Mindrift المتخصصين بمشروعات AI من مبتكري التكنولوجيا الكبار. مهمتنا هي فتح إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة العملية من جميع أنحاء العالم.</p>
<p>هذه وظيفة حُرّة لمشروع Tendem. كامرأس استخراج بيانات بايثون لكبار، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية لعمليات الاستخراج والمعالجة عبر الويب، باستخدام أدوات مختلفة مثل Apify وOpenRouter المقدمتين بجانب أساليبك الخاصة المعتمِدة على الموارد.</p>
<h4>المسؤوليات الرئيسية:</h4>
<ul>
<li>إدارة تدفقات استخراج البيانات من البداية إلى النهاية عبر مواقع ويب معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات المهيكلة.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) بجانب سير عمل مخصص لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من مصادر ويب دينامية وتفاعلية، مع تكييف الأساليب حسب الحاجة للتعامل مع المحتوى المعروض بالجافا سكريبت وسلوك الموقع المتغير.</li>
<li> تطبيق معايير جودة البيانات من خلال فحوصات التحقق، وضوابط الاتساق بين المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات السحب لبيانات كبيرة باستخدام دفعات فعالة أو توازي، رصد الإخفاقات، والحفاظ على الاستقرار أمام تغيّر بسيط في بنية الموقع.</li>
</ul>
<h4>المتطلبات:</h4>
<ul>
<li>خبرة لا تقل عن 5+ سنوات في هندسة البيانات، استخراج البيانات من الويب، التشغيل الآلي، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة بكالوريوس أو ماجستير في الهندسة، الرياضيات التطبيقية، علوم الكمبيوتر، أو غيرها من المجالات التقنية ذات الصلة ميزة إضافية.</li>
<li>يجب أن يمتلك المرشحون أساساً تقنياً قوياً وخبرة عملية في البرمجة النصية، التشغيل الآلي، ومسارات العمل المدعومة بالذكاء الاصطناعي. نبحث عن متخصصين يمكنهم حل مشاكل غير تقليدية، والعمل بثقة مع نماذج اللغة الكبيرة، وجمع البيانات وهياكلها والتحقق منها بشكل منهجي من مصادر متنوعة. نهج منهجي وتفصيلي مع القدرة على العمل بشكل مستقل أمران أساسيان.</li>
<li>خبرة قوية في استخراج البيانات باستخدام بايثون (BeautifulSoup، Selenium أو ما شابه)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجية عبر وكلاء.</li>
<li>إثبات القدرة على استخراج البيانات من تراكيب معقدة (التسلسلات، الصفحات المؤرشفة، HTML غير المتسق).</li>
<li>خلفية قوية في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات مهيكلة (CSV، JSON، Google Sheets).</li>
<li>خبرة مثبتة في التعامل مع آليات مضاد الروبوت وبُنى المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة في البنية التحتية السحابية (AWS أو ما يعادلها) والحاويات (Docker) كجزء من عمليات فعلية.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يماثلها) مطبقة في مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاقيات عمل مستقلة مع القدرة على استكشاف الأخطاء وإصلاحها بشكل مستقل.</li>
<li>إحالة إلى GitHub تعتبر ميزة.</li>
<li>الكفاءة في الإنجليزية: مستوى أعلى من المتوسط (B2) فما فوق (مطلوب).</li>
</ul>
<h4>توقعات زمن المشروع</h4>
<p>للمشروع هذا، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذه تقديرات وليست عبء عمل مضمون، وتطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين أن يحصلوا على ما يصل إلى 37 دولارًا في الساعة مكافئ، اعتمادًا على مستواهم وتيرتهم في المساهمة.</p>
<p>يتفاوت التعويض بين المشاريع بناءً على النطاق، التعقيد، والخبرة المطلوبة. يُرجى ملاحظة أن مشاريع أخرى على المنصة قد توفر مستويات كسب مختلفة وفقًا لمتطلباتها.</p></p><p></p>
<p><h4>الوصف</h4>
<p>تبحث Mindrift عن مهندسين مهرة في استخراج البيانات باستخدام بايثون على مستوى خبير للانضمام إلى مشروع Tendem وتوجيه سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين المدعوم بالذكاء الاصطناعي والبشري.</p>
<p>في هذا الدور، كمساعد ذكاء اصطناعي – هكذا نصف هذا الدور في Mindrift – ستتعاون مع وكلاء Tendem الذين يتولون المهام المتكررة، بينما تقدم التفكير النقدي، والخبرة في المجال، والتحكم في الجودة لتقديم نتائج دقيقة وقابلة للتنفيذ.</p>
<p>هذه الفرصة عن بُعد بدوام جزئي مثالية للمهنيين التقنيين ذوي الخبرة العملية في كشط الويب، واستخراج البيانات، ومعالجتها.</p>
<h4>ماذا نفعل</h4>
<p>تربط منصة Mindrift المتخصصين بمشروعات الذكاء الاصطناعي من روّاد التقنية الكبار. مهمتنا هي فتح潜 الإمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من الخبرة الواقعية من جميع أنحاء العالم.</p>
<p>هذا دور مستقل لمشروع Tendem. كمهندس استخراج بيانات بايثون خبير، ستتعامل مع مهام استخراج البيانات التي تتطلب دقة تقنية للانطلاق والمعالجة، باستخدام أدوات مختلفة مثل Apify وOpenRouter المقدمين إلى جانب نهجك الخاص المتعدد المصادر.</p>
<h4>المسؤوليات الرئيسية:</h4>
<ul>
<li>امتلاك تدفقات استخراج البيانات من البداية للنهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة والتسليم الموثوق لمجموعات البيانات الهيكلية.</li>
<li>استغلال الأدوات الداخلية (Apify، OpenRouter) إلى جانب سير العمل المخصص لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع الالتزام بالمتطلبات المحددة.</li>
<li>ضمان استخراج موثوق من المصادر الديناميكية والتفاعلية، مع تكييف الأساليب حسب الحاجة للتعامل مع المحتوى المعروض-JS وتغير سلوك المواقع.</li>
<li>فرض معايير جودة البيانات من خلال فحص التحقق والضوابط التوافق عبر المصادر، الالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم.</li>
<li>توسيع عمليات الكشط لمجموعات البيانات الكبيرة باستخدام التقطيع الفعال أو العمل المتوازي، ومراقبة الإخفاقات، والحفاظ على الاستقرار أمام تغييرات بسيطة في بنية المواقع.</li>
</ul>
<h4>المتطلبات:</h4>
<ul>
<li>خبرة لا تقل عن 5+ سنوات ذات صلة في هندسة البيانات، كشط الويب، الأتمتة، أو تطوير البرمجيات (مطلوب).</li>
<li>درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو المجالات التقنية ذات الصلة ميزة.</li>
<li>يجب أن يكون لدى المرشحين أساس تقني قوي وتجربة عملية مع البرمجة الآلية وسير العمل المدعوم بالذكاء الاصطناعي. نبحث عن متخصصين يمكنهم حل مشاكل غير تافهة، والعمل بثقة مع نماذات اللغة الكبيرة، وجمع البيانات وهيكلتها والتحقق منها من مصادر متعددة منهجيًا. نهج منضبط وتفصيلي والقدرة على العمل بشكل مستقل ضروريان.</li>
<li>خبرة قوية في كشط الويب باستخدام بايثون (BeautifulSoup، Selenium أو ما شابه)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر الوكلاء.</li>
<li>إثبات القدرة على استخراج البيانات من هياكل معقدة (هرميات، صفحات مؤرشفة، HTML غير متسق).</li>
<li>خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق، وتقديم مجموعات بيانات هيكلية (CSV، JSON، Google Sheets).</li>
<li>خبرة مع آليات مكافحة الروبوتات وهياكل المواقع الديناميكية على نطاق واسع.</li>
<li>خبرة في البنية التحتية السحابية (AWS أو ما يعادلها) والحاويات (Docker) كجزء من سير العمل الحقيقي.</li>
<li>خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما شابه) تطبق على مهام الأتمتة.</li>
<li>اهتمام قوي بالتفاصيل والتزام بدقة البيانات.</li>
<li>أخلاقيات عمل ذاتية التوجيه مع القدرة على استكشاف الأخطاء بشكل مستقل.</li>
<li>وجود رابط GitHub يعتبر زائدًا.</li>
<li>إتقان اللغة الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب).</li>
</ul>
<h4>توقعات وقت المشروع</h4>
<p>لهذا المشروع، من المقدر أن تتطلب المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. هذا تقدير وليس عبء عمل مضمون، وينطبق فقط أثناء نشاط المشروع.</p>
<h4>التعويض</h4>
<p>في هذا المشروع، يمكن للمساهمين كسب ما يصل إلى 37 دولارًا في الساعة مكافئًا، وذلك يعتمد على مستواهم وتيرتهم في المساهمة.</p>
<p>يتفاوت التعويض عبر المشاريع حسب النطاق، التعقيد، والخبرة المطلوبة. يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات ربح مختلفة بناءً على متطلباتها.</p></p><p></p>
<p><h4>يرجى تقديم سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إجادتك للغة الإنجليزية.<\/h4>\n<p>Mindrift تربط المتخصصين بفرص ذكاء اصطناعي قائمة على المشاريع مع شركات تقنية رائدة، مركّزة على الاختبار والتقييم وتحسين أنظمة AI. المشاركة قائمة على المشاريع وليست توظيفاً دائماً.<\/p>\n<h4>ما تتضمنه هذه الفرصة:<\/h4>\n<p>نقوم ببناء مجموعة بيانات لتقييم وكلاء الترميز بالذكاء الاصطناعي - مدى قدرة النموذج على التعامل مع مهام المطورين الواقعية.<\/p>\n<p>ستقوم بإنشاء مهام وتقييمات ضمن بيئات محاكاة واقعية:<\/p>\n<ul>\n <li>بناء بيئات مطور واقعية - شركة افتراضية بها قاعدة الشيفرة والبنية التحتية والسياق (التذاكر، الوثائق، المحادثات) التي تشكل تاريخ تطوير مقنع</li>\n <li>تصميم المهام من حالات وسيطة لهذه البيئات - صياغة المطالبة، تحديد معنى "تم الحل"، والتأكد من أن المهمة قابلة للحل بواسطة وكيل ذكاء اصطناعي</li>\n <li>كتابة اختبارات تتحقق من حلول الوكلاء - قبول جميع الأساليب الصحيحة ورفض الخاطئة، لا تكون صارمة جدًا ولا متساهلة جدًا</li>\n <li>التكرار على المهام والاختبارات بناءً على ملاحظات ضمان الجودة - مراجعة حلول الوكلاء، تحليل الإخفاقات، والتحسين حتى يصبح التقييم عادلًا وموثوقًا</li>\n</ul>\n<h4>ما ليس هذا:<\/h4>\n<ul>\n <li>ليس تصنيف بيانات</li>\n <li>ليس هندسة المطالبات</li>\n <li>ليس كتابة كود من الصفر - الوكيل يكتب معظم الكود؛ أنت توجه وتقييم</li>\n</ul>\n<h4>ما نبحث عنه:<\/h4>\n<ul>\n <li>8+ سنوات في تطوير البرمجيات</li>\n <li>المكدس الأساسي: بايثون (FastAPI)، جافاسكريبت/تايبسكريبت (ريأكت)، دوكر، بوستغرس، كافكا، ريـديس</li>\n <li>خبرة في كتابة الاختبارات (وظيفية، تكامل)</li>\n <li>إتقان اللغة الإنجليزية - B2+</li>\n</ul>\n<h4>لماذا هذا صعب:<\/h4>\n<p>النماذج الحدودية جيدة في الترميز بالفعل. إنشاء مهمة تتحدى النماذج الأفضل بشكل حقيقي ليس أمرًا بسيطًا. تحتاج إلى فهم عميق لمكان فشل النماذج وما السيناريوهات التي تكشف الفرق بين حل جيد وسيئ. المهام لديها العديد من الحلول الصحيحة - كتابة اختبارات تقبل جميع الحلول الصحيحة وترفض الخاطئة أصعب مما يبدو.</p>\n<h4>كيف تعمل الأمور<\/h4>\n<p>التقديم؟ اجتياز المؤهلات؟ الانضمام إلى مشروع؟ إكمال المهام؟ الدفع.</p>\n<h4>تقدير الجهد<\/h4>\n<p>المهام لهذا المشروع من المتوقع أن تستغرق 30 ساعة لإكمالها، حسب التعقيد. هذا تقدير وليس متطلبًا زمنيًا؛ أنت تقرر متى وكيفية العمل. يجب تقديم المهام بحلول الموعد النهائي وتلبية معايير القبول المذكورة ليتم قبولها.</p><\/p><p><\/p>
<p><h4>يرجى تقديم سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إجادتك للغة الإنجليزية.<\/h4>\n<p>Mindrift توصل المتخصصين بفرص الذكاء الاصطناعي المستندة إلى المشاريع لشركات التقنية الرائدة، مع تركيز على اختبار وتقييم وتحسين أنظمة الذكاء الاصطناعي. المشاركة تكون قائمة على المشروع وليست توظيفاً دائماً.<\/p>\n<h4>ما تشمل هذه الفرصة:<\/h4>\n<p>نحن نقوم ببناء مجموعة بيانات لتقييم وكلاء التشفير (التكويد) للذكاء الاصطناعي - مدى قدرة نموذج على التعامل مع مهام المطورين في العالم الواقعي.<\/p>\n<p>ستنشئ مهاماً وتقييمات ضمن بيئات محاكاة واقعية:<\/p>\n<ul>\n <li>إنشاء بيئات مطور واقعية - شركة افتراضية تحتوي على قاعدة كود وبنية تحتية وسياق (تذاكر، مستندات، محادثات) تشكل تاريخ تطوير مقنع</li>\n <li>تصميم مهام من حالات وسطية لهذه البيئات - صغ المطالبات، حدِّد ما يعني "المحَلًّ"، وتأكد من أن المهمة قابلة للحل بواسطة وكيل ذكاء اصطناعي</li>\n <li>كتابة اختبارات تتحقق من حلول الوكلاء - اعتمد جميع الأساليب الصحيحة و استبعد غير الصحيحة، لا تكون صارمة جداً ولا مُتساهلة جداً</li>\n <li>التكرار على المهام والاختبارات بناءً على ملاحظات QA - راجع حلول الوكلاء، حلل الإخفاقات، واطرِ مَ التطويع حتى تكون التقييم عادلًا وقويًا</li>\n</ul>\n<h4>ما ليس عليه:<\/h4>\n<ul>\n <li>ليس تسمية بيانات</li>\n <li>ليس هندسة المطالبات</li>\n <li>ليس كتابة الشيفرة من الصفر - الوكيل يكتب معظم الشفرة؛ أنت توجه وتقيِّم</li>\n</ul>\n<h4>ما نبحث عنه:<\/h4>\n<ul>\n <li>8+ سنوات في تطوير البرمجيات</li>\n <li>المكدس الأساسي: بايثون (FastAPI)، جافاسكريبت/تايب سكريبت (ريأكت)، دوكر، بوستجرس، كافكا، ريدي إس</li>\n <li>خبرة في كتابة الاختبارات (وظيفية، تكامل)</li>\n <li>إتقان الإنجليزية - B2+</li>\n</ul>\n<h4>لماذا هذا صعب:<\/h4>\n<p>نماذج الحدود (Frontier) جيدة في البرمجة بالفعل. إنشاء مهمة تتحدى النماذج الأفضل بشكل حقيقي ليس أمراً بسيطاً. تحتاج إلى فهم عميق لأين تفشل النماذج وما هي السيناريوهات التي تكشف الفرق بين حل جيد وآخر سيئ. للمهام العديد من الحلول الصحيحة - كتابة اختبارات تقبل جميع الحلول الصحيحة وترفض غير الصحيحة أصعب مما يبدو.</p>\n<h4>كيف يعمل:<\/h4>\n<p>التقديم؟ اجتياز التأهيل (التأهيلات)؟ الانضمام إلى مشروع؟ إكمال المهام؟ الدفع مقابل ذلك.</p>\n<h4>تقدير الجهد:<\/h4>\n<p>من المتوقع أن تستغرق المهام لهذا المشروع حوالي 30 ساعة لإكمالها، بناءً على التعقيد. هذا تقدير وليس شرطاً جدولياً؛ اختر متى وكيف ستعمل. يجب تقديم المهام قبل الموعد النهائي وتلبية معايير القبول المذكورة ليتم قبولها.</p><\/p><p><\/p>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>يرجى تقديم سيرتك الذاتية باللغة الإنجليزية وتحديد مستوى إتقانك للغة الإنجليزية.<br> تربط Mindrift المتخصصين بفرص AI قائمة على المشاريع لشركات تقنية رائدة، مع التركيز على اختبار النُظم وتقييمها وتحسينها.<br> المشاركة على أساس المشروع، وليست توظيفاً دائماً.<br> ما ينطوي عليه هذا الفرصة: نقوم ببناء مجموعة بيانات لتقييم وكلاء ترميز AI - مدى قدرة النموذج على التعامل مع مهام المطور الواقعية.<br> ستنشئ مهام وتقييمات ضمن بيئات محاكاة واقعية: بناء بيئات مطور واقعية - شركة افتراضية بها قاعدة كود وبنية تحتية وسياق (تذاكر، وثائق، محادثات) تشكل تاريخ تطوير مقبول Design مهام من حالات وسيطة لهذه البيئات - صِغّ المطالبة، عرف ماذا يعني "تم الحل"، وتأكد من أن المهمة قابلة للحل بواسطة وكيل AI Write اختبارات تتحقق من حلول الوكلاء - اقبل جميع الأساليب الصحيحة ورفض الأساليب الخاطئة، لا تكون صارمة جدًا ولا متساهلة جدًا Iterate على المهام والاختبارات بناءً على ملاحظات QA - راجع حلول الوكلاء، حلل الإخفاقات، وحسن حتى تكون التقييم عادلًا ومتماسك ما هذا ليس: ليست تصنيف بيانات ليست هندسة مطالب ليست كتابة كود من الصفر - الوكيل يكتب معظم الكود؛ أنت توجه وتقيم ما نبحث عنه: 8+ سنوات في تطوير البرمجيات مجموعة التقنية الأساسية: بايثون (FastAPI)، جافاسكريبت/تايبسكريبت (React)، دوكر، بوستجري سك، كافكا، ريديس خبرة في كتابة الاختبارات (وظيفية، تكامل) الطلاقة الإنجليزية - B2+ لماذا هذه المهمة صعبة: نماذج الحدود الأمامية جيدة في الترميز بالفعل.<br> إنشاء مهمة تتحدى أفضل النماذج فعليًا ليس أمرًا بسيطًا.<br> عليك أن تفهم بعمق أين تفشل النماذج وما هي السيناريوهات التي تكشف الاختلاف بين حل جيد وسيئ.<br> للمهام حلول كثيرة صالحة - كتابة اختبارات تقبل جميع الحلول الصحيحة وترفض الخاطئة أمر أصعب مما يبدو.<br> كيف يعمل النظام: تطبيق → اجتياز التأهيل(ات) → الانضمام إلى مشروع → إكمال المهام → الدفعEstimated الجهد: تتراوح مهام هذا المشروع حتى 30 ساعة لإكمالها، حسب التعقيد.<br> هذه تقديرات وليست متطلباً زمنياً؛ اختر متى وكيف تعمل.<br> يجب تقديم المهام بحلول الموعد وتلبية معايير القبول المدرجة ليتم قبولها.<br> التعويض: حتى 200 دولار/ساعة مكافئ، وفقاً لمستوى السرعة.<br> تُقدر المهام بنحو ~30 ساعة لكل منها؛ حدد جدولك الخاص.<br></span> </div>
<h2 class="h5">وصف العمل</h2>
<div class="t-break" data-jb-field="description">
<span>يرجى تقديم سيرتك الذاتية بالإنجليزية وذكر مستوى كفاءتك في اللغة الإنجليزية.<br> Mindrift يربط المتخصصين بفرص AI قائمـة على المشاريع لشركات التقنية الرائدة، مع التركيز على الاختبار والتقييم وتحسين أنظمة AI.<br> المشاركة قائمة على المشروع، وليست توظيفاً دائماً.<br> ما تنطوي عليه هذه الفرصة: عمل وكلاء التشفير Frontier لديهم خبرة في اجتياز الاختبارات بالفعل.<br> نقيس ما إذا كانوا يجتازونها بالطريقة الصحيحة .<br> نحن نبني مجموعة بيانات لتقييم أمان وسلوك وكلاء تشفير الذكاء الاصطناعي — ليس فقط إذا أكملوا مهمة، بل إذا فعلوا ذلك بأمانة، ضمن النطاق، ودون تقصير.<br> ستصمم مهام حيث الطريق الأسهل هو الطريق غير الآمن، وتكتب الاختبارات التي تلتقطه: بناء بيئات مطور واقعية — شركة افتراضية بها قاعدة كود وبنية تحتية وسياق (التذاكر، المستندات، المحادثات) تشكل تاريخ تطوير مقنع تصميم المهام التي تقترن هدف تطويري بريء مع اختصار غير آمن مغرٍ: زيادة النطاق، انتهاك السياسات، تلف البيانات، تغييرات واسعة الإذن اكتب اختبارات تتحقق مما إذا كان الوكيل أنجز المهمة بالطريقة الصحيحة — التقاط التقعير في الكماليات، وليس مجرد التحقق من المخرجات Iterate on tasks and tests based on QA feedback — review agent solutions, analyze failures, and refine until the evaluation is fair and robust What this is NOT: Not data labeling; Not prompt engineering; Not cybersecurity or red-teaming — there is no attacker in the scenario.<br> Cybersecurity experience is a nice-to-have but not a requirement.<br> We're looking for engineers who understand how code should behave, not penetration testers.<br> Strong software engineers, not security specialists; Not writing code from scratch — the agent writes most of the code; you design the situation and evaluate the outcome; What we look for 4–5+ years in software development; Core stack: Python, JavaScript/TypeScript; Strong test design skills — functional and integration tests that separate safe from unsafe completion, not just correct from incorrect; Hands-on experience with coding agents (Claude Code, GitHub Copilot CLI, Codex, or similar); Familiarity with GitHub PRs and CI workflows as a user; Stack breadth is welcome, not a filter.<br> Tasks simulate real repositories with databases, CI pipelines, and deploy scripts, so wider backend and infrastructure exposure is genuinely useful — but you don't need to be an expert in every layer; English proficiency — B2+ Why this is hard Frontier models are already good at coding.<br> Creating a task that genuinely challenges the best models is non-trivial.<br> The real difficulty is building the temptation — a scenario where the unsafe or out-of-scope path is the path of least resistance — and then writing tests that reliably catch an agent that took it.<br> Tasks have many valid solutions; tests must accept all of them and reject the bad ones.<br> How it works Apply → Pass qualification(s) → Join a project → Complete tasks → Get paid Project time expectations For this project, tasks are estimated to require around 20-25 hours per week during active phases, based on project requirements.<br> This is an estimate, not a guaranteed workload, and applies only while the project is active.<br> Tasks must be submitted by the deadline and meet the listed acceptance criteria to be accepted.<br> Compensation On this project, contributors can earn up to $75 per hour equivalent , depending on their level and pace of contribution.<br> Compensation varies across projects depending on scope, complexity, and required expertise.<br> Please note that other projects on the platform may offer different earning levels based on their requirements.<br></span> </div>
<h2 class="h5">وصف الوظيفة</h2>
<div class="t-break" data-jb-field="description">
<span>تبحث Mindrift عن مهندسي استخراج بيانات Python senior ذوي مهارات عالية للانضمام إلى مشروع Tendem وتوجيه سير عمل استخراج البيانات المتخصصة ضمن نظامنا الهجين بين AI والبشر. <br> في هذا الدور، كملاح AI – هكذا نشير إلى هذا الدور في Mindrift – ستتعاون مع عملاء Tendem الذين يتعاملون مع المهام المتكررة، بينما تقدم التفكير النقدي، الخبرة في المجال، وضمان الجودة لتقديم نتائج دقيقة وقابلة للإجراء. <br> هذه الفرصة بدوام جزئي عن بعد مثالية للمهنيين التقنيين الذين لديهم خبرة عملية في استخراج البيانات من الويب، واستخراجها ومعالجتها. <br> ما الذي نفعله؟ تربط منصة Mindrift المتخصصين بمشروعات AI من رواد التقنية الكبرى. <br> مهمتنا هي إطلاق إمكانات الذكاء الاصطناعي التوليدي من خلال الاستفادة من خبرة العالم الواقعي من جميع أنحاء العالم. <br> هذا دور مستقل لمشروع Tendem. <br> كمهندس Senior Python Data Scraping، ستتعامل مع مهام سحب البيانات التي تتطلب دقة تقنية لاستخراج ومعالجة الويب، باستخدام أدوات متعددة مثل Apify وOpenRouter المقدمة بجانب أساليبك الخلاقة. <br> المسؤوليات الأساسية: امتلاك سير عمل استخراج البيانات من البداية إلى النهاية عبر مواقع معقدة، مع ضمان التغطية الكاملة والدقة وتوصيل مجموعات بيانات منظمة وموثوقة. <br> الاستفادة من الأدوات الداخلية (Apify، OpenRouter) بجانب سير عمل مخصص لتسريع جمع البيانات والتحقق من صحتها وتنفيذ المهام مع تلبية المتطلبات المحددة. <br> ضمان استخراج موثوق من مصادر ويب ديناميكية وتفاعلية، وتكييف الأساليب حسب الحاجة للتعامل مع المحتوى المولّد بجافا سكريبت وسلوك الموقع المتغير. <br> فرض معايير جودة البيانات من خلال فحوصات التحقق، وضوابط التناسق عبر المصادر، والالتزام بمواصفات التنسيق، والتحقق المنهجي قبل التسليم. <br> توسيع عمليات السحب لبيانات كبيرة باستخدام دفعات فعالة أو توازي، ومراقبة الأخطاء، والحفاظ على الاستقرار أمام التغييرات الطفيفة في بنية الموقع. <br> المتطلبات: خبرة لا تقل عن 5+ سنوات في هندسة البيانات، استخراج البيانات من الويب، الأتمتة، أو تطوير البرمجيات (مطلوب). <br> درجة البكالوريوس أو الماجستير في الهندسة، الرياضيات التطبيقية، علوم الحاسوب، أو المجالات التقنية ذات الصلة تعتبر ميزة. <br> يجب أن يمتلك المرشحون أسس تقنية قوية وخبرة عملية في التلاعب بالنصوص، الأتمتة، وسير العمل بمساعدة الذكاء الاصطناعي. <br> نبحث عن متخصصين يستطيعون حل مشاكل غير تافهة، والعمل بثقة مع نماذج اللغة الكبيرة، وجمع وهيكلة والتحقق من صحة البيانات من مصادر متنوعة بشكل منهجي. <br> نهج منهجي ودقيق في التفاصيل والقدرة على العمل بشكل مستقل أمران أساسيان. <br> خبرة قوية في سحب البيانات من الويب باستخدام Python (BeautifulSoup، Selenium أو ما شابه)، بما في ذلك المحتوى الديناميكي (JS، AJAX، التمرير اللانهائي) وواجهات برمجة التطبيقات عبر البروكسى، قدرتك المثبتة على استخراج البيانات من هياكل معقدة (هرميات، صفحات مؤرشفة، HTML غير متسق) خلفية صلبة في تنظيف البيانات، التطبيع، والتحقق من الصحة، وتقديم مجموعات بيانات منظمة (CSV، JSON، Google Sheets) خبرة مثبتة في التعامل مع آليات مضاد الروبوت وبُنى المواقع الديناميكية على نطاق واسع خبرة مع بنية السحابة (AWS أو ما يعادلها) وتعبئة الحاويات (Docker) كجزء من سير عمل حقيقي، خبرة عملية مع أطر LLM (LangChain، OpenRouter، أو ما يشابهها) مع المهام الأتمتة اهتمام عالي بالتفاصيل والالتزام بدقة البيانات نهج عمل ذاتي مع القدرة على استكشاف الأخطاء بشكل مستقل رابط GitHub ميزة إضافية اللغة الإنجليزية: مستوى فوق المتوسط (B2) أو أعلى (مطلوب) توقعات الوقت للمشروع: لهذه المشاريع، من المتوقع أن تتطلب المهام حوالي 10–20 ساعة في الأسبوع خلال المراحل النشطة، بناءً على متطلبات المشروع. <br> هذه تقديرات وليست عبء عمل مضمون، وتطبق فقط أثناء نشاط المشروع. <br> التعويض: في هذا المشروع، يمكن للمساهمين كسب حتى 37 دولاراً في الساعة المكافئ، اعتماداً على مستواهم وتقدمهم. <br> يختلف التعويض عبر المشاريع اعتماداً على النطاق والتعقيد والخبرة المطلوبة. <br> يرجى ملاحظة أن مشاريع أخرى على المنصة قد تقدم مستويات كسب مختلفة بناءً على متطلباتها. </span> </div>