الموقع: المملكة العربية السعودية، دوام كامل / في الموقع
الخبرة: 8 سنوات فأكثر
الصناعة: الخدمات المصرفية / الخدمات المالية
من نحن؟
تعد شركة Crayon Data مزوداً رائداً لحلول تسريع الإيرادات القائمة على الذكاء الاصطناعي، ويقع مقرها الرئيسي في سنغافورة مع وجود لها في الهند والإمارات العربية المتحدة. منذ تأسيسنا في عام 2012، كانت مهمتنا دائماً تبسيط خيارات العالم.
اليوم، تطورنا لنصبح Tangram.ai — وهي منصة معيارية مدعومة بالذكاء الاصطناعي التوليدي ومصممة للمؤسسات. تتيح Tangram للمؤسسات تجميع الوكلاء والحلول والنماذج الذكية مثل مكعبات البناء لإنشاء وتوسيع وتكييف القدرات المدعومة بالذكاء الاصطناعي بسرعة وأمان ودقة. إنها ليست مجرد منصة، بل هي طبقة التشغيل للذكاء الاصطناعي التوليدي في المؤسسات.
نظرة عامة على الدور الوظيفي
نحن نبحث عن مهندس معماري رئيسي أول للذكاء الاصطناعي ليكون مسؤولاً عن الهندسة المعمارية المتكاملة لمنصات الذكاء الاصطناعي التوليدي والبنية التحتية للذكاء الاصطناعي على مستوى المؤسسات وبأعلى معايير الأمان للبيئات المصرفية شديدة التنظيم.
ستعمل بشكل وثيق مع فرق الأعمال والمنتجات وعلوم البيانات والهندسة والبنية التحتية والعملاء لتحويل متطلبات العمل إلى حلول ذكاء اصطناعي قابلة للتطوير.
ما ستفعله
هندسة منصات الذكاء الاصطناعي التوليدي، ونماذج اللغات الكبيرة (LLM)، وتقنية توليد الاستجابات المعززة (RAG)، ومنصات الذكاء الاصطناعي/تعلم الآلة للبيئات الآمنة والمحلية (on-premise) والبيئات المعزولة عن الإنترنت (air-gapped).
تصميم بنية تحتية معززة بمعالجات الرسومات (GPU) باستخدام NVIDIA DGX, H100/B200, NVLink/NVSwitch.
هندسة منصات الذكاء الاصطناعي على بيئة Red Hat Open Shift/Kubernetes باستخدام NVIDIA GPU Operator.
تصميم ودمج تقنيات NVIDIA NIM، وTriton Inference Server، وData Robot، وقواعد البيانات الرسومية (Graph Databases).
بناء هياكل معمارية تدعم تقنية RAG، وخرائط المعرفة (Knowledge Graphs)، وخطوط معالجة بيانات المؤسسات.
تحديد معايير الأمان وقابلية التوسع والأداء وسيادة البيانات للبيئات المصرفية.
توفير القيادة التقنية والتوجيه لفرق علوم البيانات والهندسة والذكاء الاصطناعي.
تقييم تقنيات الذكاء الاصطناعي الناشئة وقيادة اعتماد الحلول التي تخلق أثراً تجارياً ملموساً.
ما نبحث عنه
خبرة لا تقل عن 8 سنوات في الذكاء الاصطناعي/تعلم الآلة، هندسة المؤسسات، البنية التحتية أو المجالات ذات الصلة.
خبرة لا تقل عن 3 سنوات في تصميم حلول الذكاء الاصطناعي التوليدي واسعة النطاق، ونماذج اللغات الكبيرة، أو حلول الذكاء الاصطناعي/تعلم الآلة المعززة بمعالجات الرسومات.
خبرة قوية في معالجات NVIDIA الرسومية، وOpen Shift، وKubernetes، وGPU Operator.
معرفة عملية بـ NVIDIA NIM / Triton، وData Robot، وقواعد البيانات الرسومية مثل Neo4j / Arango DB.
فهم قوي لتقنيات RAG، وبنية نماذج اللغات الكبيرة (LLM)، والأنظمة الموزعة، ومنصات الذكاء الاصطناعي.
خبرة في القطاع المصرفي/BFSI، أو التكنولوجيا المالية (FinTech)، أو البيئات شديدة التنظيم.
مهارات قوية في إدارة أصحاب المصلحة، وحل المشكلات، والقيادة التقنية.
نقاط إضافية: خبرة في العمل مع البيئات المعزولة (air-gapped)، والاستدلال واسع النطاق لنماذج اللغات الكبيرة، وخرائط المعرفة، والذكاء الاصطناعي المعتمد على الوكلاء، أو أنظمة التوصية.
Location: Saudi Arabia Full Time/ On-site
Experience: 8+ years
Industry: Banking / Financial Services
Who are we?
Crayon Data is a leading provider of AI-led revenue acceleration solutions, headquartered in Singapore with a presence in India and the UAE. Founded in 2012, our mission has always been to simplify the world’s choices.
Today, we’ve evolved into Tangram.ai — a modular, Gen AI-powered platform built for the enterprise. Tangram lets organizations assemble intelligent agents, solutions, and models like building blocks to create, scale, and adapt AI-powered capabilities with speed, security, and precision. It’s not just a platform,it’s the operating layer for Gen AI in the enterprise.
Role Overview
We are looking for a Senior Lead AI Architect to own the end-to-end architecture of secure, enterprise-grade Generative AI and AI infrastructure platforms for highly regulated banking environments.
You will work closely with Business, Product, Data Science, Engineering, Infrastructure, and client teams to translate business requirements into scalable AI solutions.
What You'll Do
Architect enterprise Gen AI, LLM, RAG and AI/ML platforms for secure on-premise and air-gapped environments.
Design GPU-accelerated infrastructure using NVIDIA DGX, H100/B200, NVLink/NVSwitch.
Architect AI platforms on Red Hat Open Shift/Kubernetes using the NVIDIA GPU Operator.
Design and integrate NVIDIA NIM, Triton Inference Server, Data Robot and Graph Databases.
Build architectures supporting RAG, Knowledge Graphs and enterprise data pipelines.
Define security, scalability, performance and data-sovereignty standards for banking environments.
Provide technical leadership and guidance to Data Science, Engineering and AI teams.
Evaluate emerging AI technologies and drive adoption of solutions that create measurable business impact.
What We're Looking For
8+ years of experience in AI/ML, enterprise architecture, infrastructure or related areas.
3+ years designing large-scale Gen AI, LLM, AI/ML or GPU-accelerated solutions.
Strong experience with NVIDIA GPUs, Open Shift, Kubernetes and GPU Operator.
Hands-on knowledge of NVIDIA NIM / Triton, Data Robot and Graph Databases such as Neo4j / Arango DB.
Strong understanding of RAG, LLM infrastructure, distributed systems and AI platforms.
Experience in Banking/BFSI, Fin Tech or highly regulated environments.
Strong stakeholder management, problem-solving and technical leadership skills.
Brownie Points: Experience with air-gapped environments, large-scale LLM inference, Knowledge Graphs, Agentic AI or recommendation systems.