دمج الوسائط المتعددة
دمج الإشارات المختلفة من النصوص والرؤية والصوت في تمثيلات مشتركة متماسكة.
مجال بحثي
أبحاث تمتد عبر فهم النصوص والصور والصوت والفيديو والمستندات من خلال الاستدلال الموحد، والمواءمة السياقية، وأنظمة التعلم العابر للوسائط المصممة لتطبيقات الذكاء الاصطناعي في العالم الحقيقي.
الركائز البحثية الأساسية
دمج الإشارات المختلفة من النصوص والرؤية والصوت في تمثيلات مشتركة متماسكة.
تمكين الأنظمة من الاستنتاج والتحقق والاستدلال عبر مدخلات متعددة مع اتساق سياقي.
بناء نماذج زمنية قوية لاكتشاف الأحداث وتفسير المشاهد وفهم التدفقات المتعددة.
دمج OCR وتحليل البنية واستخراج الدلالة وفهم اللغة لمعالجة المستندات المؤسسية.
ربط المخرجات بمصادر موثوقة وأدلة متعددة الوسائط لاتخاذ قرارات موثوقة وجاهزة للإنتاج.
التركيز الحالي
تعاون مع أبحاث OpenQCore لتطوير أنظمة ذكاء اصطناعي متعددة الوسائط قابلة للتوسع وموثوقة.