StreamVLM™: اكتبوا جملة، واحصلوا على كاشف

تحتاج تحليلات الفيديو التقليدية إلى أشهر من جمع البيانات ووسمها وتدريب النموذج لكل حالة استخدام جديدة. ويستخدم StreamVLM™ نموذج رؤية ولغة (Vision-Language Model) يفهم الصور واللغة مسبقاً، فيبدأ الكاشف الذي تصفونه في جملة العمل فوراً.

احجزوا عرضاً توضيحياً

الذيل الطويل

الحالات التي لا يُقدِّمها أي مورّد جاهزةً من الصندوق

لكل مدينة قائمة بالأمور التي تحتاج إلى رصدها ولا يبيع أي مورّد تحليلات وحدة من أجلها: شخص مستلقٍ على الأرض، أو سياج تالف، أو إلقاء نفايات غير قانوني خلف مستودع. ولا يبرّر أي منها بمفرده برنامج تدريب. لكنّها مجتمعةً تمثّل معظم ما تهتمّ به البلدية فعلياً، وتجمع المكتبة المصوَّرة أدناه 24 حالة من هذا القبيل، مع مشهد الكاميرا والصفحة التي تشرح كل واحدة منها.

يسدّ StreamVLM™ هذه الفجوة. يكتب المشغّل الحالة بلغة إنجليزية بسيطة، ويقيّم المحرّك لقطات الكاميرا الحية مقابل الطلب، وتُطلِق التطابقات تنبيهات لحظية مثل أي حدث آخر. وتدعم كل قناة كاميرا عدّة كاشفات قائمة على الطلب النصي في آن واحد، لكل منها عتبة ثقة وفترة تهدئة تنبيه ونوع حدث خاصة به.

StreamVLM™ مشمول في سعر IREX القياسي: لا يوجد ترخيص منفصل، ولا وحدة، ولا رسم اشتراك. والتكلفة الإضافية الوحيدة هي عقدة GPU محلية لاستدلال نموذج الرؤية واللغة (VLM) حيثما تتطلّبها عملية النشر.

مثال

شخص ساقط في محطة مترو

كاشف لم يدرّبه أحد

«نبّه عند استلقاء شخص على الأرض.» لا توجد مجموعة بيانات لأشخاص يسقطون على الأرصفة يمكن التدريب عليها، وجمع واحدة لن يكون عملياً ولا لائقاً. ونموذج الرؤية واللغة لا يحتاج إلى واحدة: فهو يفهم المشهد مسبقاً، لذا يكون الطلب النصي نفسه هو المواصفة.

رجل مستلقٍ على جنبه داخل كيس نوم مستنداً إلى جدار ممر ربط في محطة مترو، وبجانبه حقيبة سفر وحقيبة يد.
طلب واحد، فئة حدث واحدة. تُبلِغ المنصّة عن شخص على الأرض؛ أمّا حقيقة الأمر فيقرّرها المشغّل.

مكتبة حالات الاستخدام

24 حالة استخدام لـStreamVLM وتحليلات ذات صلة

استكشفوا 24 حالة محدَّدة بطلب نصي، لكل منها صورة كاميرا توضيحية وصفحة مخصّصة. ويكمّل مسار عمل مدرَّب متعلّق بالدرّاجات ذات العجلتين المكتبةَ المرئية.

كيف يختلف

محرّك واحد بدل وحدة لكل مشكلة

لا خط تدريب

لا جمع بيانات، ولا وسم، ولا نموذج خاص بكل حالة استخدام. الكاشف الجديد جملة واحدة، ويعمل منذ لحظة حفظه.

محرّك واحد، سيناريوهات غير محدودة

مُصمَّم ليحلّ محلّ عدّة وحدات قديمة ويوحّدها، منها كشف الحرائق، ومراقبة جودة الفيديو، وكشف العبث.

قابل للضبط لكل كاشف

تُضبَط عتبة الثقة وفترة تهدئة التنبيه ونوع الحدث كل على حدة، بحيث لا تُغرِق حالة كثيرة التنبيهات المشغّلَ.

مُسجَّل مثل كل شيء آخر

يُسجَّل كل طلب نصي، ولقطة مُحلَّلة، وتنبيه، وإجراء وكيل، مع الطابع الزمني، وهوية المشغّل، وCase ID، ضمن التحكّم في الوصول المستند إلى الأدوار (RBAC).

يغذّي البحث ولوحات المعلومات

تتدفّق أحداث StreamVLM إلى الأنماط الثلاثة نفسها التي تصل إليها الوحدات التقليدية: التنبيهات اللحظية، والتحقيقات في الأرشيف، وتصدير البيانات الضخمة.

تنطبق ضمانات الحدّ من التحيّز

يندرج الكاشف المحدَّد بطلب نصي ضمن إطار الأخلاقيات نفسه الذي تندرج ضمنه الوحدات المدرَّبة، بما في ذلك قاعدة القيود الضيّقة.

الأسئلة الشائعة

هل StreamVLM متاح على نسختنا؟

يعمل StreamVLM على عقدة GPU داخل نسخة العميل. ويُؤكَّد إدراج عملية نشر معيّنة ضمن النطاق مع هندسة IREX، لا بوعد مسبق.

هل يكلّف رسماً إضافياً؟

لا. StreamVLM مشمول في سعر IREX القياسي من دون ترخيص منفصل، أو وحدة، أو رسم اشتراك. وحيثما تحتاج عملية النشر إلى عقدة GPU محلية لاستدلال نموذج الرؤية واللغة، تُحدَّد سعة تلك العقدة وسعرها بالتنسيق مع هندسة IREX.

كم كاشفاً يمكن أن تشغّله كاميرا واحدة؟

عدّة كاشفات. تحمل قناة الكاميرا الواحدة عدّة كاشفات محدَّدة بطلب نصي في آن واحد، لكل منها عتبة ثقة وفترة تهدئة تنبيه ونوع حدث خاصة به. ولا تنشر IREX بعد حدّاً أقصى لكل كاميرا: فكيفية توسّع الكثافة تتوقّف على أجهزة العميل، وتُقاس على كاميراتكم الخاصة أثناء المشروع التجريبي.

هل يمكنه أن يحلّ محلّ وحدات التحليلات الحالية لدينا؟

هو مُصمَّم ليوحّد عدداً منها، بما في ذلك كشف الحرائق، ومراقبة جودة الفيديو، وكشف العبث. أمّا الكاشفات المدرَّبة العاملة بمعدّل إطارات مرتفع فتظلّ الأداة الصحيحة لتتبّع الأشخاص والمركبات بسرعة.

ما النموذج الذي يقف خلف StreamVLM، وما الذي يمكنه الوصول إليه؟

نموذج رؤية ولغة مفتوح الأوزان تنشره جهة خارجية، ويُستخدَم كما نُشِر: لا تُجري IREX عليه ضبطاً دقيقاً ولا تُغيِّر أوزانه، بل تُثبِّته بإصدار ومجموع تحقّق (checksum) محدَّدين، وتُشغِّله فقط على نقاط نهاية مخصَّصة داخل نسختكم، على عقدة GPU الخاصة بالنسخة ذاتها. ولا تغادر أي لقطة أو طلب أو حكم النسخةَ، ولا يُستخدَم أي استدلال سحابي من جهة خارجية على أي نسخة في أي منطقة. ولا يُجري النموذج أي استدعاءات أدوات، ولا يحتفظ بأي ذاكرة بين اللقطات، ولا يملك أي وصول إلى الأرشيف، أو قاعدة بيانات الأحداث، أو قوائم المراقبة، أو الكاميرات الأخرى، أو الشبكة، وليست له أي وظيفة بيومترية: فهو يحكم على المشاهد والحالات ولا يمكنه التعرّف على هوية شخص. ولا تنشر IREX هوية هذا النموذج؛ إذ يُفصَح عن هويته وإصداره ومجموع التحقّق الخاص به للعميل بموجب اتفاقية عدم إفصاح (NDA)، لأنّ تسمية النموذج علناً تشكّل سطح هجوم وحقيقة سرعان ما تتقادم. ويحدّد الجزء B من سياسة حوكمة نماذج الذكاء الاصطناعي العامة كل ذلك بالتفصيل.

أخبِرونا بما تحتاجون إلى رؤيته

اعرضوا الحالات التي تهتمّ بها مدينتكم فعلياً. فإذا استطاع طلب نصي وصفها، يمكننا عادةً أن نُريكم كاشفاً لها في المشروع التجريبي.

احجزوا عرضاً توضيحياً