जो कैमरे आपके पास पहले से हैं, उन्हीं पर ऑडियो एनालिटिक्स

एक कैमरा केवल वही देखता है जो फ्रेम में है। उसका माइक्रोफ़ोन पूरा कमरा सुनता है। AudioTrack उस ऑडियो स्ट्रीम को, जिसे कैमरा पहले से ले जाता है, चार इवेंट क्लास में बदल देता है, जिन पर किसी भी विज़ुअल पहचान की तरह अलर्ट और खोज होती है, बिना किसी ध्वनिक सेंसर, किसी ऐरे या किसी अतिरिक्त केबलिंग के।

मॉड्यूल

AudioTrack, कैमरा चैनल पर एक डिटेक्टर

AudioTrack किसी कैमरे की ऑडियो स्ट्रीम पर आने वाली ध्वनि को चार इवेंट प्रकारों में वर्गीकृत करता है: गनशॉट, काँच टूटना, चीख़, और तेज़ आवाज़। हर एक को अलग से चालू किया जाता है, अपनी अलग प्राथमिकता रखता है, और उसी इवेंट सूची, अलार्म मॉनिटर व आर्काइव में दर्ज होता है जिसमें उस कैमरे की हर विज़ुअल पहचान दर्ज होती है। यह अपने-आप में एक अलग मॉड्यूल नहीं बल्कि एक डिटेक्टर है, इसलिए यह चैनल पहले से जो भी चला रहा हो, उस पर परत की तरह जुड़ जाता है।

हार्डवेयर कैमरा ही है। माइक्रोफ़ोन वाला कोई भी कैमरा इसे चला सकता है: ऑडियो स्ट्रीम पर AAC, G.711 mu-law या PCM के रूप में पहुँचता है, ऑडियो स्ट्रीमिंग हर चैनल पर वैकल्पिक है, और ख़रीदने, लगाने, बिजली देने या बनाए रखने के लिए कोई अलग ध्वनिक सेंसर नहीं है। जिस कंट्रोल रूम के पास पहले से माइक्रोफ़ोन वाले कैमरे हैं, उसके पास पहले से एक ध्वनिक सेंसर नेटवर्क है। यह पृष्ठ इस बारे में है कि इसे वहाँ कैसे चालू करें जहाँ आवाज़ सुनने लायक़ हो।

आवाज़ वह भर देती है जो नज़र छोड़ देती है। एक खंभे के पीछे गनशॉट, ऐसे स्टोररूम में काँच टूटना जिससे कैमरे का मुँह दूसरी तरफ़ हो, फ़ील्ड ऑफ़ व्यू के किनारे किसी सीढ़ी-कक्ष में चीख़: इनमें से कोई भी फ्रेम में नहीं है, फिर भी सब सुनाई देते हैं। यही वजह है कि गनशॉट क्लास हथियार पहचान पृष्ठ पर भी है, GunTrack के साथ, उसी अलार्म को उठाने के तीन स्वतंत्र तरीक़ों में से दूसरे के रूप में।

चार क्लास

यह किसके लिए सुनता है

गनशॉट

वह इवेंट क्लास जो प्रतिक्रिया को सूचित करता है। यह उसी चैनल पर विज़ुअल हथियार पहचान के साथ चलता है, इसलिए फ्रेम के बाहर चलाया गया हथियार भी एक ऐसी आवाज़ है जो सुनी गई।

हथियार और गनशॉट पहचान देखें

काँच टूटना

कोई दुकान का अगला हिस्सा, स्टोररूम की खिड़की, डिस्प्ले केस, या फ़ोरकोर्ट में किसी वाहन की खिड़की। आवाज़ किसी के फ्रेम में आने से पहले पहुँचती है, और यही मुख्य बात है।

चीख़

कैमरे के दृश्य से बाहर, किसी गलियारे, सीढ़ी-कक्ष या प्लेटफ़ॉर्म छोर पर संकट में कोई व्यक्ति। फ्रेम, कैमरा और समय सत्यापन के लिए ऑपरेटर तक पहुँचते हैं।

तेज़ आवाज़

बाक़ी सब कुछ इसमें आता है। कोई भी तेज़ आवाज़ जिसे मॉड्यूल बाक़ी तीन में से कोई नहीं पहचान पाता, उसे छोड़ा नहीं बल्कि रिपोर्ट किया जाता है: कोई दरवाज़ा, गिरा हुआ पैलेट, या कुछ ऐसा जो किसी व्यक्ति के निर्णय के लिए एक कॉल लायक़ हो।

सेटअप

प्रति कैमरा तीन सेटिंग्स

ऑपरेटर जो कुछ भी सेट करता है वह कैमरे के Detectors टैब पर रहता है, और साइट-वाइड कुछ भी प्रशिक्षित या ट्यून नहीं किया जाता।

  1. 01

    जो क्लास चाहिए उन्हें चालू करें

    चारों इवेंट प्रकारों में से हर एक को अलग से टिक किया जाता है और अपनी प्राथमिकता दी जाती है। कोई रिटेल स्टोररूम शायद केवल काँच टूटना और तेज़ आवाज़ चला सकता है; कोई कैंपस गलियारा चारों चला सकता है।

  2. 02

    संवेदनशीलता सेट करें

    एक अकेला संवेदनशीलता स्लाइडर तय करता है कि उस कैमरे पर पृष्ठभूमि के शोर के मुक़ाबले कोई इवेंट कितना तेज़ होना चाहिए। यही वह सेटिंग है जिस पर पायलट सबसे ज़्यादा समय लगाता है, क्योंकि किसी शांत लॉबी में सही मान किसी स्टेशन कॉनकोर्स पर ग़लत हो जाता है।

  3. 03

    इवेंट को रूट करें

    परिणामी इवेंट कैमरे और प्रकार के अनुसार उन भूमिकाओं के अलार्म मॉनिटर तक सीमित किए जाते हैं जो उनके ज़िम्मेदार हैं, और फ्रेम व लोकेशन के साथ रियल-टाइम क्राइम सेंटर, डिस्पैच वर्कफ़्लो और Sover सुरक्षित मैसेंजर तक भेजे जाते हैं। इसके बाद वे किसी भी अन्य पहचान की तरह Additional events के तहत खोजे जा सकते हैं।

उपयुक्तता

यह कहाँ फिट बैठता है, और कहाँ नहीं

इस पर चलता है
माइक्रोफ़ोन वाला कोई भी जुड़ा हुआ कैमरा, जिसकी स्ट्रीम पर ऑडियो सक्षम हो। AAC की सिफ़ारिश की जाती है; G.711 mu-law और PCM भी समर्थित हैं। कोई अलग सेंसर हार्डवेयर नहीं।
कंप्यूट
गाइड इस मॉड्यूल की कम्प्यूटेशनल जटिलता को कम दर्जा देती है, इसलिए यह उसी चैनल पर पहले से विज़ुअल एनालिटिक्स चला रहे सर्वर पर बहुत कम अतिरिक्त भार डालता है।
इनके साथ जोड़ा जा सकता है
कई मॉड्यूल और डिटेक्टर एक ही कैमरे पर एक साथ चलते हैं। एक चैनल पर GunTrack के साथ AudioTrack सामान्य हथियार कॉन्फ़िगरेशन है; घुसपैठ पहचान या किसी StreamVLM™ प्रॉम्प्ट के साथ AudioTrack भी उतना ही मान्य है।
अनुशंसित नहीं
अंडरग्राउंड स्टेशन और रेलवे टर्मिनल जैसे शोरगुल वाले आउटडोर स्थान। लगातार बना रहने वाला परिवेशी शोर वह चीज़ है जिसके विरुद्ध संवेदनशीलता थ्रेशोल्ड को काम करना पड़ता है, और हम यह पायलट में साथ मिलकर पता लगाने के बजाय यहीं बता देना बेहतर समझते हैं।

हम क्या दावा नहीं करते

पायलट से पहले यह पढ़ें

  • IREX ध्वनिक पहचान के लिए कोई रेंज, सटीकता या लेटेंसी आँकड़ा प्रकाशित नहीं करता। प्रतिबद्धता वही है जो हर मॉड्यूल रखता है: पायलट के दौरान आपके अपने कैमरों पर, लिखित रूप से सहमत मानदंडों के विरुद्ध मापा गया, और मापी गई संख्याएँ अनुबंध में जाती हैं।
  • IREX किसी आवाज़ को स्थान-निर्धारित करने का दावा नहीं करता। माइक्रोफ़ोनों के बीच कोई ट्राइऐंगुलेशन नहीं है; इवेंट उस कैमरे को दर्ज करता है जिसने उसे सुना, इसलिए कवरेज किसी सेंसर ग्रिड के बजाय आपकी कैमरा योजना का अनुसरण करता है।
  • यह कोई स्पीच सिस्टम नहीं है। चारों क्लास ही पूरी शब्दावली हैं, और बाक़ी सब या तो Loud sound है या मौन।
  • पहचान किसी व्यक्ति के सत्यापन के लिए संकेत हैं। कुछ भी स्वायत्त रूप से प्रतिक्रिया नहीं करता, और IREX के उत्पाद स्पष्ट रूप से जीवन-सुरक्षा प्रणाली नहीं हैं।

यह कहाँ चलता है

वे एस्टेट जो सुनते हैं

वही चार क्लास, हर एस्टेट पर एक अलग वजह। ये वे वर्टिकल हैं जहाँ कैमरे का माइक्रोफ़ोन अपनी उपयोगिता साबित करता है।

FAQ

क्या हमें खंभों पर गनशॉट सेंसर चाहिए?

नहीं। AudioTrack माइक्रोफ़ोन वाले किसी भी कैमरे पर चलता है, इसलिए ख़रीदने, लगाने, बिजली देने या बनाए रखने के लिए कोई ध्वनिक ऐरे नहीं चाहिए, और कैमरों के साथ चलाने के लिए कोई अलग सेंसर नेटवर्क नहीं चाहिए। ऑडियो कैमरा स्ट्रीम पर AAC, G.711 mu-law, या PCM के रूप में पहुँचता है, और यह प्रति चैनल वैकल्पिक है, इसलिए आप इसे वहाँ चालू करते हैं जहाँ आवाज़ सुनने लायक़ हो और बाक़ी एस्टेट को जैसा है वैसा ही छोड़ देते हैं।

यह कितनी दूर तक सुन सकता है, और कितनी बार सही होता है?

IREX ध्वनिक पहचान के लिए कोई रेंज, सटीकता या लेटेंसी आँकड़ा प्रकाशित नहीं करता, और हम किसी वेबसाइट के लिए एक गढ़ने नहीं जा रहे। प्रतिबद्धता वही है जो विज़ुअल डिटेक्टर रखते हैं: हम इसे पायलट के दौरान आपके अपने कैमरों पर मापते हैं, पहले से लिखित रूप से सहमत मानदंडों के विरुद्ध, और मापी गई संख्याएँ अनुबंध में जाती हैं। पहचान कैमरे के माइक्रोफ़ोन से काम करती है, इसलिए कवरेज किसी सेंसर ग्रिड के बजाय आपकी कैमरा योजना का अनुसरण करता है।

क्या यह किसी व्यस्त सड़क या स्टेशन पर काम करेगा?

अंडरग्राउंड स्टेशन और रेलवे टर्मिनल जैसे शोरगुल वाले आउटडोर स्थानों में इसकी सिफ़ारिश नहीं की जाती, और हम यह किसी पायलट रिपोर्ट में नहीं बल्कि उत्पाद पृष्ठ पर ही बता देते हैं। संवेदनशीलता सेटिंग उस कैमरे के पृष्ठभूमि शोर के सापेक्ष होती है, इसलिए लगातार परिवेशी शोर वाले चैनल पर पृष्ठभूमि और किसी इवेंट के बीच बहुत कम जगह बचती है। इनडोर और अपेक्षाकृत शांत आउटडोर कैमरे ही इसके लिए सही जगह हैं।

क्या यह बातचीत रिकॉर्ड या समझता है?

नहीं। यह मॉड्यूल ध्वनि को चार इवेंट प्रकारों में वर्गीकृत करता है और बस इतना ही। यह भाषण को टेक्स्ट में नहीं बदलता और ऑडियो को किसी खोजने-योग्य टेक्स्ट रिकॉर्ड में नहीं बदलता। कोई भी तेज़ आवाज़ जिसे यह गनशॉट, काँच टूटना, या चीख़ के रूप में वर्गीकृत नहीं कर पाता, उसे बस Loud sound के रूप में रिपोर्ट किया जाता है।

क्या एक कैमरा ऑडियो और वीडियो एनालिटिक्स साथ चला सकता है?

हाँ, और यही सामान्य कॉन्फ़िगरेशन है। कई वीडियो एनालिटिक्स मॉड्यूल और डिटेक्टर एक ही कैमरे पर एक साथ चलते हैं, और AudioTrack एक डिटेक्टर है, इसलिए यह एक चैनल पर GunTrack, किसी परिधि नियम, या किसी StreamVLM™ प्रॉम्प्ट के साथ बैठता है। इस तरह दोनों एक-दूसरे को कवर करते हैं: फ्रेम के बाहर की घटना भी एक ऐसी आवाज़ है जो सुनी गई, और मौन घटना भी एक ऐसी वस्तु है जो देखी गई।

क्या यह अपने-आप चलता है या किसी को इसे देखना पड़ता है?

यह अपने-आप चलता है और किसी व्यक्ति को अलर्ट करता है। पहचान किसी इंसान के सत्यापन के लिए संकेत हैं: कोई भी प्रतिक्रिया स्वायत्त रूप से नहीं चलती, और सत्यापन व निर्णय उसी Case ID के तहत दर्ज होते हैं जिसके तहत पहचान दर्ज हुई थी।

जो माइक्रोफ़ोन आपके पास पहले से हैं, उन्हें चालू करें

उन कैमरों को चुनें जिनका मुँह परेशानी से दूर है। यही वे कैमरे हैं जिन्हें माइक्रोफ़ोन बदल देता है।