Andenes y vestíbulos
Señale a una persona tendida junto a un banco, en un pasillo o cerca del borde del andén. El personal de monitoreo puede abrir el video y decidir si hace falta una revisión de bienestar.
Una persona en el suelo de una estación, calle o edificio público puede necesitar ayuda. StreamVLM™ permite describir esa condición visible y recibir una imagen para revisarla.
La condición
La misma postura puede deberse a un asalto armado, una pelea callejera, una caída o una emergencia médica. Una persona también puede estar durmiendo o buscando refugio al aire libre. Una imagen no permite establecer la causa ni sus circunstancias. Sí puede indicar al operador que conviene comprobarla.
En StreamVLM™, un operador autorizado escribe una condición en inglés como «Detect anyone lying on the floor in the metro, day or night». El modelo de visión y lenguaje evalúa fotogramas seleccionados en vivo según esa instrucción. Una coincidencia genera un evento con imagen, cámara, ubicación y hora para su revisión, dentro del mismo flujo de alertas que otras analíticas de video de IREX.
StreamVLM™ funciona en un nodo GPU dentro de la instancia del cliente. El operador configura el umbral de confianza y el intervalo entre alertas de cada detector, y elige las cámaras donde esa condición resulta pertinente.
Conocer los detectores de StreamVLM →Dónde resulta útil
Señale a una persona tendida junto a un banco, en un pasillo o cerca del borde del andén. El personal de monitoreo puede abrir el video y decidir si hace falta una revisión de bienestar.
Centre la detección en vestíbulos, pasillos y entradas donde el personal no puede observar todas las cámaras continuamente. Ajuste la instrucción a los espacios y horarios pertinentes.
Entregue a los equipos municipales la cámara, ubicación y hora de una persona en el suelo. El equipo decide qué ocurre y qué servicio, si corresponde, debe intervenir.
Imágenes ilustrativas de cámaras
Estas escenas sintéticas de Estocolmo emplean la misma instrucción. Muestran por qué una coincidencia inicia una evaluación humana: no clasifica el incidente ni demuestra la precisión del detector.
Una persona está en el suelo del andén, con sus pertenencias cerca. El operador puede comprobar la vista en vivo y solicitar ayuda si hace falta.
La misma postura puede requerir apoyo social en vez de una respuesta de emergencia. El evento no etiqueta a la persona ni sus circunstancias.
La instrucción también puede coincidir con una pausa inofensiva. La selección de cámaras, los umbrales locales y la revisión humana mantienen útil la alerta.
De la instrucción a la acción
Escriba una instrucción para identificar a una persona tendida en el suelo. Después seleccione las cámaras y horarios donde conviene recibir el aviso. No deduzca la causa solo por la postura.
StreamVLM evalúa los fotogramas en vivo y envía la coincidencia al flujo de eventos de IREX. La alerta incluye imagen, cámara, ubicación y hora. Un operador abre el video y comprueba qué sucede.
El equipo autorizado puede pedir al personal del lugar que compruebe la situación, solicitar atención médica o cerrar una falsa alarma. Las acciones delicadas de investigación y evidencia siguen las reglas de funciones y número de expediente de IREX.
Ajuste operativo
No. Informa la condición visible descrita en la instrucción, como una persona tendida en el suelo. Un operador revisa la vista en vivo o el video y decide si corresponde una respuesta médica o de bienestar.
No. El detector no establece intención delictiva ni las circunstancias de una persona. La misma instrucción puede coincidir con alguien que se desplomó, duerme o descansa. El personal revisa el evento y aplica la política de bienestar del lugar.
Sí. Un canal de cámara puede ejecutar varias instrucciones de StreamVLM y otros módulos de IREX, según la capacidad del nodo GPU y las comprobaciones del piloto para cada cámara. Cada instrucción tiene su propio umbral, intervalo entre alertas y tipo de evento.
IREX no publica una cifra universal de precisión para esta instrucción. El ángulo de la cámara, la calidad de la imagen, la iluminación y la definición local de una alerta útil importan. El equipo mide los resultados con sus cámaras durante un piloto y según criterios acordados.
Siga explorando
Seleccione algunas vistas representativas de estaciones, edificios o calles. Podemos definir un piloto según la postura, el volumen de alertas y el flujo de respuesta que necesita su equipo.