Noticia Tecnología

La IA generativa llega a los VMS: búsqueda en lenguaje natural y nuevos sensores marcan 2026

Publicada el 09/10/2026

La IA generativa llega a los VMS con búsquedas en lenguaje natural, mientras nuevos sensores amplían las capacidades de detección y análisis.

Imagen de La IA generativa llega a los VMS: búsqueda en lenguaje natural y nuevos sensores marcan 2026

Durante años, buscar una grabación significó conocer primero qué cámara revisar, establecer un rango horario y posteriormente avanzar manualmente por horas de video o utilizar filtros previamente definidos.

La analítica cambió parte de ese trabajo permitiendo buscar personas, vehículos, colores, matrículas y otros atributos. En 2026 comenzó a consolidarse un paso adicional: describir con palabras lo que se quiere encontrar.

Consultas del tipo “camioneta blanca entrando al estacionamiento ayer en la tarde”, “persona con mochila cerca del acceso” o “hombre usando chaleco de seguridad” empiezan a formar parte de herramientas comerciales de investigación de video.

Pero no todas funcionan de la misma manera. Algunas utilizan modelos de lenguaje para interpretar la consulta y convertirla en una búsqueda sobre metadatos existentes. Otras incorporan modelos multimodales capaces de relacionar directamente una descripción con características visuales del video.

La diferencia técnica es importante, pero para el operador el cambio es evidente: la interfaz comienza a parecerse menos a un buscador de filtros y más a una conversación con el sistema de videovigilancia.

Milestone: búsqueda, resumen y análisis de video con IA

Milestone Systems anunció durante 2026 una nueva generación de herramientas de inteligencia artificial para su ecosistema XProtect, BriefCam y Arcules.

Una de ellas es AI Search, que permite describir mediante lenguaje natural aquello que se busca y obtener los fragmentos de video relacionados.

Milestone también anunció una versión local de esta capacidad mediante BriefCam, pensada para instalaciones donde el video o su procesamiento no pueden depender de Internet, incluyendo ambientes aislados o con mayores restricciones de seguridad.

En GSX 2026, realizado entre el 14 y el 16 de septiembre en Atlanta, la compañía mostró además la próxima generación de BriefCam. Entre sus capacidades anunciadas se encuentran:

  • búsqueda por descripción en lenguaje natural;
  • entrenamiento de modelos de detección adaptados a necesidades específicas;
  • configuración de alertas más precisas;
  • análisis de relaciones entre personas y objetos.

Es importante distinguir anuncio de disponibilidad. Milestone señaló que AI Search estará disponible hacia fines de 2026, por lo que lo presentado durante GSX corresponde en parte a una vista previa de la plataforma que viene.

La estrategia va además más allá de encontrar imágenes.

XProtect Video Summarization utiliza IA generativa para elaborar descripciones estructuradas de una grabación. Esto permite, por ejemplo, que un operador seleccione un clip y solicite un resumen de lo ocurrido sin tener que redactarlo manualmente.


La compañía también trabaja en anonimización automática de rostros y matrículas para facilitar la exportación de evidencia.

En la práctica, el flujo comienza a transformarse en:


Genetec: lenguaje natural sobre instalaciones de múltiples fabricantes

Genetec ya había presentado a comienzos de 2026 nuevas capacidades de investigación para Security Center SaaS.

Su búsqueda en lenguaje natural permite escribir consultas como:

  • “persona con polera roja cerca del área de carga alrededor de las 15:00”;
  • “camioneta blanca entrando al estacionamiento ayer por la tarde”;
  • “hombre con notebook”;
  • “vehículo de trabajo con una escalera”.

La arquitectura es especialmente interesante porque Security Center está orientado a instalaciones empresariales donde pueden coexistir múltiples marcas de cámaras y múltiples sitios.

Sin embargo, existe una precisión técnica importante.

En este caso, el lenguaje natural no significa necesariamente que un modelo generativo esté “mirando” nuevamente todas las grabaciones. Genetec utiliza modelos de lenguaje para interpretar la consulta y transformarla en una búsqueda que el sistema puede ejecutar utilizando los datos y metadatos disponibles.

Por eso las capacidades finales dependen también de la información entregada por las cámaras y sus analíticas.

Durante 2026 Genetec ha ido ampliando esta experiencia con:

  • búsqueda por lenguaje natural;
  • búsqueda por similitud;
  • detección de entrada y salida;
  • actividad cercana;
  • trayectorias visuales;
  • construcción de casos;
  • organización cronológica de evidencia;
  • resúmenes asistidos por IA.

Las actualizaciones posteriores incorporaron además retroalimentación sobre cómo el sistema interpretó una consulta, permitiendo al operador entender por qué determinadas palabras fueron aceptadas, reemplazadas o descartadas.

Esto es relevante porque uno de los problemas de los sistemas generativos es precisamente saber qué entendió la máquina de lo que escribió el operador.

Cloudlink 2210: nube, pero con almacenamiento local

Otro elemento relevante de la estrategia de Genetec es el Cloudlink 2210, un appliance administrado desde Security Center SaaS que permite mantener procesamiento y almacenamiento de video en terreno.

Puede configurarse con hasta 288 TB físicos y 240 TB utilizables, dependiendo del modelo, con RAID, cifrado AES-256 para datos almacenados, TLS 1.3 para comunicaciones, Secure Boot y TPM 2.0.

Esto representa una tendencia que probablemente veremos con mayor frecuencia: sistemas administrados desde la nube que no necesariamente obligan a almacenar todo el video en ella.

La arquitectura híbrida permite mantener grandes volúmenes de grabación local mientras determinadas funciones de administración, búsqueda e inteligencia se prestan desde servicios cloud.


Hanwha Vision: BLAZE incorpora búsqueda semántica

Hanwha Vision presentó durante ISC West 2026 BLAZE, su nuevo VMS híbrido.

La plataforma combina operación local con administración y federación mediante servicios cloud, pero uno de sus elementos más interesantes está en las funciones de investigación.

Semantic Search permite buscar utilizando lenguaje natural en lugar de limitarse a atributos predefinidos.

Un operador podría describir, por ejemplo:

“persona con el rostro cubierto y una mochila en el lobby”.

El sistema intenta encontrar objetos o eventos visualmente compatibles con la descripción.

Esta función utiliza IA generativa y está disponible en determinados appliances BLAZE de la serie P equipados para procesamiento de IA.

Hanwha también incorporó Similarity Search, que permite seleccionar una persona detectada y buscar apariciones visualmente similares en otras cámaras para reconstruir su desplazamiento.

En ese caso, el procesamiento utiliza vectores de características y puede realizarse localmente dentro de la infraestructura, algo especialmente relevante para instalaciones que buscan mantener control sobre sus datos.

Las nuevas cámaras basadas en Wisenet 9, el SoC desarrollado por Hanwha, complementan esta arquitectura proporcionando metadatos y analítica directamente desde el dispositivo.


Motorola Solutions: de entender el video a ejecutar una respuesta

Motorola Solutions tomó durante 2026 una dirección diferente.

Su propuesta no se concentra únicamente en encontrar una grabación, sino en utilizar IA para conectar detección, interpretación y respuesta.

Avigilon Visual Alerts permite definir mediante lenguaje natural situaciones que deben generar una alarma.

En lugar de limitarse a reglas tradicionales como cruce de línea o permanencia, el usuario puede describir condiciones más específicas, por ejemplo:

“vehículo no autorizado cerca de una válvula de cierre”.

La plataforma analiza las cámaras buscando ese escenario y genera una alerta cuando identifica una situación compatible.

Motorola también presentó Assist Chat, una interfaz basada en IA que permite consultar información del sistema y obtener contexto operacional.

Pero el salto más ambicioso es Operator, anteriormente denominado Inform.

Motorola lo presenta como una capa de “Agentic Response & Orchestration” capaz de reunir información proveniente de:

  • videovigilancia;
  • control de acceso;
  • sensores;
  • alarmas;
  • sistemas de comunicaciones.

La intención es que el sistema no solamente detecte un incidente, sino que pueda verificar información, consultar procedimientos y ejecutar o recomendar acciones posteriores.

En determinados escenarios demostrados por la compañía, Operator puede verificar una alarma utilizando cámaras o información de sistemas cercanos y posteriormente activar un procedimiento de respuesta.

La evolución conceptual es importante:

analítica tradicional: “detecté algo”.

IA generativa: “entiendo qué estás buscando”.

IA agéntica: “entiendo el incidente y puedo coordinar qué hacer después”.

Nuevas cámaras acompañan esta evolución

La inteligencia del VMS no sirve de mucho si los sensores siguen entregando información limitada.

Durante 2026 Axis presentó varios equipos que muestran cómo también está cambiando esa primera capa del sistema.

Una cámara visual y térmica en un solo equipo

La AXIS Q2802-E Bispectral Camera combina:

  • sensor térmico VGA;
  • sensor visual 4K;
  • fusión de imagen térmica y visible;
  • AXIS Object Analytics;
  • clasificación y seguimiento de objetos.

La lógica es particularmente útil en protección perimetral.

La cámara térmica puede detectar un objeto incluso en condiciones donde la imagen convencional es deficiente y posteriormente utilizar el sensor visual para verificarlo e identificar mejor lo observado.

No se trata simplemente de colocar dos cámaras dentro de una carcasa: el sistema puede utilizar ambas fuentes para entregar una representación combinada de la escena.

Obturador global para vehículos en movimiento

Axis también lanzó la AXIS P1486-LE Global Shutter Camera, diseñada especialmente para objetos de alta velocidad.

Un obturador global captura simultáneamente todo el sensor, evitando parte de las deformaciones producidas por los rolling shutter tradicionales cuando un vehículo se desplaza rápidamente.

La cámara entrega 3 MP hasta 60 imágenes por segundo y puede alcanzar hasta 270 imágenes por segundo utilizando resoluciones inferiores.

Además incorpora iluminación infrarroja continua y estroboscópica y está basada en ARTPEC-9.

Posteriormente Axis presentó kits específicos de reconocimiento de matrículas con AXIS License Plate Verifier instalado directamente en la cámara.

El modelo basado en P1486-LE está pensado para tránsito fluido y puede capturar matrículas de vehículos circulando hasta aproximadamente 130 km/h, cubriendo dos pistas, sin requerir un servidor externo para realizar el reconocimiento.

En condiciones adecuadas también puede identificar características como tipo, color, marca y modelo del vehículo.

Un radar cubriendo 40.000 metros cuadrados

En septiembre Axis anunció el AXIS D2124-VE Radar, uno de los sensores más interesantes presentados durante el año.

Ofrece cobertura de 360° y una zona de reconocimiento de personas que alcanza aproxim. 40.000 m².

Dependiendo de la posición de la persona respecto del radar, puede clasificar seres humanos a distancias de aproximadamente 100 a 140 metros. Para vehículos, la zona de detección puede extenderse entre 140 y 200 metros, dependiendo de condiciones como velocidad, dirección y terreno.

Dependiendo de la posición de la persona respecto del radar, puede clasificar seres humanos a distancias de 

El radar puede trabajar junto con una cámara PTZ AXIS Q6225-LE.

Cuando detecta un objeto, puede entregar sus coordenadas para que la PTZ lo siga automáticamente.

Además puede configurarse una verificación denominada double-knock: una alarma de radar debe ser confirmada mediante clasificación de video antes de generar el evento definitivo.

El objetivo es atacar uno de los problemas históricos de los grandes perímetros: reducir falsas alarmas sin obligar a un operador a revisar manualmente cada detección.

El D2124-VE fue anunciado para disponibilidad comercial durante el cuarto trimestre de 2026.

Dahua combina modelos de gran escala, radar y video

Dahua presentó durante Intertraffic Amsterdam 2026 la segunda generación de sus modelos Xinghan Large-Scale AI Model 2.0 para aplicaciones de transporte.

La arquitectura está dividida en tres familias:

V-Series: procesamiento centrado en visión.

M-Series: fusión multimodal.

L-Series: comprensión del lenguaje.

La propuesta busca combinar video en tiempo real, información de tránsito y otras fuentes de datos para detectar accidentes, congestión e infracciones y posteriormente apoyar la planificación de una respuesta.

Dahua también presentó VRF 2.0, una tecnología que fusiona información de radar y video a nivel de características.

Según el fabricante, esta arquitectura busca resolver situaciones difíciles para cualquiera de los sensores por separado, como vehículos lentos o detenidos, superposición de velocidades o errores de clasificación generados por vehículos grandes.

La compañía afirma que esta tecnología puede elevar la precisión de velocidad de un radar individual desde 98% hasta 99,9%, además de reducir el proceso de calibración desde aproximadamente 30 minutos a menos de cinco.

Entre los equipos presentados aparece Bisight Pro, que combina radar y video para vigilancia de tránsito, además de soluciones para carreteras, estacionamientos y fiscalización móvil.

El cambio importante no es solamente la IA

Miradas por separado, estas novedades pueden parecer simplemente una nueva generación de productos.

En conjunto muestran un cambio más profundo en la arquitectura de la videovigilancia.

El VMS deja progresivamente de ser solamente el software que muestra y graba cámaras.

Comienza a convertirse en el lugar donde se interpreta información proveniente de distintos sensores.

Qué significa para las centrales de monitoreo en Chile

Para una pequeña instalación con diez cámaras, buscar manualmente una grabación todavía puede ser razonable.

El problema cambia completamente cuando una municipalidad, minera, centro logístico, casino, aeropuerto o empresa opera cientos o miles de cámaras.

Ninguna organización puede aumentar operadores en la misma proporción en que aumenta sus sensores.

Ahí estas tecnologías tienen sentido: reducir la cantidad de video que una persona debe revisar para encontrar información útil.

Pero la capacidad de preguntarle cosas al sistema también introduce nuevas preguntas técnicas que antes tenían menor importancia.

Al evaluar una plataforma será necesario conocer, entre otros aspectos:

  • dónde se procesa el video;
  • si la búsqueda ocurre localmente, en el borde o en la nube;
  • qué información o metadatos abandonan la instalación;
  • qué proveedores intervienen en el procesamiento;
  • qué información conserva el sistema sobre consultas realizadas;
  • qué usuarios pueden ejecutar búsquedas;
  • qué controles existen sobre la utilización de esas funciones;
  • cómo se gestionan transferencias internacionales de datos;
  • qué ocurre con los modelos y servicios cuando se pierde conectividad.

En Chile estas preguntas adquieren todavía mayor relevancia con la entrada en vigencia de la Ley N.º 21.719 el 1 de diciembre de 2026.

La nueva normativa modifica profundamente el régimen de protección de datos personales, establece nuevas obligaciones para responsables y encargados y regula expresamente las transferencias internacionales.

Además, exige una evaluación de impacto en protección de datos personales cuando exista un tratamiento de alto riesgo y específicamente cuando se realice observación o monitoreo sistemático de zonas de acceso público.

Eso toca directamente a una parte importante de los proyectos de videovigilancia municipal y urbana.

Por lo tanto, el debate ya no será solamente qué sistema encuentra más rápido a una persona con chaqueta roja.

También será necesario saber cómo lo encuentra, dónde procesa esa información y quién puede utilizar esa capacidad.

Fuentes

Milestone Systems — AI built for Security Operations

SecurityInfoWatch — Milestone previews next-generation BriefCam at GSX 2026

Genetec — Security Center SaaS investigation capabilities

Genetec — Natural language search documentation

Genetec — Security Center SaaS 2026 updates / Cloudlink 2210

Hanwha Vision — BLAZE Hybrid AI VMS

Motorola Solutions — ISC West 2026 / Operator, Visual Alerts y Assist Chat

Axis Communications — AXIS D2124-VE Radar

Axis Communications — AXIS Q2802-E Bispectral Camera

Axis Communications — LPR Camera Kits

Dahua — Xinghan 2.0 y VRF 2.0 en Intertraffic Amsterdam 2026

Biblioteca del Congreso Nacional — Ley N.º 21.719