Posez une question en langage naturel — « retrouve la personne en pantalon blanc et pull rouge, près de l'entrée, vers midi » — et l'agent parcourt vos…
Agent custom · VLM + NLP
AI Video Search
Posez une question en langage naturel — « retrouve la personne en pantalon blanc et pull rouge, près de l'entrée, vers midi » — et l'agent parcourt vos enregistrements pour retrouver la personne, l'objet et le moment exacts.
Ce qu'il fait
Vos heures de vidéo, interrogeables en une phrase
Au lieu de visionner des heures d'enregistrement image par image, vous décrivez simplement ce que vous cherchez. L'agent comprend la description — vêtements, couleurs, objets, zone, plage horaire — et remonte les séquences correspondantes, classées par pertinence. La recherche se fait par apparence et par contexte, pas par identification biométrique.
Comment ça marche
Comment ça marche
1
Vous décrivez
Vous formulez votre recherche en langage naturel, comme une phrase normale.
2
L'agent comprend
Il interprète les attributs (couleurs, vêtements, objets), la zone et la plage horaire.
3
Il parcourt vos flux
L'agent balaie les enregistrements et repère les correspondances.
4
Il vous sort la séquence
Résultats classés par pertinence ; vous validez et exportez le clip ou l'instant.
Cas d'usage
Cas d'usage
Sécurité & enquête
Retrouver une personne ou reconstituer un incident à partir d'une simple description.
Objet perdu ou abandonné
Savoir quand et où un objet est apparu ou a disparu d'une zone.
Reconstitution de parcours
Suivre le cheminement d'une personne ou d'une scène sur une plage horaire.
Gain de temps massif
Remplacer des heures de visionnage manuel par une seule requête.
Sous le capot
La stack technique
Recherche vision-langage : les images sont encodées en représentations sémantiques (embeddings) mises en correspondance avec votre requête en langage naturel. Filtrage par attributs d'apparence, par zone et par horodatage. Traitement local sur la box, sur vos caméras existantes — sans identification biométrique par défaut.
Une requête en langage naturel, exécutée en local sur la box. L'agent encode la requête, la compare aux embeddings de vos flux et renvoie les séquences les plus pertinentes — horodatées et prêtes à exporter.
# Natural-language video search — runs locally on the AI MONITORING boxfrom aimonitoring import VideoSearch
agent = VideoSearch(source="dvr://site-01", local=True)
results = agent.find(
query="person in white trousers and a red sweater, near the entrance",
when="2026-06-12 11:30 → 12:30",
zones=["entrance", "counter"],
top_k=5,
)
for r in results: # ranked by relevanceprint(r.score, r.timestamp, r.camera, r.clip)
# 0.94 11:58:12 cam_02 clip_4f9c.mp4
Bénéfices
Ce que vous y gagnez
Des heures de recherche réduites à quelques secondes.
Recherche par description — sans connaître l'identité des personnes.
Fonctionne sur vos caméras existantes.
Traitement local, conforme par défaut.
Cet agent vous intéresse ?
AI Video Search est un exemple d'agent que nous concevons sur demande spéciale. Décrivez votre besoin : on vous montre ce qu'on peut construire pour vous.
Agent custom · VLM + NLP
AI Video Search
Ask in plain language — “find the person in white trousers and a red sweater, near the entrance, around noon” — and the agent searches your recordings to find the exact person, object and moment.
What it does
Hours of video, searchable in one sentence
Au lieu de visionner des heures d'enregistrement image par image, vous décrivez simplement ce que vous cherchez. L'agent comprend la description — vêtements, couleurs, objets, zone, plage horaire — et remonte les séquences correspondantes, classées par pertinence. La recherche se fait par apparence et par contexte, pas par identification biométrique.
How it works
How it works
1
You describe
You phrase your search in plain language, like a normal sentence.
2
The agent understands
It interprets the attributes (colours, clothing, objects), the zone and the time window.
3
It scans your streams
The agent sweeps the recordings and spots the matches.
4
It pulls up the clip
Results ranked by relevance; you confirm and export the clip or the moment.
Use cases
Use cases
Security & investigation
Find a person or reconstruct an incident from a simple description.
Lost or abandoned object
Know when and where an object appeared in or disappeared from a zone.
Path reconstruction
Follow the path of a person or a scene over a time window.
Massive time savings
Replace hours of manual review with a single query.
Under the hood
The technical stack
Recherche vision-langage : les images sont encodées en représentations sémantiques (embeddings) mises en correspondance avec votre requête en langage naturel. Filtrage par attributs d'apparence, par zone et par horodatage. Traitement local sur la box, sur vos caméras existantes — sans identification biométrique par défaut.
A natural-language query, executed locally on the box. The agent encodes the query, compares it against your streams' embeddings and returns the most relevant sequences — timestamped and ready to export.
# Natural-language video search — runs locally on the AI MONITORING boxfrom aimonitoring import VideoSearch
agent = VideoSearch(source="dvr://site-01", local=True)
results = agent.find(
query="person in white trousers and a red sweater, near the entrance",
when="2026-06-12 11:30 → 12:30",
zones=["entrance", "counter"],
top_k=5,
)
for r in results: # ranked by relevanceprint(r.score, r.timestamp, r.camera, r.clip)
# 0.94 11:58:12 cam_02 clip_4f9c.mp4
Bénéfices
What you gain
Hours of searching cut down to seconds.
Search by description — without knowing people's identity.
Works on your existing cameras.
Local processing, compliant by default.
Interested in this agent?
AI Video Search is an example of an agent we design on special request. Describe your need: we'll show you what we can build for you.