Computer Vision & détection

Une caméra enregistre des pixels. Un agent IA exécute un modèle de détection et infère le contexte — c'est dans cette couche d'inférence que se trouve…

AM-VISION-01 · vision.perimeter

Une intelligence qui ne dort jamais.

Une caméra enregistre des pixels. Un agent IA exécute un modèle de détection et infère le contexte — c'est dans cette couche d'inférence que se trouve toute la valeur.

Code  AM-VISION-01Module  vision.perimeterExécution  Edge / sur site
Sous le capot · pipeline

De la trame RTSP à l'alerte qualifiée.

L'agent que nous packageons sous le nom commercial « agent sécurité » repose sur un pipeline edge déterministe : chaque flux est traité localement, image par image, jusqu'à l'évaluation des règles métier.

⚠ Extraits illustratifs et simplifiés. La configuration de production, les seuils de détection et la logique de décision sont calibrés par déploiement — propriété d'AI MONITORING, non publiés.
01·Source
RTSP
DVR/NVR · H.264
02·Détection
YOLO
classe person
03·Suivi
ByteTrack
ID intra-caméra
04·Règles
RuleEngine
zones × plages
05·Sortie
Notify
WhatsApp
zones_perimeter.jsonconfig · exemple
{
  "camera": "cam_03", "model": "yolo:person",
  "zones": [
    { "id": "reserve", "type": "interdite", "schedule": { "armed": "always" } },
    { "id": "entree",  "type": "hors_plage", "schedule": { "armed": "22:30-07:00" } }
  ],
  "min_confidence": 0.55,
  "ghost_seconds": 4          // persistance en secondes réelles
}
alert.jsonsortie · exemple
{
  "agent": "AM-VISION-01", "event": "presence_hors_plage",
  "camera": "cam_03", "zone": "entree",
  "ts": "2026-06-09T02:14:07+01:00", "confidence": 0.81,
  "snapshot": "evt/cam03_021407.jpg", "channel": "whatsapp"
}
Spécification

Architecture & confidentialité.

Entrée
Flux RTSP H.264/H.265 — DVR/NVR existant, multi-caméras
Détection
YOLO — classe person
Suivi
ByteTrack — ID temporaire, intra-caméra
Déclenchement
Zones (polygones) × plages horaires armées
Exécution
Edge / sur site — GPU NVIDIA RTX série 40
Sortie
Alerte WhatsApp — vignette, zone, horodatage
Données
Sur site · aucune vidéo en cloud · sans biométrie
Le défi

Des heures d'images.
Personne pour les regarder.

La majorité des systèmes de vidéosurveillance produisent chaque jour des heures d'enregistrements qu'aucune équipe n'a réellement le temps d'analyser. Les caméras voient tout. Mais personne ne regarde.

Lorsqu'un incident survient, les recherches commencent après les faits — une fois qu'il est déjà trop tard pour intervenir. La vidéo devient une preuve, jamais une alerte.

Pourquoi les approches classiques atteignent leurs limites

Détecter n'est pas comprendre.

La plupart des systèmes dits « intelligents » se contentent de détecter un mouvement ou une présence. Ils génèrent des alertes en masse — dont la quasi-totalité sont sans intérêt. Les équipes finissent par les ignorer, et le jour où survient la vraie alerte, elle se noie dans le bruit.

Le problème n'a jamais été de voir. Le problème est de comprendre ce qui mérite réellement une attention.

Notre approche

Une surveillance qui comprend votre réalité.

L'Agent Sécurité n'observe pas dans l'absolu. Il interprète chaque situation selon les règles propres à votre environnement — vos horaires, vos zones, votre activité.

Une présence à 10h du matin peut être parfaitement normale. La même présence à 3h du matin devient une alerte.
Une personne dans une zone publique est attendue. La même personne dans une zone restreinte devient un événement.
Ce que l'agent surveille

Une vigilance adaptée à chaque situation.

Présence hors horaires

Détection automatique d'activités en dehors des plages autorisées, avec des alertes adaptées.

Zones sensibles

Surveillance des espaces critiques : locaux techniques, réserves, accès restreints, zones stratégiques.

Intrusions

Détection des franchissements non autorisés, accès inhabituels et comportements anormaux.

Surveillance de nuit

Analyse continue des flux même lorsque les locaux sont fermés, sans intervention humaine.

Multi-sites

Supervision simultanée de plusieurs établissements depuis une seule plateforme.

L'ingénierie derrière le système

Détecter une personne est simple.
Produire une alerte pertinente est difficile.

La valeur d'un agent ne réside pas dans sa capacité à voir, mais dans sa capacité à comprendre ce qui compte. C'est là qu'intervient notre couche d'ingénierie — conçue, entraînée et réglée par nos ingénieurs sur votre terrain réel, pas en laboratoire.

01

Réduire les fausses alertes qui épuisent les équipes.

02

Filtrer les événements sans intérêt pour ne remonter que l'essentiel.

03

Adapter les règles à votre environnement et à votre activité.

04

Améliorer les performances en continu, au fil de l'usage.

Architecture & confidentialité

L'intelligence s'ajoute à l'existant.
Pas l'inverse.

Dans la majorité des cas, vos caméras restent en place, votre DVR reste en place, votre réseau reste en place. Nous ajoutons une couche d'intelligence à ce qui fonctionne déjà — sans remplacement, sans chantier lourd.

Lorsque cela est nécessaire, le traitement s'effectue localement, sur site : vos flux ne dépendent d'aucune infrastructure cloud externe, et vos données restent sous votre contrôle. L'agent est déployé et accompagné par une équipe d'ingénieurs basée à Casablanca.

Ce que vous y gagnez

Des résultats opérationnels, pas des fonctionnalités.

Temps

Moins de supervision

Fini les heures passées à consulter des enregistrements sans rien y trouver.

Réactivité

Réaction plus rapide

Les événements importants remontent immédiatement, au bon moment.

Contrôle

Meilleure visibilité

Une vision claire de ce qui se passe réellement sur vos sites.

Mise en œuvre

Déploiement rapide

Conservation maximale de l'infrastructure déjà en place.

Dans la durée

Le déploiement n'est pas la fin.
C'est le début.

L'agent progresse avec votre activité. Les règles, les scénarios et les comportements s'enrichissent au fil du temps. Notre relation commence à la mise en service — elle ne s'y arrête pas.

Vous pouvez commencer sur un périmètre limité, valider la valeur, puis étendre progressivement. C'est la manière la plus sûre d'adopter une intelligence opérationnelle sans risque.

Nous ne développons pas un système de vidéosurveillance. Nous développons un agent capable de comprendre les situations qui comptent réellement pour votre entreprise.

C'est cette différence qui transforme un système de sécurité en système d'intelligence opérationnelle.

Décrivez votre problématique de sécurité.

Nous concevrons l'agent capable d'y répondre — et si nous pensons qu'une autre approche est plus adaptée, nous vous le dirons franchement.

Du défi métier à l'intelligence opérationnelle.

Sous le capot — l'ingenierie de la vision

Une demonstration de vision par ordinateur se monte en une journee : un modele pre-entraine, une video d'exemple, des rectangles autour des personnes. Un systeme exploitable demande de traiter tout ce que la demonstration evite — la lumiere qui change, les reflets, les occlusions, la camera mal orientee, le flux qui saute des images, la personne immobile pendant vingt minutes. Notre travail porte sur cet ecart.

Perception & suivi

YOLOByteTrackReIDVLMRTSPONVIFCUDAEdge

La chaine comporte quatre etages, et chacun resout un probleme que le precedent ne peut pas resoudre. La detection localise personnes, vehicules ou objets dans chaque image : c'est l'etage le plus visible et le moins determinant, les modeles de la famille YOLO etant matures en conditions reelles.

Le suivi relie les detections dans le temps. Sans lui, on ne distingue pas une personne qui reste dix minutes d'un flux de dix passages. ByteTrack conserve les trajectoires meme quand la detection decroche brievement — derriere un presentoir, dans un contre-jour.

Le filtrage temporel est l'etage que la plupart des solutions negligent, et celui qui decide de la credibilite du systeme. Une presence n'est confirmee qu'apres une duree mesuree en secondes reelles : la cadence d'un flux RTSP varie selon la charge reseau, et un compteur indexe sur le nombre d'images derive des que le debit baisse. Le notre est indexe sur l'horloge.

La logique spatiale transforme une detection en evenement qui a du sens : zones d'interet, lignes de comptage directionnelles, perimetres interdits, plages horaires — definis site par site. Sur l'identite : la classification se fait par comportement et par zone, pas par identification des personnes. Le ReID reconnait la meme silhouette dans un meme champ sans constituer d'identite biometrique. La reconnaissance faciale n'est activee que dans un cadre legal strict, sur autorisation prealable de la CNDP.

Exploiter l'installation existante

RTSPONVIFEdgeGPUMulti-fluxRetention locale

L'architecture de reference est simple : cameras -> DVR/NVR -> box AI MONITORING -> IA locale -> tableau de bord et alertes. Le flux est lu, pas detourne ; votre enregistrement continue normalement. Le raccordement se fait en RJ45 filaire, jamais en Wi-Fi : un flux video continu sur un reseau sans fil decroche, et un decrochage produit des trous dans le comptage ou des alertes manquees.

Ce qui reste local : les videos, integralement. Ce qui peut remonter : les evenements, les compteurs, les alertes — quelques octets par evenement, pas des flux. Cette separation est ce qui rend le systeme utilisable en multi-sites sans cout de bande passante, et ce qui simplifie la conformite a la loi 09-08.

Questions frequentes

Faut-il changer nos cameras ?
Dans la grande majorite des cas, non. Si vos cameras exposent un flux RTSP ou ONVIF — ce qui est le cas de la quasi-totalite des installations IP — elles conviennent. Nous le verifions au diagnostic.
Faut-il remplacer notre installation (DVR, cablage) ?
Non. Le DVR reste en place, nous lisons le flux sans interferer avec l'enregistrement. Les cameras et le cablage restent egalement.
Les videos partent-elles dans le cloud ?
Non. Le traitement se fait sur une machine installee chez vous. Aucun flux complet n'est diffuse en permanence vers l'exterieur.
Que se passe-t-il si internet tombe ?
Le systeme continue de fonctionner : le traitement est local. Seule la remontee des alertes vers l'exterieur est interrompue, et reprend au retablissement.
Combien de cameras peut traiter une seule machine ?
Cela depend de la resolution, de la cadence et des traitements actives. Nous dimensionnons au cadrage, sur votre installation reelle — annoncer un nombre sans avoir vu les flux n'aurait aucun sens.
Peut-on commencer par une seule camera ?
Oui, et c'est meme ce que nous recommandons. On valide sur un point, on mesure, puis on etend.
Faites-vous de la reconnaissance faciale ?
Pas par defaut, et jamais sans cadre legal. C'est une capacite activee uniquement pour des clients disposant d'une autorisation CNDP prealable.
Est-ce conforme a la reglementation marocaine ?
Le traitement local et l'absence de biometrie par defaut simplifient considerablement la conformite a la loi 09-08. Nous documentons le traitement mis en place.
Combien de temps pour la mise en production ?
4 a 8 semaines entre le cadrage et la mise en production. Le nombre de cameras et la complexite des zones a definir sont les facteurs determinants — l'installation physique est courte, c'est le reglage qui fait la qualite.