Aller au contenu principal
Edge AI et stockage local : les caméras de surveillance qui coupent le cordon avec le cloud [Sponso]
OutilsNumerama · 1 min de lecture

Edge AI et stockage local : les caméras de surveillance qui coupent le cordon avec le cloud [Sponso]

Source originale ↗·

Les caméras de surveillance connectées connaissent une adoption massive dans les foyers et entreprises, mais elles dissimulent un compromis fondamental : pour accéder à leurs fonctionnalités avancées, détection de mouvement, alertes intelligentes, reconnaissance de personnes, la quasi-totalité des modèles exige que les flux vidéo soient envoyés vers des serveurs distants. Reolink, fabricant spécialisé dans la vidéosurveillance connectée, propose une alternative architecturale en embarquant le traitement directement dans la caméra, couplé à un stockage local sur carte SD ou NAS.

Cette approche, dite Edge AI, change concrètement la donne pour les utilisateurs soucieux de leur vie privée et de leur souveraineté numérique. Les données ne quittent jamais le domicile ou les locaux de l'entreprise, supprimant le risque de fuite lors d'une violation côté cloud ou d'un changement brutal de politique tarifaire de l'éditeur. L'indépendance vis-à-vis d'un abonnement mensuel représente aussi un argument économique réel sur la durée, les services cloud de surveillance pouvant atteindre plusieurs dizaines d'euros par an et par caméra.

La dépendance au cloud dans la vidéosurveillance grand public s'est imposée progressivement comme modèle dominant, portée par Nest (Google), Ring (Amazon) ou Arlo, qui y trouvent un levier de revenus récurrents. Face aux inquiétudes croissantes sur la protection des données personnelles et aux discussions réglementaires européennes autour du RGPD, le modèle local regagne en légitimité. L'embarquement de puces d'inférence IA directement dans les appareils ouvre la voie à des caméras pleinement autonomes, capables d'analyse intelligente sans dépendance réseau permanente.

Impact France/UE

Le modèle Edge AI répond directement aux exigences du RGPD en maintenant les données vidéo sur site, réduisant la dépendance aux services cloud soumis à des législations extraterritoriales.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Agent de surveillance de marché avec LangGraph et Strands sur AgentCore
1AWS ML Blog 

Agent de surveillance de marché avec LangGraph et Strands sur AgentCore

Traduction en cours de l'article sur l'agent de surveillance de marché combinant LangGraph et Strands. Amazon Web Services a publié un article technique détaillant la construction d'un agent de surveillance des marchés financiers combinant deux frameworks complémentaires : LangGraph, pour l'orchestration des workflows multi-agents, et Strands Agents, pour le raisonnement au sein de chaque nœud du système. La solution s'appuie sur Amazon Bedrock AgentCore, lancé l'année dernière, pour le déploiement en production à grande échelle. L'agent principal, baptisé securitymonitor, utilise un modèle Claude via Bedrock (avec un budget de réflexion de 8 000 tokens et une fenêtre de sortie de 16 000 tokens) et s'appuie sur trois outils spécialisés : getreportlist pour lister les rapports disponibles, getreportschema pour charger leur structure, et runreport pour exécuter des requêtes SQL avec des paramètres validés. Le code complet du projet est disponible sur GitHub. Ce choix architectural répond à un problème concret du secteur financier : les systèmes de surveillance des marchés doivent coordonner plusieurs agents spécialisés pour analyser des schémas de trading, enquêter sur des activités suspectes et produire des rapports de conformité, tout en respectant des exigences strictes de fiabilité et de traçabilité. En séparant volontairement la découverte des données de leur récupération, les concepteurs cherchent à limiter deux risques majeurs des agents autonomes : les hallucinations, lorsque le modèle invente des informations, et les attaques par injection, lorsqu'un contenu malveillant détourne le comportement de l'agent. Pour les institutions financières comme pour d'autres secteurs réglementés, cette approche illustre comment rendre des agents IA suffisamment robustes et auditables pour un usage en production réelle, et non plus seulement en démonstration. Cette publication s'inscrit dans une évolution plus large de l'IA générative, qui passe de simples chatbots conversationnels à des systèmes autonomes capables de gérer des processus métier complexes. LangGraph apporte ici un contrôle fin sur l'état partagé entre agents, avec un système de points de contrôle (checkpoints) qui permet de reprendre un workflow après une panne et d'intégrer une supervision humaine lorsque nécessaire. Strands, de son côté, reste agnostique vis-à-vis du fournisseur de modèle et gère la mémoire conversationnelle pour éviter la saturation du contexte. L'arrivée d'Amazon Bedrock AgentCore vise justement à simplifier la mise en production de ce type d'architecture multi-agents, en fournissant l'infrastructure d'observabilité et de fiabilité que les entreprises réclament avant de déployer des agents autonomes sur des cas d'usage sensibles comme la conformité financière.

OutilsTuto
1 source
L'auto-surveillance de l'inférence pour les endpoints Amazon SageMaker AI avec Amazon Quick
2AWS ML Blog 

L'auto-surveillance de l'inférence pour les endpoints Amazon SageMaker AI avec Amazon Quick

AWS a publié une nouvelle architecture de référence pour la surveillance des modèles de machine learning en production, baptisée "méta-surveillance de l'inférence", conçue pour les endpoints Amazon SageMaker AI et pilotée via Amazon Quick. Le projet est disponible en open source sur GitHub, dans le dépôt sample-mlops-bestpractices, version v2.0.0, et s'installe via un modèle CloudFormation qui crée automatiquement le VPC, les sous-réseaux, un domaine SageMaker AI, un profil utilisateur et un espace JupyterLab. L'architecture combine des services managés AWS, Amazon SageMaker AI, Amazon Athena, AWS Lambda, Amazon EventBridge et Amazon Quick, avec des outils open source comme MLflow, via les SageMaker AI MLflow Apps, et Evidently AI pour la détection de dérive des données. Le système s'appuie sur cinq tables Iceberg dans Athena formant un data lake central. L'une, trainingdata, contient les 80% de données utilisées pour entraîner le modèle. L'autre, evaluationdata, conserve les 20% restants comme référence gelée servant à mesurer la dérive de chaque modèle enregistré, et non l'ensemble d'entraînement lui même. Les deux tables sont alimentées à partir du même fichier CSV de prédictions via une étape unique appliquant un découpage déterministe par hachage des transactions. Le pipeline d'entraînement, documenté dans le notebook 1trainingpipeline.ipynb, télécharge un jeu de données de détection de fraude bancaire depuis Kaggle et trace les expériences via MLflow. Cette solution répond à un angle mort classique du machine learning en production : sans mécanisme de suivi continu, les entreprises ne découvrent la dégradation de leurs modèles que lorsque les clients se plaignent ou lors de vérifications ponctuelles, ce qui abîme la confiance. Concrètement, les équipes anti-fraude voient les faux positifs grimper, les analystes de crédit laissent passer des dossiers qui auraient dû être signalés, et les planificateurs se retrouvent avec des stocks excédentaires à cause de prévisions de demande faussées. En superposant une couche de gouvernance au dessus des pipelines d'inférence, avec détection de dérive, intégration de données de vérité terrain différées et tableaux de bord automatisés, les équipes ML peuvent repérer un problème de qualité dès son apparition plutôt que des semaines plus tard, et agir avant que l'impact commercial ne devienne visible pour les clients. Cette initiative illustre un défi plus large de l'industrie : entraîner un modèle prédictif fiable, pour la détection de fraude, le scoring de crédit ou la prévision de la demande, mobilise souvent des mois de travail, mais rien ne garantit que ses performances restent stables une fois déployé. AWS propose ici un gabarit reproductible mêlant outils managés et open source, que les équipes peuvent adapter à leur propre domaine SageMaker en modifiant simplement un fichier de configuration .env, avant d'exécuter les notebooks fournis dans l'ordre pour reproduire l'ensemble du pipeline entraînement, inférence, surveillance.

OutilsOutil
1 source
Baidu lance GenFlow 4.0 et améliore ses agents de stockage cloud et de bureautique
3Pandaily 

Baidu lance GenFlow 4.0 et améliore ses agents de stockage cloud et de bureautique

Le 27 avril, Baidu a présenté GenFlow 4.0 lors de son événement AI Day, une mise à jour majeure de son système d'agents IA généraliste. Cette nouvelle version est désormais disponible sur les versions PC et mobile de Baidu Netdisk, le service de stockage cloud de l'entreprise, et intègre des agents spécialisés pour les tâches bureautiques sur PowerPoint, Excel et Word. Les utilisateurs peuvent lancer une tâche depuis leur mobile et la faire exécuter sur PC, créant ainsi des flux de travail multi-appareils fluides. Depuis son lancement initial en avril 2025, GenFlow a atteint 100 millions d'utilisateurs actifs mensuels et 200 millions d'exécutions de tâches par mois. La version 4.0 améliore particulièrement la reconnaissance d'intention, la décomposition de tâches complexes, la coordination entre outils et la restitution des résultats. En pratique, GenFlow 4.0 permet des enchaînements bureautiques complets : analyser des données dans Excel, générer automatiquement une présentation PowerPoint à partir des résultats, puis compiler un rapport Word, le tout sans intervention manuelle entre chaque étape. Le système s'étend également à l'édition vidéo, à la gestion de photos et aux usages pédagogiques, en exploitant les fichiers déjà stockés dans le cloud. Pour renforcer la sécurité des données, Baidu introduit une fonctionnalité "espace de travail" qui limite l'accès de l'IA aux seuls fichiers autorisés. Côté entreprise, une fonctionnalité "Team Space" permet la collaboration multi-utilisateurs et la gestion de tâches par agents, déjà adoptée par plus de 10 000 organisations. Cette annonce s'inscrit dans la course acharnée que se livrent les géants technologiques chinois pour intégrer l'IA agentique dans leurs écosystèmes productifs. Baidu, qui doit faire face à une concurrence accrue d'Alibaba, Tencent et de nouveaux acteurs comme DeepSeek, mise sur Netdisk comme point d'ancrage stratégique pour déployer ses agents au quotidien. L'intégration directe dans un service de stockage à 100 millions d'utilisateurs actifs constitue un levier de diffusion considérable, et la direction prise vers l'automatisation de tâches complexes multi-applications pourrait redéfinir les standards attendus des assistants IA en milieu professionnel.

OutilsOutil
1 source
OpenAI lance ChatGPT Work, un agent IA cloud qui gère les tâches sur email, Slack et calendriers
4VentureBeat AI 

OpenAI lance ChatGPT Work, un agent IA cloud qui gère les tâches sur email, Slack et calendriers

OpenAI a lancé jeudi ChatGPT Work, un nouvel agent intégré à son chatbot phare, alimenté par son dernier modèle, GPT-5.6. L'outil vise à transformer ChatGPT d'un simple outil de questions-réponses en une plateforme de travail autonome capable d'exécuter des tâches complexes et multi-étapes directement dans les e-mails, calendriers, dépôts de code et messageries des utilisateurs. Ty Geri, chef de produit chez OpenAI ayant contribué au développement de ChatGPT Work, a expliqué que l'agent puise le contexte dans les applications, fichiers et flux de travail connectés pour produire des documents, tableurs, présentations, rapports et sites web finalisés. À partir d'un objectif donné, il découpe la tâche en étapes et peut travailler seul pendant des heures sur des projets complexes. Le déploiement commence avec les abonnés Pro, Enterprise et Edu, avant de s'étendre dans les prochains jours aux utilisateurs Plus et Business. Le cœur technique du produit repose sur une machine virtuelle persistante hébergée dans le cloud d'OpenAI, accessible en permanence depuis n'importe quel appareil, y compris sur mobile. Cette annonce marque la tentative la plus nette d'OpenAI de repositionner ChatGPT comme plateforme professionnelle plutôt que comme simple agent conversationnel. Selon Geri, l'objectif est de démocratiser les capacités agentiques déjà démontrées en interne par Codex, l'outil d'ingénierie d'OpenAI, dont l'adoption suit une courbe exponentielle dans toutes les fonctions de l'entreprise. Fait notable, cette technologie n'est pas réservée aux abonnements les plus chers : elle est disponible dès l'offre Plus, ce que Geri présente comme une prouesse conforme à la mission d'OpenAI de rendre cette puissance accessible au plus grand nombre. L'approche mobile constitue aussi une nouveauté sur le marché, avec la possibilité de créer un site web depuis son téléphone et de le partager instantanément avec des collaborateurs. Sur le plan technique, ChatGPT Work s'appuie sur des plugins basés sur le protocole MCP (Model Context Protocol) pour se connecter à Gmail, Google Calendar, Slack et GitHub, et la prise en charge de plusieurs comptes Gmail simultanés figure déjà sur la feuille de route. Ce lancement intervient à un moment charnière pour OpenAI, qui a déposé le mois dernier un dossier confidentiel d'introduction en bourse auprès de la SEC, avec une valorisation estimée entre 730 et 852 milliards de dollars et un chiffre d'affaires annualisé dépassant désormais les 25 milliards de dollars. Face à des concurrents dont les agents dépendent d'une machine locale allumée et connectée, OpenAI mise sur une infrastructure cloud toujours disponible pour asseoir son avance dans la course à l'IA agentique en entreprise.

💬 OpenAI ne lance pas juste une feature, il déplace ChatGPT du chat vers l'agent qui bosse tout seul pendant des heures dans ta boîte mail et ton Slack. Ce qui change vraiment, c'est le prix : cette capacité arrive dès l'abonnement Plus, pas réservée aux comptes Enterprise, et ça c'est une vraie rupture de stratégie face à Google ou Microsoft qui verrouillent ce genre d'outil derrière des licences pro. Reste à voir si une VM cloud "toujours allumée" tient ses promesses sur des tâches multi-étapes réelles, parce que sur le papier c'est bluffant, mais l'agentique a déjà déçu plus d'une fois en prod.

OutilsOutil
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic