DIDOES ITEndpoint Engineering← Tous les articles

Technologie IT / Inside Endpoint

Delivery Optimization et Microsoft Connected Cache : architecture, dimensionnement et validation

Delivery Optimization ne se résume pas à du peer-to-peer. Le client peut combiner CDN, Microsoft Connected Cache et pairs, vérifier chaque bloc puis choisir dynamiquement la source. Je conçois le service à partir des frontières réseau et de mesures réelles.

À propos des exemples

Je publie les diagnostics en niveau 1 et les exemples de remédiation au minimum en niveau 2. Ils restent pédagogiques, non testés et ne doivent pas être utilisés tels quels. Avant tout essai réel, adaptez-les au contexte, utilisez la simulation quand elle existe et validez le rollback sur un pilote représentatif.

01

L’essentiel

Delivery Optimization coordonne plusieurs sources : CDN d’origine, cache connecté et pairs éligibles. Les blocs reçus sont vérifiés cryptographiquement avant utilisation ; le pair ne devient pas une source de confiance arbitraire.

Le download mode et le group ID définissent la portée du peering. Le port TCP 7680 sert aux échanges entre pairs, tandis que l’accès aux services cloud DO reste indispensable pour la coordination.

Connected Cache rapproche les contenus Microsoft des sites et complète les pairs. Son état Healthy prouve la communication du conteneur avec le service DO, pas nécessairement que les clients utilisent efficacement le cache.

Delivery Optimization coordonne plusieurs sources : CDN d’origine, cache connecté et pairs éligibles. Les blocs reçus sont vérifiés cryptographiquement avant utilisation ; le pair ne devient pas une source de confiance arbitraire.
02

Pourquoi cette technologie existe

Le client DO peut télécharger en parallèle depuis HTTP/CDN, MCC et pairs. Le service cloud coordonne la découverte et la disponibilité ; bloquer ses endpoints peut provoquer un mode de fallback et annuler le peering attendu.

Le mode LAN limite les pairs au réseau local déduit par le service. Le mode Group utilise un identifiant de groupe pour représenter une frontière métier ou réseau. Internet peering et bypass doivent être décidés selon sécurité et mobilité.

Je définis l’objectif opérationnel avant de choisir le profil ou l’outil. Cette discipline sépare le besoin de sécurité, l’expérience utilisateur, l’autorité de gestion et la preuve attendue. Elle évite aussi qu’un paramètre soit activé uniquement parce qu’il apparaît dans la console.

Je compare toujours l’intention cloud, l’applicabilité, l’état reçu par Windows et le résultat réellement observé. Une affectation réussie, un état vert ou une requête HTTP acceptée ne prouve pas à lui seul que tout le parcours fonctionne.

Pour expliquer « Delivery Optimization et Connected Cache », je commence par le besoin auquel la technologie répond, puis je sépare le plan de contrôle, le transport, les composants locaux, les états persistés et les données de résultat. Cette lecture évite d’attribuer au portail une décision prise par Windows ou à l’agent une limitation du service cloud.

Je distingue les interfaces supportées des détails internes observables. Les journaux, tâches et clés de registre aident à comprendre le fonctionnement, mais ils ne deviennent pas automatiquement des contrats stables sur lesquels bâtir une automatisation durable.

Enfin, je relie la théorie au cycle réel : déclenchement, traitement, résultat, nouvelle évaluation et comportement en cas de dérive. L’objectif est de comprendre ce qui se passe, pas seulement de reproduire une configuration.

Je qualifie la nature de chaque état : intention envoyée, valeur effective, inventaire, conformité, télémétrie ou simple cache d’affichage. Ces données n’ont ni la même fraîcheur ni la même autorité. Un résultat cohérent suppose de connaître qui produit l’information, à quel moment, dans quel contexte et selon quel mécanisme elle revient au service.

Je replace aussi la technologie dans son environnement. Les identités, certificats, licences, services réseau, versions clientes et autres outils de gestion peuvent modifier son comportement sans appartenir directement à son moteur. Cette frontière permet de distinguer une limitation intrinsèque d’une dépendance absente ou d’un conflit d’architecture.

Quand une observation terrain complète la documentation, je la présente comme un indice et non comme une garantie de support. Les noms de tâches, fichiers, événements ou rythmes internes peuvent changer. Je m’appuie sur eux pour expliquer et diagnostiquer, tandis que les décisions de conception reposent sur les interfaces et comportements officiellement documentés.

  • À comprendre : comprendre l’architecture, les dépendances et les limites
  • À comprendre : mettre en œuvre un pilote mesurable et reproductible
  • À comprendre : construire un diagnostic et un rollback utilisables par l’exploitation
  • Périmètre étudié : Delivery Optimization, Microsoft Connected Cache, Windows Update, Intune
  • Périmètre étudié : postes Windows gérés et services Microsoft officiellement documentés
  • Périmètre étudié : validation en laboratoire puis pilote représentatif avant généralisation
03

Architecture, composants et flux de données

Le client DO peut télécharger en parallèle depuis HTTP/CDN, MCC et pairs. Le service cloud coordonne la découverte et la disponibilité ; bloquer ses endpoints peut provoquer un mode de fallback et annuler le peering attendu.

Le mode LAN limite les pairs au réseau local déduit par le service. Le mode Group utilise un identifiant de groupe pour représenter une frontière métier ou réseau. Internet peering et bypass doivent être décidés selon sécurité et mobilité.

Le port TCP 7680 doit fonctionner entre pairs dans la portée prévue. L’ouverture globale entre tous les sites n’est pas une exigence : je respecte segmentation et pare-feu puis teste les chemins nécessaires.

FLUXChaîne fonctionnelle — Delivery Optimization et Connected Cache
  1. CDNSource Microsoft d’origine et fallback.
  2. MCCCache connecté proche des clients.
  3. PeersPartagent les blocs dans la frontière définie.
  4. Client DOSélectionne, vérifie et assemble.

Chaque étape doit produire sa propre preuve. Un succès en amont ne garantit pas que les étapes suivantes ont terminé leur traitement.

04

Prérequis, compatibilité et limites de support

Je sépare les prérequis nécessaires à l’existence de la fonction de ceux qui ne concernent qu’un scénario d’administration. La présence d’une option dans une console ne prouve ni la prise en charge de la version cliente, ni l’éligibilité de la licence.

Les builds, éditions, rôles, dépendances réseau et contextes d’exécution doivent être confirmés avant d’interpréter un comportement. Les éléments internes observés mais non documentés comme interfaces publiques sont explicitement traités comme tels.

  • cartographie WAN/LAN/VPN
  • flux DO cloud autorisés
  • TCP 7680 selon segmentation
  • download mode et group ID définis
  • capacité disque/cache
  • contenu de test compatible
  • métriques avant/après
05

Cycle de fonctionnement, étape par étape

Cette séquence décrit ce que font les différents composants, depuis le déclenchement jusqu’au résultat. Elle sert de modèle mental : selon le scénario, certaines étapes peuvent être asynchrones ou exécutées dans un autre contexte.

Je distingue l’action demandée, son transport, son traitement local et son accusé de résultat. Cette distinction explique pourquoi deux écrans peuvent afficher temporairement des états différents sans qu’il y ait nécessairement une panne.

PROCÉDURECycle d’exécution observé
  1. 01Établir l’état initial
    Emplacement
    Portails Microsoft et poste témoin
    Commande / configuration
    Mesurer la bande passante de référence.
    Résultat attendu
    Les versions, identités, affectations, autorités et écarts sont documentés.
    Vérification
    Comparer l’inventaire local, les portails et les sources techniques.
    Impact
    Lecture seule.
    Retour arrière
    Aucun.
  2. 02Configurer le pilote
    Emplacement
    Groupe, profil ou service pilote
    Commande / configuration
    Déployer DO à un site pilote.
    Résultat attendu
    Une configuration unique et bornée est appliquée à une audience stable.
    Vérification
    Relire les inclusions, exclusions, filtres, licences et permissions.
    Impact
    Impact limité au pilote.
    Retour arrière
    Retirer l’affectation et restaurer l’état précédent.
  3. 03Observer le parcours complet
    Emplacement
    Rapports cloud et journaux locaux
    Commande / configuration
    Tester deux appareils avec contenu identique.
    Résultat attendu
    Chaque couche produit une preuve datée et les écarts sont expliqués.
    Vérification
    Rejouer le scénario nominal et au moins un cas négatif.
    Impact
    Collecte de preuves minimisées.
    Retour arrière
    Aucun pour la collecte.
  4. 04Décider la vague suivante
    Emplacement
    Dossier de changement et runbook
    Commande / configuration
    Valider MCC et sources sur clients.
    Résultat attendu
    Les critères GO sont atteints ou le changement reste explicitement en NO-GO.
    Vérification
    Contrôler les KPI, les incidents, le support et le rollback.
    Impact
    Extension contrôlée ou arrêt.
    Retour arrière
    Suspendre la vague et appliquer le runbook de retour arrière.

Le but est de comprendre la responsabilité de chaque composant et la preuve qu’il produit.

06

Fonctionnement détaillé et responsabilités

Le client DO peut télécharger en parallèle depuis HTTP/CDN, MCC et pairs. Le service cloud coordonne la découverte et la disponibilité ; bloquer ses endpoints peut provoquer un mode de fallback et annuler le peering attendu.

Le mode LAN limite les pairs au réseau local déduit par le service. Le mode Group utilise un identifiant de groupe pour représenter une frontière métier ou réseau. Internet peering et bypass doivent être décidés selon sécurité et mobilité.

Le port TCP 7680 doit fonctionner entre pairs dans la portée prévue. L’ouverture globale entre tous les sites n’est pas une exigence : je respecte segmentation et pare-feu puis teste les chemins nécessaires.

  • cartographie WAN/LAN/VPN
  • flux DO cloud autorisés
  • TCP 7680 selon segmentation
  • download mode et group ID définis
07

Configuration, exploitation et cas limites

Les seuils de RAM, disque, taille du fichier, âge et batterie déterminent si un appareil participe. Un parc trop petit, mobile ou rarement simultané peut produire peu de peer bytes sans que la configuration soit défectueuse.

Microsoft Connected Cache pour Enterprise/Education s’exécute comme un nœud de cache géré et nécessite une connectivité sortante. Les certificats, proxy et inspection TLS sont validés selon les endpoints documentés.

Le statut Healthy du nœud signifie que le conteneur communique avec le service. Pour prouver l’usage, je mesure les requêtes clients, les octets servis, les cache hits et les BytesFromCache observés sur les postes.

  • Mesurer peer/cache hit
  • Tester VPN et fallback CDN
  • Étendre avec seuils par site
08

Interpréter les résultats sans raccourci

Get-DeliveryOptimizationStatus montre les téléchargements actifs et -PeerInfo les pairs potentiels. Get-DeliveryOptimizationPerfSnap fournit un instantané de performance ; les résultats sont capturés pendant un téléchargement assez volumineux.

Le DO Troubleshooter offre HealthCheck, P2P, MCC et support bundle. Je l’utilise avant de supprimer le cache ou redémarrer DoSvc, car ces actions effacent ou perturbent les preuves utiles.

Le pilote utilise au moins deux appareils, un contenu compatible de taille suffisante et une temporisation pour laisser le premier poste alimenter le cache. Les KPI séparent CDN, MCC, LAN peers, Internet peers, débit et temps utilisateur.

Je distingue une donnée de configuration, une donnée d’inventaire et une preuve d’exécution. La première décrit ce qui devrait arriver, la deuxième décrit un état observé à un instant donné et la troisième montre ce qu’un composant a réellement tenté. Leur horodatage et leur contexte doivent converger avant toute conclusion.

Je documente les états non applicable, pending, conflict, error et success séparément. Un poste absent d’un rapport n’est pas nécessairement sain ou en échec : il peut être hors ligne, non éligible, non ciblé, en retard de télémétrie ou exclu par la politique de collecte.

09

Pilote, généralisation et maintien en conditions opérationnelles

Le pilote couvre plusieurs modèles matériels, versions de Windows, profils réseau, populations utilisateur et exceptions métier. Je conserve une cohorte témoin afin de différencier l’effet du changement d’une évolution globale du service, d’une mise à jour applicative ou d’un incident réseau.

Les critères GO sont définis avant le début : couverture, taux de succès, délai de convergence, incidents, tickets support, régressions et temps de rollback. Une moyenne satisfaisante ne masque pas un sous-groupe en échec ; les résultats sont donc segmentés par version, modèle, site et mode de gestion.

Les cas négatifs sont testés volontairement : appareil hors ligne, licence absente, identité non éligible, règle non applicable, réseau filtré et retour arrière. Un design exploitable doit échouer de manière visible, sûre et compréhensible pour le support.

Après généralisation, je programme une revue des exceptions, des permissions, des versions de profil et des dépendances. Le service cloud et Windows évoluent ; une décision correcte aujourd’hui doit rester traçable et être revalidée lorsqu’un prérequis ou une interface change.

10

Interfaces d’observation, commandes et exemples

Les commandes illustrent les objets et états décrits dans l’article. Les exemples de diagnostic restent non testés, en niveau 1 et sans modification volontaire. Ils servent à comprendre les données disponibles, pas à industrialiser une collecte.

Une automatisation durable doit employer une API ou une interface officiellement supportée. Une clé de registre, un fichier ou une tâche interne peut évoluer avec Windows, l’agent ou le service.

POWERSHELLÉtat Delivery Optimization — niveau 1
# Exemple pédagogique non testé — niveau 1
$ErrorActionPreference = 'Stop'
try {
  Get-DeliveryOptimizationStatus | Select-Object FileId,Status,TotalBytesDownloaded,BytesFromHttp,BytesFromCacheServer,BytesFromLanPeers,BytesFromInternetPeers
  Get-DeliveryOptimizationPerfSnap
  Get-DeliveryOptimizationStatus -PeerInfo
} catch { Write-Error "Collecte DO impossible : $($_.Exception.Message)"; exit 1 }

Lancer pendant un téléchargement compatible. Les noms de propriétés peuvent varier selon la version Windows.

11

Observabilité : où lire l’état réel

Je construis une chronologie unique avec l’heure de la demande, le check-in, l’événement local, la décision du composant et la remontée dans le portail. Je conserve UTC et heure locale, mais j’anonymise UPN, DeviceId, TenantId, noms internes, certificats, adresses et contenus métiers avant partage.

La collecte initiale reste en lecture seule. Je ne vide pas un cache, ne supprime pas une clé, ne réinitialise pas un agent et ne force pas un enrôlement avant d’avoir capturé les preuves. Ces actions changent l’état et peuvent rendre la cause première impossible à démontrer.

Les scripts publiés ici sont des exemples pédagogiques non testés de niveau 1. Toute remédiation réelle doit être au minimum de niveau 2, proposer une simulation, limiter sa cible, expliquer son impact et restaurer l’état précédent. Les opérations privilégiées ou à grande échelle exigent un niveau supérieur et une approbation formelle.

  • Mesurer la bande passante de référence.
  • Déployer DO à un site pilote.
  • Tester deux appareils avec contenu identique.
  • Valider MCC et sources sur clients.
  • Mesurer peer/cache hit
  • Tester VPN et fallback CDN
  • Étendre avec seuils par site
MATRICELecture structurée des preuves
CoucheQuestionPreuveDécision
CiblageLe poste devait-il recevoir la configuration ?Groupe, filtre, licence et affectationCorriger le ciblage avant le client
TransportLa demande a-t-elle atteint sa destination ?Check-in, événement, request-id ou téléchargementTraiter identité, réseau ou service
TraitementLe composant a-t-il évalué la demande ?Journal, état par paramètre ou résultat APICorriger la valeur ou le composant
RésultatL’objectif final est-il atteint ?Contrôle fonctionnel et rapport corréléValider ou maintenir NO-GO
12

Validation du modèle et cas d’usage

Je vérifie le modèle sur un appareil représentatif en reliant la configuration du service, l’état reçu, le traitement local et la donnée remontée. L’objectif n’est pas de certifier la production, mais de confirmer que l’explication décrit bien le comportement observé.

Un cas d’usage est retenu lorsque la technologie répond au besoin sans ajouter une autorité concurrente, une dépendance non maîtrisée ou un niveau d’opacité incompatible avec l’exploitation.

  • Mesurer la bande passante de référence.
  • Déployer DO à un site pilote.
  • Tester deux appareils avec contenu identique.
  • Valider MCC et sources sur clients.
  • Mesurer peer/cache hit
  • Tester VPN et fallback CDN
  • Étendre avec seuils par site
13

Limites, modes de panne et lecture des erreurs

Cette matrice relie les limites du modèle aux symptômes observables. Elle ne transforme pas une technologie en article de dépannage : elle montre où le fonctionnement normal peut diverger et quelles preuves permettent de comprendre cette divergence.

Une erreur isolée doit être replacée dans sa phase et son contexte. Je privilégie les résultats documentés du service et du client avant les détails d’implémentation susceptibles de changer.

MATRICEMatrice de diagnostic
SymptômeCause à confirmerPreuve recherchéeCorrection ciblée
Aucun octet pairCloud DO ou frontièreStatus, PeerInfo et réseauCorriger endpoints/group ID
DownloadMode 99Service cloud inaccessibleDO troubleshooterCorriger proxy/TLS
MCC Healthy, zéro hitClients non configurés/contenu absentClient status et cache metricsCorriger ciblage
Peers trouvés mais connexion KOPort 7680 filtréTest-NetConnectionOuvrir seulement la frontière
WAN non réduitPopulation ou contenu non propiceOctets par sourceRevoir dimensionnement

Une cause reste une hypothèse tant qu’elle n’est pas confirmée par une preuve locale ou une donnée de service corrélée.

14

Adoption progressive, réversibilité et vigilance

Pour introduire la technologie, je commence par un scénario borné, des appareils pilotes et des critères d’observation définis. L’adoption progresse uniquement si les dépendances, la supervision et les responsabilités de support sont comprises.

Le retour arrière dépend souvent de la propriété de la ressource et du cycle de synchronisation. Je le teste avant généralisation et je ne déduis jamais la réversibilité de la seule disparition d’un profil dans le portail.

  • Réversibilité : restaurer le download mode précédent
  • Réversibilité : retirer la policy MCC du pilote
  • Réversibilité : conserver le fallback CDN pendant toute la transition
  • Limite ou vigilance : ne pas supprimer le cache pendant la collecte
  • Limite ou vigilance : bypass 100 désactive DO
  • Limite ou vigilance : Healthy ne prouve pas les hits
  • Limite ou vigilance : inspection TLS à traiter explicitement
R

Repères d’utilisation

Cette analyse propose une méthode opérationnelle et un cadre de décision. Avant toute application à grande échelle, vérifiez les versions, les licences et les comportements sur un environnement pilote représentatif de votre contexte.

Références techniques publiques

J’ai privilégié la documentation Microsoft pour les comportements contractuels. Les retours terrain complètent l’observation, sans remplacer la documentation de support.

Delivery OptimizationMicrosoft Connected CacheWindows UpdateIntuneP2PBandwidth

Continuer la lecture

Modern Workplace LabOMA-DM et WinDC en double inscriptionEndpoint LabDiagnostic complet des applications Win32