splunk background

visibilité

Visualisez la trace complète des agents

Suivez les agents, du raisonnement au GPU sous-jacent, pour identifier rapidement les causes profondes en cas de problème.

Édition gratuite Essayez gratuitement pendant 14 jours. Aucune carte de crédit demandée.
Suivre la visite guidée Vous avez 5 minutes ? Découvrez son fonctionnement.
Visibilité

Trouvez la cause profonde sous la couche d’application

Remontez la trace d’une mauvaise réponse ou d’un échec jusqu’à la puce qui les a produits, et visualisez la trace de l’agent et l’événement matériel sur la même chronologie.

Détectez les échecs qui commencent sous le code

La cause profonde des problèmes se cache souvent sous la couche d’orchestration : le modèle a halluciné, l’agent a utilisé le mauvais outil, l’infrastructure a fait discrètement augmenter la facture, ou le matériel n’a pas tenu la charge.

Tracez les workflows multi-agents de la demande à la réponse

Suivez une requête d’un bout à l’autre. Découvrez comment les agents transmettent les tâches, quelles étapes ralentissent le processus et à quel stade les problèmes se manifestent. La trace décrit le raisonnement d’un agent : plus qu’un simple constat d’échec, elle donne à lire ce qu’il a fait et pourquoi.

Corrélez l’agent et l’infrastructure sur une même chronologie

La télémétrie corrélée vous aide à visualiser les signes précoces de dégradation de performance. Lorsqu’une hausse de la consommation de tokens, un GPU saturé, un pic de latence, une augmentation des erreurs ECC et un événement Xid 79 apparaissent simultanément, les équipes peuvent identifier les risques plus tôt, dépanner plus rapidement et passer à l’action avant l’échec de l’exécution.

image promo .conf26

Regardez les présentations de .conf26 à la demande

Découvrez les conseils des experts de Splunk et des leaders du secteur à l’ère de l’agentique.

Voir dès maintenant

fonctionnalités

Visualisez toute la pile, du raisonnement au GPU

Lire la documentation
Suivez un agent du raisonnement au GPU Suivez un agent du raisonnement au GPU

Suivez un agent du raisonnement au GPU

Consultez les appels d’outils, les modèles et les étapes de récupération d’un workflow de la requête à la réponse, puis reliez ce comportement à l’infrastructure sous-jacente. L’analyse de la cause profonde se fait sur une même chronologie, pas dans quatre outils déconnectés.

dépenses dépenses

Visualisez l’infrastructure sous-jacente

Suivez l’utilisation des GPU et de la mémoire, la consommation d’électricité et le délai jusqu’au premier token des modèles, des bases de données vectorielles et du reste de votre pile d’IA. Lorsqu’un pic dans la consommation de tokens coïncide avec un GPU saturé, la latence de la réponse n’a plus rien de mystérieux.

Parcourez toutes les étapes d’un échec d’exécution Parcourez toutes les étapes d’un échec d’exécution

Parcourez toutes les étapes d’un échec d’exécution

Parcourez une chronologie unique réunissant aussi bien un pic ECC qu’une anomalie thermique ou électrique, un Xid 79 qu’un échec d’exécution, et visualisez côte à côte la trace de l’agent et la télémétrie du GPU. Une seule vue pour répondre à la question : « Pourquoi est-ce que cela a échoué ? ».

trafic trafic

Visualisez la cascade avant l’échec de l’exécution

Les échecs catastrophiques arrivent rarement sans s’annoncer. Les signaux avant-coureurs sont souvent visibles et la télémétrie peut vous avertir tant qu’il est encore temps de sauver une exécution avant qu’elle n’échoue à la 47e heure.

Sachez quels éléments du système fonctionnent et lesquels sont précaires Sachez quels éléments du système fonctionnent et lesquels sont précaires

Sachez quels éléments du système fonctionnent et lesquels sont précaires

Supervisez la disponibilité et l’intégrité de la pile d’IA pour détecter les dégradations au plus tôt. Repérez la hausse du nombre d’ECC ou la saturation d’un cache avant qu’elles ne fassent échouer l’exécution à la 47e heure.

Bâti sur Splunk, corrélé avec Cisco Bâti sur Splunk, corrélé avec Cisco

Bâti sur Splunk, corrélé avec Cisco

Les outils purement dédiés à l’IA voient les prompts, mais jamais la puce. La supervision généraliste voit le GPU, mais pas le raisonnement de l’agent ni le tissu du réseau. Splunk et Cisco couvrent l’intégralité de la pile pour afficher au même endroit une réponse erronée et la puce qui l’a produite.

 

 

Ressources
En savoir plus sur Splunk

FAQ sur l’observabilité et le suivi des agents

Cela consiste à suivre une requête d’un bout à l’autre d’un workflow multi-agents, en capturant l’ensemble des appels d’outils, des modèles et des étapes de récupération avec le raisonnement de l’agent, puis à relier ce comportement à l’infrastructure sous-jacente.

La cause se cache souvent sous la couche d’application, et relève généralement de quatre catégories : le modèle s’est trompé, l’agent a fait quelque chose qu’il n’aurait pas dû, le coût a discrètement explosé ou le matériel n’a pas tenu la charge.

Oui. Un pic de consommation de tokens, un GPU saturé ou une hausse de la latence peuvent être affichés sur la même chronologie, de façon à relier le symptôme (ralentissement ou échec) à sa cause.

Lorsque vous exécutez des modèles à poids ouverts sur votre propre matériel, vous ne pouvez pas consulter la page d’état du fournisseur. La télémétrie corrélée vous permet de suivre un échec jusqu’à la puce et de détecter les signes précoces, comme une hausse des erreurs ECC, avant l’échec d’une longue exécution.

Splunk Agent Observability repose sur la plateforme de données Splunk et est corrélé avec l’infrastructure Cisco. Cette approche permet de réunir la trace de raisonnement de l’agent, la qualité de son résultat et son coût, ainsi que le GPU, les bases de données vectorielles et le tissu réseau sous-jacents, dans un même système d’enregistrement.

Produits connexes

Splunk Cloud Platform

Unifiez les données, le contexte et l’action, tous domaines confondus.

En savoir plus

Splunk Enterprise Security

Unifiez la détection des menaces, l’investigation et la réponse pour le SOC agentique.

En savoir plus

Splunk IT Service Intelligence

Prédisez et anticipez les problèmes informatiques avec la supervision des services pilotée par l’IA.

En savoir plus
Bien démarrer avec Splunk

Trouvez la cause profonde, du raisonnement au GPU.

Demander une démonstration
Découvrir les versions d’essai gratuites