Techniques de traitement des problèmes
L'identification et la résolution des problèmes est une approche systématique de la phase de résolution d'un problème. Elle détermine les raisons pour lesquelles l'unité ne fonctionne pas correctement et explique la démarche à suivre pour corriger le problème. Certaines techniques courantes peuvent vous aider dans votre tâche de traitement des incidents.
La première étape de traitement des problèmes consiste à décrire l'incident de manière exhaustive. La description des problèmes vous permet, à vous et au représentant du support technique, de savoir où commencer à chercher la cause du problème. A cette étape, vous devez vous poser les questions de base suivantes :
- Quels sont les symptômes de l'incident ?
- Où survient le problème ?
- Quand survient le problème ?
- Dans quelles conditions l'incident se produit-il ?
- Pouvez-vous reproduire l'incident ?
Les réponses à ces questions entraînent généralement une bonne description du problème, qui peut déboucher sur sa résolution.
Quels sont les symptômes de l'incident ?
Lorsque vous commencez à décrire un problème, la question la plus évidente est "Quel est le problème ?". Cette question peut sembler simple. Cependant, vous pouvez la diviser en différentes questions spécialisées, qui créent une image plus descriptive du problème. Ces questions peuvent être :
- Qui ou quoi signale l'incident ?
- Quels sont les codes et les messages d'erreur ?
- Comment la défaillance du système se produit-elle ? Par exemple, le problème vient-il d'une boucle, d'un blocage, d'une panne, d'une dégradation des performances ou d'un résultat incorrect ?
Où survient le problème ?
Il n'est pas toujours facile de déterminer l'origine du problème, mais cette étape est l'une des plus importantes pour la résolution du problème. Il peut y avoir de nombreuses couches de technologie entre le composant qui signale l'incident et le composant défaillant. Les réseaux, les disques et les pilotes ne sont que quelques-uns des composants à prendre en compte lorsque vous analysez des incidents.
Les questions ci-dessous vous permettent d'isoler la couche qui pose problème :
- Le problème est-il spécifique à un seul dispositif ?
- L'environnement et la configuration actuels sont-ils pris en charge ?
Si une couche signale le problème, celui-ci ne provient pas nécessairement de cette couche. Pour identifier l'endroit d'où provient un problème, vous devez comprendre l'environnement dans lequel ce problème se produit. Prenez le temps de décrire complètement l'environnement du problème, dont le système d'exploitation et la version, tous les logiciels et les versions correspondants et le matériel. Confirmez que vous exécutez l'application dans un environnement pris en charge. De nombreux problèmes peuvent être dus à des niveaux de logiciel incompatibles, qui ne sont pas destinés à être exécutés ensemble ou qui n'ont pas été testés totalement ensemble.
Quand survient le problème ?
Développez une chronologie détaillée des événements ayant entraîné un échec, en particulier pour les cas survenant une seule fois. Il est plus facile de décrire le déroulement en commençant par la fin : commencez par le moment où l'erreur a été signalée (aussi précisément que possible, voire jusqu'aux millisecondes) et remontez la suite des événements à l'aide des journaux et informations disponibles. Généralement, il n'est pas nécessaire de remonter plus loin que le premier événement suspect d'un journal de diagnostic.
Pour dresser un tableau chronologie détaillé, répondez aux questions suivantes :
- Le problème se produit-il uniquement à certains moments du jour ou de la nuit ?
- Selon quelle fréquence le problème se produit-il ?
- Quelle séquence d'événements a provoqué la survenue du problème ?
- Le problème se produit-il après une modification de l'environnement, comme une mise à niveau ou une installation du logiciel ou du matériel ?
Dans quelles conditions l'incident se produit-il ?
L'identification des systèmes et des applications en cours d'exécution au moment du problème est une étape importante de la procédure de traitement des problèmes. Ces questions concernant votre environnement peuvent vous aider à identifier la cause du problème :
- Le problème se produit-il toujours lorsque vous effectuez la même tâche ?
- Une certaine séquence d'événements doit-elle être respectée pour que le problème se produise ?
- Est-ce que l'exécution d'autres applications échoue également ?
En répondant à ce type de question, vous définissez l'environnement dans lequel le problème survient et corrélez tout événement lié. N'oubliez pas, lorsque plusieurs problèmes se produisent en même temps, les problèmes ne sont pas forcément liés.
Pouvez-vous reproduire l'incident ?
Les problèmes que vous pouvez reproduire sont souvent plus faciles à résoudre. Cependant, les problèmes que vous pouvez reproduire peuvent présenter un inconvénient. Si le problème a un impact professionnel significatif, vous ne souhaitez pas qu'il se reproduise. Si possible, recréez le problème dans un environnement de test ou de développement, qui offre généralement davantage de flexibilité et de contrôle durant votre investigation. Répondez aux questions suivantes :
- Le problème peut-il être recréé sur un système test ?
- Y a-t-il plusieurs utilisateurs qui rencontrent le même type de problème ?
- Le problème peut-il être recréé en exécutant une commande unique ou un ensemble de commandes ?