Überwachung der Infrastruktur und des Hostings
Überwachen Sie die KI-Infrastruktur und die Hosting-Plattformen, um eine optimale Leistung und Ressourcenauslastung sicherzustellen. Überwachen Sie die GPU-Auslastung, die Latenz bei der Modellinferenz, den Speicherverbrauch und die Recheneffizienz, um stabile und kosteneffiziente KI-Implementierungen zu gewährleisten.
Instana bietet Echtzeit-Einblick in die KI-Infrastruktur, einschließlich GPU-Kennzahlen, der Leistung von „ vLLM “ sowie containerisierter Umgebungen. Überwachen Sie die Latenz bei der Inferenz, den Ressourcenverbrauch und den Systemzustand mithilfe KI-gestützter Analysen, die Metriken, Traces und Protokolle miteinander verknüpfen, um eine umfassende Fehlerbehebung zu ermöglichen.
Unterstützte Plattformen
GPU-Überwachung – Überwachen Sie die GPU-Kennzahlen von „ NVIDIA “ über DCGM (Data Center GPU Manager)
vLLM Überwachung – Verfolgung der Inferenzleistung und der Ressourcenauslastung von „ vLLM “