Monitoraggio dei modelli di " OpenAI "

OpenAI fornisce modelli linguistici basati su Transformer che consentono la comprensione e la generazione del linguaggio naturale. Questa guida illustra come strumentare un'applicazione utilizzando i modelli di " OpenAI " con " OpenLLMetry " per inviare dati di telemetria a " Instana ".

Prerequisiti

Assicurati che siano soddisfatti i seguenti prerequisiti:

  • Python 3.8 o versioni successive
  • Una chiave OpenAI API (richiedila su OpenAI Platform )
  • Un account Instana
  • Panoramica sull'avvio nelle modalità con agente e senza agente

Implementazione degli strumenti di monitoraggio nell'applicazione OpenAI

  1. Installa i pacchetti richiesti.

    pip install openai traceloop-sdk
  2. Esporta la tua chiave di OpenAI API.

    export OPENAI_API_KEY="your-openai-api-key>"
     
  3. Crea la tua applicazione OpenAI. Crea un file ` Python ` contenente il seguente codice:

    import os
    from openai import OpenAI
    from traceloop.sdk import Traceloop
    from traceloop.sdk.decorators import workflow
    
    # Initialize OpenAI client
    client = OpenAI(api_key=os.getenv("OPENAI_API_KEY"))
    
    # Initialize OpenLLMetry
    Traceloop.init(app_name="openai_chat_service", disable_batch=True)
    
    @workflow(name="openai_conversation")
    def ask_openai(question: str):
        """Send a question to OpenAI and get a response."""
    
        response = client.chat.completions.create(
            model="gpt-4o-mini",
            messages=[{"role": "user", "content": question}]
        )
    
        return response.choices[0].message.content
    
    # Example usage
    if __name__ == "__main__":
        questions = [
            "What is AIOps and how does it help with IT operations?",
            "Explain the benefits of observability in modern applications."
        ]
    
        for question in questions:
            print(f"\nQuestion: {question}")
            answer = ask_openai(question)
            print(f"Answer: {answer}\n")
            print("-" * 80)
  4. Esegui la tua applicazione.

    python3 openai_app.py

    L'applicazione invierà le domande all'indirizzo OpenAI e visualizzerà le risposte. OpenLLMetry acchia automaticamente le tracce relative a ogni chiamata all' API e e le invia a Instana.

  5. Visualizza i dati su Instana.

    Dopo aver eseguito l'applicazione, nella dashboard di osservabilità di Gen AI di Instana vengono visualizzati i seguenti elementi:

    • Modello utilizzato
    • Utilizzo dei token (token in entrata e in uscita)
    • Latenza di risposta
    • Contenuto della richiesta e della risposta

Utilizzo delle risposte in streaming

Per lo streaming con risposta in tempo reale, utilizzare l' API di streaming:

@workflow(name="openai_streaming")
def ask_openai_streaming(question: str):
    """Stream responses from OpenAI in real-time."""

    stream = client.chat.completions.create(
        model="gpt-4o-mini",
        messages=[{"role": "user", "content": question}],
        stream=True
    )

    for chunk in stream:
        if chunk.choices[0].delta.content:
            print(chunk.choices[0].delta.content, end="", flush=True)

    print()  # New line after streaming completes

Risoluzione dei problemi

Per problemi comuni, come la mancata visualizzazione delle tracce o errori di connessione, consultare la sezione Risoluzione dei problemi.

Errori di autenticazione

Se si verificano errori di autenticazione:

  1. Verifica che OPENAI_API_KEY sia impostato correttamente
  2. Verifica che la tua chiave API sia valida nella piattaforma OpenAI
  3. Assicurati che la tua chiave API non sia scaduta o revocata
  4. Verifica che il tuo account disponga di crediti sufficienti

Errori di limitazione della velocità

Se si verificano errori relativi al limite di rate:

  1. Controlla i limiti di frequenza del tuo account OpenAI
  2. Se si effettuano più chiamate, inserire dei ritardi tra una richiesta e l'altra
  3. Ti consigliamo di passare a un piano " OpenAI " con limiti più elevati
  4. Implementare il backoff esponenziale per i tentativi di riconnessione

Errori relativi a modelli non trovati

Se ricevi messaggi di errore del tipo "Modello non trovato":

  1. Verificare che il nome del modello sia corretto (ad esempio, gpt-4o-mini, gpt-4o, gpt-3.5-turbo)
  2. Verifica se la tua chiave API ha accesso al modello specificato
  3. Verifica che il modello sia disponibile nella tua zona
  4. Per conoscere i modelli disponibili, consultare la documentazione sui modelli all'indirizzo OpenAI's

Passi successivi