# Eigene KI-Modelle

Unter Eigene KI-Modelle binden Sie Sprachmodelle an, die Sie selbst betreiben oder bei einem Anbieter Ihrer Wahl hosten. Voraussetzung ist ein OpenAI-kompatibler Endpunkt. Die registrierten Modelle stehen allen Chatbots, die Sie im Partnerbereich verwalten, zusätzlich zu den Modellen der integrierten Anbieter zur Verfügung. Das ist vor allem für On-Premises-Szenarien relevant, in denen Sie keine Schlüssel externer Anbieter hinterlegen möchten. Den Überblick über alle Varianten lesen Sie unter Eigene Modelle .

# Modell registrieren

  1. Klicken Sie auf Neues eigenes Modell.
  2. Tragen Sie die Verbindungsdaten ein:
Feld Bedeutung
Name Unter diesem Namen erscheint das Modell in den Auswahllisten des aiStudios. Jeder Name darf nur einmal vorkommen.
Modell-Kennung Die Modell-ID, die das aiStudio mit jeder Anfrage an Ihren Endpunkt sendet, zum Beispiel openai/gpt-oss-120b.
Basis-URL Die Adresse Ihres Endpunkts, zum Beispiel https://llm.musterorganisation.example/v1.
API-Schlüssel Der Schlüssel, mit dem sich das aiStudio bei Ihrem Endpunkt anmeldet.
Kontextfenster (Tokens) Die Anzahl an Tokens, die das Modell höchstens verarbeiten kann.
  1. Geben Sie an, was das Modell kann:
    • Reasoning-Modell: Das Modell durchläuft vor der Antwort einen Denkprozess. Wählen Sie dazu den Reasoning-Aufwand Low, Medium oder High.
    • Unterstützt Tool-Aufrufe: Das Modell beherrscht Function Calling.
    • Unterstützt Bildanalyse: Das Modell kann Bilder auswerten.
  2. Prüfen Sie die Angaben mit Verbindung testen und klicken Sie auf Anlegen. Die Schaltfläche wird aktiv, sobald alle Felder ausgefüllt sind.

Ist der Endpunkt erreichbar, zeigt der Verbindungstest die Antwortzeit in Millisekunden. Andernfalls nennt er die wahrscheinliche Ursache, etwa einen ungültigen API-Schlüssel, eine Modell-Kennung, die Ihr Endpunkt nicht bereitstellt, oder einen Endpunkt, der keine Verbindungen vom aiStudio annimmt.

# Modelle verwalten

Das erste Modell, das Sie registrieren, wird automatisch zum Standard. Ein anderes Modell bestimmen Sie über die Spalte Standard zum Standardmodell. Über das Stiftsymbol bearbeiten Sie ein Modell, über das Papierkorbsymbol löschen Sie es.

# Eigene Modelle einsetzen

Registrierte Modelle stehen an drei Stellen zur Auswahl:

Die automatische Modellauswahl eines Agenten nutzt weiterhin nur die Modelle der integrierten Anbieter. Soll ein Agent mit Ihrem Modell antworten, wählen Sie es manuell aus.

Anfragen an eigene Modelle gehen an Ihren Endpunkt. Wo diese Daten verarbeitet werden, bestimmt deshalb der Betrieb Ihres Endpunkts und nicht Kauz.

Ist Ihr Endpunkt im laufenden Betrieb nicht erreichbar, weist der Chatbot in seiner Antwort darauf hin, dass das konfigurierte Modell nicht erreichbar ist, und bittet darum, die Konfiguration im aiStudio zu prüfen. Dasselbe gilt für einen eigenen Embedding-Endpunkt.

# Eigenen Embedding-Endpunkt anbinden

Beim Einlesen von Daten und bei der Suche zu jeder Nutzerfrage berechnet das aiStudio Embeddings. Im Bereich Embedding-Modell (Snowflake Arctic) leiten Sie diese Berechnung auf Ihren eigenen Endpunkt um. Das gilt für alle Chatbots, die Sie im Partnerbereich verwalten.

  1. Aktivieren Sie Eigenen Snowflake-Arctic-Endpunkt verwenden.
  2. Tragen Sie die Snowflake-Arctic-Basis-URL ein, zum Beispiel https://embeddings.musterorganisation.example/v1, und den API-Schlüssel.
  3. Prüfen Sie die Verbindung mit Verbindung testen.

Die Einstellung wird automatisch gespeichert, sobald eine gültige URL und ein API-Schlüssel eingetragen sind.