Skip to main content

OpenAI-kompatible Server

Mit dem Protokoll OpenAI-kompatibel lässt sich jeder Server anbinden, der die OpenAI-Chat-Completions-API implementiert: Schritt-für-Schritt-Anleitungen für die gängigen Setups stehen unter Lokale Modelle und Private Provider; diese Seite beschreibt das generische Protokoll.

Einrichtung

  1. Inferenz-Server starten und die OpenAI-kompatible Schnittstelle aktivieren.
  2. In MDScribe unter Admin → Einstellungen → Modelle → Verbindungen einen neuen Provider anlegen:
    • Protokoll: OpenAI-kompatibel
    • Base URL: erforderlich, inklusive /v1 (z.B. http://localhost:11434/v1 für Ollama)
    • API-Key: nur falls der Server einen verlangt
  3. Verbindung prüfen und speichern — die Modellliste wird über GET /v1/models synchronisiert.

Besonderheiten

  • Es findet keine Ableitung von Modell-Fähigkeiten statt: Reasoning-Unterstützung und Modalitäten werden nicht erraten. Der Administrator wählt selbst, welches Modell welchen Slot belegt, und kann Fähigkeiten pro Modell manuell pflegen.
  • Eine explizite Base URL ist Pflicht; es gibt bewusst keinen Fallback-Endpunkt.

Einordnung für den Datenschutz

Bei einem Server in eigener Infrastruktur verlassen Eingaben das eigene Netz nicht — zusammen mit Self-Hosting der MDScribe-Instanz ist das die Variante mit der größten Eigenkontrolle. Die Verantwortung für Betrieb, Absicherung und Compliance liegt vollständig beim Betreiber.