OpenAI-kompatible Server
Mit dem ProtokollOpenAI-kompatibel lässt sich jeder Server anbinden, der die OpenAI-Chat-Completions-API implementiert:
- Lokale Inferenz-Server wie Ollama, vLLM und llama.cpp sowie LM Studio
- Der lokale Proxy von Privatemode für vertrauliche Cloud-Inferenz
- Beliebige andere Dienste mit kompatibler Schnittstelle
Einrichtung
- Inferenz-Server starten und die OpenAI-kompatible Schnittstelle aktivieren.
- In MDScribe unter
Admin → Einstellungen → Modelle → Verbindungeneinen neuen Provider anlegen:- Protokoll:
OpenAI-kompatibel - Base URL: erforderlich, inklusive
/v1(z.B.http://localhost:11434/v1für Ollama) - API-Key: nur falls der Server einen verlangt
- Protokoll:
- Verbindung prüfen und speichern — die Modellliste wird über
GET /v1/modelssynchronisiert.
Besonderheiten
- Es findet keine Ableitung von Modell-Fähigkeiten statt: Reasoning-Unterstützung und Modalitäten werden nicht erraten. Der Administrator wählt selbst, welches Modell welchen Slot belegt, und kann Fähigkeiten pro Modell manuell pflegen.
- Eine explizite Base URL ist Pflicht; es gibt bewusst keinen Fallback-Endpunkt.