Ressourcen · Dokumentation

Plattformdokumentation.

Von Grund auf produktionsreif.

OpenQCore-Dokumentation für Teams, die zuverlässige KI-Produkte für Chat, Sprache, multimodale Generierung und Wissens-Workflows mit gezielter Laufzeitsteuerung entwickeln.

API-first LaufzeitWorkspace- & persönliche BereicheStreaming + Nicht-StreamingRate-Limit + Deduplizierung + SperreSprach-Pipeline (STT/LLM/TTS)Console Knowledge-APIs

Schnellstart

Vom ersten Request bis zum Produktionseinsatz in Minuten.

1) Authentifizieren

Verwenden Sie JWT-Session-Authentifizierung oder API-Schlüssel-Authentifizierung mit kontextabhängiger Zugriffskontrolle.

2) Laufzeit-Bereich wählen

Setzen Sie bei Bedarf persönlichen oder Workspace-Kontext mithilfe von Runtime-Headern.

3) Chat-Completions aufrufen

Verwenden Sie /api/v1/chat/completions für die Kern-Ausführung des Assistants.

4) Sprache und Multimodalität hinzufügen

Verwenden Sie /api/v1/voice und Iris-Endpunkte für STT/TTS-, Bild-, Video- und OCR-Workflows.

5) Wissen integrieren

Verwenden Sie /api/v1/console/knowledge für Upload, Ingestion und abrufgesteuerte Anfragen.

Basis-URL

Basis der öffentlichen API

/api/v1

Alle öffentlichen Plattformendpunkte sind unter /api/v1 verfügbar.

Authentifizierung & Bereich

Kontextbewusster Zugriff für persönliche und Workspace-Ausführungen.

Authentifizierungsmethoden

JWT/Session oder API-Schlüssel

Scope-Header

X-Scope-Type: personal | workspace

Workspace-Header

X-Workspace-ID: [uuid] (erforderlich im Workspace-Bereich)

Agent-Header

X-Agent-ID: [uuid] (optional)

Validierungsregeln

  • Wenn scope auf 'personal' gesetzt ist, ist workspace_id nicht erlaubt.
  • Wenn scope 'workspace' ist, ist workspace_id erforderlich.
  • Ungültige Scope-Header führen zu einem 422-Status.

Ratenbegrenzungen

Richtlinienbasierte Drosselung nach Authentifizierungskontext.

API-Schlüssel

60 Anfragen pro Minute

Der Bucket-Schlüssel verwendet die Hash-Identität des API-Schlüssels.

JWT/Sitzung

120 Anfragen pro Minute

Der Bucket-Schlüssel verwendet die Workspace-ID, wenn vorhanden, andernfalls die Benutzer-ID.

Header für Drosselungsantworten

Retry-AfterX-RateLimit-LimitX-RateLimit-RemainingX-RateLimit-Reset

Chat-Laufzeit

/chat/completions mit Produktionssteuerungsebenen.

GET /api/v1/chat/health
POST /api/v1/chat/completions

Ausführungsverhalten

  • Backpressure-Tracking und Zurückweisung bei Systemüberlastung (503).
  • Verteiltes Sperrverfahren, um doppelte laufende Verarbeitung zu verhindern (409).
  • Dedup-Cache für Nicht-Stream-Antworten.
  • Sitzungs- und Nachrichtenpersistenz für Benutzer- und Assistentenbeiträge.
  • Laufzeitvalidierung für Anfrage, Anhänge und Sitzungszugriff.

Sprachlaufzeit

STT → LLM → TTS-Pipeline mit Streaming und Unterbrechungsmöglichkeit.

POST /api/v1/voice/chat/meta
POST /api/v1/voice/chat
POST /api/v1/voice/interrupt/{session_id}
WS /api/v1/voice/ws

Sprachfunktionen

  • Router für Fallback-Anbieter (OpenAI + Azure).
  • Circuit-Breaker für STT-, LLM- und TTS-Phasen.
  • Audio-Konvertierungs-Pipeline für Nicht-WAV-Eingaben.
  • Streaming-Audioantworten mit Metadaten-Headern.
  • Abbruchkontext für sitzungsweite Unterbrechungen.
  • Lastabwurf und Qualitätsverschlechterung bei hoher Auslastung.

Iris Multimodal

Modellgesteuerte Bild-, Video-, OCR- und Verifizierungs-Workflows.

Modellkatalog

iris-orbit

Automatischer Routing-Modus

iris-genesis

Bildgenerierung

iris-edit

Bildbearbeitung (nicht implementiert)

iris-lens

Bildanalyse (nicht implementiert)

iris-video

Videogenerierung

iris-ocr

Dokumenten-OCR

iris-verify

Identitätsprüfung

iris-guard

Betrugserkennung (nicht implementiert)

iris-face

Gesichtsverifizierung (nicht implementiert)

Konsolenwissen

APIs für das Workspace-Konsolenwissen zum Import und zur Abfrage.

/api/v1/console/knowledge
GET /api/v1/console/knowledge
POST /api/v1/console/knowledge
POST /api/v1/console/knowledge/upload
GET /api/v1/console/knowledge/{item_id}
PATCH /api/v1/console/knowledge/{item_id}
DELETE /api/v1/console/knowledge/{item_id}
POST /api/v1/console/knowledge/ask

Einschränkungen für das Wissen

  • Maximale Dateigröße: 20MB
  • Erlaubte Typen: PDF, DOC, DOCX, TXT, Markdown
  • Die Aufnahme erfolgt asynchron im Hintergrund
  • Status: pending → processing → processed | failed

Fehlersemantik

Gängige Antwortklassen der Plattform.

400

Ungültige Anfrage, fehlende Daten oder fehlerhafte Eingaben

401

Authentifizierung fehlt oder ungültig

403

Berechtigung nicht erlaubt / Einschränkung der Workspace-Rolle

404

Ressource nicht gefunden

409

Anfrage bereits in Bearbeitung (Sperrkonflikt)

413

Nutzlast zu groß (z. B. Audio-/Dateigrößenbeschränkungen)

415

Nicht unterstützter Inhaltstyp

422

Validierungsfehler (Bereich/Kontext/Schema)

429

Rate-Limit überschritten

503

Systemüberlastung / Anbieter nicht verfügbar

Beobachtbarkeit

Nachverfolgbare Ausführung über Chat- und Sprach-Lebenszyklen.

  • Trace-IDs zur Anforderungs-Korrelation.
  • Middleware-Pipeline zur Nutzungsprotokollierung.
  • OpenTelemetry-Initialisierung mit OTLP-Export.
  • Antwort-Header geben Timing-Signale in Sprachabläufen preis.
X-Trace-IDX-Session-IDX-STT-Time-MSX-LLM-Time-MSX-TTS-Time-MS

Entwickeln Sie mit Zuversicht in der OpenQCore-Laufzeitumgebung.

Nutzen Sie die Dokumentation als Ihren Produktionsfahrplan für Chat, Sprache, multimodale Generierung und wissensgestützte Ausführung.