Risorse · Documentazione

Documentazione della piattaforma.

Pronto per la produzione fin dalla progettazione.

Documentazione OpenQCore per team che realizzano prodotti AI affidabili per chat, voce, generazione multimodale e workflow di conoscenza, con controllo del runtime basato sugli ambiti.

Runtime orientato alle APIAmbiti workspace e personaliStreaming + Non-StreamingRate-Limit + dedup + lockPipeline vocale (STT/LLM/TTS)API di conoscenza della console

Avvio rapido

Dalla prima richiesta al percorso di produzione in pochi minuti.

1) Autenticazione

Usa l'autenticazione JWT (sessione) o con chiave API con controllo accessi basato sullo scope.

2) Scegli lo scope di runtime

Imposta il contesto personale o del workspace usando gli header di runtime quando necessario.

3) Richiama chat completions

Usa /api/v1/chat/completions per l'esecuzione principale dell'assistente.

4) Aggiungi voce e multimodale

Usa /api/v1/voice e gli endpoint Iris per flussi di lavoro STT/TTS, immagini, video e OCR.

5) Integra la conoscenza

Usa /api/v1/console/knowledge per caricamento, ingestione e richieste basate sul recupero.

URL base

Base API pubblica

/api/v1

Tutti gli endpoint pubblici della piattaforma sono montati sotto /api/v1.

Autenticazione e ambito

Accesso contestuale per esecuzioni personali e del workspace.

Metodi di autenticazione

JWT/sessione o chiave API

Header dello scope

X-Scope-Type: personal | workspace

Header del workspace

X-Workspace-ID: [uuid] (richiesto nello scope workspace)

Header agente

X-Agent-ID: [uuid] (opzionale)

Regole di validazione

  • Se lo scope è personal, workspace_id non è consentito.
  • Se lo scope è workspace, workspace_id è obbligatorio.
  • Gli header di scope non validi restituiscono 422.

Limiti di velocità

Limitazione basata su policy per contesto di autenticazione.

Chiave API

60 richieste al minuto

La chiave del bucket usa l'identità hash della chiave API.

JWT/session

120 richieste al minuto

La chiave del bucket usa l'id del workspace quando presente, altrimenti l'id dell'utente.

Header di risposta per il throttling

Retry-AfterX-RateLimit-LimitX-RateLimit-RemainingX-RateLimit-Reset

Runtime Chat

/chat/completions con livelli di controllo per la produzione.

GET /api/v1/chat/health
POST /api/v1/chat/completions

Comportamenti di esecuzione

  • Tracciamento della backpressure e rifiuto in caso di sovraccarico del sistema (503).
  • Blocco distribuito per prevenire elaborazioni duplicate in corso (409).
  • Cache per deduplicazione per risposte non in streaming.
  • Persistenza di sessione/messaggi per i turni dell'utente e dell'assistente.
  • Validazione in runtime per la richiesta, gli allegati e l'accesso alla sessione.

Runtime Voce

Pipeline STT → LLM → TTS con streaming e interruzione.

POST /api/v1/voice/chat/meta
POST /api/v1/voice/chat
POST /api/v1/voice/interrupt/{session_id}
WS /api/v1/voice/ws

Funzionalità vocali

  • Router per provider di fallback (OpenAI + Azure).
  • Interruttori di circuito per le fasi STT, LLM e TTS.
  • Pipeline di conversione audio per input non-WAV.
  • Risposte audio in streaming con intestazioni dei metadati.
  • Contesto di cancellazione per l'interruzione a livello di sessione.
  • Gestione del carico e degrado della qualità sotto carico elevato.

Iris Multimodale

Flussi di lavoro per immagini, video, OCR e verifica instradati dal modello.

Catalogo dei modelli

iris-orbit

Modalità di instradamento automatico

iris-genesis

Generazione di immagini

iris-edit

Modifica delle immagini (non implementato)

iris-lens

Analisi delle immagini (non implementato)

iris-video

Generazione di video

iris-ocr

OCR dei documenti

iris-verify

Verifica dell'identità

iris-guard

Rilevamento delle frodi (non implementato)

iris-face

Verifica facciale (non implementato)

Conoscenza della console

API della console del workspace per l'ingestione e le richieste.

/api/v1/console/knowledge
GET /api/v1/console/knowledge
POST /api/v1/console/knowledge
POST /api/v1/console/knowledge/upload
GET /api/v1/console/knowledge/{item_id}
PATCH /api/v1/console/knowledge/{item_id}
DELETE /api/v1/console/knowledge/{item_id}
POST /api/v1/console/knowledge/ask

Vincoli della conoscenza

  • Dimensione massima del file: 20MB
  • Tipi consentiti: PDF, DOC, DOCX, TXT, Markdown
  • L'ingestione viene eseguita in background in modo asincrono
  • Stati: in attesa → in elaborazione → elaborato | non riuscito

Semantica degli errori

Classi di risposta comuni della piattaforma.

400

Richiesta non valida, dati mancanti o input malformato

401

Autenticazione assente o non valida

403

Ambito non consentito / restrizione del ruolo nel workspace

404

Risorsa non trovata

409

Richiesta già in elaborazione (conflitto di blocco)

413

Payload troppo grande (es. limiti per audio/file)

415

Tipo di contenuto non supportato

422

Errore di validazione (ambito/contesto/schema)

429

Limite di richieste superato

503

Sovraccarico del sistema / provider non disponibile

Osservabilità

Esecuzione tracciabile attraverso i cicli di vita di chat e voce.

  • ID di traccia per la correlazione delle richieste.
  • Pipeline middleware per il logging dell'utilizzo.
  • Inizializzazione di OpenTelemetry con esportazione OTLP.
  • Gli header di risposta espongono segnali temporali nei flussi vocali.
X-Trace-IDX-Session-IDX-STT-Time-MSX-LLM-Time-MSX-TTS-Time-MS

Sviluppa con fiducia sul runtime OpenQCore.

Usa la documentazione come mappa di produzione per chat, voce, generazione multimodale ed esecuzione basata sulla conoscenza.