Recursos · Documentação

Documentação da plataforma.

Projetada para uso em produção.

Documentação do OpenQCore para equipes que desenvolvem produtos de IA confiáveis em chat, voz, geração multimodal e fluxos de conhecimento, com controle de runtime por escopo.

Runtime orientado à APIEscopos: workspace e pessoalStreaming e não streamingLimite de taxa + Deduplicação + BloqueioPipeline de voz (STT/LLM/TTS)APIs de conhecimento do Console

Início rápido

Da primeira requisição ao ambiente de produção em minutos.

1) Autenticar

Use autenticação por sessão JWT ou por chave de API com controle de acesso por escopo.

2) Escolher escopo de runtime

Defina o contexto pessoal ou do workspace usando cabeçalhos de runtime quando necessário.

3) Executar chat completions

Use /api/v1/chat/completions para executar o núcleo do assistente.

4) Adicionar voz e multimodal

Use /api/v1/voice e os endpoints Iris para fluxos de STT/TTS, imagem, vídeo e OCR.

5) Integrar conhecimento

Use /api/v1/console/knowledge para upload, ingestão e perguntas orientadas por recuperação.

URL base

Base da API pública

/api/v1

Todos os endpoints públicos da plataforma estão sob /api/v1.

Autenticação e Escopo

Acesso sensível ao contexto para execuções pessoais e do workspace.

Métodos de autenticação

JWT/session ou API key

Cabeçalho de escopo

X-Scope-Type: personal | workspace

Cabeçalho do workspace

X-Workspace-ID: [uuid] (obrigatório quando o escopo for workspace)

Cabeçalho do agente

X-Agent-ID: [uuid] (opcional)

Regras de validação

  • Se o scope for personal, workspace_id não é permitido.
  • Se o scope for workspace, workspace_id é obrigatório.
  • Cabeçalhos de scope inválidos retornam 422.

Limites de taxa

Limitação de requisições por políticas conforme o contexto de autenticação.

API key

60 requisições por minuto

A chave do bucket usa o hash da API key para identificação.

JWT/session

120 requisições por minuto

A chave do bucket usa o workspace id quando presente; caso contrário, usa o user id.

Cabeçalhos de resposta do controle de taxa

Retry-AfterX-RateLimit-LimitX-RateLimit-RemainingX-RateLimit-Reset

Ambiente de execução do Chat

/chat/completions com camadas de controle em produção.

GET /api/v1/chat/health
POST /api/v1/chat/completions

Comportamentos de execução

  • Monitoramento de backpressure e rejeição por sobrecarga do sistema (503).
  • Bloqueio distribuído para evitar processamento duplicado em andamento (409).
  • Cache de deduplicação para respostas não em streaming.
  • Persistência de sessão e de mensagens para interações entre usuário e assistente.
  • Validação em tempo de execução de requisição, anexos e acesso à sessão.

Runtime de Voz

Pipeline STT → LLM → TTS com streaming e interrupção.

POST /api/v1/voice/chat/meta
POST /api/v1/voice/chat
POST /api/v1/voice/interrupt/{session_id}
WS /api/v1/voice/ws

Recursos de voz

  • Roteamento para provedores de fallback (OpenAI e Azure).
  • Circuit breakers para as fases STT, LLM e TTS.
  • Pipeline de conversão de áudio para entradas que não estão em WAV.
  • Respostas de áudio em streaming com cabeçalhos de metadados.
  • Contexto de cancelamento para interrupções em nível de sessão.
  • Alívio de carga e degradação da qualidade sob carga elevada.

Iris Multimodal

Fluxos de trabalho de imagem, vídeo, OCR e verificação roteados por modelo.

Catálogo de modelos

iris-orbit

Modo de roteamento automático

iris-genesis

Geração de imagens

iris-edit

Edição de imagem (não implementada)

iris-lens

Análise de imagem (não implementada)

iris-video

Geração de vídeo

iris-ocr

OCR de documentos

iris-verify

Verificação de identidade

iris-guard

Detecção de fraude (não implementado)

iris-face

Verificação facial (não implementado)

Conhecimento do Console

APIs de conhecimento do console do espaço de trabalho para ingestão e consulta.

/api/v1/console/knowledge
GET /api/v1/console/knowledge
POST /api/v1/console/knowledge
POST /api/v1/console/knowledge/upload
GET /api/v1/console/knowledge/{item_id}
PATCH /api/v1/console/knowledge/{item_id}
DELETE /api/v1/console/knowledge/{item_id}
POST /api/v1/console/knowledge/ask

Restrições de conhecimento

  • Tamanho máximo do arquivo: 20 MB
  • Tipos permitidos: PDF, DOC, DOCX, TXT, Markdown
  • A ingestão é processada de forma assíncrona em segundo plano
  • Estados: pendente → em processamento → processado | falha

Semântica de erros

Classes de resposta comuns da plataforma.

400

Requisição inválida, dados ausentes ou entrada malformada

401

Autenticação ausente ou inválida

403

Escopo não permitido / restrição de função no espaço de trabalho

404

Recurso não encontrado

409

Requisição já em processamento (conflito de bloqueio)

413

Carga útil muito grande (ex.: limites de áudio/arquivo)

415

Tipo de conteúdo não suportado

422

Falha de validação (escopo/contexto/esquema)

429

Limite de taxa excedido

503

Sobrecarga do sistema / provedor indisponível

Observabilidade

Execução rastreável nos ciclos de vida de chat e voz.

  • IDs de rastreamento para correlação de requisições.
  • Pipeline de middleware para registro de uso.
  • Inicialização do OpenTelemetry com exportação OTLP.
  • Cabeçalhos de resposta expõem sinais de timing em fluxos de voz.
X-Trace-IDX-Session-IDX-STT-Time-MSX-LLM-Time-MSX-TTS-Time-MS

Construa com confiança no runtime do OpenQCore.

Use a documentação como seu mapa de produção para chat, voz, geração multimodal e execução baseada em conhecimento.