Risorse · Architettura

Architettura Runtime di OpenQCore

Architettura a livello di sistema per l'orchestrazione dei provider, il controllo del routing, la normalizzazione dei contratti e l'affidabilità in produzione.

Architettura Runtime

Un modello di esecuzione stratificato dall'ingresso della richiesta alla risposta deterministica e alla pulizia.

API Gateway

Autenticazione, validazione degli scope, modellazione della richiesta e inizializzazione del trace.

Router decisionale

Classificazione di intento e modalità con selezione del percorso consapevole delle policy.

Motore di esecuzione

Esecuzione Chat/Voice/Iris con gestione sia in streaming che non in streaming.

Controlli di sicurezza

Limiti di velocità, lock distribuiti, circuit breaker e protezione da sovraccarico.

Flusso di esecuzione

Livello di persistenza

Messaggi di sessione, cache di deduplicazione e logging di utilizzo/eventi.

Connettori dei provider

Adattatori OpenAI, Gemini, Claude e Replicate sotto un'unica interfaccia.

Costruttore di contratti

Costruisce involucri di risposta stabili per i client e i sistemi a valle.

Livello provider

Astrazione unificata dei provider con instradamento consapevole delle policy e gestione dei fallback.

OpenAI

Principale per i canali di generazione chat, voce e immagini.

Gemini

Canale multimodale per il ragionamento con supporto alle immagini.

Claude

Canale di fallback per il ragionamento focalizzato sul testo.

Replicate

Canale specializzato per la generazione di immagini/video.

Instradamento consapevole delle policy

Router di astrazione dei provider

Seleziona il provider in base a capacità, profilo di latenza, stato di affidabilità e policy dell'ambiente.

Matrice di instradamento

Instradamento guidato dall'intento con selezione primario/fallback basata sulle capacità.

Tipo di intentoPercorso primarioPercorso di fallbackContratto di output
Chat testualeOpenAI/ClaudeGeminiInvolucro di testo standard
Conversazione vocaleOpenAI (canale voce)Fallback Azure/OpenAIInvolucro voce + metadati
Generazione di immaginiOpenAI/ReplicateReplicate/OpenAIArray di immagini + utilizzo + metadati
Generazione di videoCanale video di ReplicateDefinito dalla policyArray di video + metadati

Livello del contratto di output

Involucro di risposta normalizzato tra tutti i provider e le modalità.

{
  "success": true,
  "content": "...",
  "provider": "...",
  "usage": {},
  "metadata": {},
  "images": [],
  "files": [],
  "videos": []
}

Pilastri dell'architettura

  • Ingresso unificato per autenticazione, ambito e validazione delle policy.
  • Routing basato sull'intento con strategie di esecuzione consapevoli della modalità.
  • L'astrazione del provider isola le differenze dei fornitori dalle superfici del prodotto.
  • La normalizzazione dei contratti garantisce stabilità per frontend e SDK.

Garanzie in produzione

  • Pulizia deterministica per il tracciamento dei lock e delle richieste in sospeso.
  • Degradazione controllata sotto stress del provider o del sistema.
  • Esecuzione tracciabile tramite identificatori di richiesta, sessione e trace.
  • Contratti di risposta coerenti tra tutti i provider.
  • Controlli operativi progettati per carichi di lavoro di produzione su scala aziendale.