Arquitetura de Inteligência Artificial (Gemini & Workers AI)
Arquitetura de Inteligência Artificial (AIService & /api/ai)
Section titled “Arquitetura de Inteligência Artificial (AIService & /api/ai)”O Prime Crown possui um subsistema de Inteligência Artificial híbrido desenhado para oferecer autonomia operacional, tradução simultânea, análise de sentimento de mensagens e estratégias de expansão geográfica com zero custo recorrente obrigatório.
Todas as chamadas não-streaming do AIService usam um transporte autenticado com teto de 30 segundos e composição do AbortSignal do consumidor. Assim chat, tradução, sentimento, incidentes e recomendações não permanecem indefinidamente ocupados em rede móvel degradada; consumidores com lifecycle descartam resultados depois de desmontagem ou mudança de contexto. Em Leads → Intelligence, gerar estratégia adquire lock síncrono antes do primeiro await, cancela ao sair ou trocar de identidade, limpa o resultado anterior durante a nova análise e só publica resposta/toast/loading quando o epoch ainda pertence à conta que iniciou o pedido. Streaming SSE mantém seu próprio lifecycle de leitura e cancelamento explícito.
🤖 1. Fluxo de Execução da IA Híbrida
Section titled “🤖 1. Fluxo de Execução da IA Híbrida”sequenceDiagram
autonumber
actor User as Usuário / Sistema
participant Service as AIService.ts (Frontend)
participant Edge as Edge Handler (/api/ai)
participant WAI as Cloudflare Workers AI (@cf/meta/llama-3.2-1b-instruct)
participant Gemini as Google Gemini 2.0 Flash API
User->>Service: Chama funcionalidade de IA (ex: translateMessage)
Service->>Edge: POST /api/ai { prompt, isJson, preferFree: true }
alt Tentar Provedor Gratuito Primeiro (Workers AI)
Edge->>WAI: env.AI.run('@cf/meta/llama-3.2-1b-instruct', { prompt })
alt Resposta bem-sucedida do Workers AI
WAI-->>Edge: Retorna resposta da IA
Edge-->>Service: { text: "..." }
else Falha ou Limite atingido no Workers AI
Edge->>Gemini: Fallback: fetch(generativelanguage.googleapis.com, key: GEMINI_API_KEY)
Gemini-->>Edge: Retorna resposta do Gemini Flash 2.0
Edge-->>Service: { text: "..." }
end
end
Service-->>User: Exibe resultado na interface
⚡ 2. Recursos Suportados pelo AIService
Section titled “⚡ 2. Recursos Suportados pelo AIService”A. Tradução Simultânea de Mensagens (translateMessage)
Section titled “A. Tradução Simultânea de Mensagens (translateMessage)”- Provedor: Cloudflare Workers AI (Llama 3.2 1B Instruct).
- Função: Traduz mensagens entre Inglês (
en-GB) e Português (pt-BR) mantendo o tom polido do atendimento de luxo.
B. Sugestão de Respostas ao Cliente (suggestSupportResponse)
Section titled “B. Sugestão de Respostas ao Cliente (suggestSupportResponse)”- Provedor: Workers AI / Gemini Flash.
- Função: Analisa o histórico recente do chat e sugere 3 respostas rápidas em tom cortês britânico (Elite British Tone).
C. Análise de Urgência & Sentimento (analyzeMessageUrgency)
Section titled “C. Análise de Urgência & Sentimento (analyzeMessageUrgency)”- Provedor: Workers AI / Gemini Flash.
- Função: Avalia mensagens de entrada atribuindo nota de urgência (0-10) e sentimento (
HAPPY,NEUTRAL,FRUSTRATED,CRITICAL), notificando o gerente se o cliente demonstrar frustração.
D. Estratégia de Crescimento Geográfico (generateGrowthStrategy)
Section titled “D. Estratégia de Crescimento Geográfico (generateGrowthStrategy)”- Provedor: Gemini Flash.
- Função: Correlaciona a localização de clientes e o tempo vago de funcionários para sugerir bairros para campanhas de marketing localizadas.
E. Geração e Streaming em Tempo Real (streamGemini)
Section titled “E. Geração e Streaming em Tempo Real (streamGemini)”- Provedor: Google Gemini 2.0 Flash (
streamGenerateContent?alt=sse). - Função: Transmite tokens de saída imediatamente via Server-Sent Events (SSE) com latência <150ms no primeiro caractere, ideal para geração de cartas de recuperação e relatórios operacionais longos.