Skip to content

Arquitetura de Inteligência Artificial (Gemini & Workers AI)

Arquitetura de Inteligência Artificial (AIService & /api/ai)

Section titled “Arquitetura de Inteligência Artificial (AIService & /api/ai)”

O Prime Crown possui um subsistema de Inteligência Artificial híbrido desenhado para oferecer autonomia operacional, tradução simultânea, análise de sentimento de mensagens e estratégias de expansão geográfica com zero custo recorrente obrigatório.

Todas as chamadas não-streaming do AIService usam um transporte autenticado com teto de 30 segundos e composição do AbortSignal do consumidor. Assim chat, tradução, sentimento, incidentes e recomendações não permanecem indefinidamente ocupados em rede móvel degradada; consumidores com lifecycle descartam resultados depois de desmontagem ou mudança de contexto. Em Leads → Intelligence, gerar estratégia adquire lock síncrono antes do primeiro await, cancela ao sair ou trocar de identidade, limpa o resultado anterior durante a nova análise e só publica resposta/toast/loading quando o epoch ainda pertence à conta que iniciou o pedido. Streaming SSE mantém seu próprio lifecycle de leitura e cancelamento explícito.


🤖 1. Fluxo de Execução da IA Híbrida

Section titled “🤖 1. Fluxo de Execução da IA Híbrida”
sequenceDiagram
    autonumber
    actor User as Usuário / Sistema
    participant Service as AIService.ts (Frontend)
    participant Edge as Edge Handler (/api/ai)
    participant WAI as Cloudflare Workers AI (@cf/meta/llama-3.2-1b-instruct)
    participant Gemini as Google Gemini 2.0 Flash API

    User->>Service: Chama funcionalidade de IA (ex: translateMessage)
    Service->>Edge: POST /api/ai { prompt, isJson, preferFree: true }
    
    alt Tentar Provedor Gratuito Primeiro (Workers AI)
        Edge->>WAI: env.AI.run('@cf/meta/llama-3.2-1b-instruct', { prompt })
        alt Resposta bem-sucedida do Workers AI
            WAI-->>Edge: Retorna resposta da IA
            Edge-->>Service: { text: "..." }
        else Falha ou Limite atingido no Workers AI
            Edge->>Gemini: Fallback: fetch(generativelanguage.googleapis.com, key: GEMINI_API_KEY)
            Gemini-->>Edge: Retorna resposta do Gemini Flash 2.0
            Edge-->>Service: { text: "..." }
        end
    end
    Service-->>User: Exibe resultado na interface

A. Tradução Simultânea de Mensagens (translateMessage)

Section titled “A. Tradução Simultânea de Mensagens (translateMessage)”
  • Provedor: Cloudflare Workers AI (Llama 3.2 1B Instruct).
  • Função: Traduz mensagens entre Inglês (en-GB) e Português (pt-BR) mantendo o tom polido do atendimento de luxo.

B. Sugestão de Respostas ao Cliente (suggestSupportResponse)

Section titled “B. Sugestão de Respostas ao Cliente (suggestSupportResponse)”
  • Provedor: Workers AI / Gemini Flash.
  • Função: Analisa o histórico recente do chat e sugere 3 respostas rápidas em tom cortês britânico (Elite British Tone).

C. Análise de Urgência & Sentimento (analyzeMessageUrgency)

Section titled “C. Análise de Urgência & Sentimento (analyzeMessageUrgency)”
  • Provedor: Workers AI / Gemini Flash.
  • Função: Avalia mensagens de entrada atribuindo nota de urgência (0-10) e sentimento (HAPPY, NEUTRAL, FRUSTRATED, CRITICAL), notificando o gerente se o cliente demonstrar frustração.

D. Estratégia de Crescimento Geográfico (generateGrowthStrategy)

Section titled “D. Estratégia de Crescimento Geográfico (generateGrowthStrategy)”
  • Provedor: Gemini Flash.
  • Função: Correlaciona a localização de clientes e o tempo vago de funcionários para sugerir bairros para campanhas de marketing localizadas.

E. Geração e Streaming em Tempo Real (streamGemini)

Section titled “E. Geração e Streaming em Tempo Real (streamGemini)”
  • Provedor: Google Gemini 2.0 Flash (streamGenerateContent?alt=sse).
  • Função: Transmite tokens de saída imediatamente via Server-Sent Events (SSE) com latência <150ms no primeiro caractere, ideal para geração de cartas de recuperação e relatórios operacionais longos.