
Lunio AI
Editor de imagens com IA que combina referências, intenção textual e controles de composição para gerar ou corrigir imagens com o Gemini de forma estruturada e reproduzível.
O Lunio AI é um ambiente de edição e geração de imagens que transforma uma intenção criativa em uma solicitação estruturada para modelos Gemini. A aplicação combina imagem de referência, prompt textual, presets visuais, enquadramento, iluminação e histórico em uma interface orientada a experimentação rápida, mantendo visíveis os controles que normalmente ficam escondidos em uma chamada de modelo.
O problema central é a fragilidade de fluxos baseados em prompts monolíticos: cada ajuste exige reescrever instruções, referências e parâmetros, o que dificulta repetir uma composição ou entender por que um resultado mudou. O Lunio AI resolve isso separando a intenção em dimensões editáveis, com catálogos canônicos de estilos, poses, câmera e domínios criativos, além de modos explícitos para preservar o prompt original ou executar uma correção estética direcionada.
No frontend React com Vite e Tailwind CSS, o usuário envia uma imagem, descreve o objetivo e combina os controles disponíveis. O construtor de prompts agrega texto, presets, câmera e referências com os parâmetros de amostragem; em seguida, a API Express recompõe a solicitação usando os IDs oficiais do catálogo, injeta guardrails e negativos e mantém a semântica de cada modo. O fluxo padrão compõe a instrução completa, o Raw Prompt envia somente o texto e a configuração de amostragem, enquanto o Aesthetic Fix usa uma diretiva de reparo para corrigir anatomia, partes duplicadas e interseções, ignorando presets, câmera, domínios e referências.
A camada de backend resolve a configuração do modelo e da chave Gemini por variável de ambiente ou Secret Manager, envia os dados inline da imagem original e das referências junto da configuração de geração e persiste os resultados em storage público para serem consumidos pela interface. O painel de saída permite revisar a imagem ao lado da origem, consultar metadados e executar novamente a geração; um histórico limitado a quarenta execuções conserva prompts, presets, câmera, referências, modelo e flags de modo, com uma cópia de sessão no navegador. O Image Chat usa a mesma integração Gemini com instruções específicas para analisar a imagem carregada ou o resultado gerado.
O resultado é um fluxo de criação mais controlável e reproduzível: o usuário explora variações sem perder a estrutura que produziu cada saída, enquanto a API mantém guardrails, armazenamento e seleção de modelo em um ponto central. A arquitetura também está preparada para ambientes locais e para a publicação em Google Cloud, com frontend estático em Cloud Storage, API containerizada no Cloud Run, segredos no Secret Manager e automação de build e deploy pelo Cloud Build.
Visão geral da solução
