Stack oficial. Outras ferramentas só com aprovação prévia.
📝 LLMs (texto)
| Ferramenta | Quando usar |
|---|---|
| Claude (Sonnet/Opus) | Roteiros longos, raciocínio complexo, auditoria editorial, análise de imagem para character pack |
| Gemini (Pro/Deep Research) | Pesquisa profunda, análise de imagem com Nano Banana embutido, contextos longos |
| GPT (5 / 4.1) | Tarefas variadas, cobertura ampla, fallback |
Estratégia de modelo:
- Tarefas simples (classificação inbox, transcrição): Gemini Flash, Claude Haiku, GPT-4.1-mini
- Tarefas complexas (roteiro Jornal/Miguel, auditoria, pesquisa profunda): Claude Sonnet/Opus, Gemini Pro 2.5, GPT-5
🎨 Imagem
Freepik
- Para: geração de imagem com referência, edição, montagem de cenas, upscale via Magnific embutido
- Como prompt visual: descrição em PT-BR + imagem de referência (character pack)
- Aspect ratios: 9:16 (reels), 1:1 (post), 4:5 (carrossel)
- Conta: [a registrar em [[Anexos_Sistema/credenciais.md]]]
Magnific
- Para: upscale e enriquecimento de detalhes em imagens já geradas
- Quando usar: sempre antes de subir para Instagram/TikTok, garante qualidade
- Acesso: via Freepik (subscription combinada) ou independente
Nano Banana (via Freepik ou Gemini)
- Para: consistência de personagem entre cenas (ponto forte da ferramenta)
- Como: subir imagem do character pack como referência + descrever a cena nova
- Limitação conhecida: dois personagens na mesma cena às vezes confunde — gerar separado e compor
🎬 Vídeo
Veo 3 (via Flow)
- Para: animação principal, 5-8s, com áudio sincronizado opcional
- Como prompt: descrição em PT-BR da cena inteira (personagem + ação + câmera + iluminação + duração)
- Forte em: consistência facial, expressões sutis, áudio sincronizado nativo
- Limitação: dois personagens na mesma cena às vezes confunde — gerar separado e compor
- Estrutura típica do prompt:
"[Personagem - descrição completa] [ação] em [cenário]. [Movimento de câmera]. [Iluminação]. Estilo: boneco de feltro animado, paleta vibrante."
Kling (via Freepik)
- Para: alternativa ao Veo 3 quando a cena exige movimento corporal mais expressivo
- Como: imagem de referência + descrição da ação
- Forte em: movimento humano/criatura natural
🔊 Voz
ElevenLabs (atual)
- Para: clonagem de voz e TTS para os personagens
- Modelo: Multilingual v2 ou Turbo v2.5
- Settings padrão: Stability 0.5, Similarity 0.75, Style 0.0–0.3
- Voice ID: registrar em cada
Voice_Profile_<personagem>.md - Conta: [a registrar]
MiniMax Audio (em avaliação)
- Para: alternativa em teste — mesma função do ElevenLabs
- Status: em avaliação para 2026-Q3
- Quando aprovado, migrar voice profiles e atualizar este guia
🎵 Música
Suno
- Para: trilhas sonoras e jingles dos personagens
- Como prompt: estilo + instrumentação + mood + duração + idioma (PT-BR para letras)
- Reuso: cada personagem pode ter "tema" próprio gerado uma vez
- Conta: [a registrar]
⚙️ Orquestração
OpenClaw
- Para: rodar os 7 agentes do vault (Inbox Bot, Curador Diário, Pesquisador Semanal, Roteirista, Auditor Editorial, Gerador Visual, Arquivista)
- Memória: o próprio vault Git
- Canais: WhatsApp para entrada de ideias da equipe
- Status: estrutura preparada — configuração em documento separado
Claude Code / Codex
- Para: setup inicial do vault e operações pontuais que precisam de coding
- Acesso: Git push/pull do repo do vault
🚫 Ferramentas que NÃO usamos
Não cite, não sugira, não tente integrar:
- Midjourney
- Sora / Sora 2
- Higgsfield
- Runway
- DALL-E / GPT-Image (a menos que via API GPT direta)
- Pika
- HeyGen, D-ID, Hedra (lip sync — avaliar caso necessário no futuro)
Se uma necessidade não for atendida pelo stack atual, criar nota em 00_📥_Inbox/duvidas_para_humano/ propondo avaliação de nova ferramenta.
Custos de referência (revisar mensalmente)
| Ferramenta | Plano | Custo aproximado |
|---|---|---|
| Claude API | uso por token | variável |
| Gemini API | uso por token | variável |
| Freepik Pro+ | mensal | a registrar |
| Magnific | mensal | a registrar |
| Veo 3 (via Flow) | mensal | a registrar |
| ElevenLabs Creator | mensal | a registrar |
| Suno Pro | mensal | a registrar |
Política de uso responsável
- Geração de pessoa real: apenas a Bené (e adversários EM situações públicas verificáveis). NUNCA criar visual de adversário em situação fictícia que possa enganar (deepfake)
- Watermark: se a plataforma marcar como IA, deixar marca visível
- Disclosure: legenda do post deve indicar quando o conteúdo é gerado por IA
- Armazenamento: prompts e outputs ficam no vault, versionados em Git
Atualização deste guia
- Mensal: revisar custos
- Trimestral: revisar stack (adições/remoções)
- Após nova ferramenta entrar: atualizar esta nota + AGENTS.md