Pular para o conteúdo
Beneverso
Equipe

Guia

Guia de Ferramentas de IA

O stack oficial (e a lista do que NÃO usamos). Consulte antes de escolher ferramenta para gerar imagem, vídeo, voz ou trilha.

Produção

Original no vault: Beneverso_Vault/99_⚙️_Sistema/Guia_Ferramentas_IA.md

Ressalva: Documento de 06/05/2026, com revisão prevista mensal (custos) e trimestral (stack) — e nenhuma das duas aconteceu. Sintomas: toda a tabela de custos segue "a registrar", as contas seguem "[a registrar]" e o MiniMax Audio continua marcado como "em avaliação para 2026-Q3", trimestre já em curso. O que vale sem ressalva é a lista de ferramentas proibidas e a política de uso responsável.

Stack oficial. Outras ferramentas só com aprovação prévia.

📝 LLMs (texto)

FerramentaQuando usar
Claude (Sonnet/Opus)Roteiros longos, raciocínio complexo, auditoria editorial, análise de imagem para character pack
Gemini (Pro/Deep Research)Pesquisa profunda, análise de imagem com Nano Banana embutido, contextos longos
GPT (5 / 4.1)Tarefas variadas, cobertura ampla, fallback

Estratégia de modelo:

  • Tarefas simples (classificação inbox, transcrição): Gemini Flash, Claude Haiku, GPT-4.1-mini
  • Tarefas complexas (roteiro Jornal/Miguel, auditoria, pesquisa profunda): Claude Sonnet/Opus, Gemini Pro 2.5, GPT-5

🎨 Imagem

Freepik

  • Para: geração de imagem com referência, edição, montagem de cenas, upscale via Magnific embutido
  • Como prompt visual: descrição em PT-BR + imagem de referência (character pack)
  • Aspect ratios: 9:16 (reels), 1:1 (post), 4:5 (carrossel)
  • Conta: [a registrar em [[Anexos_Sistema/credenciais.md]]]

Magnific

  • Para: upscale e enriquecimento de detalhes em imagens já geradas
  • Quando usar: sempre antes de subir para Instagram/TikTok, garante qualidade
  • Acesso: via Freepik (subscription combinada) ou independente

Nano Banana (via Freepik ou Gemini)

  • Para: consistência de personagem entre cenas (ponto forte da ferramenta)
  • Como: subir imagem do character pack como referência + descrever a cena nova
  • Limitação conhecida: dois personagens na mesma cena às vezes confunde — gerar separado e compor

🎬 Vídeo

Veo 3 (via Flow)

  • Para: animação principal, 5-8s, com áudio sincronizado opcional
  • Como prompt: descrição em PT-BR da cena inteira (personagem + ação + câmera + iluminação + duração)
  • Forte em: consistência facial, expressões sutis, áudio sincronizado nativo
  • Limitação: dois personagens na mesma cena às vezes confunde — gerar separado e compor
  • Estrutura típica do prompt:
    "[Personagem - descrição completa] [ação] em [cenário].
    [Movimento de câmera]. [Iluminação].
    Estilo: boneco de feltro animado, paleta vibrante."
    

Kling (via Freepik)

  • Para: alternativa ao Veo 3 quando a cena exige movimento corporal mais expressivo
  • Como: imagem de referência + descrição da ação
  • Forte em: movimento humano/criatura natural

🔊 Voz

ElevenLabs (atual)

  • Para: clonagem de voz e TTS para os personagens
  • Modelo: Multilingual v2 ou Turbo v2.5
  • Settings padrão: Stability 0.5, Similarity 0.75, Style 0.0–0.3
  • Voice ID: registrar em cada Voice_Profile_<personagem>.md
  • Conta: [a registrar]

MiniMax Audio (em avaliação)

  • Para: alternativa em teste — mesma função do ElevenLabs
  • Status: em avaliação para 2026-Q3
  • Quando aprovado, migrar voice profiles e atualizar este guia

🎵 Música

Suno

  • Para: trilhas sonoras e jingles dos personagens
  • Como prompt: estilo + instrumentação + mood + duração + idioma (PT-BR para letras)
  • Reuso: cada personagem pode ter "tema" próprio gerado uma vez
  • Conta: [a registrar]

⚙️ Orquestração

OpenClaw

  • Para: rodar os 7 agentes do vault (Inbox Bot, Curador Diário, Pesquisador Semanal, Roteirista, Auditor Editorial, Gerador Visual, Arquivista)
  • Memória: o próprio vault Git
  • Canais: WhatsApp para entrada de ideias da equipe
  • Status: estrutura preparada — configuração em documento separado

Claude Code / Codex

  • Para: setup inicial do vault e operações pontuais que precisam de coding
  • Acesso: Git push/pull do repo do vault

🚫 Ferramentas que NÃO usamos

Não cite, não sugira, não tente integrar:

  • Midjourney
  • Sora / Sora 2
  • Higgsfield
  • Runway
  • DALL-E / GPT-Image (a menos que via API GPT direta)
  • Pika
  • HeyGen, D-ID, Hedra (lip sync — avaliar caso necessário no futuro)

Se uma necessidade não for atendida pelo stack atual, criar nota em 00_📥_Inbox/duvidas_para_humano/ propondo avaliação de nova ferramenta.

Custos de referência (revisar mensalmente)

FerramentaPlanoCusto aproximado
Claude APIuso por tokenvariável
Gemini APIuso por tokenvariável
Freepik Pro+mensala registrar
Magnificmensala registrar
Veo 3 (via Flow)mensala registrar
ElevenLabs Creatormensala registrar
Suno Promensala registrar

Política de uso responsável

  • Geração de pessoa real: apenas a Bené (e adversários EM situações públicas verificáveis). NUNCA criar visual de adversário em situação fictícia que possa enganar (deepfake)
  • Watermark: se a plataforma marcar como IA, deixar marca visível
  • Disclosure: legenda do post deve indicar quando o conteúdo é gerado por IA
  • Armazenamento: prompts e outputs ficam no vault, versionados em Git

Atualização deste guia

  • Mensal: revisar custos
  • Trimestral: revisar stack (adições/remoções)
  • Após nova ferramenta entrar: atualizar esta nota + AGENTS.md

Transcrição do vault. Mudou o arquivo lá? Atualize lib/guias.ts — o vault é a fonte, esta página é o espelho.