FLUX.1 Kontext no ComfyUI: edição em várias etapas e consistência de personagens

"O model card do FLUX.1 Kontext Dev da Black Forest Labs descreve os 12B parâmetros, edição sucessiva, uso das saídas e limites da Non-Commercial License."
Uma imagem frontal de uma personagem fictícia já está satisfatória: cabelo curto prateado, olhos âmbar e detalhes corretos na roupa. Na segunda imagem, a única intenção era trocar o palco por uma rua urbana, mas o formato do rosto, a cor do cabelo e a roupa mudaram juntos. Depois de ajustar pose e expressão, a terceira rodada começou a perder nitidez. É nesse ponto que o FLUX.1 Kontext ajuda: ele usa a imagem de entrada como contexto e permite dizer, por texto, o que mudar e o que manter, reduzindo o desvio causado por regenerar a imagem inteira.
Ele não é uma ferramenta de travamento permanente de rosto. A Black Forest Labs mostrou capacidade de manter elementos entre edições, mas também publicou um caso de falha com artefatos e perda de qualidade após seis rodadas. A abordagem mais segura é explorar em sequências curtas, salvar imagens intermediárias e mudar uma variável principal por vez.
Para que o FLUX.1 Kontext serve e quando não usar
FLUX.1 Kontext Dev é um modelo de edição de imagens com 12B parâmetros que recebe ao mesmo tempo uma imagem e instruções de texto. Ele é adequado para trocar fundos, roupas, regiões específicas, estilos e textos, além de continuar uma edição a partir da saída anterior.
| Necessidade | Como o Kontext trabalha | O que preservar no prompt | Principal risco |
|---|---|---|---|
| Trocar o fundo e manter a pessoa | Alterar somente o fundo | face, pose, scale, position | O fundo também altera rosto ou composição |
| Trocar a roupa e manter o rosto | Descrever apenas material e cor da roupa | facial features, hairstyle, expression | Roupa e formato do corpo mudam juntos |
| Mudar o cenário de um produto | Reescrever somente o ambiente | shape, logo, material, proportions | Logotipo e proporção da embalagem são redesenhados |
| Criar uma série em várias rodadas | Alterar uma dimensão por rodada | Repetir em cada rodada os itens essenciais | Pequenos erros se acumulam |
| Criar um ativo de personagem duradouro | Usar o Kontext para explorar direções | Salvar uma referência limpa | Menos estabilidade de longo prazo que uma solução treinada |
O Kontext e outros métodos de controle resolvem problemas diferentes. O ControlNet é mais apropriado para fixar pose, profundidade e contorno; o LoRA funciona melhor para reutilizar por longo prazo um personagem ou estilo. IPAdapter injeta condições a partir de uma imagem de referência, enquanto soluções do tipo FaceID priorizam características faciais.
Instalar o Kontext Dev: arquivos e pastas
O tutorial oficial atual do ComfyUI usa como caminho principal um diffusion model FP8 scaled, um VAE e dois text encoders. A página do modelo pode exigir a aceitação prévia dos termos da BFL.
ComfyUI/models/
├── diffusion_models/
│ └── flux1-dev-kontext_fp8_scaled.safetensors
├── text_encoders/
│ ├── clip_l.safetensors
│ └── t5xxl_fp16.safetensors
└── vae/
└── ae.safetensors
Segundo o tutorial oficial, t5xxl_fp16.safetensors também pode ser substituído por t5xxl_fp8_e4m3fn_scaled.safetensors. Depois de copiar os arquivos, atualize a lista de modelos. Se o loader ainda não os encontrar, verifique o nome das pastas e a integridade dos arquivos e reinicie o ComfyUI. Para problemas gerais de importação e nós ausentes, consulte o guia de reutilização de workflows do ComfyUI.
Abrir o template nativo
Atualize o ComfyUI ou o ComfyUI Desktop e procure Flux.1 Kontext Dev em Workflow Templates. O local e o nome do menu podem mudar com a interface. Se não encontrar o template, atualize antes de instalar pacotes de nós de procedência desconhecida.
Executar a primeira rodada: cadeia de nós e prompt em inglês
O fluxo oficial Dev segue esta sequência:
- Em
Load Diffusion Model, selecioneflux1-dev-kontext_fp8_scaled.safetensors. - Em
DualCLIP Load, selecioneclip_l.safetensorse o encoder T5. - Em
Load VAE, selecioneae.safetensors. - Em
Load Image(from output), abra a imagem que será editada. - Escreva o prompt em inglês no
CLIP Text Encode. - Clique em
Queueou useCtrl/Cmd + Enter.
A página oficial atual do ComfyUI ainda informa que esse fluxo Kontext Dev aceita somente prompts em inglês. Não dependa de resultados ocasionais em português. Uma instrução curta e específica em inglês facilita descobrir se a falha está no modelo, no prompt ou no workflow.
Na primeira rodada, mude somente um objeto
Teste primeiro a troca do fundo. Não altere ao mesmo tempo fundo, roupa, pose, idade e estilo. Uma única mudança cria uma referência limpa e mostra qual instrução introduziu o desvio.
Change the background to a city street at night.
Keep the person in the exact same position, scale, and pose.
Preserve the same facial features, hairstyle, expression, and clothing.
Como escrever o prompt: alteração e preservação
Um prompt do Kontext não precisa acumular termos de qualidade. O importante é declarar objeto, ação e invariantes. Palavras como beautiful, better e make it different não definem uma fronteira de edição; change, replace, keep e preserve ajudam o modelo a separar o que muda do que permanece.
| Cenário | Instrução imprecisa | Formulação mais controlável |
|---|---|---|
| Trocar o fundo | Put her on a beach | Change the background to a beach while keeping the same face, pose, scale, and position |
| Mudar a roupa | Transform her into a Viking | Change only the clothing to Viking armor while preserving facial features and hairstyle |
| Alterar a cor do produto | Create a new bottle design | Change only the bottle color to blue; preserve shape, logo placement, material, and proportions |
| Converter o estilo | Make it a sketch | Convert to a pencil sketch while maintaining the original composition and subject identity |
Termos de preservação para pessoa, produto e composição
| O que manter | Itens que devem aparecer no prompt | Sinal de falha |
|---|---|---|
| Identidade da pessoa | facial features, hairstyle, expression, body shape | Mudança nos olhos, rosto, cabelo ou idade |
| Forma do produto | shape, logo placement, material, proportions | Alteração na grafia do logotipo, na curva da embalagem ou no material |
| Composição | composition, camera angle, position, scale | Deslocamento, corte ou perspectiva diferente |
| Pose | pose, hand position, body orientation | Posição dos membros e contorno se desviam |
Quando a pose precisar ser rigorosa, não continue acrescentando mais descrições de pose ao prompt do Kontext. Esse é normalmente o sinal para usar ControlNet.
Edição em várias rodadas: salvar, verificar e reverter
O fluxo usa Load Image(from output) para colocar a saída anterior como entrada da rodada seguinte. Uma ordem prática é fundo, roupa ou acessório, movimento ou expressão leve e, por último, iluminação e estilo.
- Salve a imagem de referência sem edição.
- Na primeira rodada, troque apenas o fundo e salve
round-01. - Na segunda, mude somente roupa ou acessório e salve
round-02. - Na terceira, faça uma alteração leve de pose ou expressão.
- Só então ajuste estilo, cor ou iluminação.
Quando é obrigatório reverter
Se formato do rosto, olhos, logotipo, proporções do produto ou nitidez piorarem de forma clara, volte à última imagem intermediária limpa. Não acrescente “restaure o rosto” sobre uma imagem já desviada: a nova instrução pode redesenhar regiões adicionais e carregar o erro para a rodada seguinte.
Não existe um número fixo de rodadas seguras. O caso de falha da BFL mostra artefatos visíveis após seis edições, mas isso não significa “cinco são seguras e seis sempre falham”. A imagem de entrada, a amplitude da mudança e as instruções de cada rodada afetam o resultado.
Receitas práticas para consistência de personagens e produtos
Para personagens, descreva características observáveis em vez de usar apenas she ou him:
Change only the background.
Keep the same woman with short silver hair and amber eyes.
Preserve her facial features, hairstyle, expression, body shape, pose, and scale.
Para produtos, liste como invariantes os detalhes sensíveis da marca:
Place the same bottle on a marble counter.
Preserve the exact bottle shape, logo placement, label text, material, proportions, and camera angle.
Change only the environment and surrounding lighting.
Esses prompts reduzem o desvio, mas não substituem a verificação humana. Em imagens comerciais de produtos, revise logotipo, texto, proporções, informações da embalagem e material em cada arquivo. Para pessoas reais, use apenas material próprio ou autorizado.
Como escolher entre Dev, Pro, Max, FP8 e GGUF
| Opção | Acesso | Uso indicado | Atenção |
|---|---|---|---|
| Kontext Dev | Pesos locais abertos | Pesquisa, personalização, privacidade local e testes frequentes | Pesos sujeitos à Non-Commercial License |
| Kontext Pro | API / Partner Nodes | Edição comercial e iteração rápida | Preço e termos dependem da plataforma atual |
| Kontext Max | API / Partner Nodes | Maior obediência às instruções e edição de texto | Não equivale aos pesos locais Dev |
| FP8 scaled | Caminho principal do tutorial oficial do ComfyUI | Executar rapidamente com nós nativos | Memória suficiente depende do ambiente e da resolução |
| GGUF / Nunchaku | Implementações da comunidade ou específicas | Reduzir uso de VRAM ou acelerar | Nós, qualidade da quantização e compatibilidade exigem teste |
Não trate “12 GB sempre funciona” ou “16 GB sempre é rápido” como requisitos fixos. O consumo também depende de T5, resolução, VAE, preview, offload e outros nós. Para mais detalhes, consulte o guia de baixo uso de VRAM e aceleração no ComfyUI.
Comece a testar o guidance pelo valor do exemplo
O exemplo do Diffusers no model card do Hugging Face usa guidance_scale=2.5. Ele serve como ponto inicial, mas diferentes nós, imagens e áreas de edição no ComfyUI não justificam afirmar que “1.5–2.5 é sempre melhor”. Fixe a entrada e o seed e ajuste apenas um parâmetro por vez.
Ordem de diagnóstico para falhas comuns
| Sintoma | Verifique primeiro | Próximo passo |
|---|---|---|
| O arquivo não aparece na lista de modelos | Pasta, nome do arquivo e integridade do download | Atualize a lista e reinicie |
| O prompt quase não tem efeito | Idioma inglês e objeto específico | Use change/replace para declarar a alteração |
| O rosto muda ao trocar o fundo | Mais de uma dimensão foi alterada? | Acrescente face, hairstyle e pose aos itens preservados |
| A imagem perde nitidez a cada rodada | A saída já desviada continua sendo usada? | Volte à última imagem intermediária limpa |
| O logotipo do produto muda | logo e label foram declarados invariantes? | Reduza a área de edição e revise manualmente |
| Composição ou pose sai do controle | É necessário controle estrutural forte? | Use ou combine ControlNet |
| VRAM insuficiente | FP8, T5, resolução e nós adicionais | Reavalie GGUF, offload ou API |
Durante o diagnóstico, fixe imagem de entrada e seed e altere apenas o prompt ou um parâmetro. Trocar modelo, quantização, resolução e prompt ao mesmo tempo impede descobrir a causa.
Licença, conformidade e escolha final
Os pesos do FLUX.1 Kontext Dev estão atualmente sujeitos à FLUX.1 dev Non-Commercial License. O model card informa que as saídas geradas podem ter uso pessoal, científico e comercial, mas isso não autoriza integrar diretamente os pesos Dev em um serviço pago. Para implantação comercial, confira o licensing atual da BFL. Pro e Max são produtos de API e seguem os termos da plataforma usada.
A escolha final depende do objetivo:
- Para trocar fundo, roupa, região específica e explorar conceitos por pouco tempo, comece com Kontext.
- Para reutilizar de forma duradoura um personagem original ou estilo, use LoRA.
- Se o objetivo principal for manter o mesmo rosto, avalie soluções do tipo FaceID e trate a autorização de imagem.
- Quando pose, contorno e composição precisarem permanecer rigorosos, use ControlNet.
- Para injetar estilo ou assunto de uma referência em uma nova geração, avalie IPAdapter.
Depois da primeira execução, salve a referência e avance na ordem “fundo → roupa → movimento leve → iluminação ou estilo”. A vantagem do Kontext não é prometer ausência de desvio, mas dar contexto claro a cada alteração e permitir voltar ao último estado limpo quando algo sair do esperado.
Fazer uma edição Kontext em várias etapas com possibilidade de reversão
Execute primeiro o template oficial Dev, altere uma variável por rodada e descreva claramente o que deve ser preservado em personagens, produtos e composição.
- 1
Step 1: Atualizar e abrir o template
Atualize o ComfyUI e procure Flux.1 Kontext Dev em Workflow Templates. Se o template não aparecer, confirme a versão instalada. - 2
Step 2: Colocar os arquivos dos modelos
Instale diffusion model, VAE e text encoders CLIP/T5 nas pastas correspondentes; depois atualize ou reinicie e confirme que os loaders encontram os arquivos. - 3
Step 3: Importar a imagem de referência
Abra uma imagem própria ou autorizada em Load Image(from output) e salve uma cópia da referência ainda não editada. - 4
Step 4: Começar com uma única variável
No CLIP Text Encode, descreva em inglês o objeto a alterar e liste rosto, pose, proporções ou composição que precisam permanecer iguais. - 5
Step 5: Salvar a saída da primeira rodada
Verifique rosto, cabelo, logotipo, material, posição e nitidez; só use a saída na próxima rodada depois de aprová-la. - 6
Step 6: Adicionar mudanças gradualmente
Avance na ordem fundo, roupa ou acessório, movimento leve, iluminação ou estilo, alterando apenas uma dimensão principal por rodada. - 7
Step 7: Reverter ao primeiro sinal de desvio
Se rosto, proporções do produto, logotipo ou nitidez piorarem, volte à última saída limpa, reduza a mudança e tente novamente. - 8
Step 8: Decidir se é hora de trocar de método
Para reutilização duradoura de personagens, travamento rigoroso de rosto ou controle preciso de pose, avalie LoRA, soluções do tipo FaceID ou ControlNet.
FAQ
Qual é a diferença entre FLUX.1 Kontext e LoRA?
Onde colocar os arquivos do Kontext Dev no ComfyUI?
Como reduzir mudanças no rosto com FLUX Kontext?
O prompt do Kontext Dev pode ser escrito em português?
Por que a imagem perde nitidez após várias edições?
FLUX.1 Kontext Dev pode ser usado comercialmente?
10 min de leitura · Publicado em: 21 ago 2026 · Atualizado em: 21 ago 2026
Guia prático de ComfyUI e Stable Diffusion
Se você chegou pela busca, o caminho mais rápido é ir para o post anterior ou próximo desta série.
Anterior
ComfyUI IPAdapter: imagem de referência, estilo, composição e modelos
Combine o IPAdapter com o CLIP Vision, ajuste weight e weight_type, controle estilo e composição e resolva erros em fluxos SD1.5, SDXL e FLUX.
Parte 7 de 13
Próximo
Consistência facial no ComfyUI: InstantID, FaceID ou ReActor
Compare InstantID, IPAdapter FaceID e ReActor para manter rostos no ComfyUI, com modelos, caminhos, ajustes, erros frequentes e limites de licença.
Parte 9 de 13



Comentários
Entre com GitHub para comentar