Como remover o fundo funciona de verdade — e quando falha
Nada está sendo recortado. Um modelo estima, pixel a pixel, quanto de cada um pertence ao objeto. Sabendo disso, todo resultado estranho que você já viu passa a fazer sentido.
Atualizado
O que sai é uma máscara, não um recorte
O modelo olha sua foto e devolve uma imagem em tons de cinza com o mesmo formato: branca onde tem certeza de que aquele pixel é o objeto, preta onde tem certeza de que é fundo, e cinza em todos os pontos em que está em dúvida. Essa imagem vira diretamente o canal de transparência do resultado.
Então não há contorno, não há traçado e nada foi decalcado. O que volta é confiança, desenhada como transparência. Cabelo, pelo, borrão de movimento, vidro e sombra caem no meio dessa faixa — e a suavidade que você vê nessas bordas é o modelo sendo honesto, não sendo ruim.
O modelo procura uma única coisa evidente
A U²-Net, que é o que roda aqui, é uma rede de detecção de objeto saliente. Ela foi treinada para responder a uma pergunta só: nesta imagem, o que se destaca? Um objeto sobre um fundo razoavelmente simples é exatamente o terreno dela.
Dê a ela uma imagem sem resposta única e ela não recusa — espalha uma máscara fraca e incerta por tudo. Passamos vinte e quatro fotografias e lemos os valores de alfa. As dez sem objeto único voltaram como manchas translúcidas ou como nada: uma foto aérea de floresta produziu 0,0% de pixels confiantes e ainda assim «funcionou» formalmente.
Essa falha é silenciosa, e por isso agora a ferramenta mede a máscara e avisa em vez de te entregar um PNG vazio.
- Funciona: uma pessoa, um produto sobre a mesa, um bicho de estimação, um sapato, uma bicicleta, uma montanha contra o céu.
- Não funciona: multidões, trânsito, um campo de tulipas, uma estante, um recife de corais, floresta vista de cima.
- No meio: um grupo de objetos parecidos — talvez saiam alguns, e meio transparentes.
Por que as bordas amolecem e por que fotos grandes ficam piores
O modelo vê sua imagem em 320×320 pixels, qualquer que seja o tamanho real, e a máscara volta também em 320×320. Para aplicá-la é preciso esticá-la de volta às dimensões originais. Numa foto de 4000 pixels, um pixel de máscara cobre mais de uma dezena de pixels reais, e isso aparece no contorno.
Escolher uma foto melhor não resolve — é o formato do método. Se você vai usar o resultado pequeno, não fará diferença; se vai usar grande, fará.
Há também uma troca direta entre download e qualidade. O modelo rápido tem 4,4 MB e o preciso 168 MB: quarenta vezes maior, e visivelmente diferente na mesma foto. O pequeno tende a deixar um fantasma tênue do fundo; o grande separa cabelo e objetos pequenos com limpeza.
Quando o modelo não deveria ser quem escolhe
Se a foto tem vários objetos, ou o que você quer não é o protagonista do enquadramento, aumentar a qualidade do modelo não ajuda: nunca lhe perguntaram a qual você se referia.
Para isso existe outra ferramenta. O recorte por clique passa um codificador pesado sobre a imagem uma única vez e depois responde a cada clique quase de imediato. Medimos 6,0 segundos de codificador e 0,10 segundo por clique na CPU, e é só por isso que dá para ser uma interface de clicar e ver em vez de esperar e ver. Um ponto costuma pegar parte de um objeto; o segundo ponto diz o que mais faz parte dele.
Salve em PNG, ou a transparência some
JPG não tem canal de transparência nenhum. Salve um recorte como JPG e a região transparente não continua transparente — volta em branco ou preto, e muita gente se surpreende com isso depois do fato. PNG e WebP carregam alfa; use um dos dois.
Mais uma coisa que vale dizer em voz alta: as fotos que as pessoas passam por um removedor de fundo costumam ser de pessoas. Isso roda dentro da aba do navegador, então a imagem não é enviada a lugar nenhum — mas o modelo precisa ser baixado antes de começar, e informamos o tamanho antes de você se comprometer.
Faça agora, sem enviar nada
Por que apareceu que não encontrou nenhum objeto?
Porque a máscara saiu fraca em toda parte, em vez de forte em algum lugar. Contamos separadamente os pixels claramente de primeiro plano e os incertos; se quase não há confiantes, ou se os incertos os superam de longe, a resposta honesta é que aquela foto não tem um objeto único a encontrar.
Dá para conseguir uma borda limpa no cabelo?
Em parte. O modelo preciso é bem melhor com cabelo. Mas a máscara é calculada em 320×320 e ampliada, então numa foto de alta resolução há um limite para o quão fina essa borda pode ser: ela nunca vai igualar uma máscara feita à mão.
Removeu o objeto errado. Dá para escolher?
Com a remoção de fundo não — o modelo escolhe o que se destaca e não tem como saber o que você queria. Use a ferramenta de recorte por clique: você aponta o objeto desejado e acrescenta pontos para incluir ou excluir partes.
Vale a leitura
- O que é um arquivo HEIC e por que ele não abre
- PNG, JPG, WebP ou AVIF — qual você deveria usar?
- Por que seu PDF é tão pesado — e o que realmente reduz
- MOV contra MP4 — o que muda de verdade
- A IA cria detalhe real ao ampliar uma imagem?
- SRT ou VTT — de qual arquivo de legenda você precisa?
- O que são stems — e dá mesmo para separar uma música pronta?
- Por que meu PDF não abre?
- CSV contra Excel — o que muda de verdade
- Dá para confiar num resumo feito por IA?
- WAV ou MP3: qual você precisa de verdade?
- O que é um códec — e como ele difere do MP4?
- Por que meu vídeo fica deitado?