toolsmith

Sem upload · tudo roda no seu navegador

Como remover o fundo funciona de verdade — e quando falha

Nada está sendo recortado. Um modelo estima, pixel a pixel, quanto de cada um pertence ao objeto. Sabendo disso, todo resultado estranho que você já viu passa a fazer sentido.

Atualizado

O que sai é uma máscara, não um recorte

O modelo olha sua foto e devolve uma imagem em tons de cinza com o mesmo formato: branca onde tem certeza de que aquele pixel é o objeto, preta onde tem certeza de que é fundo, e cinza em todos os pontos em que está em dúvida. Essa imagem vira diretamente o canal de transparência do resultado.

Então não há contorno, não há traçado e nada foi decalcado. O que volta é confiança, desenhada como transparência. Cabelo, pelo, borrão de movimento, vidro e sombra caem no meio dessa faixa — e a suavidade que você vê nessas bordas é o modelo sendo honesto, não sendo ruim.

O modelo procura uma única coisa evidente

A U²-Net, que é o que roda aqui, é uma rede de detecção de objeto saliente. Ela foi treinada para responder a uma pergunta só: nesta imagem, o que se destaca? Um objeto sobre um fundo razoavelmente simples é exatamente o terreno dela.

Dê a ela uma imagem sem resposta única e ela não recusa — espalha uma máscara fraca e incerta por tudo. Passamos vinte e quatro fotografias e lemos os valores de alfa. As dez sem objeto único voltaram como manchas translúcidas ou como nada: uma foto aérea de floresta produziu 0,0% de pixels confiantes e ainda assim «funcionou» formalmente.

Essa falha é silenciosa, e por isso agora a ferramenta mede a máscara e avisa em vez de te entregar um PNG vazio.

  • Funciona: uma pessoa, um produto sobre a mesa, um bicho de estimação, um sapato, uma bicicleta, uma montanha contra o céu.
  • Não funciona: multidões, trânsito, um campo de tulipas, uma estante, um recife de corais, floresta vista de cima.
  • No meio: um grupo de objetos parecidos — talvez saiam alguns, e meio transparentes.

Por que as bordas amolecem e por que fotos grandes ficam piores

O modelo vê sua imagem em 320×320 pixels, qualquer que seja o tamanho real, e a máscara volta também em 320×320. Para aplicá-la é preciso esticá-la de volta às dimensões originais. Numa foto de 4000 pixels, um pixel de máscara cobre mais de uma dezena de pixels reais, e isso aparece no contorno.

Escolher uma foto melhor não resolve — é o formato do método. Se você vai usar o resultado pequeno, não fará diferença; se vai usar grande, fará.

Há também uma troca direta entre download e qualidade. O modelo rápido tem 4,4 MB e o preciso 168 MB: quarenta vezes maior, e visivelmente diferente na mesma foto. O pequeno tende a deixar um fantasma tênue do fundo; o grande separa cabelo e objetos pequenos com limpeza.

Quando o modelo não deveria ser quem escolhe

Se a foto tem vários objetos, ou o que você quer não é o protagonista do enquadramento, aumentar a qualidade do modelo não ajuda: nunca lhe perguntaram a qual você se referia.

Para isso existe outra ferramenta. O recorte por clique passa um codificador pesado sobre a imagem uma única vez e depois responde a cada clique quase de imediato. Medimos 6,0 segundos de codificador e 0,10 segundo por clique na CPU, e é só por isso que dá para ser uma interface de clicar e ver em vez de esperar e ver. Um ponto costuma pegar parte de um objeto; o segundo ponto diz o que mais faz parte dele.

Salve em PNG, ou a transparência some

JPG não tem canal de transparência nenhum. Salve um recorte como JPG e a região transparente não continua transparente — volta em branco ou preto, e muita gente se surpreende com isso depois do fato. PNG e WebP carregam alfa; use um dos dois.

Mais uma coisa que vale dizer em voz alta: as fotos que as pessoas passam por um removedor de fundo costumam ser de pessoas. Isso roda dentro da aba do navegador, então a imagem não é enviada a lugar nenhum — mas o modelo precisa ser baixado antes de começar, e informamos o tamanho antes de você se comprometer.

Faça agora, sem enviar nada

Por que apareceu que não encontrou nenhum objeto?

Porque a máscara saiu fraca em toda parte, em vez de forte em algum lugar. Contamos separadamente os pixels claramente de primeiro plano e os incertos; se quase não há confiantes, ou se os incertos os superam de longe, a resposta honesta é que aquela foto não tem um objeto único a encontrar.

Dá para conseguir uma borda limpa no cabelo?

Em parte. O modelo preciso é bem melhor com cabelo. Mas a máscara é calculada em 320×320 e ampliada, então numa foto de alta resolução há um limite para o quão fina essa borda pode ser: ela nunca vai igualar uma máscara feita à mão.

Removeu o objeto errado. Dá para escolher?

Com a remoção de fundo não — o modelo escolhe o que se destaca e não tem como saber o que você queria. Use a ferramenta de recorte por clique: você aponta o objeto desejado e acrescenta pontos para incluir ou excluir partes.

Vale a leitura