Cómo funciona quitar el fondo de verdad — y cuándo falla
No se está recortando nada. Un modelo adivina, píxel a píxel, cuánto de cada uno pertenece al sujeto. Sabiendo eso, todos los resultados raros que has visto tienen explicación.
Actualizado
Lo que sale es una máscara, no un recorte
El modelo mira tu foto y devuelve una imagen en blanco y negro con su misma forma: blanca donde está seguro de que ese píxel es el sujeto, negra donde está seguro de que es fondo, y de mil grises donde duda. Esa imagen se convierte directamente en el canal de transparencia del resultado.
Así que no hay contorno, no hay trazado y no se ha calcado nada. Lo que vuelve es confianza, dibujada como transparencia. El pelo, el pelaje, el movimiento borroso, el cristal y las sombras caen en mitad de ese rango, y esa suavidad del borde no es que el modelo sea malo: es que está siendo honesto.
El modelo busca una sola cosa evidente
U²-Net, que es lo que corre aquí, es una red de detección de objetos salientes. La entrenaron para responder a una única pregunta: en esta imagen, ¿qué destaca? Un sujeto sobre un fondo razonablemente sencillo es exactamente su terreno.
Si le das una imagen sin una respuesta única, no se niega: extiende una máscara débil e insegura por encima de todo. Pasamos veinticuatro fotografías y leímos los valores de alfa. Las diez que no tenían un sujeto claro volvieron como manchas translúcidas o como nada: una toma aérea de bosque produjo un 0.0% de píxeles seguros y aun así «funcionó» formalmente.
Ese fallo es silencioso, y por eso ahora la herramienta mide la máscara y te lo dice en lugar de entregarte un PNG vacío.
- Funciona: una persona, un producto sobre una mesa, una mascota, un zapato, una bicicleta, una montaña contra el cielo.
- No funciona: multitudes, tráfico, un campo de tulipanes, una estantería, un arrecife, un bosque visto desde arriba.
- A medias: un grupo de objetos parecidos — puede que salgan algunos, y medio transparentes.
Por qué se ablandan los bordes y por qué empeora en fotos grandes
El modelo ve tu imagen a 320×320 píxeles sea cual sea su tamaño real, y la máscara vuelve también a 320×320. Para aplicarla hay que estirarla hasta las dimensiones originales. En una foto de 4000 píxeles, un píxel de máscara cubre más de una decena de píxeles reales, y eso se nota en el contorno.
Elegir una foto mejor no lo arregla: es la forma del método. Si vas a usar el resultado en pequeño, dará igual; si lo vas a usar en grande, no.
También hay un canje directo entre descarga y calidad. El modelo rápido pesa 4,4 MB y el preciso 168 MB: cuarenta veces más, y con resultados visiblemente distintos sobre la misma foto. El pequeño suele dejar un fantasma tenue del fondo; el grande separa limpiamente el pelo y los objetos pequeños.
Cuándo el modelo no debería ser quien elige
Si la foto tiene varios objetos, o lo que quieres no es el protagonista del encuadre, subir la calidad del modelo no sirve de nada: nunca le preguntaron a cuál te referías.
Para eso hay otra herramienta. El recorte por clic pasa un codificador pesado sobre la imagen una sola vez y luego responde a cada clic casi al instante. Medimos 6,0 segundos de codificador y 0,10 segundos por clic en CPU, y por eso puede ser una interfaz de pulsar y ver en lugar de esperar y ver. Un punto suele coger parte de un objeto; el segundo punto le dice qué más forma parte de él.
Guárdalo en PNG o la transparencia desaparece
JPG no tiene canal de transparencia. Si guardas un recorte como JPG, la zona transparente no sigue siéndolo: vuelve en blanco o en negro, y mucha gente se lleva la sorpresa después. PNG y WebP sí llevan alfa; usa uno de los dos.
Una cosa más conviene decirla en voz alta: las fotos que la gente pasa por un quitafondos suelen ser de personas. Esto corre dentro de la pestaña del navegador, así que la imagen no se envía a ninguna parte — pero el modelo sí hay que descargarlo antes de empezar, y te decimos su tamaño antes de que te comprometas.
Hazlo ahora, sin subir nada
¿Por qué dice que no encontró ningún sujeto?
Porque la máscara salió débil por todas partes en vez de fuerte en algún sitio. Contamos por separado los píxeles claramente de primer plano y los dudosos; si casi no hay seguros, o los dudosos los superan de largo, la respuesta honesta es que esa foto no tiene un sujeto único que encontrar.
¿Puedo conseguir un borde limpio en el pelo?
En parte. El modelo preciso es mucho mejor con el pelo. Pero la máscara se calcula a 320×320 y se amplía, así que en una foto de alta resolución hay un límite a lo fino que puede ser ese borde: nunca igualará a una máscara hecha a mano.
Ha quitado el objeto equivocado. ¿Puedo elegir?
Con el quitafondos no: el modelo escoge lo que destaca y no tiene forma de saber qué querías. Usa el recorte por clic, donde señalas el objeto que quieres y añades puntos para incluir o excluir partes.
Vale la pena leer
- Qué es un archivo HEIC y por qué no abre
- PNG, JPG, WebP o AVIF: ¿cuál deberías usar?
- Por qué tu PDF pesa tanto y qué lo reduce de verdad
- MOV frente a MP4: qué cambia de verdad
- ¿La IA añade detalle real al ampliar una imagen?
- SRT o VTT — ¿qué archivo de subtítulos necesitas?
- Qué son los stems — ¿y de verdad se puede desmezclar una canción?
- ¿Por qué no se abre mi PDF?
- CSV frente a Excel — qué cambia de verdad
- ¿Se puede fiar uno de un resumen hecho por IA?
- WAV o MP3: ¿cuál necesitas realmente?
- ¿Qué es un códec y en qué se diferencia de MP4?
- ¿Por qué mi vídeo sale de lado?