Eliminar objetos no deseados de un video online gratis
Guía paso a paso para eliminar objetos no deseados de un video online gratis. Incluye modelos, entradas, salidas y flujos de trabajo de ejemplo con especificaciones concretas.
En resumen
Eliminar objetos de un video consiste en borrar elementos y rellenar los huecos con modelos de IA como Veo 3.1. Sube archivos MP4 en 1080p, aplica máscaras en fotogramas clave y genera clips limpios de 30 segundos, con el costo indicado antes de cada trabajo.
Qué significa realmente eliminar objetos de un video
Eliminar objetos de un video consiste en borrar elementos específicos de una grabación en movimiento y reemplazarlos con un fondo que coincida con los fotogramas circundantes. No es recortar, desenfocar ni aplicar una simple máscara.
Cómo funciona el proceso por dentro
El flujo comienza detectando el objeto a lo largo de los fotogramas con un generador de máscaras. Después, un modelo de video rellena el área enmascarada usando el contexto temporal de los fotogramas vecinos. Veo 3.1 procesa secuencias de 24 fps en 1080p, mientras que Seedance 2.0 mantiene la coherencia del movimiento en clips de 8 segundos. Kling 3.0 admite tomas más largas, de hasta 12 segundos, antes de que aparezcan artefactos.
Los usuarios suben un archivo de video de menos de 200 MB, dibujan o generan automáticamente máscaras en 3-5 fotogramas clave y ajustan parámetros como una intensidad de 0.75 y una escala de guía de 7.5. El sistema devuelve un nuevo MP4 sin el objeto.
Entradas y salidas concretas
Una ejecución típica acepta MP4 o MOV a 1920x1080, 30 fps y un máximo de 45 segundos. La salida es siempre un MP4 codificado en H.264 con la misma resolución. Una generación sobre un clip de 15 segundos con Wan 2.7 devuelve un archivo de 48 MB, y el costo se indica antes de ejecutarla.
Flujo de ejemplo: sube un clip de entrevista en 1080p, enmascara un auto que pasa en los fotogramas 45, 90 y 135, elige el modo de referencia a video y recibe el metraje limpio en 42 segundos.
Formatos y tamaños de archivo compatibles
- Entrada: MP4, MOV, hasta 500 MB
- Salida: MP4, 1920x1080 o 1280x720
- Duración máxima por trabajo: 60 segundos con Veo 3.1
Dónde aparece en flujos de trabajo reales
Los creadores limpian videos de productos quitando etiquetas de precio antes de publicarlos en Efectos de video con IA. Los editores eliminan micrófonos de pértiga de grabaciones de personas hablando a cámara con Video a video. Los YouTubers borran peatones del fondo en sus vlogs de viaje encadenando pasadas de Imagen a video sobre fotogramas extraídos.
Un equipo de redes sociales procesa 12 clips por semana, cada uno de 22 segundos, en 1080p. Aplican la misma máscara en tomas similares para mantener la coherencia de marca.
Comparación de ajustes habituales
| Modelo | Segundos máx. | Costo en créditos | Ideal para |
|---|---|---|---|
| Veo 3.1 | 8 | Indicado en la app | Movimiento rápido |
| Kling 3.0 | 12 | Indicado en la app | Fondos complejos |
| Seedance 2.0 | 10 | Indicado en la app | Coherencia de personajes |
Empieza por la página de Efectos de video con IA para probar la eliminación de objetos en tu primer clip.
Cómo elegir parámetros para obtener resultados coherentes
La intensidad controla con qué agresividad el modelo elimina la región enmascarada. Los valores entre 0.65 y 0.80 suelen conservar la textura fina del fondo en metraje 1080p y, aun así, eliminar el objeto. Subir la intensidad por encima de 0.85 a menudo introduce desenfoque en bordes que se mueven rápidamente por el encuadre. La escala de guía ajusta con qué rigor el modelo sigue el contexto circundante; entre 6.5 y 8.0 funciona para la mayoría de las tomas de entrevistas y productos, mientras que los valores superiores a 9.0 pueden suavizar en exceso el movimiento natural.
El intervalo de muestreo de fotogramas determina cuántos fotogramas clave reciben máscaras manuales. Colocar una máscara cada 12–18 fotogramas en material de 30 fps logra un equilibrio entre precisión y tiempo invertido. Los intervalos más cortos ayudan cuando el objeto atraviesa cambios de iluminación complejos o cuando la propia cámara está en movimiento.
El tamaño de la ventana temporal indica al modelo cuántos fotogramas vecinos debe consultar durante el inpainting. Una ventana de cinco fotogramas a cada lado reduce el parpadeo en fondos estáticos. Las ventanas más grandes (siete o nueve fotogramas) resultan útiles para tomas caminando con cámara en mano, pero aumentan el tiempo de procesamiento y el costo en créditos.
Cómo crear una estrategia de máscaras para escenas complejas
Empieza por identificar los puntos de entrada y salida del objeto en la línea de tiempo. Marca primero esos fotogramas y luego añade máscaras a intervalos regulares entre ellos. Para objetos que giran o cambian de forma, dibuja máscaras separadas en los fotogramas donde la silueta cambia de forma notable en lugar de depender solo de la interpolación.
Cuando aparecen varios elementos similares, como varios peatones en una acera, aísla uno cada vez. Ejecutar pasadas separadas evita que el modelo mezcle rasgos de distintos objetos en la misma área enmascarada. Después de cada pasada, revisa el resultado al 50 por ciento de velocidad para detectar bordes residuales antes de pasar al siguiente objeto.
Las superficies reflectantes y las sombras requieren atención adicional. Extiende la máscara un poco más allá del objeto visible para capturar su sombra o reflejo y luego baja la intensidad a 0.70 para que el modelo reconstruya la textura del suelo a partir de los fotogramas cercanos. Prueba un clip de vista previa de tres segundos antes de lanzar el trabajo completo.
Usa la herramienta de edición de máscaras para refinar los contornos en los fotogramas extraídos cuando la detección automática deja huecos alrededor de elementos delgados como cables o postes.
Posprocesamiento del archivo de salida
Cuando recibas el clip limpio, revísalo fotograma a fotograma en la resolución original. Los pequeños artefactos en los bordes se pueden corregir importando el archivo en un editor estándar y aplicando un desvanecimiento de un píxel en la zona afectada. Aplica la corrección de color a todo el clip de forma uniforme en lugar de intentar igualar la región reconstruida por separado.
Las pistas de audio no se modifican durante la eliminación de objetos. Si el elemento eliminado producía sonido, como un teléfono que suena, graba un audio de reemplazo por separado y añádelo después. Exporta la versión final con la misma velocidad de fotogramas que la entrada para no introducir nuevos problemas de sincronización.
Cuando el fondo contiene texto o letreros que deben seguir siendo legibles, ejecuta una segunda pasada con una máscara más ajustada y una intensidad menor. Así conservas el detalle y, a la vez, eliminas el objeto principal. Guarda ambas versiones para hacer pruebas A/B y ver qué resultado funciona mejor en la plataforma de destino.
Cómo escalar la eliminación de objetos a varios clips
Crea una plantilla de máscara reutilizable cuando varios clips comparten el mismo ángulo de cámara y fondo. Exporta las coordenadas de la máscara del primer trabajo e impórtalas en los archivos siguientes. Ajusta solo los fotogramas en los que la posición del objeto cambia por pequeñas diferencias de encuadre.
Para trabajos por lotes, agrupa los clips por velocidad de movimiento e iluminación similares. Procesar metraje exterior diurno junto con clips de interior con poca luz en una misma sesión suele producir resultados inconsistentes, porque los modelos temporales dependen de estadísticas del fondo que difieren mucho entre entornos.
Controla el uso de créditos registrando la duración del clip, el modelo elegido y el número de máscaras por trabajo. Estos datos ayudan a prever los límites mensuales cuando un equipo procesa decenas de videos cada semana. Cuando el trabajo termine, descarga el MP4 de inmediato; algunos paneles eliminan los archivos después de siete días.
Une los clips limpios en secuencias más largas con el procesador por lotes para mantener ajustes de color y resolución coherentes en todo el proyecto sin volver a subir cada archivo por separado.
Preguntas frecuentes
¿Qué velocidad de fotogramas funciona mejor para las pruebas gratuitas de eliminación de objetos?▾
La mayoría de las herramientas usan por defecto 24 fps o 30 fps. Las tasas más bajas consumen menos créditos, pero pueden generar tirones en escenas de acción rápida.
¿Cuántas máscaras se necesitan para un clip de 30 segundos?▾
Normalmente se coloca una máscara cada 15 fotogramas para obtener resultados estables con modelos como Veo 3.1.
¿Puedo eliminar textos superpuestos en lugar de objetos físicos?▾
Sí. Dibuja una máscara holgada alrededor del texto y ejecuta el trabajo con valores de intensidad más altos, alrededor de 0.85.
¿La herramienta admite entrada en 4K actualmente?▾
Los flujos actuales aceptan un máximo de 1080p. Si lo necesitas, escala el resultado después con herramientas de imagen independientes.
