Efecto de profundidad 3D en imagen
Un modelo de IA estima a qué distancia está cada parte de tu foto, y esa profundidad se usa para desplazar los píxeles y crear un anaglifo 3D (gafas rojo/cian) o una imagen estéreo lado a lado.
Cómo una foto plana produce profundidad: la estimación monocular en palabras sencillas
Puedes mirar cualquier foto corriente y saber al instante qué está cerca y qué está lejos —incluso con un ojo cerrado. Estás usando señales aprendidas: las cosas cercanas quedan más abajo en el encuadre y se solapan con las lejanas, los objetos conocidos tienen tamaños esperados, las texturas se comprimen con la distancia, y el paisaje lejano se vuelve borroso. El modelo de IA de esta página ha aprendido las mismas señales a partir de millones de fotografías y las aplica a la tuya: para cada píxel estima a qué distancia está ese punto, produciendo un mapa de profundidad —en la práctica un relieve en escala de grises de la escena. Ese mapa impulsa entonces el efecto 3D: los píxeles considerados más cercanos se desplazan más entre las vistas del ojo izquierdo y el derecho, que es exactamente la diferencia que tu cerebro interpreta como profundidad.
Profundidad relativa — qué significa eso para tu resultado
El modelo te dice qué está más cerca y qué más lejos, nunca a cuántos metros está algo. En la práctica eso tiene tres consecuencias. No puedes medir con él —la salida es una ilusión para los ojos, no un dato para la ingeniería. El orden de profundidad se equivoca de vez en cuando de formas en que la visión humana no lo haría: los espejos, el agua, el cristal, los cielos sin rasgos y las fotos de fotos pueden confundirlo, porque el reflejo y la transparencia rompen las señales de las que aprendió. Y a lo largo de bordes nítidos en primer plano puede que notes un fino borde donde los píxeles desplazados revelan zonas que la cámara nunca llegó a ver en realidad —el efecto las rellena de forma plausible, pero una mirada de cerca deja ver el truco. Las fotos con un sujeto claro a una distancia claramente distinta del fondo dan la profundidad más convincente de todas.
Anaglifo o lado a lado: dos salidas para dos públicos
La salida en anaglifo es la que conviene compartir: una única imagen de tamaño normal que cualquiera con unas gafas baratas de cartón rojo/cian puede ver —en cualquier pantalla, e incluso impresa en papel. El precio es la precisión del color, ya que el efecto funciona enviando canales de color distintos a cada ojo. La salida lado a lado conserva el color natural completo pero exige más al espectador: son dos vistas completas una junto a otra —el archivo tiene exactamente el doble de ancho que el original— pensada para un visor VR, un estereoscopio o la técnica de visión cruzada libre. Una regla práctica razonable: anaglifo para compartir con un público desconocido, lado a lado para tu propio visor. En cuanto a la intensidad, empieza con algo sutil —un desplazamiento de píxeles modesto se lee como una profundidad limpia, mientras que uno grande empieza a desgarrar los bordes.
La descarga de una sola vez, y qué se queda en tu dispositivo
Todo aquí se ejecuta dentro de tu navegador. El modelo de profundidad se descarga desde nuestro propio sitio la primera vez que se usa —unos 50 MB, guardados después en la caché de tu navegador, así que solo la primera conversión conlleva la espera— y tu foto nunca sale de tu dispositivo en ningún momento. Para mantener rápida la estimación, la imagen de trabajo se reduce a un máximo de 768 píxeles en su lado más largo, y la imagen 3D se construye a ese tamaño —bien para pantallas y para compartir, que es para lo que sirve un efecto de profundidad. El plan gratuito cubre cinco fotos al día en esta herramienta, hasta 10 MB cada una. Un último consejo práctico: como la salida lado a lado tiene el doble de ancho, resulta un archivo pesado, así que pásala por nuestro Comprimir imagen gratuito antes de publicarla —un archivo mucho más pequeño, con el efecto estéreo totalmente intacto.
Esto es un efecto de profundidad, no un escaneo 3D
El modelo de IA (Depth Anything V2) estima la profundidad <em>relativa</em> —qué está más cerca o más lejos dentro de la foto— no medidas del mundo real. Ese mapa de profundidad desplaza los píxeles lateralmente en una cantidad proporcional a lo cerca que están, que es precisamente lo que crea la ilusión estereoscópica al ver la imagen con gafas rojo/cian o mediante visión cruzada. Piensa en ello como un efecto 3D estilizado, no como una reconstrucción 3D precisa.
¿Por qué la primera conversión tarda más?
En el primer uso, tu navegador descarga desde este sitio el modelo de estimación de profundidad (unos 50 MB en total). Después queda en caché, así que las siguientes conversiones en esta página empiezan mucho más rápido.
¿Anaglifo o lado a lado — cuál debería elegir?
El anaglifo necesita unas gafas rojo/cian, pero por lo demás funciona como una imagen plana normal. El modo lado a lado no necesita gafas, pero sí un visor VR/estéreo o práctica con la visión cruzada — elige el que puedas ver de verdad.
¿Se sube mi foto a algún sitio?
No — el modelo de IA se ejecuta íntegramente dentro de tu navegador (WebAssembly). Tu foto nunca sale de tu dispositivo.
