
El nombre y el motor
DeepNude IA: el nombre es el mismo, el motor no
Que diga IA no significa que sea la misma tecnología. Lo que más cambia entre un servicio y otro es cuánto está dispuesto a explicar.
Respuesta corta
Ningún modelo ve a través de la tela. Lo que ocurre técnicamente es otra cosa: se marca una parte de los píxeles de la foto, se descarta su contenido y ese hueco se vuelve a dibujar desde cero con un modelo generativo. El cuerpo que aparece en el resultado no salió de la foto original, porque ese dato nunca estuvo ahí: la forma se inventa con el patrón de millones de imágenes ajenas.
Acá se desarma el motor que usan los servicios que se presentan con la etiqueta IA —o AI, que es la misma palabra en inglés y también se busca así—: cómo funcionan la difusión y el relleno, dónde se rompe el resultado y qué afirmaciones no se pueden verificar desde fuera. El panorama general está en la guía sobre qué quedó del programa original.
El motor
Difusión y relleno, no una radiografía
Son dos técnicas distintas trabajando juntas. La difusión dibuja; el relleno delimita dónde puede aparecer ese dibujo nuevo. Sin las dos, un resultado así nunca calzaría sobre la foto de origen.
Un modelo de difusión se entrena de una forma que suena al revés: se le da una imagen entera, se la arruina con ruido en pasos sucesivos hasta convertirla en manchas al azar, y el modelo aprende a deshacer ese camino paso por paso. Una vez entrenado, la dirección se invierte para producir: arranca de ruido puro y lo va limpiando de a poco hasta que aparece algo verosímil. En ninguno de esos pasos se lee información oculta de la foto; lo único que se lee son los píxeles visibles de alrededor.
Lo que lo volvió barato y rápido es dónde ocurre ese cálculo. El trabajo de Rombach y equipo sobre modelos de difusión latente (2022) movió el proceso de los píxeles a un espacio latente, es decir a una versión comprimida de la imagen, y el mismo paper reporta el mejor resultado de su momento en relleno de áreas. Esas dos frases explican toda la industria que se paró encima: sin esa compresión, una sola imagen pediría un equipo que no entra en un negocio que cobra centavos por pieza.
Se arma la máscara
El servicio marca el área que va a reemplazar, casi siempre por detección automática de la silueta. El resto queda bloqueado y no se toca.
Se descarta el contenido
Adentro de la máscara no queda nada de la foto original. El punto de partida del paso siguiente es ruido, no una tela que se transparenta.
Se limpia el ruido por pasos
El modelo conjetura y corrige su conjetura decenas de veces. Cada paso se guía con los píxeles de fuera de la máscara y con una instrucción de texto que arma el servicio.
Se funden los bordes
El límite de la máscara se difumina y se igualan el tono de piel y la dirección de la luz. Ese paso cosmético es justamente el que hace que todo parezca una sola foto.
Sale la imagen
El resultado se decodifica al tamaño final. Ese tamaño lo decide el servicio, y casi ninguno lo escribe antes de que pagues.
Por eso el vocabulario de la publicidad falla desde la primera palabra. No se abre nada y no se revela nada: hay un pedazo de imagen borrado y vuelto a llenar por un motor de dibujo de propósito general.
Qué modelo dice usar cada uno
Cinco de los seis no nombran el motor que cobran
La etiqueta IA está en los seis sitios; el nombre del modelo, en uno. Abajo, servicio por servicio, qué motor declara cada uno en sus propias páginas y qué se puede leer al lado de esa declaración sin abrir una cuenta.
| Servicio | Qué modelo declara | Qué se puede leer al lado |
|---|---|---|
| WaveSpeed | Los nombra a todos, y nombra a sus dueños. Su catálogo de más de mil motores identifica de qué empresa es cada uno: ByteDance, Alibaba, Google, OpenAI y MiniMax están entre ellas. | El catálogo y el precio por corrida se leen antes del registro, con una advertencia contractual al lado: quien ejecuta acepta además las condiciones del autor del modelo, que no negoció. |
| Ainudez | Ninguno. No aparece un nombre de modelo ni en su tarifa ni en sus cuatro documentos legales. | Su política de privacidad promete que ni las entradas ni los resultados se usan para entrenar modelos de terceros: da esos terceros por existentes sin decir cuáles son. |
| Undresswith | Ninguno para generar. El único modelo que describe es de moderación: estima edad y género del material que entra. | Publica la lista de paquetes y el consumo por imagen, pero ni una línea sobre qué calcula la imagen, con qué y en qué infraestructura. |
| UndressHer | Ninguno. Habla de «sus modelos» sin identificar uno solo. | Declara que ese entrenamiento usa datos sintéticos y no imágenes de usuarios. Es una afirmación sobre los datos, no sobre el motor. |
| Deep Undress | Ninguno, en ninguna de sus pantallas públicas. | De su lado técnico solo hay cifras de consumo y de entrada: 2 unidades un borrador, 3 adelantar la cola, 20 MB por imagen. |
| Pornworks | Sin dato: ningún documento suyo se abre desde fuera. | Nada, tampoco sobre esto. El renglón queda vacío en vez de llenarse con una cifra de otra página. |
La tabla deja una conclusión incómoda para la etiqueta: el único que explica su motor es el que no procesa fotos de personas. Los cinco que sí lo hacen cobran por un modelo que no identifican, así que «el mejor modelo» de una portada no se puede contrastar con nada, ni siquiera con el competidor que probablemente esté llamando al mismo.
De ahí sale la pregunta útil antes de cargar saldo, y no es cuál es mejor: es qué pasa el día que el dueño del modelo corte el acceso. Donde el catálogo está nombrado, la respuesta ya está escrita y se lee antes de pagar. Donde no lo está, no hay siquiera pregunta que hacer, porque no hay catálogo que mirar: la función desaparece un martes y el saldo cargado sigue del otro lado.
Nada de esto mide la calidad de lo que devuelven. Mide cuánto explican de sí mismos, que es lo único comprobable desde fuera y lo que más se confunde con lo primero.
Dónde se rompe
Los errores tienen patrón, y el patrón se explica solo
El modelo anda bien en superficies grandes y parejas, y mal en cualquier cosa que tenga estructura y deba mantenerse coherente. Todo lo de abajo ocurre en el borde entre la máscara y la foto real.
| Dónde la máscara toca la foto original | Qué se ve en el resultado |
|---|---|
| Objetos que cruzan el cuerpo | Una bandolera, la tira de una mochila, el pelo largo, los brazos cruzados: todo cae sobre el límite, y ahí el modelo tiene que adivinar qué está adelante y qué atrás. |
| Estampados y pliegues | Rayas, cuadros, encaje y telas con caída complicada. El patrón queda cortado justo en el borde, y ese corte se nota apenas ampliás la imagen. |
| Tatuajes, lunares, cicatrices | Están en la foto original y desaparecen del resultado, o aparecen en otro lugar. El modelo no guarda ficha de la piel de una persona concreta. |
| Dedos y accesorios | El punto débil clásico de los modelos de imagen: cambia la cantidad de dedos, un anillo se funde con la piel, una pulsera se corta al medio. |
| Poses de costado o cuerpos cortados por el encuadre | Cuanto menos contexto hay alrededor de la máscara, más libertad tiene el modelo para inventar y más se van las proporciones. |
| Fotos de baja resolución | El resultado no puede ser más nítido que el origen. Lo que aumenta son los píxeles, no el detalle. |
| Más de una persona en el cuadro | La máscara se estira hacia la persona de al lado y partes del cuerpo se mudan de una figura a otra. |
| Luz dura y sombras marcadas | La dirección de la luz se recalcula en el área nueva, así que las sombras del cuerpo suelen no coincidir con las de la cara. |
Esa lista tiene un efecto directo sobre la plata. Como la falla recién se ve cuando la imagen está terminada, una foto casi nunca se resuelve en una sola pasada, y ninguno de los seis servicios revisados ofrece la corrección sin cargo. La cuenta real no es el precio de una imagen, sino ese precio multiplicado por la cantidad de intentos hasta que dejás de probar. Cómo se descuenta eso del saldo está en generar no es editar, y qué te dan los créditos de bienvenida, en cómo leer la tabla de precios.
Qué cambió y qué no
Cinco cosas que conviene entender del motor
La tecnología cambió dos veces desde , pero las preguntas que deciden siguen siendo las mismas: quién calcula, dónde, a qué costo y con qué consecuencia frente a la ley argentina.
De las GAN a la difusión
El programa de usaba otra familia de modelos. Según la nota de Vice que informó su retiro en junio de 2019, el algoritmo se apoyaba en redes generativas antagónicas entrenadas para una tarea estrecha. Eso se notaba en el resultado: un modelo así solo funciona con encuadres parecidos a los de su entrenamiento y se rompe apenas salís de ahí.
La difusión cambió la economía del asunto. El modelo base es de propósito general, lo hizo otra empresa y se lo orienta a una tarea estrecha con ajustes chicos y con instrucciones de texto. Lo que vende un servicio de hoy no es un modelo: es una interfaz, una cola y una caja registradora montadas encima del modelo de otro. Por eso pudieron aparecer decenas de servicios en un año cuando en 2019 había uno solo.
De dónde sale esa forma
Lo que aparece dentro de la máscara es un promedio ponderado de los datos de entrenamiento, no una reconstrucción de la persona de la foto. Por eso el resultado suele verse genérico: proporciones cercanas al promedio del conjunto, piel demasiado pareja y rasgos propios que desaparecen. Cuanto más se aleja un cuerpo de ese promedio, más obvio es el desvío.
La pregunta inversa también importa: si la imagen que mandás pasa a ser dato de entrenamiento. Acá los seis no coinciden. Ainudez declara en su política de privacidad que ni las imágenes de entrada ni los resultados se usan para marketing, perfilado ni entrenamiento de modelos de terceros. WaveSpeed, al revés, lista el material subido como dato de entrenamiento y admite que puede contener información sensible. Las dos son declaraciones propias, sin auditoría externa.
Quién hace el cálculo
La difusión necesita placa de video de centro de datos, y eso cierra una pregunta de una vez: ninguno de estos servicios corre adentro del celular. La foto siempre sale, se procesa en el servidor de otro y vuelve. Lo que queda instalado en tu equipo, si queda algo, es una ventana.
Por eso la diferencia entre abrir el navegador e instalar una aplicación no es técnica en cuanto al procesamiento, sino en cuanto a cuánto acceso al dispositivo entregás. El recorrido completo del archivo está desarmado en qué revisar antes de empezar, y la comparación de los seis renglón por renglón, en las alternativas que quedaron.
Afirmaciones que no se pueden probar
Tres promesas se repiten en las portadas de esta categoría y las tres son imposibles de verificar desde fuera: resultado realista, la foto no se guarda y el mejor modelo. La primera no tiene unidad de medida. La segunda se cree o no se cree, porque nadie puede mirar adentro del servidor ajeno. La tercera suele apuntar al mismo modelo de terceros que usa el competidor.
Lo que sí se puede revisar es lo aburrido: si la tarifa se lee antes de registrarse, si hay una razón social nombrada, si hay un plazo de borrado en días y si el pago se puede desconocer ante un banco. Esas cuatro preguntas también son el filtro que conviene aplicar antes de cualquier cargo, y están detalladas en qué mirar antes de pagar.
Inventado no es impune
Que el cuerpo del resultado sea ficticio no mejora la posición de nadie. La Ley 27.736, de , incorporó la violencia digital a la Ley 26.485 y alcanza expresamente la obtención, reproducción y difusión sin consentimiento de material íntimo «real o editado». La palabra «editado» está puesta ahí a propósito: el encuadre no depende de que el archivo sea auténtico, sino de que haya una persona identificable adentro. Lo que sí depende del caso es la norma: la 26.485 protege a las mujeres de la violencia por razones de género, y fuera de ese supuesto hay que apoyarse en figuras generales.
Lo que se evalúa es la conducta hacia esa persona, no la calidad técnica del archivo. Un resultado que se nota falso igual pega la cara de alguien sobre material sexual y igual circula con su nombre. Por eso «qué tan realista queda» no es una pregunta legal, y contestarla con orgullo no atenúa nada. De dónde viene el nombre que usan todos estos servicios está en el origen del nombre.
Preguntas frecuentes
Dudas sobre el motor
Las respuestas se apoyan en dos cosas nada más: publicaciones técnicas que cualquiera puede abrir y documentos que cada servicio publica sobre sí mismo.
¿El modelo ve de verdad el cuerpo debajo de la ropa?
No, y físicamente es imposible. Una foto guarda solo la luz que rebotó en la superficie exterior. El modelo borra el área marcada y la vuelve a dibujar desde ruido, así que lo que sale es una invención que combina con el entorno, no información escondida adentro del archivo.
¿Por qué dos intentos con la misma foto dan resultados distintos?
Porque el proceso arranca de ruido aleatorio. Un punto de partida distinto produce un camino de limpieza distinto. No hay una única respuesta que el modelo esté buscando, y esa es la razón por la que corregir un resultado siempre significa un cargo nuevo.
¿Se nota la diferencia con una foto auténtica?
Muchas veces sí, ampliando el borde de la máscara: el estampado cortado, la cantidad de dedos, sombras que no siguen la misma dirección, tatuajes que faltan. Pero esas señales se adelgazan con baja resolución, y en la pantalla de un celular buena parte no se ve.
¿La imagen que mando entrena el modelo?
Depende del servicio, y la respuesta vale lo que valga su documento. Uno declara expresamente que no la usa para entrenar modelos de terceros; otro lista los archivos subidos como datos de entrenamiento. No hay forma de verificar ninguna de las dos desde fuera.
¿Puede correr sin internet, adentro del celular?
No en la forma en que circula hoy. Un modelo de difusión pide memoria de video y espacio muy por encima del tamaño de una aplicación común. Cualquier cosa que diga trabajar dentro del equipo igual manda la foto al servidor, y el propio tamaño del archivo delata la afirmación.
¿Subir la resolución mejora la precisión?
Más grande no es más preciso. El escalado agrega píxeles, no detalle verdadero, y en el área enmascarada no hay detalle original que recuperar. Lo que suele aumentar son los artefactos del borde.
¿La redacción probó el resultado de estos servicios?
No. Acá no se manda ninguna imagen y no se produce ningún resultado. Lo que se lee y se archiva son los documentos públicos de los servicios y las publicaciones técnicas; donde ellos callan, esta página lo anota como hueco en vez de taparlo con una conjetura.