La profesión de «operador de redes neuronales»: pronto sustituirán a los ilustradores y diseñadores

La profesión de «operador de redes neuronales»: pronto sustituirán a los ilustradores y diseñadores

Las imágenes creadas por las redes neuronales de Midjourney y DALL-E han pasado de ser imágenes abstractas a obras de arte conscientes y muy detalladas. Para obtener un buen resultado, necesitas crear una descripción inteligente, una especie de algoritmo que la inteligencia artificial empiece a generar arte. Como con cualquier habilidad valiosa, ha habido «expertos» en redes neuronales que ofrecen sus servicios por dinero.

El sitio web The Verge describió una plataforma para la venta de tales habilidades, PromptBase. Ayuda a los «operadores de redes neuronales» a intercambiar descripciones de texto por resultados específicos. Funciona de forma muy sencilla: buscamos un artista, describimos con detalle lo que queremos conseguir, y a cambio de dinero obtenemos un texto que será «acelerado» por Midjourney o DALL-E.

Imagen generada por DALL-E

En palabras, este tipo de ganancia puede sonar a piratería. En realidad, el comprador obtiene casi un código que contiene ciertas palabras clave para un resultado concreto, así como una ortografía especial que permite introducir diferentes variables en la descripción.

Los periodistas de The Verge hablaron con el diseñador de la plataforma PromptBase, Justin Reckling, y hemos destacado lo más importante de esa entrevista.

¿Dónde empezaste y qué conocimientos relacionados tenías?

Empecé a trabajar con redes neuronales en abril de 2022. Entonces descubrí rápidamente que podía convertir el texto en imágenes con mucha precisión. Entre mis habilidades relacionadas: la programación.

Antes de crear una descripción, intento comprender cómo la reconoce una red neuronal. Para ello, mi experiencia en programación es muy útil. Literalmente, cada palabra del texto para generar una imagen tiene su propio peso.

Imagen generada con DALL-E

¿Cuántas descripciones de generación de imágenes vendes al día? ¿Para qué crees que los compra la gente?

Suelo vender de tres a cinco descripciones al día. Ahora mismo tengo en mi arsenal unos 50 textos que pueden adaptarse a un caso concreto. Periódicamente añado nuevas. En mi opinión, la mayoría de las descripciones que vendo se utilizan para el entretenimiento.

¿Cómo se crean las nuevas descripciones?

La mayoría de las veces utilizo una combinación de intereses personales y peticiones de la comunidad. Quiero hacer cosas que sean útiles para la gente. También me fijo en lo que se vende bien.

¿Cuál es tu descripción más popular?

Mi producto más vendido es «Ciudades en bloque». Parece que se utiliza para las impresiones de las camisetas.

¿Por dónde empiezo?

Primero me hago una idea aproximada de lo que quiero conseguir y luego intento reducirlo a personas, lugares, actores principales y otros detalles. Utilizo una red neuronal para crear algunas descripciones aproximadas, que me ayudan a entender cómo podría ser la escena. Me parece más fácil tomar algo que ya funciona bien y luego añadir algo nuevo. Es mejor empezar con los grandes toques importantes y luego pasar a los detalles más pequeños.

Investigo bastante para cada trabajo. Empiezo haciendo preguntas en el GPT-3 (un modelo de lenguaje generativo que funciona según el principio de autocompletado: introduces el principio del texto y el programa genera la continuación más probable). Por ejemplo, creo una descripción para obtener una imagen de una manicura, en cuyo caso podría preguntar: «Alguien se está haciendo la manicura, explica lo que ves». Esto me permite obtener información específica para crear las palabras clave más precisas.

¿Hay alguna habilidad o técnica particular que hayas aprendido al trabajar con redes neuronales?

Al crear un texto para convertirlo en imágenes, puede ser útil utilizar citas para separar las ideas principales. Tampoco está de más aprender términos útiles como «hiperrealista», «macro», «iluminación cinematográfica», «primer plano», «medio plano» y otros. Esto ayudará a añadir profundidad, detalle y a controlar el enfoque y la distancia.

¿En qué se diferencia el proceso de trabajo con las redes neuronales de DALL-E y Midjourney?

Depende de lo que necesites hacer. Si quieres algo más profesional, como un sustituto de la foto de archivo, entonces DALL-E es la mejor opción. En mi opinión, Midjourney produce los resultados más creativos, pero requiere más tiempo y esfuerzo para trabajar.

¿Cuánto ganas?

Tengo que gastar entre 10 y 15 dólares por cada invitación para acceder a las redes neuronales. Tengo que vender de 5 a 10 descripciones para alcanzar el equilibrio. Para mí, se trata de una inversión en tecnología que dará sus frutos a largo plazo.

Esto arroja un poco de luz sobre el valor de las descripciones para la generación de imágenes. Mucha gente critica mis ganancias porque sólo ven el resultado final y les parece que no me esfuerzo mucho.

¿Qué opinas de los derechos de autor de tu obra? ¿Crees que tiene derechos de autor?

Apenas pienso en el tema, ya que sólo intento crear algo de lo que esté orgulloso y que guste a los demás. Me pagan por mi trabajo y eso es suficiente para mí.

Como conclusión.

Teniendo en cuenta el desarrollo y el progreso de las redes neuronales para trabajar con contenidos visuales, existe la posibilidad de sustituir a una serie de profesiones creativas, como los ilustradores y los diseñadores. Juzga tú mismo: sería sencillamente poco práctico e ineficaz emplear a un especialista altamente especializado, si una red neuronal convencional puede generar docenas o incluso cientos de imágenes y logotipos.

Existe la posibilidad de que ahora estemos asistiendo a un proceso evolutivo desde el trabajo con editores gráficos hasta la escritura de un «algoritmo» en el que puedes establecer tus variables y obtener los resultados que desees. Hay razones para pensar y aprender a «comunicarse» con las redes neuronales.