A los trincaIAs

Fornicious Jr

Madmaxista
Desde
26 Ene 2020
Mensajes
72.287
Fruta
136.517
Por qué stable diffusion hace unos meses era lo más y con el hugginsface ese tacaño se conseguían cosas muy potables, mientras que dall-e era una guano

Y ahora es al revés

Dall-e 3 es lo más (texto, gestiona varios objetos de forma correcta, acabados muy buenos en diversos estilos)

Y los modelos gratuitos (o con x tokens de prueba) basados en stable diffusion van hacia atrás

Hasta con playgroundAI que era lo más top hace unos meses, ahora hay que picar mucha piedra con los prompts para que devuelva algo aceptable
 
En marzo de 2023 las imágenes que creaba bing con dall-e 2 eran un puro truño

Las de stable diffusion 2.1 que generaba la demo y luego playgroundAI eran aceptables si conseguías mediante prompt negativo evitar los brazos extras


Clipdrop con stable diffusion xl cuando lo tenía abierto generaba imágenes muy buena

Pero ahora con el xl turbo (el que genera imágenes en tiempo real) ha vuelto a las cavernas

Para que playgroundAI te genere algo medio aceptable, te tienes que currar el prompt, el prompt negativo, usar image to image y darle los últimos retoques con inpaint

Bing image creator, te genera un 90% de imágenes usables

Stable diffusion es incapaz de añadir personajes extra o de distinguir que uno tiene que llevar un libro y el otro un móvil o que uno tiene que estar enfadado y el otro a carcajada limpia

Cosa que en bing con dall-e 3 lo consigues hasta escribiendo el prompt en castellano
 
Por qué stable diffusion hace unos meses era lo más y con el hugginsface ese tacaño se conseguían cosas muy potables, mientras que dall-e era una guano

Y ahora es al revés

Dall-e 3 es lo más (texto, gestiona varios objetos de forma correcta, acabados muy buenos en diversos estilos)

Y los modelos gratuitos (o con x tokens de prueba) basados en stable diffusion van hacia atrás

Hasta con playgroundAI que era lo más top hace unos meses, ahora hay que picar mucha piedra con los prompts para que devuelva algo aceptable
Perro rabioso, vas a ser sustituido.
 
Por qué stable diffusion hace unos meses era lo más y con el hugginsface ese tacaño se conseguían cosas muy potables, mientras que dall-e era una guano

Y ahora es al revés

Dall-e 3 es lo más (texto, gestiona varios objetos de forma correcta, acabados muy buenos en diversos estilos)

Y los modelos gratuitos (o con x tokens de prueba) basados en stable diffusion van hacia atrás

Hasta con playgroundAI que era lo más top hace unos meses, ahora hay que picar mucha piedra con los prompts para que devuelva algo aceptable

Dall E no es un modelo. Es un workflow en el que llega integrado GPT4 para el tema de los tags por lo cual está mejor entrenado, las descripciones de los conceptos son mejores, y tiene una mejor compresión de lo que le estás pidiendo.

Sobre los modelos de Stable Diffusion. SDXL está censurado. El SD. 1.5 fué un leakazo que hubo antes de caparlo. Lo que quiere decir que SDXL es muy malo haciendo NSFW o haciendo famosos (los quitaron del entrenamiento del SDXL para evitar litigios)

Evidentemente los modelos basados en 1.5 son mejores (SDXL tiene un efecto bokeh casquivano en todas las generaciones además) y a nivel de variedad de recursos no tiene parangón. Los modelos entrenados con 1.5 cada vez son mejores tanto fotorealismo como figurativo. Las manos siguen siendo una guano como la copa de un pino.

Es DALL e MEJOR? en compresión sí, claro. Pero sigue siendo una guano censurada.

Los profesionales usan SD. 1.5. con un montón de plugins + horas de photoshop. Un pro no se puede permitir insensateces de censuras. Una herramienta censurada no vale ni para tomar por pandero. Es como si te dan un martillo de plástico

Dicho esto ojalá se filtrará el código de DALL-E, Aunque vete preparando una gpu de 40gb de vram para correr eso como mínimo.
 
Última edición:
Dall E no es un modelo. Es un workflow en el que llega integrado GPT4 para el tema de los tags por lo cual está mejor entrenado, las descripciones de los conceptos son mejores, y tiene una mejor compresión de lo que le estás pidiendo.

Sobre los modelos de Stable Diffusion. SDXL está censurado. El SD. 1.5 fué un leakazo que hubo antes de caparlo. Lo que quiere decir que SDXL es muy malo haciendo NSFW o haciendo famosos (los quitaron del entrenamiento del SDXL para evitar litigios)

Evidentemente los modelos basados en 1.5 son mejores (SDXL tiene un efecto bokeh casquivano en todas las generaciones además) y a nivel de variedad de recursos no tiene parangón. Los modelos entrenados con 1.5 cada vez son mejores tanto fotorealismo como figurativo. Las manos siguen siendo una guano como la copa de un pino.

Es DALL e MEJOR? en compresión sí, claro. Pero sigue siendo una guano censurada.

Los profesionales usan SD. 1.5. con un montón de plugins + horas de photoshop. Un pro no se puede permitir insensateces de censuras. Una herramienta censurada no vale ni para tomar por pandero. Es como si te dan un martillo de plástico

Dicho esto ojalá se filtrará el código de DALL-E, Aunque vete preparando una gpu de 40gb de vram para correr eso como mínimo.

Gracias

Me estaba pasando con playgroundAI que puedes elegir la versión de stable diffusion y la 2.1 ha sufrido un retroceso respecto al año pasado y la XL en clipdrop funcionaba más o menos bien, pero ahora en playgroundAI que es la única que la tiene en abierto (más allá de darte tokens para 3 o 4 intentos) es infumable

Estoy tirando de colab para conseguir algo decente con las limitaciones de modelos y capacidad que te ofrecen los espacios preconfigurados que hay ahora disponibles

Sí que es cierto que si no te importa un cierto estilo dibujo animado hay webapps que devuelven cosas medio usables

Pero lo que no tiene sentido, más que el que cuentas de haberlos capado por todas partes, es que webapps que devolvían resultados aceptables ahora devuelvan guano incluso usando prompts complejos y añadiendo prompt negativo, imagetoimage e inpaint

Y bing, sí, que no es que sea una maravilla, y a la mínima te salga el puro perrito, pero puedes obtener una imagen para salir de un apuro con prompts sencillos, e incluso, escritos en castellano
 

Estadísticas del foro

Temas
2.049.570
Mensajes
58.151.942
Miembros
190.834
Último miembro
Xxtoxicxx

El blog de burbuja.info

Volver