Como gerar imagens com o novo Stable Diffusion 3 Medium online
Como gerar imagens com o novo Stable Diffusion 3 Medium online

Nas últimas horas, o pessoal da Stability.ai anunciou o lançamento do novo modelo «Stable Diffusion 3 Medium» que (supostamente) inclui dois bilhões de parâmetros, uma compreensão mais precisa de prompts e melhorias gerais em aspectos como o fotorrealismo. Este modelo também prioriza seu funcionamento em ambientes com uma quantidade de VRAM mais limitada, mas se você quiser ver o que ele pode fazer antes de iniciar qualquer download, o fato é que já existem espaços gratuitos no HuggingFace

Admito que estou desconectado da geração de imagens com inteligência artificial. Depois de obter centenas de milhares de resultados com Auto1111 e os modelos disponíveis no Civitai, inevitavelmente se começa a reconhecer padrões, erros, limitações. A isso se somam os requisitos de hardware: modelos mais complexos exigem uma quantidade maior de VRAM, e a única alternativa para muitos usuários tem sido reciclar modelos antigos.

Assim chegamos ao Stable Diffusion 3 Medium, que em teoria recebeu várias otimizações para garantir sua execução em hardware comercial. Na minha mente, isso significa «qualquer GPU com 8 GB de VRAM ou menos», mas em vez de compartilhar links para guias de instalação e download, hoje recomendo algo muito mais simples: Visitar o HuggingFace, e testar as demonstrações gratuitas do Stable Diffusion 3 Medium online.

Testando o Stable Diffusion 3 Medium online e grátis

Como gerar imagens com o novo Stable Diffusion 3 Medium online
Como era de esperar, os modelos estão sob fogo...

Por quê? Bem... porque estão detonando no Reddit. Supõe-se que o modelo é mais forte na hora de gerar imagens fotorrealistas, e isso é verdade se reproduzirmos paisagens ou estruturas, mas o problema é quando aparecem humanos na equação. Os «velhos truques» parecem funcionar bem (mãos nos bolsos ou atrás das costas, prompts negativos amplos, etc.), no entanto, é muito difícil aceitar que esses modelos continuem cometendo os mesmos erros depois de tanto tempo, quando seus concorrentes já têm (no mínimo) um ano gerando mãos corretamente.

Como gerar imagens com o novo Stable Diffusion 3 Medium online
«imagem altamente detalhada de um bunker militar abandonado no meio do deserto. Luz do dia no deserto profundo, calor, céu azul brilhante. Metal enferrujado e concreto em ruínas, paredes quebradas, vigas expostas, ambiente pós-apocalíptico.»
Como gerar imagens com o novo Stable Diffusion 3 Medium online
«fotografia profissional de uma mulher caucasiana esperando em um ponto de ônibus. Vestindo um casaco longo azul escuro, mãos no bolso, pequeno chapéu de lã branco, cachecol verde. Cabelo preto curto estilo pixie, olhos verdes, olhando para a câmera. Dia chuvoso de inverno, umidade, frio.»

Os usuários culpam o «excesso de censura» por parte da Stability.ai (algo que já aconteceu com versões anteriores), mas outros associam a qualidade do modelo aos inconvenientes financeiros que a empresa está enfrentando atualmente. Política interna à parte, se você quiser testar com seus próprios prompts no Stable Diffusion 3 Medium, clique no link abaixo, escolha um dos «Spaces» disponíveis... e tenha paciência. Por momentos, é muito difícil acessar uma GPU livre...

Teste o Stable Diffusion 3 Medium: Clique aqui