Início NOTÍCIAS OpenAI reforça o modelo de geração de imagens ChatGPT

OpenAI reforça o modelo de geração de imagens ChatGPT

56
0

OpenAI foi lançado por um novo modelo de IA de geração de imagens na terça-feira, chamado ChatGPT Images 2.0. Este modelo pode gerar mais de uma imagem a partir de um único prompt, como um livreto de estudo completo, bem como saída de texto em idiomas diferentes do inglês, como chinês e hindi. Esta versão está disponível globalmente para ChatGPT e usuários de código, com uma versão preferencial disponível para assinantes pagantes.

Sempre que uma grande empresa de IA lança um novo modelo de imagem, ela pode reavivar o interesse e aumentar o uso, especialmente se os usuários das redes sociais passarem a usar imagens poderosas e autotransformáveis. No ano passado, o lançamento do modelo Nano Banana do Google foi um grande marco para a empresa, principalmente no que diz respeito à postagem de usuários figuras hiperrealistas de si mesmos online. No início deste ano, as imagens ChatGPT agitaram as redes sociais à medida que os usuários as compartilhavam Mímicos gerados por IA.

O que é diferente?

Como o novo modelo pode aproveitar os recursos do ChatGPT, o Images 2.0 pode pesquisar na Internet informações atualizadas e gerar mais de uma imagem. Essencialmente, a automação pode usar etapas adicionais para gerar números maiores a partir de um único prompt. O Images 2.0 também tem data de intervalo de conhecimento mais recente: dezembro de 2025.

Isto também significa que os resultados do novo modelo são mais granulares. Por exemplo, para prever o tempo em São Francisco quando gerei um infográfico para amanhã, então vale a pena fazer. A imagem gerada pelo ChatGPT incluía detalhes meteorológicos precisos para o dia chuvoso, juntamente com um esboço detalhado do Ferry Building, Castle Theatre, Pictish Houses e Pyramerica Transamerica.

Além disso, o Images 2.0 é mais adequado para usuários que desejam uma proporção de aspecto exclusiva para saídas de imagem. O novo modelo pode gerar imagens de 3:1 de largura a 1:3 de altura, e os usuários podem ajustar o tamanho da imagem como parte do prompt da ferramenta de IA.

Primeiras impressões

Depois de várias horas gerando imagens com o novo modelo, fiquei impressionado com sua capacidade de renderização de texto, pelo menos em inglês. Não faz muito tempo, em qualquer um dos principais modelos impressos, muitas vezes incluíam numerosos caracteres ou palavras distorcidas, letras estrangeiras perdidas. O ChatGPT lutou para rotular as imagens com precisão há dois anos, portanto, os resultados mais limpos e complexos do Images 2.0 são um sinal de melhoria contínua. O Google também está se concentrando em melhores resultados de imagens com texto nas iterações recentes do Nano Banana.

A imagem pode conter cartaz de propaganda Pessoa bebendo café Xícara de café Roupas Camisa e jaqueta

AI REECE ROGERS-nascido

Source link