Skip to main content
A geração de imagens permite que um agente crie novas imagens a partir de um prompt de texto ou edite imagens enviadas pelo usuário. O agente escolhe entre gerar e editar com base no que foi solicitado e no contexto disponível.

Habilitar a geração de imagens

A geração de imagens é ativada por meio da janela modal Add Tools no Agent Builder (não na seção Capabilities). Clique em Add Tools na parte inferior do painel do Agent Builder e, em seguida, adicione uma das ferramentas de modelo de imagem — por exemplo, OpenAI Image Tools, DALL-E-3 ou Stable Diffusion. O agente escolhe automaticamente a opção mais adequada com base na solicitação, ou você pode restringi-la nas instruções.

Geração

Quando o usuário solicita uma imagem, o agente chama a ferramenta de geração com um prompt e retorna a imagem resultante embutida. O agente mantém uma referência à imagem em seu contexto para poder descrevê-la ou reutilizá-la na mesma conversa.

Edição

Se o usuário enviar uma imagem e pedir uma modificação — mudar uma cor, adicionar um objeto, ampliar uma composição — o agente invoca a variante de edição da ferramenta. A saída substitui a região relevante ou estende a imagem original, conforme solicitado.

Observações

  • Imagens geradas não são enviadas automaticamente para uma análise separada com vision. Se você precisar que o agente interprete uma imagem, use vision com uma imagem enviada pelo usuário.
  • As políticas de conteúdo do provedor se aplicam. Prompts que violam a política do provedor retornam um erro em vez de uma imagem.
Última modificação em 3 de julho de 2026