ToolCabana

Legenda de imagem com IA

Rascunhe uma legenda de imagem com um modelo local no navegador.

Favorites are saved in this browser. Find them in My favorites.

Legenda de imagem com IA

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.

Drop your files here

or choose files from your device

Como usar Legenda de imagem com IA

AI image captioner writes a short caption describing a photo using the ViT-GPT2 image captioning model, which runs in your browser after it downloads. Generation is limited to 80 new tokens, and the caption can be copied or downloaded as image-caption.txt. Captions can omit or invent details, so review them before publishing.

  1. Escolha um arquivo de origem. Se a ferramenta aceitar vários arquivos, ordene-os como quiser.
  2. Verifique o formato de origem antes de executar a operação.
  3. Execute a legenda de imagem com IA, revise a saída e use os controles disponíveis para copiar ou baixar.

O que esta ferramenta suporta

Baixa um modelo de inferência na primeira execução. O chat e a geração exigem WebGPU; modelos menores de reconhecimento usam WebAssembly do navegador. A saída da IA pode omitir ou inventar detalhes. Revise antes de usar.

Limites e processamento

As fontes de texto são limitadas a 8,000 caracteres; a busca de imagens aceita até 20 imagens e uma consulta de 500 caracteres. Os modelos podem truncar textos longos. Os primeiros downloads podem ter centenas de MB e exigem memória do navegador.

Fonte de exemplo
A useful tool makes everyday work easier. Review the results before sharing.

Perguntas frequentes

What AI model does the image captioner use?

It runs Xenova/vit-gpt2-image-captioning, a quantized image-to-text model, through a browser runtime. The model downloads on the first run and may remain in the browser cache for later captions on the same device.

Can the AI image captioner describe more than one image?

Each run captions the first image you select. To caption several photos, run the tool once per image and copy or download each caption separately.

Can the captioner read text or recognize people in an image?

It is a general captioning model, not an OCR or recognition tool. It produces a brief description of the scene, so add names, places, visible text and other context yourself.

Onde minha entrada é processada?

O modo local baixa recursos públicos do modelo e do ambiente de execução e mantém a entrada neste navegador. Os modelos podem ficar em cache neste dispositivo.

Quais são os limites de entrada?

As fontes de texto são limitadas a 8,000 caracteres; a busca de imagens aceita até 20 imagens e uma consulta de 500 caracteres. Os modelos podem truncar textos longos. Os primeiros downloads podem ter centenas de MB e exigem memória do navegador.