ToolCabana

Générateur de légendes d'images par IA

Rédige une légende d'image avec un modèle local dans le navigateur.

Favorites are saved in this browser. Find them in My favorites.

Générateur de légendes d'images par IA

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.

Drop your files here

or choose files from your device

Comment utiliser Générateur de légendes d'images par IA

AI image captioner writes a short caption describing a photo using the ViT-GPT2 image captioning model, which runs in your browser after it downloads. Generation is limited to 80 new tokens, and the caption can be copied or downloaded as image-caption.txt. Captions can omit or invent details, so review them before publishing.

  1. Choisissez un fichier source. Si l'outil accepte plusieurs fichiers, classez-les dans l'ordre souhaité.
  2. Vérifiez le format de la source avant de lancer l'opération.
  3. Lancez le générateur de légendes d'images par IA, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.

Ce que cet outil prend en charge

Télécharge un modèle d'inférence au premier lancement. La discussion et la génération nécessitent WebGPU ; les modèles de reconnaissance plus légers utilisent le WebAssembly du navigateur. Le résultat de l'IA peut omettre ou inventer des détails. Vérifiez-le avant utilisation.

Limites et traitement

Les sources texte sont limitées à 8 000 caractères ; la recherche d'images accepte jusqu'à 20 images et une requête de 500 caractères. Les modèles peuvent tronquer les textes longs. Les premiers téléchargements peuvent représenter plusieurs centaines de MB et nécessiter de la mémoire pour le navigateur.

Exemple de source
A useful tool makes everyday work easier. Review the results before sharing.

Questions fréquentes

What AI model does the image captioner use?

It runs Xenova/vit-gpt2-image-captioning, a quantized image-to-text model, through a browser runtime. The model downloads on the first run and may remain in the browser cache for later captions on the same device.

Can the AI image captioner describe more than one image?

Each run captions the first image you select. To caption several photos, run the tool once per image and copy or download each caption separately.

Can the captioner read text or recognize people in an image?

It is a general captioning model, not an OCR or recognition tool. It produces a brief description of the scene, so add names, places, visible text and other context yourself.

Où ma saisie est-elle traitée ?

Le mode local télécharge des ressources publiques de modèle et d'exécution et conserve la saisie dans ce navigateur. Les modèles peuvent rester en cache sur cet appareil.

Quelles sont les limites de saisie ?

Les sources texte sont limitées à 8 000 caractères ; la recherche d'images accepte jusqu'à 20 images et une requête de 500 caractères. Les modèles peuvent tronquer les textes longs. Les premiers téléchargements peuvent représenter plusieurs centaines de MB et nécessiter de la mémoire pour le navigateur.