Générateur de légendes d'images par IA
Rédige une légende d'image avec un modèle local dans le navigateur.
Générateur de légendes d'images par IA
Drop your files here
or choose files from your device
Comment utiliser Générateur de légendes d'images par IA
AI image captioner writes a short caption describing a photo using the ViT-GPT2 image captioning model, which runs in your browser after it downloads. Generation is limited to 80 new tokens, and the caption can be copied or downloaded as image-caption.txt. Captions can omit or invent details, so review them before publishing.
- Choisissez un fichier source. Si l'outil accepte plusieurs fichiers, classez-les dans l'ordre souhaité.
- Vérifiez le format de la source avant de lancer l'opération.
- Lancez le générateur de légendes d'images par IA, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.
Ce que cet outil prend en charge
Télécharge un modèle d'inférence au premier lancement. La discussion et la génération nécessitent WebGPU ; les modèles de reconnaissance plus légers utilisent le WebAssembly du navigateur. Le résultat de l'IA peut omettre ou inventer des détails. Vérifiez-le avant utilisation.
Limites et traitement
Les sources texte sont limitées à 8 000 caractères ; la recherche d'images accepte jusqu'à 20 images et une requête de 500 caractères. Les modèles peuvent tronquer les textes longs. Les premiers téléchargements peuvent représenter plusieurs centaines de MB et nécessiter de la mémoire pour le navigateur.
Exemple de source
A useful tool makes everyday work easier. Review the results before sharing.
Questions fréquentes
What AI model does the image captioner use?
It runs Xenova/vit-gpt2-image-captioning, a quantized image-to-text model, through a browser runtime. The model downloads on the first run and may remain in the browser cache for later captions on the same device.
Can the AI image captioner describe more than one image?
Each run captions the first image you select. To caption several photos, run the tool once per image and copy or download each caption separately.
Can the captioner read text or recognize people in an image?
It is a general captioning model, not an OCR or recognition tool. It produces a brief description of the scene, so add names, places, visible text and other context yourself.
Où ma saisie est-elle traitée ?
Le mode local télécharge des ressources publiques de modèle et d'exécution et conserve la saisie dans ce navigateur. Les modèles peuvent rester en cache sur cet appareil.
Quelles sont les limites de saisie ?
Les sources texte sont limitées à 8 000 caractères ; la recherche d'images accepte jusqu'à 20 images et une requête de 500 caractères. Les modèles peuvent tronquer les textes longs. Les premiers téléchargements peuvent représenter plusieurs centaines de MB et nécessiter de la mémoire pour le navigateur.