# Generador de pies de foto con IA

> Redacta un pie de foto con un modelo local del navegador.

[Open tool](https://www.toolcabana.com/es/image-caption) · [Imágenes y diseño](https://www.toolcabana.com/es/category/images-and-design)

Tool ID: image-caption. Requested language: es. Description language: es. Complete guide translation: yes.

## Overview (en)

AI image captioner writes a short caption describing a photo using the ViT-GPT2 image captioning model, which runs in your browser after it downloads. Generation is limited to 80 new tokens, and the caption can be copied or downloaded as image-caption.txt. Captions can omit or invent details, so review them before publishing.

## Supported tasks (es)

Descarga un modelo de inferencia en la primera ejecución. El chat y la generación requieren WebGPU; los modelos de reconocimiento más pequeños usan WebAssembly del navegador. La salida de la IA puede omitir o inventar detalles. Revísala antes de usarla.

## Steps (es)

1. Elige un archivo de origen. Si la herramienta acepta varios archivos, ordénalos como quieras.
2. Comprueba el formato de origen antes de ejecutar la operación.
3. Ejecuta el generador de pies de foto con IA, revisa la salida y usa los controles disponibles para copiar o descargar.

## Settings

No additional settings.

## Limitations (es)

Las fuentes de texto están limitadas a 8,000 caracteres; la búsqueda de imágenes acepta hasta 20 imágenes y una consulta de 500 caracteres. Los modelos pueden truncar textos largos. Las primeras descargas pueden ser de cientos de MB y requieren memoria del navegador.

## Example input

```text
A useful tool makes everyday work easier. Review the results before sharing.
```

## Privacy and connections (es)

El modo local descarga recursos públicos del modelo y del entorno de ejecución y mantiene la entrada en este navegador. Los modelos pueden quedar en caché en este dispositivo.

## Questions (es)

### What AI model does the image captioner use?

It runs Xenova/vit-gpt2-image-captioning, a quantized image-to-text model, through a browser runtime. The model downloads on the first run and may remain in the browser cache for later captions on the same device.

### Can the AI image captioner describe more than one image?

Each run captions the first image you select. To caption several photos, run the tool once per image and copy or download each caption separately.

### Can the captioner read text or recognize people in an image?

It is a general captioning model, not an OCR or recognition tool. It produces a brief description of the scene, so add names, places, visible text and other context yourself.

### ¿Dónde se procesa mi entrada?

El modo local descarga recursos públicos del modelo y del entorno de ejecución y mantiene la entrada en este navegador. Los modelos pueden quedar en caché en este dispositivo.

### ¿Cuáles son los límites de entrada?

Las fuentes de texto están limitadas a 8,000 caracteres; la búsqueda de imágenes acepta hasta 20 imágenes y una consulta de 500 caracteres. Los modelos pueden truncar textos largos. Las primeras descargas pueden ser de cientos de MB y requieren memoria del navegador.

## Related tools

- [Image watermark remover](https://www.toolcabana.com/es/remove-watermark)
- [Object eraser](https://www.toolcabana.com/es/remove-object)
- [Remove text from photo](https://www.toolcabana.com/es/remove-photo-text)
- [Remove photo date stamp](https://www.toolcabana.com/es/remove-date-stamp)
