# KI-Bildbeschreibung

> Erstellt einen Bildbeschriftungsentwurf mit einem lokalen Browsermodell.

[Open tool](https://www.toolcabana.com/de/image-caption) · [Bilder und Design](https://www.toolcabana.com/de/category/images-and-design)

Tool ID: image-caption. Requested language: de. Description language: de. Complete guide translation: yes.

## Overview (en)

AI image captioner writes a short caption describing a photo using the ViT-GPT2 image captioning model, which runs in your browser after it downloads. Generation is limited to 80 new tokens, and the caption can be copied or downloaded as image-caption.txt. Captions can omit or invent details, so review them before publishing.

## Supported tasks (de)

Lädt beim ersten Durchlauf ein Inferenzmodell herunter. Chat und Generierung erfordern WebGPU; kleinere Erkennungsmodelle nutzen WebAssembly im Browser. KI-Ausgaben können Details auslassen oder erfinden. Prüfe sie vor der Verwendung.

## Steps (de)

1. Wähle eine Quelldatei aus. Wenn das Tool mehrere Dateien akzeptiert, ordne sie in der gewünschten Reihenfolge an.
2. Prüfe das Quellformat, bevor du den Vorgang ausführst.
3. Führe die KI-Bildbeschreibung aus, prüfe die Ausgabe und verwende dann die verfügbaren Bedienelemente zum Kopieren oder Herunterladen.

## Settings

No additional settings.

## Limitations (de)

Textquellen sind auf 8.000 Zeichen begrenzt; die Bildsuche akzeptiert bis zu 20 Bilder und eine Suchanfrage mit 500 Zeichen. Modelle können langen Text kürzen. Erste Downloads können mehrere hundert MB umfassen und benötigen Browserspeicher.

## Example input

```text
A useful tool makes everyday work easier. Review the results before sharing.
```

## Privacy and connections (de)

Der lokale Modus lädt öffentliche Modell- und Laufzeit-Assets herunter und behält die Eingabe in diesem Browser. Modelle können auf diesem Gerät zwischengespeichert bleiben.

## Questions (de)

### What AI model does the image captioner use?

It runs Xenova/vit-gpt2-image-captioning, a quantized image-to-text model, through a browser runtime. The model downloads on the first run and may remain in the browser cache for later captions on the same device.

### Can the AI image captioner describe more than one image?

Each run captions the first image you select. To caption several photos, run the tool once per image and copy or download each caption separately.

### Can the captioner read text or recognize people in an image?

It is a general captioning model, not an OCR or recognition tool. It produces a brief description of the scene, so add names, places, visible text and other context yourself.

### Wo wird meine Eingabe verarbeitet?

Der lokale Modus lädt öffentliche Modell- und Laufzeit-Assets herunter und behält die Eingabe in diesem Browser. Modelle können auf diesem Gerät zwischengespeichert bleiben.

### Welche Eingabelimits gelten?

Textquellen sind auf 8.000 Zeichen begrenzt; die Bildsuche akzeptiert bis zu 20 Bilder und eine Suchanfrage mit 500 Zeichen. Modelle können langen Text kürzen. Erste Downloads können mehrere hundert MB umfassen und benötigen Browserspeicher.

## Related tools

- [Image watermark remover](https://www.toolcabana.com/de/remove-watermark)
- [Object eraser](https://www.toolcabana.com/de/remove-object)
- [Remove text from photo](https://www.toolcabana.com/de/remove-photo-text)
- [Remove photo date stamp](https://www.toolcabana.com/de/remove-date-stamp)
