Bild zu Bild (Bildbearbeitung)
Erstelle oder bearbeite Bilder aus Referenzbildern mit GPT Image 2 über BetterTokens OpenAI-kompatible API. Mit Einrichtung, Beispielen und Fehlerbehebung.
POST /v1/images/edits
Der Bild-zu-Bild-Endpunkt verwendet einen Request-Body im Format multipart/form-data. Lade ein oder mehrere Referenzbilder hoch und übermittle Prompt- und Parameterfelder als Formularfelder.
https://bettertoken.ai/v1 als Base URL. Übermittle deinen BetterToken API Key über Authorization: Bearer YOUR_API_KEY.Empfohlene Werte
Sende diese Felder in jedem Request explizit:image für ein einzelnes Referenzbild. Verwende wiederholte image[]-Felder für mehrere Referenzbilder.
Ein Referenzbild
Mehrere Referenzbilder
Einen ausgewählten Bereich mit Maske bearbeiten
Füge das optionale Dateifeldmask hinzu, wenn du die Bearbeitung auf einen ausgewählten Bereich lenken möchtest. Der aktuelle BetterToken-Endpunkt liest eine einzelne Datei im Feld mask. Sende keine wiederholten mask[]-Felder.
- Originalbild und Maske müssen dasselbe Dateiformat und dieselben Pixelabmessungen haben. Jede Datei muss kleiner als 50 MB sein. Verwende für maximale Kompatibilität PNG mit Alpha-Kanal für beide Dateien.
- Die Maske muss einen Alpha-Kanal enthalten. Vollständig transparente Pixel (
Alpha 0) markieren den Bereich, den das Modell neu zeichnen darf. Vollständig deckende Pixel (Alpha 255) weisen das Modell an, diesen Bereich beizubehalten. - Ein normales RGB-Schwarzweißbild ist keine gültige Maske, wenn es nicht tatsächlich einen Alpha-Kanal enthält.
- Wenn du mehrere
image[]-Felder sendest, wird die Maske auf das erste Eingabebild angewendet. - Die Maske dient dem Modell als Orientierung. Sie garantiert nicht, dass Pixel außerhalb des transparenten Bereichs absolut identisch bleiben.
Maskierte Bearbeitung mit Python
Öffne beide Dateien in einer einzigenwith-Anweisung, damit Python sie nach der Anfrage schließt:
Dateien vor dem Upload prüfen
Diese minimale Pillow-Prüfung kontrolliert die erforderlichen Angaben zu Format, Abmessungen und Alpha-Kanal. Bei einer typischen lokalen Maske gibt sie außerdem eine Warnung aus, wenn der Alpha-Kanal nicht sowohl vollständig transparente als auch vollständig deckende Bereiche enthält:Python-Beispiel
Empfohlene Größen
size steht für das erwartete Seitenverhältnis und die Größenstufe. Die tatsächlich zurückgegebenen Pixel können vom Server zugeordnet oder angepasst werden. Verwende die dekodierten Bildabmessungen, statt die Ausgabe zwangsweise auf den angeforderten Wert zuzuschneiden.
Bild speichern
Eine erfolgreiche Antwort folgt dem OpenAI-kompatiblen Bildantwortformat:data[0].b64_json und speichere es als Base64-Bildinhalt. Setze immer output_format: "png", damit du das dekodierte Bild als .png speichern kannst.
Antwortablauf
Dieser Endpunkt ist synchron. Halte nach dem Senden vonPOST /images/edits den aktuellen HTTP-Request offen, bis der Server antwortet. Bei erfolgreicher Generierung wird der Bildinhalt in data[0].b64_json zurückgegeben.
Der Endpunkt gibt keine task_id zurück; es gibt keinen separaten Endpunkt für Statusabfragen oder das Herunterladen von Ergebnissen.
Verwandte Dokumentation
Autorisierungen
Bearer authentication header of the form Bearer <token>, where <token> is your auth token.
Body
Use the GPT Image 2 model ID.
gpt-image-2 "gpt-image-2"
Instructions for editing the image or generating from reference images.
"Use this reference image to create a more polished square product hero image while preserving the main style."
The reference image field for a single input image.
Repeat this field for each input when sending multiple reference images.
An optional single mask file. The mask and original image must have the same format and dimensions, each file must be smaller than 50 MB, and the mask must contain an Alpha channel. For maximum compatibility, use PNG with an Alpha channel for both files. With multiple image[] inputs, the mask applies to the first image.
Use 1. Send separate requests when you need multiple output images.
"1"
The requested image size or aspect-ratio tier. The server may map or adjust the final pixel dimensions, so inspect the decoded image for its actual size.
auto, 1024x1024, 1536x1024, 1024x1536, 1536x1152, 1152x1536, 2048x2048, 2048x1152, 3840x2160, 2160x3840 "1024x1024"
Use b64_json.
b64_json "b64_json"
Use png. Do not rely on jpeg or webp being returned directly in the selected format.
png "png"

