Skip to Content
МоделиGPT ImageРедактирование и объединение

Редактирование и объединение изображений

Загрузите одно или несколько изображений и измените или объедините их по промпту.

Перед началом

Что нужноПодробности
API-ключСоздайте его в консоли OfoxAI  и замените YOUR_OFOX_API_KEY в коде
ОкружениеДля cURL нужен jq для декодирования изображения; для Python — pip install openai; для Node.js — версия 18 или выше, без зависимостей
ИзображенияПоместите input.png в текущий каталог; для объединения изображений добавьте также input2.png. PNG или JPEG, ≤ 15 МБ каждое
ТаймаутУстановите таймаут клиента 600 секунд. Высокое качество, большие размеры или редактирование могут занимать несколько минут
Значения, используемые в коде
Адрес APIhttps://api.ofox.ai/v1
ID моделиopenai/gpt-image-2.5-sunburstВ примерах используется flare; для редактирования рекомендуется sunburst
API-ключЗамените YOUR_OFOX_API_KEY в коде на свой ключ
Зависимости Pythonpip install openai

Редактирование изображения

Каждый пример ниже был запущен в неизменном виде. Результат сохраняется в файл output.png в текущем каталоге.

Terminal
curl -s https://api.ofox.ai/v1/images/edits \ -H "Authorization: Bearer YOUR_OFOX_API_KEY" \ -F "model=openai/gpt-image-2.5-flare" \ -F "image=@input.png" \ -F "prompt=Replace the background with a wooden table, keep the subject unchanged" \ -F "quality=low" \ -o response.json jq -r '.data[0].b64_json' response.json | base64 --decode > output.png

Если не указать size, размер результата выбирает модель, и он может отличаться от исходного. Чтобы сохранить исходный размер, укажите его явно, например size=1024x1024.

Как писать промпт

Чётко укажите две вещи: что изменить и что сохранить.

СценарийПример промпта
Редактирование одного изображенияЗамени фон на деревянную столешницу, объект оставь без изменений
Объединение изображенийПомести объект с первого изображения на фон второго изображения

При нескольких изображениях называйте их в порядке загрузки: «первое изображение», «второе изображение». Чтобы изменить лишь небольшую часть изображения, надёжнее использовать инпейнтинг.

Объединение нескольких изображений

Отправьте несколько референсных изображений за один раз. Порядок загрузки определяет, к чему относятся «первое изображение» и «второе изображение» в промпте. Поместите input.png и input2.png в текущий каталог.

Terminal
# До 16 изображений за запрос, ≤ 15 МБ каждое curl -s https://api.ofox.ai/v1/images/edits \ -H "Authorization: Bearer YOUR_OFOX_API_KEY" \ -F "model=openai/gpt-image-2.5-flare" \ -F "image[]=@input.png" \ -F "image[]=@input2.png" \ -F "prompt=Place the subject of the first image onto the background of the second" \ -F "quality=low" \ -o response.json jq -r '.data[0].b64_json' response.json | base64 --decode > output.png

Провайдеры

Закреплять провайдера не нужно. Для всех трёх моделей эндпоинт редактирования обслуживают и Azure, и OpenAI, а шлюз маршрутизирует запросы автоматически.

Если у вас есть требования к модерации контента, вы можете выбрать провайдера, но эндпоинт редактирования принимает только заголовок X-OfoxAI-Provider-Type; extra_body в форме игнорируется. После выбора провайдера запросы не будут переключаться на другого провайдера, если выбранный недоступен. См. Выбор провайдера.

Значения параметров

Параметры, специфичные для эндпоинта редактирования. model, n, output_format и остальные работают так же, как при генерации по тексту — см. Текст в изображение · Значения параметров.

Обязательные
imageобязательныйfileform

Изображение для редактирования. Для нескольких изображений повторите поле как image[]; в Python SDK передайте список.

▸ Подробнее

Референсные изображения тоже оплачиваются как токены: референсное изображение 1024×1024 по замерам дало 1 024 входных токена, поэтому редактирование стоит дороже генерации по тексту при том же размере.

▶Дополнительные · 1X-OfoxAI-Provider-TypeExpand
X-OfoxAI-Provider-Typestringheader· значенияazure_foundryopenai

Обычно не требуется — шлюз маршрутизирует автоматически. Используйте только для закрепления конкретного провайдера.

Ограничения загрузки

ПараметрОграничение
Каждое референсное изображение≤ 15 МБ
Весь запрос≤ 50 МБ
Количество изображенийШлюз не ограничивает; рекомендуется не более 16
ФорматPNG, JPEG

Модель масштабирует референсные изображения примерно до 1024 px. Файлы больше 5 МБ лишь замедляют загрузку и не улучшают результат.

Распространённые ошибки

ОшибкаПричинаРешение
Invalid image file or modeЗагруженное изображение не является стандартным PNG или JPEGПересохраните как PNG или JPEG
Invalid file 'image[0]': unsupported mimetypeЗагруженный файл не является изображениемЗагрузите изображение PNG, JPEG или WebP
does not support the 'input_fidelity' parameterОтправлен input_fidelityУдалите его; это семейство всегда обрабатывает референсные изображения с высокой точностью
moderation_blockedПромпт или референсное изображение заблокированы системой безопасности на стороне поставщика моделиИзмените промпт или референсное изображение и повторите попытку
provider_type_unavailableУказанный вручную провайдер не обслуживает эту модельУдалите заголовок X-OfoxAI-Provider-Type
Invalid sizeПереданный размер нарушает одно из четырёх правилСм. Размер
404 model_not_foundОшибка в написании идентификатора модели или неверный регистрСкопируйте идентификатор модели с этой страницы

Другие ошибки см. в полной таблице ошибок.

Официальная документация

Документация OpenAI описывает поведение при прямом обращении к OpenAI. При вызове через OfoxAI приоритет имеют результаты замеров из этого раздела. Например, для редактирования не нужно закреплять провайдера.

Last updated on