微软/azure-image-2

GPT-Image 2 是 OpenAI 的图像生成与编辑模型,适合文字生成图片、参考图改图、商品图优化、海报素材、创意概念图和营销视觉制作。它适合需要较高画面质量、指令理解和商业可用性的图片生成场景。

OperativoTexto a imagenImagen a imagenEdición de imágenes-20%vs. oficialPrecio por dimensiones de usoUso comercialPrivacidad de datos

Entradaesquema real

参考图reference_images
No test requests yet. Send your first request.

Salida

Ejecuta el formulario de la izquierda. Los resultados, el estado del sondeo y el cURL aparecen debajo.

Precios

Este modelo se cobra según las dimensiones de uso indicadas aquí. Comparar todos los precios.

Precios de lista en USD. Tu precio efectivo también depende del grupo de facturación de tu clave API.

Criterio文本输入 Tokensgpt-image-2-az
$4.00por 1 M5/1M
Criterio图片输入 Tokensgpt-image-2-az
$6.40por 1 M8/1M
Criterio缓存文本输入 Tokensgpt-image-2-az
$1.00por 1 M1.25/1M
Criterio缓存图片输入 Tokensgpt-image-2-az
$1.60por 1 M2/1M
Criterio图片输出 Tokensgpt-image-2-az
$24.00por 1 M30/1M

API

POST/v1/images/generations
const BASE_URL = "https://api.dreamtoai.com";
const API_KEY = process.env.MIX_API_KEY;

const headers = {
  "Authorization": `Bearer ${API_KEY}`,
  "Content-Type": "application/json",
};

const payload = {
  "model": "gpt-image-2-az",
  "input": {
    "prompt": "生成一张产品海报,白色背景,商业摄影风格",
    "image_url": "https://example.com/input.png",
    "reference_images": [
      "https://example.com/reference.png"
    ],
    "mask": "https://example.com/mask.png",
    "size": "2752x1536",
    "quality": "medium",
    "output_format": "png",
    "background": "auto",
    "n": 1,
    "user": "user-123",
    "style": "Describe the output you want",
    "response_format": "url"
  }
};

const submit = await fetch(`${BASE_URL}/v1/jobs`, {
  method: "POST",
  headers,
  body: JSON.stringify(payload),
}).then((r) => r.json());

const status = await fetch(`${BASE_URL}/v1/jobs/${submit.id}`, { headers })
  .then((r) => r.json());
console.log(status);

Crea una clave en Consola → Claves API y reemplaza el marcador del ejemplo.

README

azure-image-2

GPT-Image 2 是 OpenAI 的图像生成与编辑模型,适合文字生成图片、参考图改图、商品图优化、海报素材、创意概念图和营销视觉制作。它适合需要较高画面质量、指令理解和商业可用性的图片生成场景。

¿Por qué elegirlo?

Generación de texto a imagen
Convierte prompts en lenguaje natural en imágenes terminadas.
Pago por uso
Se cobra por uso desde tu monedero, sin suscripción.
Caché de prompts
La entrada en caché se cobra a $1.00 por 1M de tokens, lo que reduce el coste del contexto repetido.
Compatible con tu SDK actual
Llámalo en formato OpenAI Images: los clientes existentes solo necesitan una nueva URL base y una clave.
Una clave para todos los modelos
La misma clave de API sirve para todos los modelos de dreamtoai.

Parámetros

ParámetroObligatorioDescripción
promptstringObligatorioDescripción en texto de lo que se quiere generar.
image_urlimageOpcionalImagen de referencia para guiar el resultado.
reference_imagesarrayOpcional参考图
maskimageOpcional遮罩图
sizestringOpcionalTamaño de la imagen de salida.
qualityenumOpcionalNivel de calidad de la salida. Opciones: auto, low, medium, high. Predeterminado: auto.
output_formatenumOpcional输出格式 Opciones: png, jpeg, webp. Predeterminado: png.
backgroundenumOpcional背景 Opciones: auto, transparent, opaque.
nintegerOpcionalNúmero de resultados que se generan.
userstringOpcional终端用户标识
stylestringOpcional风格
response_formatenumOpcionalFormato del resultado devuelto, como una URL o datos base64. Opciones: base64, url.

Cómo usarlo

  1. Pruébalo aquí primero — Inicia sesión y ejecuta el modelo en el playground de arriba para revisar el resultado antes de escribir código.
  2. Crea una clave de API — Abre Consola → Claves de API y crea una clave. La misma clave sirve para todos los modelos.
  3. Escribe tu prompt — Describe el sujeto, el estilo, la composición y la iluminación que quieres.
  4. Configura los parámetros opcionales — Ajusta los parámetros opcionales de arriba para controlar la salida.
  5. Envía la solicitud — Llama a POST /v1/images/generations con el ID de modelo gpt-image-2-az.
  6. Lee el resultado — El resultado generado llega en la respuesta y la solicitud queda registrada en la consola.

Cómo escribir prompts eficaces

El modelo lee un prompt como un brief creativo. Nombra primero el sujeto y luego añade los detalles que importan.

1. Sujeto y acción

Quién o qué aparece en la imagen y qué está haciendo.

2. Estilo y técnica

Foto, render 3D, acuarela o ilustración plana. Para un aspecto fotográfico, indica un objetivo o un tipo de película.

3. Composición

Encuadre y punto de vista: primer plano, plano general, cenital, centrado, regla de los tercios.

4. Iluminación y color

Hora dorada, luz de estudio suave, neón, paleta pastel, alto contraste.

5. Texto en la imagen

Pon las palabras exactas entre comillas y di dónde van.

Un póster con el titular "OPEN LATE" en letras blancas gruesas en la parte superior.
Prompt
Débiluna cafetería
SólidoUna acogedora cafetería de esquina en una tarde lluviosa, vista a través del escaparate. Luz cálida de tungsteno dentro, un barista vertiendo arte latte, condensación en el cristal, reflejos de la calle. Foto de 35 mm, poca profundidad de campo, paleta apagada de verde azulado y ámbar.

Precios

Concepto facturadoPrecioPrecio oficial
文本输入 Tokens$4.00 por 1 M$5.00/1M
图片输入 Tokens$6.40 por 1 M$8.00/1M
缓存文本输入 Tokens$1.00 por 1 M$1.25/1M
缓存图片输入 Tokens$1.60 por 1 M$2.00/1M
图片输出 Tokens$24.00 por 1 M$30.00/1M

Es un 20% menos que el precio oficial de lista.

Precios de lista en USD. Tu precio efectivo también depende del grupo de facturación de tu clave API. Comparar todos los precios

Mejores casos de uso

  • Marketing y publicidad — Crea visuales de campaña y variaciones de anuncios en minutos.
  • Comercio electrónico — Crea fotos de producto, escenas de estilo de vida y banners.
  • Arte conceptual y storyboards — Explora personajes, entornos y escenas antes de la producción.
  • Contenido para redes sociales — Crea imágenes acordes a la marca en formato cuadrado, vertical u horizontal.
  • Exploración de diseño — Prueba maquetaciones, paletas y estilos rápidamente.
  • Ilustración editorial — Ilustra artículos, boletines y presentaciones.

Consejos avanzados

  • Genera varias variantes de un prompt prometedor antes de pulir los detalles.
  • Pon el sujeto en la primera frase; añade estilo e iluminación después.
  • Mantén idéntico un prefijo largo compartido entre solicitudes para que la entrada repetida se cobre al precio de caché.
  • Escribe entre comillas cualquier texto que deba aparecer en la imagen.
  • Elige la relación de aspecto según dónde se usará la imagen antes de generarla.
  • Si el modelo admite semilla, reutiliza la misma para comparar cambios de prompt de forma justa.

Ver todos los modelos de imagenExplorar API Market

FAQ

¿Qué es azure-image-2?

GPT-Image 2 是 OpenAI 的图像生成与编辑模型,适合文字生成图片、参考图改图、商品图优化、海报素材、创意概念图和营销视觉制作。它适合需要较高画面质量、指令理解和商业可用性的图片生成场景。

¿Cómo llamo a la API de azure-image-2?

Envía POST /v1/images/generations con el ID de modelo gpt-image-2-az y tu clave de API. En la sección API de arriba hay ejemplos listos para ejecutar.

¿Cómo se calcula la facturación?

Las solicitudes se facturan a los precios indicados arriba y se cargan a tu cartera. El coste final depende del uso y del grupo de facturación asociado a tu clave API.

¿Dónde consigo una clave API?

Créala en Consola → Claves API. La misma clave sirve para todos los modelos del gateway.

¿Puedo usar el resultado con fines comerciales?

Sí. Puedes usar lo que generes en proyectos comerciales, sujeto a los términos del proveedor del modelo.

Acerca de azure-image-2 en dreamtoai

GPT-Image 2 是 OpenAI 的图像生成与编辑模型,适合文字生成图片、参考图改图、商品图优化、海报素材、创意概念图和营销视觉制作。它适合需要较高画面质量、指令理解和商业可用性的图片生成场景。

Modelos relacionados

Próximos pasos