核心能力
- 文生图 — 根据文本描述生成图片
- 图片编辑 — 在
inline_data中传入参考图,配合文字指令进行编辑 - 宽高比控制 —
1:1、4:3、3:4、16:9、9:16 - 分辨率控制 —
1K(~1024px)、2K(~2048px)、4K(~4096px,按长边) - 多模态输出 — 通过
responseModalities: ["TEXT", "IMAGE"]同时返回图片和文字说明
文生图示例
curl "https://ai.alad.com/v1beta/models/gemini-3-pro-image-preview-c:generateContent?key=YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [
{
"role": "user",
"parts": [
{ "text": "生成一张山间日落的图片" }
]
}
],
"generationConfig": {
"responseModalities": ["TEXT", "IMAGE"],
"imageConfig": {
"aspectRatio": "16:9",
"imageSize": "1K"
}
}
}'
import requests, base64
url = "https://ai.alad.com/v1beta/models/gemini-3-pro-image-preview-c:generateContent"
response = requests.post(url, params={"key": "YOUR_API_KEY"}, json={
"contents": [
{
"role": "user",
"parts": [{"text": "生成一张山间日落的图片"}]
}
],
"generationConfig": {
"responseModalities": ["TEXT", "IMAGE"],
"imageConfig": {"aspectRatio": "16:9", "imageSize": "1K"}
}
})
for part in response.json()["candidates"][0]["content"]["parts"]:
if "inline_data" in part:
with open("output.jpg", "wb") as f:
f.write(base64.b64decode(part["inline_data"]["data"]))
print("图片已保存至 output.jpg")
elif "text" in part:
print("说明文字:", part["text"])
图片编辑示例(传入参考图)
在同一个parts 数组中同时传入 text 指令和 inline_data 参考图。
# 先将图片转为 base64:
# BASE64=$(base64 -i your_photo.jpg)
#
# 然后发送请求:
curl "https://ai.alad.com/v1beta/models/gemini-3-pro-image-preview-c:generateContent?key=YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [
{
"role": "user",
"parts": [
{
"text": "这是我的一张照片,请在我旁边加一只羊驼"
},
{
"inline_data": {
"mime_type": "image/jpeg",
"data": "<YOUR_BASE64_ENCODED_IMAGE>"
}
}
]
}
],
"generationConfig": {
"responseModalities": ["TEXT", "IMAGE"],
"imageConfig": {
"aspectRatio": "1:1",
"imageSize": "1K"
}
}
}'
import requests, base64
# 读取并编码参考图片
with open("your_photo.jpg", "rb") as f:
image_b64 = base64.b64encode(f.read()).decode("utf-8")
url = "https://ai.alad.com/v1beta/models/gemini-3-pro-image-preview-c:generateContent"
response = requests.post(url, params={"key": "YOUR_API_KEY"}, json={
"contents": [
{
"role": "user",
"parts": [
{
"text": "这是我的一张照片,请在我旁边加一只羊驼"
},
{
"inline_data": {
"mime_type": "image/jpeg",
"data": image_b64 # ← 将 base64 字符串粘贴至此
}
}
]
}
],
"generationConfig": {
"responseModalities": ["TEXT", "IMAGE"],
"imageConfig": {"aspectRatio": "1:1", "imageSize": "1K"}
}
})
for part in response.json()["candidates"][0]["content"]["parts"]:
if "inline_data" in part:
with open("output.jpg", "wb") as f:
f.write(base64.b64decode(part["inline_data"]["data"]))
print("图片已保存至 output.jpg")
elif "text" in part:
print("说明文字:", part["text"])
参数说明
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
key | string | 是 | API 密钥(查询参数) |
contents[].parts[].text | string | 是 | 文字提示或指令 |
contents[].parts[].inline_data.mime_type | string | 否 | 参考图类型:image/jpeg、image/png、image/webp |
contents[].parts[].inline_data.data | string | 否 | Base64 编码的参考图数据 |
generationConfig.responseModalities | array | 是 | ["IMAGE"] 或 ["TEXT", "IMAGE"] |
generationConfig.imageConfig.aspectRatio | string | 否 | 1:1 / 4:3 / 3:4 / 16:9 / 9:16 |
generationConfig.imageConfig.imageSize | string | 否 | 1K / 2K / 4K(默认 1K) |
API 参考
查看 gemini-3-pro-image-preview-c 的交互式 API Playground。

