图像与视频教程:先选能力,再选模型和入口
图像和视频不是“聊天模型换个提示词”这么简单。你需要确认模型能力、模型分组、客户端入口和接口路径,再用最小请求验证一次。
先看结论:图片和视频应该怎么选入口
图片和视频最容易混淆的不是接口地址,而是模型能力和任务返回方式。先按目标结果选入口,再做最小验证。
| 你要的结果 | 优先入口 | 关键字段 | 成功信号 |
|---|---|---|---|
| 从文字生成一张图 | /v1/images/ 或 Cherry Studio 图像入口 |
model、prompt、可选 size |
返回图片 URL 或 base64,且用量日志有记录。 |
| 上传原图后改图 | /v1/images/edits |
model、prompt、image 文件字段 |
返回修改后的图片,原图没有泄露到公开位置。 |
| 让模型理解图片 | 视觉聊天模型和聊天接口 | 包含图片的 messages |
模型能描述图片内容,而不是生成新图片。 |
| 生成视频 | /v1/videos |
model、prompt、可选 seconds 或参考图 |
先返回视频任务 ID,再查询到完成或失败状态。 |
本章解决什么
这一章适合已经会创建令牌、知道 Base URL 规则,但不确定“图片/视频到底该怎么接”的用户。你会得到三件事:
知道选哪类模型
按文生图、图像编辑、图像理解、视频生成拆开,不混用聊天模型。
知道走哪个入口
图形客户端走 Cherry Studio;程序接入走 /v1/images 或 /v1/videos。
知道怎么验收
不是只看模型列表,而是要拿到图片、任务 ID 或视频最终状态。
模型与能力对照
| 你要做什么 | 选择哪类模型 | 入口 | 验收结果 |
|---|---|---|---|
| 从文字生成图片 | 图像生成模型 | POST /v1/images/ 或 Cherry Studio 图像入口 |
返回图片 URL 或 base64 数据。 |
| 上传图片后改图 | 图像编辑模型 | POST /v1/images/edits |
使用 multipart/form-data 上传文件并返回新图。 |
| 让模型理解图片内容 | 支持视觉输入的聊天模型 | 聊天客户端或 /v1/chat/completions |
模型能描述图片或回答图片相关问题。 |
| 从文字生成视频 | 视频生成模型 | POST /v1/videos |
先返回任务 ID,再查询到完成状态。 |
| 下载视频成品 | 已完成的视频任务 | GET /v1/videos/{task_id}/ |
任务完成后能下载或播放结果。 |
/v1/models 返回为准。不要手写模型名,也不要拿 Claude / Codex 分组令牌去调用图像或视频模型。
按场景选入口
如果你还不知道该选哪类模型,先从目标结果倒推。图像和视频任务的成本、耗时、返回方式差异很大,先用小任务确认方向,再扩大尺寸或时长。
| 目标场景 | 优先入口 | 建议模型能力 | 第一次怎么测 |
|---|---|---|---|
| 文章配图、封面草稿、社媒小图 | Cherry Studio 图像入口 | 图像生成模型 | 先用 1 张 1024 级别图片验证风格和速度。 |
| 产品图、海报、对外定稿 | API 或支持高清输出的图形客户端 | 高质量图像生成 / 图像编辑模型 | 先用低分辨率确认构图,再提高尺寸或质量。 |
| 根据原图改背景、改风格、保留主体 | /v1/images/edits |
图像编辑模型 | 用无隐私测试图上传,确认文件字段、格式和大小都被接受。 |
| 让模型读图、分析截图、解释照片 | 聊天客户端或 /v1/chat/completions |
视觉理解模型 | 先问“这张图里有什么”,确认模型真的看到了图片。 |
| 广告短片、产品动效、社媒视频 | /v1/videos |
视频生成模型 | 先生成 3-5 秒短片,拿到任务 ID 后轮询最终状态。 |
| 自动化批量生成 | 服务端 API | 按任务拆分图像/视频模型和令牌 | 先做单条请求,再加队列、并发、重试和日志。 |
五步接入流程
先确定任务类型
文生图、改图、图片理解、视频生成是四条不同路径,先选能力再选模型。
创建匹配分组的令牌
图像和视频任务需要支持对应模型的分组。分组选错通常会出现 403 或 model not found。
选择入口
不写代码就用 Cherry Studio;写代码就用开发者 API;自动化流程再考虑脚本或工作流平台。
跑最小请求
先用短 prompt 和低分辨率测试,确认链路、分组和模型都对,再放大任务。
核对日志和扣费
生成成功后,到 6星中转 用量日志按时间点核对。视频任务还要确认最终状态。
图形客户端怎么接
| 客户端 | Base URL | 注意事项 |
|---|---|---|
| Cherry Studio | https://www.6xin.cc/v1 |
提供商类型选择 OpenAI 兼容;图像任务要进入图像功能区,不要用普通聊天入口硬跑。 |
| 其他 OpenAI 兼容客户端 | https://www.6xin.cc/v1 |
确认客户端支持图像生成或文件上传;不支持时请改用 API。 |
| 命令行或脚本 | https://www.6xin.cc/v1 |
令牌放环境变量或 Secret,不要写进脚本仓库。 |
如果你只是想在图形界面里聊天或出图,先看 Cherry Studio 分功能验证。如果要写代码或接后端服务,继续看本页 API 示例。
接口字段速查
第一次接入时只填最小字段,等链路成功后再加尺寸、质量、参考图、负面提示词、种子或回调等高级参数。不同模型支持的高级字段可能不同,以模型广场和接口返回为准。
| 接口 | 最小必填 | 常见可选项 | 第一次怎么验收 | 常见失败点 |
|---|---|---|---|---|
POST /v1/images/ |
model、prompt |
size、quality、n、response_format |
返回图片 URL 或 base64;用量日志里能看到对应请求。 | 拿聊天模型生图、模型 ID 不属于图像分组、尺寸不被模型支持。 |
POST /v1/images/edits |
model、prompt、image 文件 |
mask、size、quality |
上传一张无隐私小图,返回修改后的图片。 | 字段名不是 image、文件太大、上传了本地路径而不是文件内容。 |
POST /v1/chat/completions 视觉输入 |
model、包含图片的 messages |
max_tokens、temperature |
让模型描述测试图片,确认它真的读到了图像内容。 | 把“读图”当成“生图”;视觉理解模型不能直接生成新图片。 |
POST /v1/videos |
model、prompt |
seconds、resolution、参考图或参考视频字段 |
先拿到任务 ID,再进入查询步骤。 | 把视频当同步接口等待成品、一次请求时长过长、令牌分组不支持视频模型。 |
GET /v1/videos/{task_id} |
任务 ID | 无 | 状态从排队或生成中变为完成,或返回明确失败原因。 | 任务 ID 记录错误、查询过快、没有处理失败和超时状态。 |
GET /v1/videos/{task_id}/ |
已完成的任务 ID | 无 | 能下载或播放最终视频内容。 | 任务还没完成就下载,或把成品链接公开到不安全位置。 |
生成前检查清单
正式出图或生成视频前,先扫一遍下面的检查项。这里比“保存配置成功”更重要,因为很多错误只有真实生成时才会出现。
| 检查项 | 通过标准 | 常见失败表现 |
|---|---|---|
| 令牌分组 | 令牌所属分组能访问目标图像或视频模型。 | 403、model not found、模型列表为空。 |
| 模型能力 | 文生图用图像生成模型,改图用图像编辑模型,读图用视觉理解模型,视频用视频生成模型。 | 聊天正常但无法出图,或图片入口一直失败。 |
| 接口路径 | 图像生成、图像编辑、视频生成分别走对应路径,不混用。 | 404、参数不识别、客户端一直转圈。 |
| 文件和隐私 | 测试图不含隐私;上传文件大小、格式、字段名都符合客户端或 API 要求。 | 上传失败、请求体过大、客服截图泄露私人图片。 |
| 任务规模 | 第一次用短 prompt、低分辨率、短视频、小并发。 | 请求超时、额度消耗过快、生成结果不稳定。 |
| 日志回证 | 生成后能在 6星中转 用量日志按时间点找到记录。 | 客户端显示成功但平台没有日志,可能仍在走旧配置。 |
API 最小示例
文生图
curl "https://www.6xin.cc/v1/images/generations" \
-H "Authorization: Bearer sk-你的令牌" \
-H "Content-Type: application/json" \
-d '{
"model": "图像模型ID",
"prompt": "一个绿色玻璃质感的 6星中转 字母 C 图标,白色背景",
"size": "1024x1024"
}'
图像编辑
curl "https://www.6xin.cc/v1/images/edits" \
-H "Authorization: Bearer sk-你的令牌" \
-F "model=图像编辑模型ID" \
-F "prompt=把背景改成浅色办公桌,保留主体" \
-F "image=@./input.png"
视频生成与查询
curl "https://www.6xin.cc/v1/videos" \
-H "Authorization: Bearer sk-你的令牌" \
-F "model=视频模型ID" \
-F "prompt=一个 6星中转 标志从屏幕中央轻微发光出现" \
-F "seconds=5"
curl "https://www.6xin.cc/v1/videos/任务ID" \
-H "Authorization: Bearer sk-你的令牌"
视频任务状态怎么读
视频通常不是一次请求直接返回成品。创建任务后,保存返回的任务 ID,再用查询接口看状态和进度。
| 状态 | 含义 | 你应该做什么 | 不要这样做 |
|---|---|---|---|
queued |
任务已提交,正在排队。 | 等待一段时间后再查,记录创建时间。 | 立刻重复提交同一个任务。 |
in_progress |
任务正在生成。 | 继续轮询,轮询间隔不要太短。 | 把它当失败处理,或同时开大量重复任务。 |
completed |
任务已经完成。 | 再访问内容下载接口,或保存返回的成品 URL。 | 把成品链接直接贴到公开工单或聊天里。 |
failed |
任务失败。 | 保留任务 ID、模型、prompt 摘要、错误信息和时间点。 | 只截图“失败”两个字,不保留可排查信息。 |
# 查询视频任务状态
curl "https://www.6xin.cc/v1/videos/任务ID" \
-H "Authorization: Bearer sk-你的令牌"
# 任务 completed 后再下载内容
curl "https://www.6xin.cc/v1/videos/任务ID/content" \
-H "Authorization: Bearer sk-你的令牌" \
--output result.mp4
常见误区
用聊天模型生图
聊天模型可以理解图片,不等于能生成图片。请使用图像生成模型和图像接口。
分组选错
图像/视频模型通常需要对应分组。出现 403 时优先查模型分组和模型 ID。
视频当同步接口用
视频通常是异步任务。创建任务后要查询状态,不要等待一次请求直接返回成品。
把完整令牌贴给别人
排障时只提供脱敏令牌片段、模型 ID、时间、错误码和请求路径。
失败时按这张表排查
| 现象 | 优先检查 | 下一步 |
|---|---|---|
| 模型列表能看到,生成时报 403 | 令牌分组是否真的包含目标图像或视频模型。 | 回到 模型分组验证,用同一条令牌跑对应能力的最小请求。 |
| 图像编辑上传失败 | 字段名是否为 image,是否真正上传文件内容。 |
先用无隐私的小图测试,不要只传本地路径字符串。 |
| 视频一直没有完成 | 任务状态、创建时间、轮询间隔、prompt 和时长。 | 先降低时长或复杂度,再用新任务验证;不要无限重复提交。 |
| 客户端成功但 6星中转 没有日志 | 客户端是否还在走旧 Base URL、旧令牌或本地缓存配置。 | 用本页 curl 示例直接请求 6星中转,和客户端结果对比。 |
| 同一任务连续 5xx 或超时 | 状态页、任务规模、并发、文件大小和重试策略。 | 暂停批量任务,保留时间点和任务 ID,再看 状态页与真实请求。 |
这些情况先停下来,不要继续提交高消耗任务
图像和视频请求比普通聊天更容易产生高消耗或长时间排队。最小请求还没稳定前,不要批量提交、不要提高时长,也不要上传敏感素材排障。
| 现象 | 先停止什么 | 下一步只做这一件事 |
|---|---|---|
| 生成时报 403 | 不要继续换 prompt。 | 先检查令牌分组是否包含目标图像或视频模型。 |
| 视频任务长时间未完成 | 不要无限重复提交同一任务。 | 降低时长或复杂度,记录任务 ID 后查状态。 |
| 上传文件失败 | 不要先上传客户或隐私素材。 | 用无隐私小图确认字段名、文件内容和大小限制。 |
| 6星中转 没有用量日志 | 不要只在客户端里重试。 | 用本页最小 curl 对照,确认请求真的打到 6星中转。 |
| 连续 5xx 或超时 | 不要继续扩大批量任务。 | 暂停批量请求,保留时间点、模型 ID、任务 ID 和脱敏信息。 |
改错后怎么退回低成本任务
图像和视频排障不要靠“多试几次”。先把任务退回到低成本、无隐私、单请求的状态,确认能力链路后再加尺寸、时长、参考图或批量队列。
| 刚才改了什么 | 先退回到什么状态 | 回退后怎么确认 |
|---|---|---|
| 模型或分组 | 用当前令牌请求 /v1/models,只选择一个可见的图像或视频模型。 |
跑一次对应能力的最小请求,不同时换 prompt、尺寸和令牌。 |
| 图片尺寸、质量或数量 | 先退回单张、低分辨率、默认质量。 | 确认能返回图片 URL 或 base64,再逐步提高质量或数量。 |
| 图像编辑文件 | 换成一张无隐私、体积小、格式明确的测试图。 | 确认 image 文件字段被接受,再换回真实素材。 |
| 视频时长或复杂 prompt | 退回 3-5 秒短视频和一句清晰 prompt。 | 先拿到任务 ID,再确认状态能从排队进入完成或明确失败。 |
| 批量任务或自动化队列 | 暂停队列,只保留单条测试任务。 | 单条任务成功、日志能对上后,再恢复限速队列。 |
需要人工协助时准备这些信息
图像和视频问题比普通聊天更依赖任务 ID、文件字段和状态。提交工单前先把信息整理好,排查会快很多。
问题类型:文生图 / 图像编辑 / 图片理解 / 视频生成
请求时间:2026-06-21 19:30 左右
请求路径:/v1/images/generations 或 /v1/videos
模型 ID:从 6星中转 模型广场复制的模型 ID
状态码或任务状态:403 / 429 / queued / in_progress / failed 等
任务 ID:仅视频任务需要
令牌片段:只提供前后少量字符,不提供完整令牌
是否能在用量日志看到记录:能 / 不能
已做过的最小请求:贴脱敏 curl 或截图
完成标准
| 检查项 | 通过标准 | 不通过时先看 |
|---|---|---|
| 模型分组 | 令牌所属分组能访问你选择的图像或视频模型。 | 模型分组 |
| 接口路径 | 文生图走 /v1/images/,改图走 /v1/images/edits,视频走 /v1/videos。 |
模型与能力对照 |
| 最小请求 | 至少一次短 prompt 能返回图片、任务 ID 或最终视频状态。 | API 最小示例 |
| 日志核对 | 6星中转 用量日志中能按时间点找到对应请求。 | 状态页与可用性 |