绘图与视频

图像与视频教程:先选能力,再选模型和入口

图像和视频不是“聊天模型换个提示词”这么简单。你需要确认模型能力、模型分组、客户端入口和接口路径,再用最小请求验证一次。

预计阅读 8 分钟 适合接入图片理解、图像生成、图像编辑或视频任务的用户
模型选型 文生图 图像编辑 视频任务 Cherry Studio 接口字段

先看结论:图片和视频应该怎么选入口

图片和视频最容易混淆的不是接口地址,而是模型能力和任务返回方式。先按目标结果选入口,再做最小验证。

你要的结果优先入口关键字段成功信号
从文字生成一张图 /v1/images/generations 或 Cherry Studio 图像入口 model、prompt、可选 size 返回图片 URL 或 base64,且用量日志有记录。
上传原图后改图 /v1/images/edits model、prompt、image 文件字段 返回修改后的图片,原图没有泄露到公开位置。
让模型理解图片 视觉聊天模型和聊天接口 包含图片的 messages 模型能描述图片内容,而不是生成新图片。
生成视频 /v1/videos model、prompt、可选 seconds 或参考图 先返回视频任务 ID,再查询到完成或失败状态。

本章解决什么

这一章适合已经会创建令牌、知道 Base URL 规则,但不确定“图片/视频到底该怎么接”的用户。你会得到三件事:

知道选哪类模型

按文生图、图像编辑、图像理解、视频生成拆开,不混用聊天模型。

知道走哪个入口

图形客户端走 Cherry Studio;程序接入走 /v1/images 或 /v1/videos。

知道怎么验收

不是只看模型列表,而是要拿到图片、任务 ID 或视频最终状态。

模型与能力对照

你要做什么选择哪类模型入口验收结果
从文字生成图片 图像生成模型 POST /v1/images/generations 或 Cherry Studio 图像入口 返回图片 URL 或 base64 数据。
上传图片后改图 图像编辑模型 POST /v1/images/edits 使用 multipart/form-data 上传文件并返回新图。
让模型理解图片内容 支持视觉输入的聊天模型 聊天客户端或 /v1/chat/completions 模型能描述图片或回答图片相关问题。
从文字生成视频 视频生成模型 POST /v1/videos 先返回任务 ID,再查询到完成状态。
下载视频成品 已完成的视频任务 GET /v1/videos/{task_id}/content 任务完成后能下载或播放结果。
模型 ID 以 6星中转 模型广场和 /v1/models 返回为准。不要手写模型名,也不要拿 Claude / Codex 分组令牌去调用图像或视频模型。

按场景选入口

如果你还不知道该选哪类模型,先从目标结果倒推。图像和视频任务的成本、耗时、返回方式差异很大,先用小任务确认方向,再扩大尺寸或时长。

目标场景优先入口建议模型能力第一次怎么测
文章配图、封面草稿、社媒小图 Cherry Studio 图像入口 图像生成模型 先用 1 张 1024 级别图片验证风格和速度。
产品图、海报、对外定稿 API 或支持高清输出的图形客户端 高质量图像生成 / 图像编辑模型 先用低分辨率确认构图,再提高尺寸或质量。
根据原图改背景、改风格、保留主体 /v1/images/edits 图像编辑模型 用无隐私测试图上传,确认文件字段、格式和大小都被接受。
让模型读图、分析截图、解释照片 聊天客户端或 /v1/chat/completions 视觉理解模型 先问“这张图里有什么”,确认模型真的看到了图片。
广告短片、产品动效、社媒视频 /v1/videos 视频生成模型 先生成 3-5 秒短片,拿到任务 ID 后轮询最终状态。
自动化批量生成 服务端 API 按任务拆分图像/视频模型和令牌 先做单条请求,再加队列、并发、重试和日志。

五步接入流程

1

先确定任务类型

文生图、改图、图片理解、视频生成是四条不同路径,先选能力再选模型。

2

创建匹配分组的令牌

图像和视频任务需要支持对应模型的分组。分组选错通常会出现 403 或 model not found。

3

选择入口

不写代码就用 Cherry Studio;写代码就用开发者 API;自动化流程再考虑脚本或工作流平台。

4

跑最小请求

先用短 prompt 和低分辨率测试,确认链路、分组和模型都对,再放大任务。

5

核对日志和扣费

生成成功后,到 6星中转 用量日志按时间点核对。视频任务还要确认最终状态。

图形客户端怎么接

客户端Base URL注意事项
Cherry Studio https://www.6xin.cc/v1 提供商类型选择 OpenAI 兼容;图像任务要进入图像功能区,不要用普通聊天入口硬跑。
其他 OpenAI 兼容客户端 https://www.6xin.cc/v1 确认客户端支持图像生成或文件上传;不支持时请改用 API。
命令行或脚本 https://www.6xin.cc/v1 令牌放环境变量或 Secret,不要写进脚本仓库。

如果你只是想在图形界面里聊天或出图,先看 Cherry Studio 分功能验证。如果要写代码或接后端服务,继续看本页 API 示例。

接口字段速查

第一次接入时只填最小字段,等链路成功后再加尺寸、质量、参考图、负面提示词、种子或回调等高级参数。不同模型支持的高级字段可能不同,以模型广场和接口返回为准。

接口最小必填常见可选项第一次怎么验收常见失败点
POST /v1/images/generations model、prompt size、quality、n、response_format 返回图片 URL 或 base64;用量日志里能看到对应请求。 拿聊天模型生图、模型 ID 不属于图像分组、尺寸不被模型支持。
POST /v1/images/edits model、prompt、image 文件 mask、size、quality 上传一张无隐私小图,返回修改后的图片。 字段名不是 image、文件太大、上传了本地路径而不是文件内容。
POST /v1/chat/completions 视觉输入 model、包含图片的 messages max_tokens、temperature 让模型描述测试图片,确认它真的读到了图像内容。 把“读图”当成“生图”;视觉理解模型不能直接生成新图片。
POST /v1/videos model、prompt seconds、resolution、参考图或参考视频字段 先拿到任务 ID,再进入查询步骤。 把视频当同步接口等待成品、一次请求时长过长、令牌分组不支持视频模型。
GET /v1/videos/{task_id} 任务 ID 无 状态从排队或生成中变为完成,或返回明确失败原因。 任务 ID 记录错误、查询过快、没有处理失败和超时状态。
GET /v1/videos/{task_id}/content 已完成的任务 ID 无 能下载或播放最终视频内容。 任务还没完成就下载,或把成品链接公开到不安全位置。

生成前检查清单

正式出图或生成视频前,先扫一遍下面的检查项。这里比“保存配置成功”更重要,因为很多错误只有真实生成时才会出现。

检查项通过标准常见失败表现
令牌分组 令牌所属分组能访问目标图像或视频模型。 403、model not found、模型列表为空。
模型能力 文生图用图像生成模型,改图用图像编辑模型,读图用视觉理解模型,视频用视频生成模型。 聊天正常但无法出图,或图片入口一直失败。
接口路径 图像生成、图像编辑、视频生成分别走对应路径,不混用。 404、参数不识别、客户端一直转圈。
文件和隐私 测试图不含隐私;上传文件大小、格式、字段名都符合客户端或 API 要求。 上传失败、请求体过大、客服截图泄露私人图片。
任务规模 第一次用短 prompt、低分辨率、短视频、小并发。 请求超时、额度消耗过快、生成结果不稳定。
日志回证 生成后能在 6星中转 用量日志按时间点找到记录。 客户端显示成功但平台没有日志,可能仍在走旧配置。

API 最小示例

文生图

curl "https://www.6xin.cc/v1/images/generations" \
  -H "Authorization: Bearer sk-你的令牌" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "图像模型ID",
    "prompt": "一个绿色玻璃质感的 6星中转 字母 C 图标,白色背景",
    "size": "1024x1024"
  }'

图像编辑

curl "https://www.6xin.cc/v1/images/edits" \
  -H "Authorization: Bearer sk-你的令牌" \
  -F "model=图像编辑模型ID" \
  -F "prompt=把背景改成浅色办公桌,保留主体" \
  -F "image=@./input.png"

视频生成与查询

curl "https://www.6xin.cc/v1/videos" \
  -H "Authorization: Bearer sk-你的令牌" \
  -F "model=视频模型ID" \
  -F "prompt=一个 6星中转 标志从屏幕中央轻微发光出现" \
  -F "seconds=5"

curl "https://www.6xin.cc/v1/videos/任务ID" \
  -H "Authorization: Bearer sk-你的令牌"

视频任务状态怎么读

视频通常不是一次请求直接返回成品。创建任务后,保存返回的任务 ID,再用查询接口看状态和进度。

状态含义你应该做什么不要这样做
queued 任务已提交,正在排队。 等待一段时间后再查,记录创建时间。 立刻重复提交同一个任务。
in_progress 任务正在生成。 继续轮询,轮询间隔不要太短。 把它当失败处理,或同时开大量重复任务。
completed 任务已经完成。 再访问内容下载接口,或保存返回的成品 URL。 把成品链接直接贴到公开工单或聊天里。
failed 任务失败。 保留任务 ID、模型、prompt 摘要、错误信息和时间点。 只截图“失败”两个字,不保留可排查信息。
# 查询视频任务状态
curl "https://www.6xin.cc/v1/videos/任务ID" \
  -H "Authorization: Bearer sk-你的令牌"

# 任务 completed 后再下载内容
curl "https://www.6xin.cc/v1/videos/任务ID/content" \
  -H "Authorization: Bearer sk-你的令牌" \
  --output result.mp4

常见误区

用聊天模型生图

聊天模型可以理解图片,不等于能生成图片。请使用图像生成模型和图像接口。

分组选错

图像/视频模型通常需要对应分组。出现 403 时优先查模型分组和模型 ID。

视频当同步接口用

视频通常是异步任务。创建任务后要查询状态,不要等待一次请求直接返回成品。

把完整令牌贴给别人

排障时只提供脱敏令牌片段、模型 ID、时间、错误码和请求路径。

失败时按这张表排查

现象优先检查下一步
模型列表能看到,生成时报 403 令牌分组是否真的包含目标图像或视频模型。 回到 模型分组验证,用同一条令牌跑对应能力的最小请求。
图像编辑上传失败 字段名是否为 image,是否真正上传文件内容。 先用无隐私的小图测试,不要只传本地路径字符串。
视频一直没有完成 任务状态、创建时间、轮询间隔、prompt 和时长。 先降低时长或复杂度,再用新任务验证;不要无限重复提交。
客户端成功但 6星中转 没有日志 客户端是否还在走旧 Base URL、旧令牌或本地缓存配置。 用本页 curl 示例直接请求 6星中转,和客户端结果对比。
同一任务连续 5xx 或超时 状态页、任务规模、并发、文件大小和重试策略。 暂停批量任务,保留时间点和任务 ID,再看 状态页与真实请求。

这些情况先停下来,不要继续提交高消耗任务

图像和视频请求比普通聊天更容易产生高消耗或长时间排队。最小请求还没稳定前,不要批量提交、不要提高时长,也不要上传敏感素材排障。

现象先停止什么下一步只做这一件事
生成时报 403 不要继续换 prompt。 先检查令牌分组是否包含目标图像或视频模型。
视频任务长时间未完成 不要无限重复提交同一任务。 降低时长或复杂度,记录任务 ID 后查状态。
上传文件失败 不要先上传客户或隐私素材。 用无隐私小图确认字段名、文件内容和大小限制。
6星中转 没有用量日志 不要只在客户端里重试。 用本页最小 curl 对照,确认请求真的打到 6星中转。
连续 5xx 或超时 不要继续扩大批量任务。 暂停批量请求,保留时间点、模型 ID、任务 ID 和脱敏信息。

改错后怎么退回低成本任务

图像和视频排障不要靠“多试几次”。先把任务退回到低成本、无隐私、单请求的状态,确认能力链路后再加尺寸、时长、参考图或批量队列。

刚才改了什么先退回到什么状态回退后怎么确认
模型或分组 用当前令牌请求 /v1/models,只选择一个可见的图像或视频模型。 跑一次对应能力的最小请求,不同时换 prompt、尺寸和令牌。
图片尺寸、质量或数量 先退回单张、低分辨率、默认质量。 确认能返回图片 URL 或 base64,再逐步提高质量或数量。
图像编辑文件 换成一张无隐私、体积小、格式明确的测试图。 确认 image 文件字段被接受,再换回真实素材。
视频时长或复杂 prompt 退回 3-5 秒短视频和一句清晰 prompt。 先拿到任务 ID,再确认状态能从排队进入完成或明确失败。
批量任务或自动化队列 暂停队列,只保留单条测试任务。 单条任务成功、日志能对上后,再恢复限速队列。
回退期间不要上传客户素材或私人图片。排障用测试素材完成后,再用真实素材做一次受控验证,并确认不会把生成结果或原图暴露到公开渠道。

需要人工协助时准备这些信息

图像和视频问题比普通聊天更依赖任务 ID、文件字段和状态。提交工单前先把信息整理好,排查会快很多。

问题类型:文生图 / 图像编辑 / 图片理解 / 视频生成
请求时间:2026-06-21 19:30 左右
请求路径:/v1/images/generations 或 /v1/videos
模型 ID:从 6星中转 模型广场复制的模型 ID
状态码或任务状态:403 / 429 / queued / in_progress / failed 等
任务 ID:仅视频任务需要
令牌片段:只提供前后少量字符,不提供完整令牌
是否能在用量日志看到记录:能 / 不能
已做过的最小请求:贴脱敏 curl 或截图
不要把完整令牌、私人图片原图、客户素材、未公开视频链接贴到公开渠道。需要截图时,先遮住密钥和个人信息。

完成标准

检查项通过标准不通过时先看
模型分组 令牌所属分组能访问你选择的图像或视频模型。 模型分组
接口路径 文生图走 /v1/images/generations,改图走 /v1/images/edits,视频走 /v1/videos。 模型与能力对照
最小请求 至少一次短 prompt 能返回图片、任务 ID 或最终视频状态。 API 最小示例
日志核对 6星中转 用量日志中能按时间点找到对应请求。 状态页与可用性