状态页怎么用:先判断是你本地问题,还是线路波动
状态页用于查看模型分组的近期可用性、延迟和异常趋势。它不是绝对裁决,但能帮助你判断下一步是查本地配置、降低并发、换模型,还是等待恢复。
等不及了,先按这张表判断
状态页只能回答“平台探测视角是否异常”。它不能替你判断令牌、分组、模型 ID 和客户端配置是否正确。
| 状态页看到什么 | 你的请求现象 | 优先判断 | 马上做什么 |
|---|---|---|---|
| 绿色 | 401 / 403 / 404 | 多半是本地配置、令牌、分组或模型 ID 问题。 | 回到令牌、模型分组和工具配置页排查。 |
| 绿色 | 只有你的客户端超时 | 可能是本地网络、代理、客户端超时或项目配置覆盖。 | 用 curl 做最小请求,对比客户端结果。 |
| 黄色 / 橙色 | 偶发超时或变慢 | 可能是分组波动。 | 降低并发、加退避重试,必要时换轻量模型。 |
| 红色 | 同类模型大面积失败 | 平台或上游可用性更可疑。 | 暂停密集重试,切换备用模型或等待恢复。 |
| 灰色 / 暂无数据 | 不确定是否能用 | 可能是低频探测或未覆盖分组。 | 用测试令牌发一次最小真实请求。 |
状态页由哪些区域组成
不同入口的展示可能略有差异,但读法是一致的:先看模型分组,再看最新探测,再看趋势。
| 区域 | 告诉你什么 | 怎么使用 |
|---|---|---|
| 模型分组概览 | Claude、Codex、Gemini、图像、视频等能力分组的整体状态。 | 先定位你正在调用的模型属于哪个分组。 |
| 探测结果 | 平台定时发起轻量请求后得到的状态、耗时和成功情况。 | 重点看最新一格,再看前几格是否连续异常。 |
| 近期趋势 | 一段时间内是否稳定、变慢或连续失败。 | 判断是偶发抖动,还是同类模型正在大面积波动。 |
| 说明和更新时间 | 探测时间、数据延迟或特殊分组说明。 | 更新时间过旧时,不要只凭状态页下结论。 |
状态页看什么
| 指标 | 说明 | 怎么判断 |
|---|---|---|
| 状态颜色 | 表示该模型分组最近是否可用。 | 绿色通常可用,黄色或橙色表示波动,红色表示异常。 |
| 延迟 | 从平台发起探测到得到响应的时间。 | 延迟升高不一定失败,但交互体验会变差。 |
| 成功率 | 最近探测窗口内成功的比例。 | 持续下降时优先换稳定线路或稍后重试。 |
| 更新时间 | 最近一次探测或刷新时间。 | 如果更新时间很旧,不要用它判断当前问题。 |
| 分组名称 | 状态按能力或模型家族展示。 | 先确认你的模型 ID 属于这个分组,再看状态。 |
状态颜色怎么理解
| 颜色 | 通常含义 | 建议动作 |
|---|---|---|
| 绿色 | 近期探测正常。 | 如果你仍失败,优先查本地配置、令牌、模型和分组。 |
| 黄色 | 延迟升高或偶发失败。 | 不急的任务可以继续;赶时间时换更轻量模型或稳定分组。 |
| 橙色 | 成功率明显下降,但不是完全不可用。 | 加退避重试,减少并发;连续失败时切换模型。 |
| 红色 | 连续失败或当前不可用。 | 暂停密集重试,切换其他可用模型,等待恢复。 |
| 灰色 | 暂无数据、低频探测或探测暂停。 | 不要仅凭灰色判断故障,补一次最小真实请求验证。 |
低频探测和展示型分组怎么理解
状态页会优先覆盖常用聊天、代码和主流模型分组。图像、视频、超长上下文等高消耗任务,单次探测成本更高,可能不会每隔几分钟都发真实生成请求。看到绿色、灰色或长时间无变化时,要结合最小真实请求判断。
| 状态页现象 | 可能原因 | 你该怎么做 |
|---|---|---|
| 绿色但你的图像或视频任务失败 | 绿色可能代表该能力近期可用,不等于你的参数、文件、分组和模型 ID 全部正确。 | 先用最低成本参数跑一次小任务,再按错误码查模型分组、文件格式和请求字段。 |
| 灰色或暂无数据 | 该分组可能低频探测、暂未聚合,或不是主流展示分组。 | 不要直接判定故障。先请求 /v1/models,再做一次最短生成。 |
| 状态页正常,但用量日志没有记录 | 请求可能没打到 6星中转,或者客户端仍在走旧 Base URL。 | 回到工具配置页检查 Base URL、当前 Provider、环境变量和项目级覆盖。 |
| 状态页异常,但你的请求成功 | 探测样本和你的真实请求可能走不同模型、不同分组或不同时间窗口。 | 可以继续使用,但保留重试和备用模型;生产任务不要只靠单次成功判断。 |
按场景使用状态页
| 你遇到什么 | 状态页怎么看 | 下一步 |
|---|---|---|
| 想知道某个模型现在能不能用 | 找到对应分组,看最新颜色和最近几格趋势。 | 绿色可直接试;黄色或橙色带重试;红色先换模型。 |
| 请求一直 5xx 或超时 | 如果同分组大面积橙色/红色,多半是平台或上游波动。 | 等待恢复、换同家族其他模型,或切到备用分组。 |
| 请求变慢但能返回 | 看延迟是否整体升高,还是只有你本地慢。 | 整体慢就降并发或换模型;只有你慢就查网络、代理和客户端。 |
| 401 / 403 / model not found | 状态页通常帮不上忙,这更像配置或权限问题。 | 回到 令牌与安全、模型分组 和 错误码速查。 |
| 图像或视频任务不确定是否可用 | 状态页只能给趋势参考,长任务状态可能有延迟。 | 用低分辨率、短时长或小文件跑最小任务,再看结果。 |
| 生产业务受影响 | 看是否同分组连续异常,并记录开始时间。 | 执行降级策略,保留模型、状态码、请求时间和脱敏令牌片段。 |
和真实请求一起判断
状态页只说明平台探测视角,真实用户还会受到本地网络、账号额度、模型分组和客户端配置影响。推荐按下面顺序确认:
看状态页
确认目标模型或分组是否大面积异常。
核对模型分组
确认模型 ID 来自当前分组,令牌也属于同一能力范围。
查模型列表
用测试令牌请求 /v1/models,判断认证和模型可见性是否正常。
发真实生成
用最短 prompt 请求一次聊天、Messages、图像或视频最小任务,确认生成链路。
看错误码
按 FAQ 区分 401、403、404、429 和 5xx,再决定是否重试。
最小真实请求怎么做
状态页异常时,真实请求能确认影响你当前令牌和当前模型;状态页正常时,真实请求能确认是不是客户端或本地网络问题。
先看模型列表
这一步验证令牌和模型可见性。返回 401 先处理令牌;列表里没有目标模型就先处理分组。
curl "https://www.6xin.cc/v1/models" \
-H "Authorization: Bearer sk-你的令牌"
再跑短聊天
把模型 ID 换成第一步列表里能看到的模型。短请求成功后,再回到客户端或业务代码。
curl "https://www.6xin.cc/v1/chat/completions" \
-H "Authorization: Bearer sk-你的令牌" \
-H "Content-Type: application/json" \
-d '{
"model": "模型广场复制的模型ID",
"messages": [{"role": "user", "content": "回复 OK"}]
}'
对照用量日志
确认同一时间、同一模型、同一令牌有记录。没有记录时,说明请求可能没打到 6星中转。
看完状态页后怎么决策
| 结论 | 适用情况 | 建议动作 |
|---|---|---|
| 继续使用 | 状态页绿色,最小请求成功,用量日志正常。 | 回到目标工具继续使用;如果客户端失败,查客户端配置。 |
| 降低并发 | 状态页黄色或延迟升高,但请求仍能成功。 | 减少批量任务并发,加入 1s / 2s / 4s 退避。 |
| 换模型或分组 | 同类模型持续慢,业务不能等待。 | 选择同能力的备用模型,并重新验证令牌分组。 |
| 暂停重试 | 红色或大面积 5xx,连续重试仍失败。 | 停止密集重试,避免无效消耗和队列堆积。 |
| 提交问题 | 状态页和真实请求矛盾,或问题持续复现。 | 带上时间、模型、错误码、脱敏令牌片段和最小请求结果。 |
状态页不能替代什么
- 不能证明你的令牌一定有权限访问某个模型。
- 不能证明你的请求参数一定合法。
- 不能替代一次真实
/v1/chat/completions或/v1/messages请求。 - 不能展示你的账号余额和账单状态。
- 不能保证每一个高消耗、长耗时任务都被实时高频探测。
这些情况先停下来,不要继续扩大影响
状态页是判断方向的工具,不是最终裁决。遇到异常时先缩小请求范围、保留证据,再决定切线路、降并发或等待恢复。
| 现象 | 先停止什么 | 下一步只做这一件事 |
|---|---|---|
| 目标模型显示红色或持续异常 | 不要继续跑高并发或长任务。 | 切到备用模型或稳定分组,并用短请求验证。 |
| 状态页绿色但你请求失败 | 不要直接判定平台整体故障。 | 检查令牌、分组、模型 ID、Base URL 和真实错误码。 |
| 灰色或无数据 | 不要把它当成一定不可用。 | 用你的测试令牌跑一次最小请求,再结合日志判断。 |
| 连续超时或 5xx | 不要无限自动重试。 | 降低并发,记录时间、模型、请求路径和错误码。 |
| 需要提交工单 | 不要发送完整令牌或客户数据。 | 按工单模板提供脱敏信息和最小复现结果。 |
需要提交工单时带什么
| 信息 | 为什么需要 | 注意事项 |
|---|---|---|
| 问题发生时间 | 方便和状态页探测窗口、用量日志对齐。 | 尽量写具体到分钟,不要只写“刚刚”。 |
| 模型 ID 和分组 | 判断是否只有某个模型或某类分组异常。 | 模型 ID 从请求体或工具配置复制。 |
| 状态页现象 | 说明当时是绿色、黄色、橙色、红色还是无数据。 | 可以截图,但遮住任何完整令牌。 |
| 错误码和请求路径 | 区分认证、分组权限、模型不存在、限流或服务异常。 | 只提供路径和状态码,不提供完整密钥。 |
| 脱敏令牌片段 | 方便定位是哪张令牌的问题。 | 只给前后几位,绝对不要贴完整令牌。 |
可复制的信息模板
发生时间:
状态页现象:绿色 / 黄色 / 橙色 / 红色 / 灰色
模型 ID:
令牌分组:
请求路径:/v1/models / /v1/chat/completions / /v1/messages / 其他
错误码:
最小请求是否成功:
用量日志是否有记录:
已尝试:换模型 / 重开客户端 / curl 验证 / 降并发 / 其他
判断完成标准
| 判断项 | 应该得到的结论 | 下一步 |
|---|---|---|
| 状态页是否异常 | 能判断目标模型或分组是正常、波动还是不可用。 | 正常时查本地配置;异常时切线路或等待恢复。 |
| 真实请求是否成功 | 至少跑过一次模型列表和一次短生成请求,或一个最小图像/视频任务。 | 失败时按 FAQ 与排障 区分错误码。 |
| 是否需要换线路 | 能根据成功率、延迟和业务影响判断是否切稳定分组。 | 回到 模型分组 或工具配置页调整。 |
| 是否需要提交工单 | 已经准备好时间、模型、错误码、脱敏令牌片段和请求现象。 | 按 FAQ 的工单信息表提交,不提供完整令牌。 |