常见问题

基础使用

Shark Hub 是什么?

Shark Hub 是 AI 模型接入服务。你可以把它配置到 Codex、Claude Code 等现成工具,也可以在自己的应用、脚本或内部系统中调用 API。账户、密钥、用量和费用在 Shark Hub 中独立管理。

我应该从哪里开始?

先注册并登录控制台,创建一个 API 密钥。然后根据你的场景选择“配置 AI 工具”或“API 开发接入”,按照对应指南填入 API 密钥和当前 Base URL。

“配置 AI 工具”和“API 开发接入”有什么区别?

如果你想直接使用 Codex、Claude Code 等已有工具,选择“配置 AI 工具”;如果你要在自己的应用、脚本或服务里调用模型,选择“API 开发接入”。两种方式都从获取 API 密钥开始。

API 密钥和 Base URL 分别做什么?

API 密钥用于验证身份和权限,Base URL 用于指定请求发往哪个服务地址。两者需要一起配置,具体地址以控制台当前提示和对应接口指南为准。

一个 API 密钥能同时配置多个工具吗?

可以,但更建议按工具、项目或成员分别创建密钥。这样更容易核对用量、设置独立额度,也能在单个密钥泄露时只撤销该密钥,不影响其他工具。

当前支持哪些模型,模型名称怎么填?

可用模型、分组和模型名称会持续更新。请以控制台“模型与价格”当前展示为准,不要直接复制旧文档或其他服务中的模型名称。

模型与线路

不同服务商的模型可以一起用吗?

可以在同一个 Shark Hub 账户中管理不同模型的调用,但每个应用仍需按照它使用的接口协议和模型配置接入。请根据模型与应用选择 OpenAI 兼容接口或 Anthropic 兼容接口,不要把“一个账户”理解为所有服务商都使用同一套原生配置。

会不会把我指定的模型换成其他模型?

不会静默替换你明确指定的模型。调度可以在同一模型的合格线路之间切换,但不会用另一个模型代替请求中的模型。当目标模型暂无合格线路时,请求应明确失败,而不是降级到其他模型。

“价格优先”和“稳定优先”有什么区别?

价格优先会在满足基础可用条件的线路中优先提供更优价格;稳定优先只使用达到更高响应率、响应速度和长尾稳定标准的线路。两者调整的是服务保障档位,不是模型本身的回答能力。

某条线路故障时会发生什么?

同一模型可以由多条合格线路提供服务。检测到线路异常后,调度引擎会停止继续使用异常线路,并在当前可用候选中切换容灾线路。当前请求是否重试取决于错误类型和请求状态,客户端仍应合理设置超时和重试。

为什么同一个模型有时快、有时慢?

响应速度会受输入长度、预期输出、上下文占用、推理强度、流式或非流式返回、网络和当时负载影响。因此官网按相同类型和负载档位观察 P95 等指标,不用单次最快结果代表长期体验。

响应率、响应速度和 SLA 怎么看?

响应率反映请求是否成功获得响应;响应速度反映排队、首次回复和完整回复的耗时;SLA 用来描述一段统计窗口内的服务可用表现。官网中的指标按当前统计口径更新,具体以模型表现页面的说明为准。

价格、充值与退款

充值完成后,余额没有更新怎么办?

先确认支付已完成,再刷新控制台并查看充值记录。若余额仍未更新,请向小助手提供支付时间和订单信息,以便核对。

为什么价格会变化?

每个计费项的正式折扣范围由已发布政策确定;系统再在范围内生成连续的价格区段。成本和市场数据只用于生成建议与后续排程,不会让某一次调用临时重新定价。实际计费以请求开始时命中的已发布价格区段为准。

价格为什么可以低于官方参考价?

Shark Hub 将同一模型的多条可用上游线路纳入评估,并结合官方参考价、近期成本和市场价格发布折扣。低价来自供给与调度效率,不是将请求静默替换为更低等级的模型。

价格变化会影响已经开始的请求吗?

不会中途改价。每次请求在开始时锁定当时已发布的价格区段,后续价格排程只影响之后开始的请求,也不会对历史用量追溯加价。

输入、输出和缓存读取 Token 怎么计费?

一次调用可能包含本次新增的输入、模型生成的输出,以及复用缓存的上下文。首次处理一段可复用的长上下文时,上游会在内部建立缓存;后续请求命中相同上下文时记为缓存读取,通常比重新处理这段内容更便宜。缓存读取不是摘要,模型仍会使用完整上下文。首次建立缓存时会产生缓存写入;同一段内容在一次调用中不会同时重复计为普通输入和缓存写入。输入、输出和缓存读取均按实际 Token 用量计费,每次请求以开始时已发布的价格为准。

请求失败也会扣费吗?

如果失败前没有产生上游确认的可结算用量,则不形成应收费用;如果上游已经确认产生可结算用量,即使请求最终失败,已发生的部分仍可能按实际用量计费。

工具看起来卡住没有回答,为什么使用记录还在增加?

界面暂时没有显示最终回答,不代表工具已经停止调用。Codex、Claude Code 等工具可能仍在进行推理、读取文件、调用工具、重试或发起后续请求;实际产生的输入、输出和缓存读取 Token 会汇总至消费明细。平台不会按等待时长对单个请求持续计费,使用记录只会在上游返回可结算用量后写入。若不希望继续产生新调用,请先在工具中停止当前任务,再到控制台“使用记录”按时间查看请求、模型和 Token 用量;仍无法判断时,请提供发生时间、所用工具、模型名称和脱敏后的请求记录给小助手排查。

怎样核对每一笔模型调用费用?

在控制台“使用记录”中按请求时间查看模型、Token 用量和对应费用,再与请求开始时的已发布价格核对。如果仍有疑问,向小助手提供请求时间和脱敏后的记录信息。

充值后可以退款吗?

可以。首笔充值支持随用随退;后续充值也可以联系小助手沟通处理。

账户与安全

平台会如何处理 Prompt 和模型返回内容?

请求内容需要经 Shark Hub 转发至对应模型服务才能完成调用。请不要在 Prompt 中放入与任务无关的密码、API 密钥、身份证件或客户隐私;涉及企业敏感数据时,请先联系团队确认适用的数据处理与合规要求。

API 密钥可以发给别人或写在前端代码里吗?

不可以。API 密钥会使用账户额度,只应保存在可信设备、环境变量或服务端密钥管理中。不要把完整密钥放进网页前端、公开仓库、截图、聊天记录或发给不可信人员。

如何降低密钥泄露和意外消费的风险?

为不同工具或项目创建独立密钥,并按需设置消费额度、请求频率、有效期和 IP 限制。定期查看使用记录,不再使用的密钥及时删除或停用。

怀疑 API 密钥泄露了怎么办?

立即删除或停用原密钥,重新创建密钥并更新所有相关配置。同时检查近期使用记录和费用;发现异常调用时,将时间范围和脱敏记录提供给小助手协助排查。

故障与支持

配置后仍然无法调用怎么办?

先检查 API 密钥是否完整有效、Base URL 是否使用当前控制台提供的地址、模型和接口协议是否匹配,再重启对应工具。仍有问题时,记录错误时间、请求方式和错误信息,联系小助手协助排查。

返回 401 或 403 错误怎么办?

这类错误通常与身份或权限有关。检查 API 密钥是否完整、已启用且没有多余空格,鉴权方式是否符合当前接口协议,密钥所属分组是否可以使用目标模型。

返回 429 错误怎么办?

429 表示当前请求频率、并发或可用资源达到限制。先降低并发并按递增间隔重试,同时检查密钥是否设置了频率限制。如果持续发生,记录模型、时间和并发量后联系小助手。

返回 5xx、超时或连接中断怎么办?

先使用合理的超时时间,并对可重试请求做有上限的递增退避,不要立即高频重发。同时确认本地网络、Base URL 和目标模型正常。持续异常时,提供错误时间、模型、请求方式和脱敏后的错误内容。

联系小助手时应该提供哪些信息?

联系小助手时,请提供问题发生时间、使用的工具或接口、模型名称、HTTP 状态码和脱敏错误信息。请不要提供完整 API 密钥,也不要附上与排障无关的敏感 Prompt 或业务数据。

终端提示找不到 node 或 npm

重新安装 Node.js LTS。安装结束后关闭所有 PowerShell 或 Terminal 窗口,再新开一个窗口执行 node -vnpm -v。只有 node 可用而 npm 不可用,通常说明安装不完整。

终端提示找不到 codex 或 claude

重新执行对应的 npm 全局安装命令,确认没有报错,然后关闭并重新打开终端,再检查版本号。

点击 CC Switch 导入没有反应

先确认 CC Switch 已安装并正在运行;再次点击导入时允许浏览器打开外部应用。如果始终没有弹窗,检查系统是否已将 ccswitch:// 协议关联到 CC Switch。

控制台能登录,但工具无法使用

依次确认 API 密钥完整有效、CC Switch 当前启用的是刚导入的配置、导入目标与实际工具一致。修改后应重启对应工具。

密钥无效或未正确填写

检查 API 密钥是否完整、是否已启用,并确认前后没有空格。若密钥可能泄露或已被删除,请创建新密钥后重新配置。

接口地址、路径或模型不匹配

确认 Base URL 为当前控制台提供的地址,并检查请求路径、CC Switch 导入目标和当前分组支持的模型名称。

请求频率、配额或服务压力限制

稍后重试,同时在控制台检查账户余额、密钥额度和使用记录。如果持续出现,请将错误时间与请求信息提供给小助手。

Shark Hub 上手指南 · 持续更新中 ·