指南/黑话词典

中转站黑话词典:社区术语到底在说什么

「降智」「掉包」「官转」「号池」都是社区用语,没有统一的官方定义。它们适合快速描述感受、异常或商家声明;要判断模型、渠道与计费是否符合约定,还得回到请求、响应、账单和服务端记录。

最后更新 2026-08-16可收藏备查

现象与异常

社区里通常指什么使用边界
降智模型回答质量相对过去或对照组下降这是现象描述。Prompt、参数、上下文、模型版本和上游路由变化都可能产生相似表现,按降智排查逐项分流
掺假服务的模型、渠道、用量或能力与声明不一致的统称范围很宽,公开结论应改写成具体差异,例如「固定任务持续偏离官方同期对照」
掉包 / 模型掉包请求标称模型 A,服务端却把全部或部分请求交给另一个模型响应里的 model 字段可被网关填写;模型身份需要服务端记录或成体系的行为审计,见模型审计方法
上下文截断请求到达模型前被裁短,或上下文超过接口允许范围长对话「失忆」也可能来自应用没有发送完整历史。核对方法见上下文截断
参数过滤网关在转发时删除、改写或忽略请求字段用同一请求对比客户端发出的 JSON 与服务行为;逐项验收方法见OpenAI API 兼容性
断流流式响应在协议结束事件之前中止,客户端只拿到部分内容要区分网络中断、上游错误和客户端解析失败,检查方法见 SSE 流式完整性
跑路站点停止提供服务,账户余额无法继续使用或取回这是结果描述,不能靠某个接口字段预测。控制预存余额、保存主体和退款规则可以缩小损失

计费与用量

社区里通常指什么使用边界
倍率中转站把模型用量换算成站内余额时使用的系数倍率是定价规则,不自动表示渠道类型。保存购买时的规则,并核对账单的计算过程
虚标 / 偷 Token账户记录的 Token 用量或扣费高于按约定口径计算的结果先排除三家 API 的字段口径、缓存与推理 Token 差异,再谈异常,见 Token 用量对照账单对账
缓存套利服务方取得缓存带来的上游成本差额,但结算规则没有向用户说明或仍按完整输入收费是否属于违约取决于购买时公布的计费规则;缓存是否命中要看协议记录,见 Prompt Cache 检查
输出缩水相同任务的输出持续变短,完成度下降或需要更多重试输出长度受模型、参数和任务影响。它可以作为成本体验指标,不能单独证明计费或模型被改写
重复计费同一份输入在账单中被计算多次,或与公布的多轮对话计费方式不符多轮 API 通常会再次发送历史消息;应核对客户端实际发送的输入与站方计费规则

usage 是 API 响应里的用量对象。不同供应商、不同接口的字段和包含关系并不相同;它记录服务端报告的用量,不是不可改写的第三方凭证。具体字段以当前官方文档和站内用量对照为准。

渠道与资源声明

社区里通常指什么使用边界
中转站 / API 中转接收客户端请求,再调用其他模型服务并返回结果的第三方网关网关可能只做转发,也可能做模型映射、协议转换、重试和计费
官转 / 官方直连商家声称请求通过模型厂商提供的正式 API这是来源声明。协议外形相同只能证明兼容性,不能确认实际账号或上游路径
一方云商家声称请求通过 AWS、Google Cloud 或 Azure 等云平台托管的模型服务同一云平台可能有多种端点、协议和模型。Bedrock 的证据边界见Bedrock 转发证据
号池商家声称由一组账号轮换或分担请求「号」可能指订阅账号、API 项目或其他资源,具体范围要向商家确认;限流节奏只能当线索
逆向 / 2api商家或用户用来指把消费端产品或客户端的内部调用包装成 API各家实现差异很大。价格、错误格式或一次产品自报不足以确认这类来源
IDE 额度反代声称使用 Kiro、GitHub Copilot 等编程产品所含资源来承接请求产品环境、底层模型、推理渠道和付费资源是四个问题,见模型与渠道身份
CCMax / Kiro / AWS-Q 等分组名站方用于描述资源来源、产品环境或套餐的标签标签含义取决于站方说明,并可能随时间改变。保存原始页面,不从名称直接推导模型或账号来源

这些标签会随社区和商家用法漂移。需要比较渠道时,把「站方声明」「客户端可观察行为」「账户或服务端记录」分开保存,见中转站渠道类型

协议与监控

指什么能用来做什么
request-id / 请求 ID服务为一笔请求生成的关联标识用来连接客户端错误、服务端日志和支持工单;无法在上游查询的单个 ID 不能证明渠道来源
stop_reason / 终止原因说明一次生成为什么结束的响应字段区分正常结束、达到输出上限、工具调用等情况;字段名称和取值以对应 API 文档为准
TTFTTime To First Token,首 Token 延迟观察排队、网络和服务速度变化。单次 TTFT 无法识别模型或渠道
拨测 / 探测主动发送已知请求,检查接口状态和行为固定请求适合比较不同时间或分组,但探测结果只覆盖被采样的请求
基线在请求条件固定时,一段时间内的正常表现范围用来发现后续偏离;配置、模型版本或任务改变后要另起基线

社区术语负责给问题命名,原始请求、响应、账单和可关联的服务端记录负责限定结论。遇到名称冲突时,先写下观察到的差异,再到对应专题补证据。

术语会漂移,原始记录要保留

LinkyMonitor 持续保存同一分组的请求行为、Usage、响应结构与变化时间,便于从社区说法回到可复查的材料。

申请试用