指南/黑话词典
中转站黑话词典:社区术语到底在说什么
「降智」「掉包」「官转」「号池」都是社区用语,没有统一的官方定义。它们适合快速描述感受、异常或商家声明;要判断模型、渠道与计费是否符合约定,还得回到请求、响应、账单和服务端记录。
现象与异常
| 词 | 社区里通常指什么 | 使用边界 |
|---|---|---|
| 降智 | 模型回答质量相对过去或对照组下降 | 这是现象描述。Prompt、参数、上下文、模型版本和上游路由变化都可能产生相似表现,按降智排查逐项分流 |
| 掺假 | 服务的模型、渠道、用量或能力与声明不一致的统称 | 范围很宽,公开结论应改写成具体差异,例如「固定任务持续偏离官方同期对照」 |
| 掉包 / 模型掉包 | 请求标称模型 A,服务端却把全部或部分请求交给另一个模型 | 响应里的 model 字段可被网关填写;模型身份需要服务端记录或成体系的行为审计,见模型审计方法 |
| 上下文截断 | 请求到达模型前被裁短,或上下文超过接口允许范围 | 长对话「失忆」也可能来自应用没有发送完整历史。核对方法见上下文截断 |
| 参数过滤 | 网关在转发时删除、改写或忽略请求字段 | 用同一请求对比客户端发出的 JSON 与服务行为;逐项验收方法见OpenAI API 兼容性 |
| 断流 | 流式响应在协议结束事件之前中止,客户端只拿到部分内容 | 要区分网络中断、上游错误和客户端解析失败,检查方法见 SSE 流式完整性 |
| 跑路 | 站点停止提供服务,账户余额无法继续使用或取回 | 这是结果描述,不能靠某个接口字段预测。控制预存余额、保存主体和退款规则可以缩小损失 |
计费与用量
| 词 | 社区里通常指什么 | 使用边界 |
|---|---|---|
| 倍率 | 中转站把模型用量换算成站内余额时使用的系数 | 倍率是定价规则,不自动表示渠道类型。保存购买时的规则,并核对账单的计算过程 |
| 虚标 / 偷 Token | 账户记录的 Token 用量或扣费高于按约定口径计算的结果 | 先排除三家 API 的字段口径、缓存与推理 Token 差异,再谈异常,见 Token 用量对照和账单对账 |
| 缓存套利 | 服务方取得缓存带来的上游成本差额,但结算规则没有向用户说明或仍按完整输入收费 | 是否属于违约取决于购买时公布的计费规则;缓存是否命中要看协议记录,见 Prompt Cache 检查 |
| 输出缩水 | 相同任务的输出持续变短,完成度下降或需要更多重试 | 输出长度受模型、参数和任务影响。它可以作为成本体验指标,不能单独证明计费或模型被改写 |
| 重复计费 | 同一份输入在账单中被计算多次,或与公布的多轮对话计费方式不符 | 多轮 API 通常会再次发送历史消息;应核对客户端实际发送的输入与站方计费规则 |
usage 是 API 响应里的用量对象。不同供应商、不同接口的字段和包含关系并不相同;它记录服务端报告的用量,不是不可改写的第三方凭证。具体字段以当前官方文档和站内用量对照为准。
渠道与资源声明
| 词 | 社区里通常指什么 | 使用边界 |
|---|---|---|
| 中转站 / API 中转 | 接收客户端请求,再调用其他模型服务并返回结果的第三方网关 | 网关可能只做转发,也可能做模型映射、协议转换、重试和计费 |
| 官转 / 官方直连 | 商家声称请求通过模型厂商提供的正式 API | 这是来源声明。协议外形相同只能证明兼容性,不能确认实际账号或上游路径 |
| 一方云 | 商家声称请求通过 AWS、Google Cloud 或 Azure 等云平台托管的模型服务 | 同一云平台可能有多种端点、协议和模型。Bedrock 的证据边界见Bedrock 转发证据 |
| 号池 | 商家声称由一组账号轮换或分担请求 | 「号」可能指订阅账号、API 项目或其他资源,具体范围要向商家确认;限流节奏只能当线索 |
| 逆向 / 2api | 商家或用户用来指把消费端产品或客户端的内部调用包装成 API | 各家实现差异很大。价格、错误格式或一次产品自报不足以确认这类来源 |
| IDE 额度反代 | 声称使用 Kiro、GitHub Copilot 等编程产品所含资源来承接请求 | 产品环境、底层模型、推理渠道和付费资源是四个问题,见模型与渠道身份 |
| CCMax / Kiro / AWS-Q 等分组名 | 站方用于描述资源来源、产品环境或套餐的标签 | 标签含义取决于站方说明,并可能随时间改变。保存原始页面,不从名称直接推导模型或账号来源 |
这些标签会随社区和商家用法漂移。需要比较渠道时,把「站方声明」「客户端可观察行为」「账户或服务端记录」分开保存,见中转站渠道类型。
协议与监控
| 词 | 指什么 | 能用来做什么 |
|---|---|---|
request-id / 请求 ID | 服务为一笔请求生成的关联标识 | 用来连接客户端错误、服务端日志和支持工单;无法在上游查询的单个 ID 不能证明渠道来源 |
stop_reason / 终止原因 | 说明一次生成为什么结束的响应字段 | 区分正常结束、达到输出上限、工具调用等情况;字段名称和取值以对应 API 文档为准 |
| TTFT | Time To First Token,首 Token 延迟 | 观察排队、网络和服务速度变化。单次 TTFT 无法识别模型或渠道 |
| 拨测 / 探测 | 主动发送已知请求,检查接口状态和行为 | 固定请求适合比较不同时间或分组,但探测结果只覆盖被采样的请求 |
| 基线 | 在请求条件固定时,一段时间内的正常表现范围 | 用来发现后续偏离;配置、模型版本或任务改变后要另起基线 |
社区术语负责给问题命名,原始请求、响应、账单和可关联的服务端记录负责限定结论。遇到名称冲突时,先写下观察到的差异,再到对应专题补证据。
术语会漂移,原始记录要保留
申请试用
LinkyMonitor 持续保存同一分组的请求行为、Usage、响应结构与变化时间,便于从社区说法回到可复查的材料。