GrokCode 工具箱
定位工具型站点:把中转检测、能力验真、成本换算、监控告警、价格同步串成一条工作流。 每个工具都标明能做什么 / 不能做什么 / 结果怎么读,避免把「通断」当成「真假模型」。
验真深度对照 · 选对工具
同一套 API,不同工具回答的问题不同。先看深度与额度风险,再点进详情页的能力边界。
能力边界速览
点进任意工具可看完整「能 / 不能 / 怎么读 / 可信度」。
轻量验收:这个 Base+Key 能不能用、有哪些模型、Chat 能否回包。
- ✓ 预检 Base URL 是否公网可达(SSRF 拦截内网)
- ✓ GET /v1/models 拉模型列表(需 Key 时带鉴权)
- ✗ 不测真实业务压测 QPS / 并发上限
- ✗ 不做多地区节点对比(请用多节点测速)
可信度:通断结论可信;能力与「真假模型」需升级实验室。
深度验收:速度分布 + 固定题库能力分,辅助判断是否疑似降智。
- ✓ 多轮测 TTFT / Total / 吞吐 tok/s 与成功率
- ✓ bench_v1:数学 / 英文 / 中文 / 代码四维固定题
- ✗ 不是官方 MMLU/GPQA 认证榜,题量有限
- ✗ 不能证明「一定是官方 checkpoint」
可信度:筛「明显注水/挂掉」很有效;细粒度排名请结合天梯 + 多源。
同一机房视角下,并行对比多个 Base 的连通与 models 延迟。
- ✓ 最多 6 个 URL 并行
- ✓ 阶段:连接 → /v1/models → 可选 chat
- ✗ 不是全球多地区探针(无香港/美西等分布式节点)
- ✗ 不等于你电脑访问速度
可信度:节点间相对排序可信;绝对值随网络波动。
把 NewAPI 的 model_ratio 体系与 $/M 单价互相换算,避免调价算错。
- ✓ 倍率 → 输入/输出 $/M(含 group_ratio)
- ✓ 单价 → model_ratio / completion_ratio
- ✗ 不代表任何站点「实际扣费」——以账单为准
- ✗ 不处理固定价/按次/图片计费等特殊模型
可信度:公式换算准确;与真实账单需对账工具校验。
用你设定的单价规则重算「应计费」,对比 CSV 中的 cost 差额。
- ✓ 解析常见表头(model/prompt/completion/cost)
- ✓ 按模型覆盖单价
- ✗ 不保证适配所有厂商导出格式(复杂引号/合并单元格需预处理)
- ✗ 不自动拉取账单,需你粘贴 CSV
可信度:同规则下算术准确;差异原因需结合业务排查。
对外提供 NewAPI/Sub2API 可同步的公开价格 JSON。
- ✓ GET /api/pricing 兼容 NewAPI type2
- ✓ GET /api/ratio_config 倍率 map
- ✗ 不保证与所有厂商官网实时一致
- ✗ 不是你站点的实际售价
可信度:同步格式正确;价格为聚合参考。
必备工具(优先用)
覆盖:通断 → 测速验真 → 成本 → 监控 → 同步定价
填 Base URL + Key:预检 /v1/models / Chat 多轮,快速判断中转能不能用。
轻量验收:这个 Base+Key 能不能用、有哪些模型、Chat 能否回包。
去检测 →TTFT / 吞吐 / 成功率 + bench_v1 四维能力分,对照天梯判断是否降智。
深度验收:速度分布 + 固定题库能力分,辅助判断是否疑似降智。
打开实验室 →余额 / 质量 / 能力按 10 分钟起定时探测,失败与恢复发邮件。
挂机观测:按设定频率做余额/质量/能力探测,异常与恢复邮件通知。
配置监控 →并行探测最多 6 个 Base URL 的连接、models 与可选 chat 延迟,对比中转节点。
同一机房视角下,并行对比多个 Base 的连通与 models 延迟。
多节点探测 →官方 Token 价 × 综合倍率,估算日用 / Agent 旗舰线费用(CNY)。
官方 Token 价 × 站点综合倍率,粗算编码/Agent 费用。
估算成本 →model_ratio / completion_ratio ↔ 输入输出 $/M 双向换算,对齐 NewAPI 计费公式。
把 NewAPI 的 model_ratio 体系与 $/M 单价互相换算,避免调价算错。
去换算 →输入/输出 Token 量 × 单价,秒算单次与百万次费用,支持 USD/CNY。
按用量 × 单价 × 倍率估算单次/合计费用(USD/CNY)。
去速算 →NewAPI /api/pricing · Sub2API LiteLLM 表,可作上游同步数据源。
对外提供 NewAPI/Sub2API 可同步的公开价格 JSON。
接入文档 →综合倍率、7 日可用率、决策四卡。
打开倍率榜 →带实测能力
会向你填写的 Base URL 发探测请求,用于验收中转与模型真实性。
填 Base URL + Key:预检 /v1/models / Chat 多轮,快速判断中转能不能用。
轻量验收:这个 Base+Key 能不能用、有哪些模型、Chat 能否回包。
去检测 →TTFT / 吞吐 / 成功率 + bench_v1 四维能力分,对照天梯判断是否降智。
深度验收:速度分布 + 固定题库能力分,辅助判断是否疑似降智。
打开实验室 →余额 / 质量 / 能力按 10 分钟起定时探测,失败与恢复发邮件。
挂机观测:按设定频率做余额/质量/能力探测,异常与恢复邮件通知。
配置监控 →并行探测最多 6 个 Base URL 的连接、models 与可选 chat 延迟,对比中转节点。
同一机房视角下,并行对比多个 Base 的连通与 models 延迟。
多节点探测 →推荐使用路径
关注侧栏
任意页面右侧「关注」可聚合店铺 / 商品 / API / 监控状态(本机存储)。适合盯店上新与监控异常。
连通 · 验真
TTFT / 吞吐 / 成功率 + bench_v1 四维能力分,对照天梯判断是否降智。
深度验收:速度分布 + 固定题库能力分,辅助判断是否疑似降智。
打开实验室 →填 Base URL + Key:预检 /v1/models / Chat 多轮,快速判断中转能不能用。
轻量验收:这个 Base+Key 能不能用、有哪些模型、Chat 能否回包。
去检测 →并行探测最多 6 个 Base URL 的连接、models 与可选 chat 延迟,对比中转节点。
同一机房视角下,并行对比多个 Base 的连通与 models 延迟。
多节点探测 →成本 · 换算
model_ratio / completion_ratio ↔ 输入输出 $/M 双向换算,对齐 NewAPI 计费公式。
把 NewAPI 的 model_ratio 体系与 $/M 单价互相换算,避免调价算错。
去换算 →输入/输出 Token 量 × 单价,秒算单次与百万次费用,支持 USD/CNY。
按用量 × 单价 × 倍率估算单次/合计费用(USD/CNY)。
去速算 →官方 Token 价 × 综合倍率,估算日用 / Agent 旗舰线费用(CNY)。
官方 Token 价 × 站点综合倍率,粗算编码/Agent 费用。
估算成本 →监控 · 提醒
情报 · 选型
中转 / NewAPI / OpenRouter / 官方 model id 对照与解析。
把乱七八糟的 model 字符串归一到常见 canonical / OpenRouter id。
查别名 →热门用量、任务消费、厂商份额与智力指数。
打开排行 →对标 OpenRouter:价格、上下文、Tools/Vision、智力指数。
浏览模型 →四维分 + AA 多维复核,识别中转是否「真模型」。
看天梯 →推理节点总部/机房、uptime、覆盖模型。
看托管商 →价格 · 同步
运维 · 数据
関連ツール
Clavue CLI / imux IDE / clavue-2.1
Clavue · CLI 与 Agent 平台
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗imux · 原生 macOS AI IDE
Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗Clavue 2.1 · 产品级大模型
旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗