数据核验进行中收录不等于推荐,待核验内容会明确标注。

本站一手测试 · 2026-08-02

API MART 实测:
Claude Code、Codex 与 11 次 API 请求

围绕两种协议直调和两款开发工具代码任务,记录本轮可核对的结果、账单摘要和兼容边界。

首轮结果

成功完成,但仍只建议小额试用

以下指标只代表本轮样本,不外推长期稳定性。

直接 API11 / 11
工具任务2 / 2
计费记录19 条
总消耗0.29792 Credits

本轮判断

当前小样本可以完成 Anthropic Messages、OpenAI Responses、Claude Code 和 Codex CLI 任务;但单一时段不能证明长期稳定,适合先小额试用。

协议直调

Anthropic 与 Responses 的小样本

固定低温度提示词,单次输出上限 128 Token。

协议与模型成功最小时延中位时延最大时延Token(输入 / 输出)
Anthropic Messages
claude-sonnet-4-6
6 / 62.159s2.516s2.986s192 / 114
OpenAI Responses
gpt-5.4-mini
5 / 51.110s1.621s2.040s120 / 70

Responses 的形态校验返回裸 JSON;Claude 返回 Markdown 代码围栏包裹的 JSON。“HTTP 成功”不等于严格结构化输出合规,调用方仍需做解析与校验。

开发工具

不是只发一句问候,而是真实改代码

两款工具面对同一个无隐私小项目:读文件、修复加法函数、运行单测。

Claude Code

  • 版本 2.1.195;模型 claude-sonnet-4-6。
  • 完成修改,Node.js 单测 1 / 1 通过。
  • 4 次计费模型调用,消耗 0.14678 Credits。

Codex CLI

  • 显式指定 gpt-5.4-mini 后完成相同任务。
  • 4 次计费模型调用,消耗 0.12948 Credits。
  • 启动时出现非阻断模型列表格式警告,因此不写“零配置完全兼容”。

账单如何核对

测试部分消耗 Credits
Anthropic 直接请求0.01836
Responses 直接请求0.00330
Claude Code 微任务0.14678
Codex CLI 微任务0.12948
合计0.29792

本轮账单汇总为 0.29792 Credits;人民币等值不用于跨站价格排名。

这份实测不能证明什么

样本边界

  • 样本量有限,未做分时复测。
  • 未做多地区、多运营商验证。
  • 代码任务很小,不能外推复杂工程、长上下文或高并发。

没有测试

  • 未测试退款、客服工单、高并发或复杂项目。
  • 没有独立验证模型来源与模型真实性。
  • 没有把一次成功写成“长期稳定”或“全网最好”。

本站无已确认联盟关系;结论仅适用于本轮公开的样本与限制。

先看完整站点资料,再决定是否试用。

API MART 详情页同时保留历史调用、当前价格、运营主体、风险和本轮测试证据。

查看 API MART 详情 →