本轮判断
当前小样本可以完成 Anthropic Messages、OpenAI Responses、Claude Code 和 Codex CLI 任务;但单一时段不能证明长期稳定,适合先小额试用。
本站一手测试 · 2026-08-02
围绕两种协议直调和两款开发工具代码任务,记录本轮可核对的结果、账单摘要和兼容边界。
首轮结果
以下指标只代表本轮样本,不外推长期稳定性。
本轮判断
当前小样本可以完成 Anthropic Messages、OpenAI Responses、Claude Code 和 Codex CLI 任务;但单一时段不能证明长期稳定,适合先小额试用。
协议直调
固定低温度提示词,单次输出上限 128 Token。
| 协议与模型 | 成功 | 最小时延 | 中位时延 | 最大时延 | Token(输入 / 输出) |
|---|---|---|---|---|---|
| Anthropic Messages claude-sonnet-4-6 | 6 / 6 | 2.159s | 2.516s | 2.986s | 192 / 114 |
| OpenAI Responses gpt-5.4-mini | 5 / 5 | 1.110s | 1.621s | 2.040s | 120 / 70 |
Responses 的形态校验返回裸 JSON;Claude 返回 Markdown 代码围栏包裹的 JSON。“HTTP 成功”不等于严格结构化输出合规,调用方仍需做解析与校验。
开发工具
两款工具面对同一个无隐私小项目:读文件、修复加法函数、运行单测。
| 测试部分 | 消耗 Credits |
|---|---|
| Anthropic 直接请求 | 0.01836 |
| Responses 直接请求 | 0.00330 |
| Claude Code 微任务 | 0.14678 |
| Codex CLI 微任务 | 0.12948 |
| 合计 | 0.29792 |
本轮账单汇总为 0.29792 Credits;人民币等值不用于跨站价格排名。
本站无已确认联盟关系;结论仅适用于本轮公开的样本与限制。
API MART 详情页同时保留历史调用、当前价格、运营主体、风险和本轮测试证据。