数据核验进行中收录不等于推荐,待核验内容会明确标注。

本站一手测试 · 2026-08-02

Poixe 实测:
Claude Code、Codex 与 10 次 API 请求

围绕两种协议直调和两款开发工具代码任务,记录本轮可核对的结果、账单摘要和兼容边界。

首轮结果

两种协议和两款工具均完成,仍建议小额试用

以下指标只代表本轮单一时段的小样本,不外推长期稳定性。

直接 API10 / 10
工具任务2 / 2
计费请求18 笔
总消耗$0.02743683

本轮判断

当前小样本可以完成 Anthropic Messages、OpenAI Responses、Claude Code 和 Codex CLI 任务;但 Codex 需要关闭一个不受支持的默认工具,且单一时段不能证明长期稳定。

协议直调

Anthropic 与 Responses 各请求 5 次

固定提示词,单次输出上限 128 Token;时延为客户端端到端记录。

协议与模型成功最小时延中位时延最大时延Token(输入 / 输出)
OpenAI Responses
gpt-5.6-luna
5 / 51.485s1.733s3.011s1,600 / 178
Anthropic Messages
claude-haiku-4-5
5 / 51.123s1.522s3.747s160 / 95

Responses 的 5 次结果均通过严格 JSON 形态校验;Anthropic 的 5 次结果均返回 Markdown 代码围栏包裹的 JSON。“HTTP 成功”不等于严格结构化输出合规,调用方仍需做解析与校验。

开发工具

两款工具完成同一个真实代码微任务

任务内容为读取文件、修复加法实现并运行单元测试;测试文件未被修改。

Claude Code

  • 使用 claude-haiku-4-5 完成代码修改。
  • 独立复核后,Node.js 单元测试 1 / 1 通过。
  • 5 笔计费模型调用,消耗 $0.01194080。

Codex CLI

  • 首次请求因默认图像工具不受支持而被拒绝,未产生计费。
  • 关闭该工具后,使用 gpt-5.6-luna 完成修改,独立复核测试 1 / 1 通过。
  • 成功任务产生 3 笔计费模型调用,消耗 $0.01456115。

账单如何核对

测试部分请求数消耗
两种协议直接请求10$0.00093488
Claude Code 微任务5$0.01194080
Codex CLI 成功任务3$0.01456115
合计18$0.02743683

金额按本轮站方日志逐笔汇总;不同路由、模型、等级或活动可能改变价格。

这份实测不能证明什么

样本边界

  • 样本量有限,未做分时复测。
  • 未做多地区、多运营商验证。
  • 代码任务很小,不能外推复杂工程、长上下文或高并发。

兼容边界

  • Codex 默认图像工具当前会被拒绝,需要关闭后使用。
  • 模型列表格式与 Codex 预期不完全一致,会出现非阻断警告。
  • 未测试退款、客服,也没有独立验证模型来源与真实性。

测试结论仅适用于本页公开的样本与限制,不能外推长期稳定性。

先看完整站点资料,再决定是否试用。

Poixe 详情页同时保留当前价格、运营主体、风险、第三方材料和本轮一手测试证据。

查看 Poixe 详情 →