主题
模型与价格
价格从站点「模型广场」实时抓取(2026-09-27 更新),单位为 元 / 1M Token(输入 / 输出分开计价,动态计费)。
当前可用模型(7 个)
| 模型 ID | 定位 | 输入 ¥/1M | 输出 ¥/1M |
|---|---|---|---|
gpt-6-astra | GPT-6 旗舰:复杂推理、编程、计算机操作、研究与文档创作 | ¥1.0 | ¥5.0 |
gpt-6-sol | 复杂编程与智能体工作流 | ¥0.2 | ¥1.0 |
gpt-6-luna | 高效模型,适合高强度批量任务 | ¥0.1 | ¥0.6 |
gpt-5.6-sol | 前沿 GPT-5.6:复杂专业工作、编程与智能体工作流 | ¥0.5 | ¥3.0 |
gpt-5.6-terra | 均衡型 GPT-5.6,适合日常工作 | ¥0.2 | ¥1.2 |
gpt-5.6-luna | 高性价比 GPT-5.6,快速高吞吐 | ¥0.1 | ¥0.6 |
codex-auto-review | 代码审查专用 | ¥0.15 | ¥0.6 |
怎么确认实时清单
价格与可用模型会随上游调整,以控制台「模型广场」为准:
bash
curl https://api.allenyeahger.xyz/v1/models \
-H "Authorization: Bearer sk-your-key"选型建议
| 场景 | 推荐 |
|---|---|
| 复杂推理 / 长文写作 / Agent 编排 | gpt-6-astra |
| 日常编码、智能体工作流 | gpt-6-sol 或 gpt-5.6-sol |
| 高吞吐批量任务、成本敏感 | gpt-6-luna / gpt-5.6-luna |
| 日常工作均衡款 | gpt-5.6-terra |
| 代码审查自动化 | codex-auto-review |
成本提示
长上下文请求会重复发送历史消息,输入 Token 成倍累积。批量任务优先用 *-luna 系列,单条成本可低至旗舰模型的 1/10。
状态观测(来自模型广场,2026-09-27)
| 模型 | 成功率 | 平均延迟 | 吞吐 |
|---|---|---|---|
gpt-6-astra | 61.90% | 59.56s | 54.3 t/s |
gpt-6-sol | 100.00% | 20.92s | 82.9 t/s |
⚠️
gpt-6-astra近 24 小时成功率偏低,重负载场景可临时改用gpt-6-sol。