> ## Documentation Index
> Fetch the complete documentation index at: https://docs.aioagi.tech/llms.txt
> Use this file to discover all available pages before exploring further.

# 模型（令牌）分组介绍

> 了解 AIOAGI 模型服务的 Token 组、适用场景、费率标签和选择建议。

AIOAGI 通过 Token 组管理 API Key 可访问的模型范围、服务线路和计费策略。你在控制台创建令牌时选择 Token 组，后续用这个 API Key 调用 OpenAI 兼容接口时，就会按该分组的模型权限和线路策略处理请求。

<Warning>
  Token 组名称、模型范围、费率标签、缓存策略和可用线路可能会调整。正式接入前，请在控制台 **令牌**、**模型列表** 或开发者指南中核对当前信息。
</Warning>

## Token 组有什么用

<CardGroup cols={2}>
  <Card title="控制模型范围" icon="brain">
    不同 Token 组支持的模型系列不同。先确认分组，再选择 `model` 参数。
  </Card>

  <Card title="匹配线路策略" icon="route">
    分组可能对应官方直连、官方优先、Azure 兜底、特价线路、第三方平台或自动路由。
  </Card>

  <Card title="管理成本" icon="coins">
    分组费率会影响实际消耗。低成本任务可以使用特价或速刷分组，生产任务应优先稳定分组。
  </Card>

  <Card title="隔离业务" icon="layer-group">
    为不同团队、应用或环境创建独立 API Key，便于统计、限额、审计和排障。
  </Card>
</CardGroup>

## 先看这几个标识

<CardGroup cols={3}>
  <Card title="🚀 高速或优质线路">
    `🚀` 通常表示该分组强调速度、稳定性、官方来源、模型覆盖或综合体验。
  </Card>

  <Card title="🤖 推荐分组">
    `【推荐】` 表示平台公开说明中推荐优先测试的分组，通常适合多数高频场景。
  </Card>

  <Card title="❗ 特价或逆向优先">
    `❗` 通常表示该分组更偏低价、速刷或逆向优先策略。建议用于测试、批处理或非关键任务。
  </Card>
</CardGroup>

<Note>
  “官方”“纯官”“官方优先”“Azure 兜底”“逆向优先”“第三方”等词来自分组公开说明。实际路由、模型版本和服务策略请以控制台展示和实测结果为准。
</Note>

## 费率标签怎么理解

分组说明中的 `0.15￥`、`0.3￥`、`0.6￥`、`2￥`、`5￥` 等数值是费率标签，用于帮助你比较不同 Token 组的成本级别。它不是单次请求固定价格。

实际扣费通常还会受到模型倍率、输入 Token、输出 Token、缓存命中、图像尺寸、视频时长、生成质量、并发策略和当前分组规则影响。

<Tip>
  生产接入前，请用目标 Token 组、目标模型和真实请求样例做小规模测试。最终余额消耗以控制台账单和当前分组策略为准。
</Tip>

## 推荐选择路径

<Steps>
  <Step title="先确定任务类型">
    判断当前任务是通用对话、编程、图像视频生成、开源模型调用、批量低价处理，还是企业生产接入。
  </Step>

  <Step title="再选择 Token 组">
    按模型范围、稳定性、速度和成本选择分组。关键业务优先选择稳定或官方来源更明确的分组。
  </Step>

  <Step title="创建独立 API Key">
    在控制台 **令牌** 页面创建 API Key。建议一个 API Key 只服务一个明确业务场景。
  </Step>

  <Step title="核对模型可用性">
    调用 `GET /models` 或查看控制台 **模型列表**，确认当前 API Key 可以访问目标模型 ID。
  </Step>
</Steps>

## 分组速览

下表整理常见 Token 组的公开说明。价格、费率、模型范围和支持策略仅作选型参考，请以控制台展示为准。

<Table>
  <thead>
    <tr>
      <th>Token 组</th>
      <th>公开说明</th>
      <th>适合场景</th>
      <th>使用建议</th>
    </tr>
  </thead>

  <tbody>
    <tr>
      <td><code>default</code></td>
      <td>🚀【默认分组】（全模型高稳定）</td>
      <td>新手接入、通用测试、稳定优先的生产调用。</td>
      <td>不确定怎么选时先用它。上线前仍需确认目标模型可用。</td>
    </tr>

    <tr>
      <td><code>auto</code></td>
      <td>自动分组</td>
      <td>快速试用、临时测试、不想手动选择分组的场景。</td>
      <td>实际线路可能随平台策略变化。关键业务建议改用固定分组。</td>
    </tr>

    <tr>
      <td><code>官方直连-Azure-Claude-Gemini</code></td>
      <td>🚀【推荐】(便宜好用+官方优先)：GPT-Claude-Gemini-Grok-0.6￥</td>
      <td>GPT、Claude、Gemini、Grok 的综合型调用。</td>
      <td>适合兼顾成本和稳定性的主力分组。不同模型请分别实测。</td>
    </tr>

    <tr>
      <td><code>高速特价-GPT-Claude-Gemini</code></td>
      <td>❗高速特价(逆向优先)：GPT-Claude-Gemini-Grok-0.5￥</td>
      <td>需要较快响应，同时希望控制成本的批量任务。</td>
      <td>逆向优先线路可能有波动。建议用于可重试任务。</td>
    </tr>

    <tr>
      <td><code>普速特价-GPT-Claude-Gemini</code></td>
      <td>❗普速特价(逆向优先)：GPT-Claude-Gemini-0.4￥</td>
      <td>低成本文本处理、离线任务、非关键自动化。</td>
      <td>更重视成本时使用。对延迟和稳定性敏感时准备备用分组。</td>
    </tr>

    <tr>
      <td><code>OpenAI-直连</code></td>
      <td>🚀OpenAI官方高速稳定(Az兜底)-Grok(官)-2.0￥</td>
      <td>OpenAI 与 Grok 相关的稳定调用。</td>
      <td>适合要求响应质量和可用性更稳定的 OpenAI 兼容接口业务。</td>
    </tr>

    <tr>
      <td><code>OpenAI-特价</code></td>
      <td>🚀OpenAI-特价高速(Az兜底)-Grok(官)-1.2￥</td>
      <td>OpenAI 与 Grok 相关的低成本高速调用。</td>
      <td>适合成本敏感任务。上线前确认关键模型和参数可用。</td>
    </tr>

    <tr>
      <td><code>OpenAI-正价纯官</code></td>
      <td>🚀OpenAI正价纯官(全模型高稳定)-5.0￥</td>
      <td>OpenAI 官方来源、全模型覆盖和高稳定性要求较高的业务。</td>
      <td>适合生产、关键工作流和长期稳定接入。</td>
    </tr>

    <tr>
      <td><code>OpenAI-特价纯官</code></td>
      <td>🚀OpenAI特价纯官(部分模型速刷)-4.0￥</td>
      <td>需要 OpenAI 官方来源，但能接受部分模型覆盖的任务。</td>
      <td>创建 API Key 后通过 `GET /models` 核对可用模型。</td>
    </tr>

    <tr>
      <td><code>Gemini-特价纯官</code></td>
      <td>🚀Gemini特价纯官(部分模型速刷)-1.8￥</td>
      <td>Gemini 系列模型的低成本官方来源调用。</td>
      <td>适合 Gemini 多模态、长上下文和跨语言任务。请按模型实测。</td>
    </tr>

    <tr>
      <td><code>Claude-直连</code></td>
      <td>🚀Claude正价纯官(全模型高稳定 Claude Code 官方畅享)-5￥</td>
      <td>Claude 全模型、Claude Code 和稳定优先的生产使用。</td>
      <td>适合对 Claude 服务来源、质量一致性和稳定性要求高的场景。</td>
    </tr>

    <tr>
      <td><code>Claude-特价</code></td>
      <td>🤖【推荐】Claude-满血版(Claude Code缓存0.1x)-2￥</td>
      <td>Claude Code、高频编程、代码问答和成本敏感的 Claude 调用。</td>
      <td>关注缓存命中策略。缓存、模型覆盖和可用性以控制台为准。</td>
    </tr>

    <tr>
      <td><code>Coding</code></td>
      <td>🤖【推荐】超强编程：Claude Code(缓存0.1x)-Codex(缓存0.1x)-Gemini-2￥</td>
      <td>IDE 编程助手、代码生成、代码审查和自动化开发任务。</td>
      <td>建议为编程工具单独创建 API Key，便于统计和限额。</td>
    </tr>

    <tr>
      <td><code>Codex速刷</code></td>
      <td>🚀低价Codex速刷：Codex(Plus号池-缓存0.1x)-Claude(Kiro三方-缓存0.1)-0.15￥</td>
      <td>低成本 Codex 批量任务、脚本生成、重复性代码处理。</td>
      <td>适合速刷和可回滚任务。关键代码仍建议保留测试和人工审查。</td>
    </tr>

    <tr>
      <td><code>Coding速刷</code></td>
      <td>🚀全网低价Coding模型速刷：Claude Code(aws官方采集版-缓存0.1x)-0.3￥</td>
      <td>低成本 Claude Code 速刷、非关键编程测试和临时代码任务。</td>
      <td>优先用于成本敏感场景。生产任务建议准备稳定分组作为备用。</td>
    </tr>

    <tr>
      <td><code>OpenSource</code></td>
      <td>😊开源低价超稳：Deepseek-Qwen-Kimi-GLM-MiniMax-0.6￥</td>
      <td>DeepSeek、Qwen、Kimi、GLM、MiniMax 等开源或国产模型任务。</td>
      <td>适合中文任务、企业内部助手、批量文本处理和高性价比调用。</td>
    </tr>

    <tr>
      <td><code>image\_video</code></td>
      <td>🚀【绘图/视频生成】支持Gemini、OpenAI、Midjourney系列绘图/视频生成模型包括：Banana、GPT Image、Midjourney、Sora、Veo等</td>
      <td>图像生成、视频生成、多媒体创作和视觉工作流。</td>
      <td>多媒体计费通常与模型、尺寸、时长和质量有关。请在控制台核对参数。</td>
    </tr>

    <tr>
      <td><code>（其他模型及价格定制请联系管理员）</code></td>
      <td>📞（模型及价格定制请联系管理员）</td>
      <td>企业定制模型、批量额度、专属分组和特殊线路需求。</td>
      <td>正式使用前确认模型清单、额度、价格、线路策略和支持边界。</td>
    </tr>
  </tbody>
</Table>

## 分组详细说明

以下按已公开费率标签从低到高排序。未标注统一费率的分组放在后面。分组名称、费率标签和模型范围可能变化，请以控制台当前展示为准。

<AccordionGroup>
  <Accordion title="Codex速刷（0.15￥）：低价 Codex 批处理分组" icon="rocket">
    `Codex速刷` 面向低价 Codex 速刷任务，公开说明包含 Codex Plus 号池、缓存 `0.1x`，以及 Claude Kiro 三方缓存能力，费率标签为 `0.15￥`。它适合批量改写、脚本生成、重复性代码处理和成本敏感的开发任务。该分组更强调低价和速度，关键代码生成建议保留测试、审查和可回滚流程。
  </Accordion>

  <Accordion title="Coding速刷（0.3￥）：低价 Claude Code 速刷分组" icon="code-branch">
    `Coding速刷` 面向低价 Coding 模型速刷，公开说明包含 Claude Code aws 官方采集版和缓存 `0.1x`，费率标签为 `0.3￥`。它适合非关键编程测试、临时代码任务、批量辅助修改和成本敏感的开发流程。由于它更强调速刷和低价，生产任务建议准备 `Coding`、`Claude-特价` 或 `Claude-直连` 作为备用。
  </Accordion>

  <Accordion title="普速特价-GPT-Claude-Gemini（0.4￥）：低成本通用分组" icon="gauge">
    `普速特价-GPT-Claude-Gemini` 公开说明为普速特价和逆向优先，费率标签为 `0.4￥`。它适合低成本调用、离线批处理、批量文本处理和可重试任务。该分组更重视成本，可能牺牲部分速度和稳定性。对结果质量敏感的任务建议加入人工抽检、自动重试或备用 Token 组。
  </Accordion>

  <Accordion title="高速特价-GPT-Claude-Gemini（0.5￥）：高速低价分组" icon="bolt">
    `高速特价-GPT-Claude-Gemini` 公开说明为高速特价和逆向优先，费率标签为 `0.5￥`。它适合对响应速度和成本敏感的测试、批处理和非关键业务。由于服务来源可能不是稳定优先策略，同一模型的可用性、质量一致性和参数兼容性可能与官方优先分组不同。建议为关键任务准备备用分组。
  </Accordion>

  <Accordion title="官方直连-Azure-Claude-Gemini（0.6￥）：官方优先综合分组" icon="route">
    `官方直连-Azure-Claude-Gemini` 面向 GPT、Claude、Gemini 和 Grok 等模型，公开说明强调便宜好用和官方优先，费率标签为 `0.6￥`。它适合需要多模型覆盖，同时希望兼顾稳定性和成本的业务。不同模型系列可能使用不同服务来源或兜底策略，请分别测试目标模型的可用性、延迟和参数兼容性。
  </Accordion>

  <Accordion title="OpenSource（0.6￥）：开源低价超稳分组" icon="box-open">
    `OpenSource` 面向 DeepSeek、Qwen、Kimi、GLM 和 MiniMax 等开源或国产模型，费率标签为 `0.6￥`。它适合中文任务、企业内部助手、知识库问答、批量文本处理和高性价比调用。不同模型来自不同服务来源，能力边界、上下文长度、响应速度和输出风格可能差异明显。请按目标模型单独测试。
  </Accordion>

  <Accordion title="OpenAI-特价（1.2￥）：OpenAI 低成本高速分组" icon="tags">
    `OpenAI-特价` 面向 OpenAI 和 Grok 相关的低成本高速调用，并包含 Azure 兜底说明，费率标签为 `1.2￥`。它适合需要控制成本，又希望保留较好响应速度的任务。由于分组策略不同，稳定性和模型覆盖可能不同于纯官或直连分组。上线前请确认关键模型、上下文长度和参数可用。
  </Accordion>

  <Accordion title="Gemini-特价纯官（1.8￥）：Gemini 官方低成本分组" icon="gem">
    `Gemini-特价纯官` 面向 Gemini 系列的官方特价调用，公开说明为部分模型速刷，费率标签为 `1.8￥`。它适合 Gemini 多模态、长上下文和跨语言任务的低成本接入。不同 Gemini 模型的上下文长度、参数支持、响应质量和多模态能力可能不同，请按目标模型实测。
  </Accordion>

  <Accordion title="OpenAI-直连（2.0￥）：OpenAI 高速稳定分组" icon="plug">
    `OpenAI-直连` 面向 OpenAI 官方高速稳定调用，并包含 Azure 兜底和 Grok 官方能力说明，费率标签为 `2.0￥`。它适合 OpenAI 兼容接口的生产业务。相比特价或逆向优先分组，它更适合要求模型版本、参数行为和输出质量更稳定的场景。实际模型范围、兜底策略和可用状态以控制台为准。
  </Accordion>

  <Accordion title="Claude-特价（2￥）：Claude Code 推荐分组" icon="code">
    `Claude-特价` 面向 Claude 满血版和 Claude Code 缓存优惠场景，费率标签为 `2￥`，并标注 Claude Code 缓存 `0.1x`。它适合高频编程、代码问答和成本敏感的 Claude 使用。与直连分组相比，它更强调性价比。稳定性、缓存策略和具体模型覆盖请以控制台与实测为准。
  </Accordion>

  <Accordion title="Coding（2￥）：综合编程推荐分组" icon="terminal">
    `Coding` 聚合 Claude Code、Codex 和 Gemini 等编程模型能力，费率标签为 `2￥`，并标注 Claude Code、Codex 缓存 `0.1x`。它适合 IDE 助手、代码生成、代码审查、脚本编写和自动化开发任务。建议为 Cursor、Windsurf、Claude Code、Codex 等工具分别创建独立 API Key，便于统计用量和限制额度。
  </Accordion>

  <Accordion title="OpenAI-特价纯官（4.0￥）：OpenAI 官方速刷分组" icon="badge-percent">
    `OpenAI-特价纯官` 强调 OpenAI 官方来源和部分模型速刷，费率标签为 `4.0￥`。它适合希望使用官方来源，同时愿意接受部分模型覆盖的任务。该分组的模型范围可能小于正价纯官分组。请在创建 API Key 后通过 `GET /models` 或控制台 **模型列表** 核对可用模型。
  </Accordion>

  <Accordion title="Claude-直连（5￥）：Claude 官方高稳定分组" icon="feather">
    `Claude-直连` 强调 Claude 正价纯官、全模型高稳定，并覆盖 Claude Code 官方畅享，费率标签为 `5￥`。它适合 Claude Code、长文本写作、复杂推理和生产级 Claude 调用。该分组更适合对稳定性、质量一致性和官方来源有要求的场景。
  </Accordion>

  <Accordion title="OpenAI-正价纯官（5.0￥）：OpenAI 官方高稳定分组" icon="shield-check">
    `OpenAI-正价纯官` 强调 OpenAI 官方、全模型和高稳定，费率标签为 `5.0￥`。它适合对服务来源、模型质量、版本一致性和长期稳定性要求高的业务。该分组通常成本更高，但更适合生产调用、关键工作流和长期稳定接入。价格费率、模型范围和支持策略请以控制台展示为准。
  </Accordion>

  <Accordion title="default（费率以控制台为准）：默认高稳定分组" icon="layer-group">
    `default` 是默认 Token 组，定位是全模型高稳定。它适合新手接入、通用测试和不想频繁切换分组的场景。该分组通常会优先覆盖更完整的模型范围，但实际服务来源仍可能按平台策略调整。上线前请确认目标模型在当前 API Key 下可用，并用真实请求样例做小规模验证。
  </Accordion>

  <Accordion title="auto（费率以实际路由为准）：自动分组" icon="shuffle">
    `auto` 会交由平台自动选择可用分组或线路。它适合快速试用、临时测试和不想手动选择分组的场景。由于服务来源可能随平台策略、可用容量和模型状态变化，稳定性、响应速度、输出质量和最终费用都可能出现波动。关键业务建议改用明确的固定 Token 组。
  </Accordion>

  <Accordion title="image_video（按模型和参数计费）：绘图和视频生成分组" icon="image">
    `image_video` 面向绘图和视频生成，覆盖 Gemini、OpenAI、Midjourney、Banana、GPT Image、Sora、Veo 等系列能力。图像和视频模型通常按模型、尺寸、时长、质量、生成次数和当前参数策略计费。它适合视觉创作、多媒体生成、设计工作流和视频内容生成。请在控制台确认具体模型 ID、接口入口、尺寸、时长和参数限制。
  </Accordion>

  <Accordion title="其他模型及价格定制（联系管理员确认）：定制分组" icon="handshake">
    `（其他模型及价格定制请联系管理员）` 面向企业定制、专属模型、批量额度、特殊线路和转售场景。定制分组的服务来源、稳定性、模型范围、价格费率和支持边界通常需要单独确认。请在正式使用前明确模型清单、额度、线路策略、账单口径和问题支持方式。
  </Accordion>
</AccordionGroup>

## 按场景选择

<AccordionGroup>
  <Accordion title="我只想快速开始" icon="rocket">
    优先选择 `default` 或 `auto`。`default` 更适合稳定测试，`auto` 更适合快速试用。创建 API Key 后，请在控制台确认可用模型列表。
  </Accordion>

  <Accordion title="我要做生产业务" icon="shield-check">
    优先考虑 `default`、`OpenAI-正价纯官`、`Claude-直连`、`OpenAI-直连` 或 `官方直连-Azure-Claude-Gemini`。上线前用真实请求做小流量验证，并准备备用分组。
  </Accordion>

  <Accordion title="我要控制成本" icon="gauge">
    可以测试 `普速特价-GPT-Claude-Gemini`、`高速特价-GPT-Claude-Gemini`、`OpenAI-特价`、`Codex速刷`、`Coding速刷` 或 `OpenSource`。这类分组更适合批处理、非关键任务和可重试任务。
  </Accordion>

  <Accordion title="我要接入 Claude Code 或 Codex" icon="code">
    优先看 `Coding`、`Claude-特价`、`Codex速刷` 和 `Coding速刷`。如果你更重视 Claude 官方稳定性，可以选择 `Claude-直连`。建议为每个编程工具创建独立 API Key。
  </Accordion>

  <Accordion title="我要用开源或国产模型" icon="box-open">
    选择 `OpenSource`。它覆盖 DeepSeek、Qwen、Kimi、GLM、MiniMax 等模型系列，适合中文问答、知识库、批量文本处理和成本敏感型业务。
  </Accordion>

  <Accordion title="我要生成图片或视频" icon="image">
    选择 `image_video`。它面向 Banana、GPT Image、Midjourney、Sora、Veo 等图像和视频模型。请在控制台确认具体模型 ID、接口入口、尺寸、时长、质量参数和计费规则。
  </Accordion>

  <Accordion title="我要企业定制" icon="handshake">
    如果你需要专属模型、固定额度、专用线路、批量开通或特殊价格，请联系管理员确认定制 Token 组。不要在公开文档或客户端代码中暴露真实 API Key。
  </Accordion>
</AccordionGroup>

## 常见排查

* 如果模型不可用，请先确认 API Key 所属 Token 组是否支持该模型。
* 如果返回 `401`，请检查 API Key 是否复制完整，且令牌没有过期。
* 如果返回额度不足，请检查账户余额、令牌额度上限和 Token 组配额。
* 如果响应速度不符合预期，请在控制台确认当前分组线路，并考虑切换稳定或高速分组。
* 如果扣费不符合预期，请核对模型倍率、缓存命中、输入输出 Token 和多媒体生成参数。

<Tip>
  如果你不确定该选择哪个 Token 组，或遇到模型不可用、稳定性、质量、计费等问题，可以联系平台管理员咨询。联系前建议准备 API Key 所属分组、模型 ID、请求时间、错误码和简要问题描述。
</Tip>

## 联系管理员

<CardGroup cols={2}>
  <Card title="QQ 技术支持群" icon="comments">
    当前公开 QQ 群号为 `9499698745`。你可以进群咨询 Token 组选择、模型可用性、稳定性和计费问题。
  </Card>

  <Card title="微信咨询" icon="message">
    当前公开微信咨询号为 `AIOAGI`。你可以添加微信联系平台管理员，咨询分组定制、企业接入和模型服务问题。
  </Card>
</CardGroup>

<Note>
  QQ 群、微信号和支持政策可能调整。添加前请以官网首页、控制台或 [服务状态与支持](/service-status) 展示的最新联系方式为准。
</Note>

<CardGroup cols={2}>
  <Card title="查看 API Key 全流程" icon="key" href="/api-key-guide">
    按步骤完成注册、充值、创建令牌和应用配置。
  </Card>

  <Card title="查看计费与充值" icon="coins" href="/pricing">
    了解分组费率、模型倍率和成本控制建议。
  </Card>
</CardGroup>
