Skip to content

模型、分组、限速详情

合理使用与速率限制

为保证平台运行正常、用户合理使用,普通用户密钥禁止二次转发、多人共享、高并发应用,且不支持申请提升限额,如有相关需求请购买高级用户(按量计费,限额提升)。我们有权利停止严重滥用者的密钥,无论其是普通用户或高级用户。

如需购买和续费密钥,可以优先考虑前往售后群下单并自助续费。优惠渠道比淘宝便宜!

☀️ 普通用户(计时卡)

您可以前往官网模型列表,在筛选器中选择 普通用户 分组,查看普通用户可使用的全部模型。

速率限制

  • 每分钟: 8 次成功请求,最多重试尝试 32 次(即最多 40 次共计上游请求)。
  • 每天: 500 次成功请求,最多重试尝试 2000 次(即最多 2500 次共计上游请求)。

注意:激活码请前往大模型 Hub 官网激活/续费使用,不要混淆玄喵酒馆与大模型 Hub!

💎 高级用户(按量卡)

可前往官网模型列表查看模型按量计费价格,单位为玄喵币。

如您不确定自己是否需要高级用户权益,可以继续购买续费普通用户密钥,同时购买一个小额度高级用户尝尝鲜,试试强大的高级模型!

高级用户密钥按量计费,永不过期,用完额度为止,可以自助查询使用情况。

高级用户专享优势

  1. 使用高成本专属模型。
  2. 最高的速率限制,并发无压力!
  3. 热门模型更快、更稳定。
  • OpenAI GPT/o 部分模型
  • Anthropic Claude Sonnet 系列模型
  • Anthropic Claude Haiku 系列模型
  • Anthropic Claude Opus 系列模型
  • Google Gemini 3/3.1 Pro
  • Google Gemini 2.5 Flash Image (Nano Banana) 图片生成模型
  • Google Gemini 3.1 Flash Image (Nano Banana 2) 图片生成模型
  • Google Gemini 3 Pro Image (Nano Banana Pro) 图片生成模型
  • Google Imagen 3/4/4 Fast/4 Ultra 图片生成模型
  • Google Veo 2/3/4 系列和 Gemini Omni Flash 视频生成模型

推荐您前往官网模型列表,在筛选器中选择 高级用户 分组,查看高级用户可使用的全部模型。

一些模型并非永久提供。如果模型稳定性较差,则会被下架,请选择其他模型。在官网模型列表页面查看当前可用的所有模型!

🧩 谷歌 Gemini DeepThink 模型详解
  • -deepthink 后缀模型为深入研究模型,对标 Gemini Ultra DeepThink,采用多智能体架构,适合需要高准确率的场景,但响应速度较慢且价格较高。
🧩 谷歌 Nano Banana 及其他多模态生成模型详解
  • Gemini Image 即 Nano Banana 系列无后缀模型为原生 Gemini 格式,必须严格遵守 Google API 的 Nano Banana 调用方式,例如传递思考签名等,遇到 400 就是参数错误。

  • -ext 模型为官方渠道,在服务端进行了兼容处理,会把图片转换为 Markdown 格式嵌入到对话中,且无需自行处理思考签名。支持图片/文本混合生成。

  • -gwp 和 -ge 也提供一些 Gemini 多模态模型。它们使用 Gemini 自主决策生成的图片比例,需要使用自然语言指定。

  • -re 提供许多 Google 多模态模型,这些模型只能生成多模态内容(图像/视频),不支持文本生成,即使是 Nano Banana 系列模型。详情见下表。

-re 模型参数指定方式

所有参数优先级:请求体参数 > 提示词关键词 > 默认值

图片生成

参数

参数可选值默认值
比例landscape, portrait, square, four-three, three-fourlandscape
分辨率2k, 4k(imagen 不支持)无放大

方式一:Gemini 参数

json
{
  "model": "gemini-3-pro-image-re",
  "generationConfig": {
    "imageConfig": {
      "aspectRatio": "16:9",
      "imageSize": "2K"
    }
  }
}

aspectRatio 支持:1:1 / 16:9 / 9:16 / 4:3 / 3:4 / 正方形 / 横版 / 竖版 / 四比三 / 三比四

imageSize 支持:2K / 2k / 4K / 4k / 1K

方式二:OpenAI 参数

json
{
  "model": "gemini-3-pro-image-re",
  "size": "1024x1792",
  "quality": "high"
}

size 宽高比值自动映射到最近比例,quality 映射:high/hd/ultra → 4k,medium → 2k

方式三:提示词自然语言

json
{
  "model": "gemini-3-pro-image-re",
  "messages": [{"role": "user", "content": "画一张竖版4K猫咪图"}]
}

比例关键词:正方形/方形/1:1 → square,竖版/竖屏/竖图/纵向/portrait → portrait,横版/横屏/横图/横向/landscape → landscape 分辨率关键词:4K/超高清 → 4k,2K/高清 → 2k 这些关键词会在生成前从提示词中移除

视频生成

根据图片数量自动路由到合适变体:

模型0图片1图片2图片3+图片
veo-3.1-fast-reT2VI2VI2VR2V
veo-3.1-reT2VI2VI2V
veo-3.1-lite-reT2VI2V插值R2V
gemini-omni-flash-reT2VI2VI2VR2V

Omni Flash 额外支持时长参数(4s/6s/8s/10s),默认 4s。

参数

参数可选值默认值适用模型
比例landscape, portraitlandscape全部
时长4s, 6s, 8s, 10s4sOmni Flash

方式一:Gemini 参数

json
{
  "model": "gemini-omni-flash-re",
  "generationConfig": {
    "imageConfig": {
      "aspectRatio": "16:9"
    },
    "duration": "10s"
  }
}

方式二:OpenAI 参数

json
{
  "model": "gemini-omni-flash-re",
  "duration": "6s"
}

比例通过 size 字段传递(同图片模型)

方式三:提示词自然语言

json
{
  "model": "veo-3.1-fast-re",
  "messages": [{"role": "user", "content": "竖版猫叫"}]
}

比例关键词同图片模型。Omni Flash 额外支持时长关键词:4秒/四秒/4s → 4s,6秒/六秒/6s → 6s 等 这些关键词会在生成前从提示词中移除

图片数量校验

视频模型严格校验图片数量,超出模型允许范围返回 400。

速率限制

  • 每分钟: 200 次成功请求,最多重试尝试 1800 次(即最多 2000 次共计上游请求)。
  • 每天: 100000 次成功请求,最多重试尝试 900000 次(即最多 1000000 次共计上游请求)。

组合购买说明

重要提示:若同时购买多个用户权限,会分发多个独立的密钥!需要在前端软件中新增多一个供应商,方便切换调用。