最近在折腾大模型 API 的时候发现了 Peezy,一个聚合了多个主流模型的 AI 网关平台。它目前对部分模型提供免费调用额度,其中 DeepSeek V4 Flash 0731 每 5 小时可调用 500 次,对于个人开发者和小型项目来说相当实用。

下面把相关信息和使用流程整理出来,供有需要的朋友参考,如果觉得量不够,还可以继续尝试使用别人的公益站,点击这篇文章查看 免费大模型API公益站合集,赶紧蹬起来吧!

免费模型与额度

目前平台开放的免费模型主要包括:

模型 每 5 小时额度
DeepSeek V4 Flash 0731 500 次
MiniMax M3 200 次
Poolside Laguna S 2.1 500 次
MiMo V2.5 免费(额度以控制台显示为准)
免费额度
免费额度

关于额度计算方式有一点值得说明:Peezy 采用的是 5 小时滚动窗口(Rolling Window),而非传统的每日零点重置。也就是说,系统会统计你过去 5 小时内的请求总数,超过窗口期后最早的一批请求自动释放。这种方式对不定时使用的开发者更加友好。

需要注意的是,官方标注的额度为估算值,实际可用次数会受到提示词长度、输出长度和是否调用工具等因素的影响。

接入步骤

访问 peezy.p0.system 进入注册页面,支持邮箱注册,也可以用 GitHub 等第三方账号授权登录。

登录后进入 Connect 页面,点击创建密钥。生成的 API Key 只会展示一次,建议及时复制到安全的地方保存。

创建密钥
创建密钥

Peezy 提供与 OpenAI 兼容的接口,已有的 OpenAI SDK 代码只需要调整两个参数即可:

  • Base URLhttps://api.p0.systems/api/agents/v1

  • 模型名称:如 deepseek-v4-flash-0731

以下是一个可直接运行的 Python 示例:

from openai import OpenAI
 
client = OpenAI(
api_key="你的_API_Key",
base_url="https://api.p0.systems/api/agents/v1"
)
 
response = client.chat.completions.create(
model="deepseek-v4-flash-0731",
messages=[
{"role": "user", "content": "用 Python 写一个二分查找函数"}
]
)
 
print(response.choices[0].message.content)

如果需要使用 Anthropic 格式的接口,对应的端点为

https://api.p0.systems/api/agents/v1/messages

我们尝试接入下 Claude Code,可以看到实际是可用的。

接入claude code
接入claude code

补充说明

除了通过 API 调用,Peezy 还提供了命令行工具和桌面客户端,内置了终端编码代理,支持 GLM 5.2、Kimi K2.7 Code、腾讯 HY3 等多个模型。如果你习惯在终端环境中工作,可以直接安装客户端体验。

免费额度无需绑定信用卡,注册即可使用。对于超出免费额度的场景,平台也提供了付费订阅方案,不过本文聚焦于免费部分,有需求的读者可以自行在官网了解详情。

总结

Peezy 目前的免费额度对于原型验证、学习测试和轻量级应用开发来说已经足够。尤其是 DeepSeek V4 Flash 0731 每 5 小时 500 次的调用量,在同类型平台中算是比较慷慨的。接入成本低、接口兼容性好,值得纳入开发者的工具备选清单。