最近在折腾大模型 API 的时候发现了 Peezy,一个聚合了多个主流模型的 AI 网关平台。它目前对部分模型提供免费调用额度,其中 DeepSeek V4 Flash 0731 每 5 小时可调用 500 次,对于个人开发者和小型项目来说相当实用。
下面把相关信息和使用流程整理出来,供有需要的朋友参考,如果觉得量不够,还可以继续尝试使用别人的公益站,点击这篇文章查看 免费大模型API公益站合集,赶紧蹬起来吧!
免费模型与额度
目前平台开放的免费模型主要包括:
| 模型 | 每 5 小时额度 |
|---|---|
| DeepSeek V4 Flash 0731 | 500 次 |
| MiniMax M3 | 200 次 |
| Poolside Laguna S 2.1 | 500 次 |
| MiMo V2.5 | 免费(额度以控制台显示为准) |
关于额度计算方式有一点值得说明:Peezy 采用的是 5 小时滚动窗口(Rolling Window),而非传统的每日零点重置。也就是说,系统会统计你过去 5 小时内的请求总数,超过窗口期后最早的一批请求自动释放。这种方式对不定时使用的开发者更加友好。
需要注意的是,官方标注的额度为估算值,实际可用次数会受到提示词长度、输出长度和是否调用工具等因素的影响。
接入步骤
访问 peezy.p0.system 进入注册页面,支持邮箱注册,也可以用 GitHub 等第三方账号授权登录。
登录后进入 Connect 页面,点击创建密钥。生成的 API Key 只会展示一次,建议及时复制到安全的地方保存。
Peezy 提供与 OpenAI 兼容的接口,已有的 OpenAI SDK 代码只需要调整两个参数即可:
Base URL:
https://api.p0.systems/api/agents/v1模型名称:如
deepseek-v4-flash-0731
以下是一个可直接运行的 Python 示例:
from openai import OpenAI client = OpenAI( api_key="你的_API_Key", base_url="https://api.p0.systems/api/agents/v1") response = client.chat.completions.create( model="deepseek-v4-flash-0731", messages=[ {"role": "user", "content": "用 Python 写一个二分查找函数"} ]) print(response.choices[0].message.content)
如果需要使用 Anthropic 格式的接口,对应的端点为
https://api.p0.systems/api/agents/v1/messages
我们尝试接入下 Claude Code,可以看到实际是可用的。
补充说明
除了通过 API 调用,Peezy 还提供了命令行工具和桌面客户端,内置了终端编码代理,支持 GLM 5.2、Kimi K2.7 Code、腾讯 HY3 等多个模型。如果你习惯在终端环境中工作,可以直接安装客户端体验。
免费额度无需绑定信用卡,注册即可使用。对于超出免费额度的场景,平台也提供了付费订阅方案,不过本文聚焦于免费部分,有需求的读者可以自行在官网了解详情。
总结
Peezy 目前的免费额度对于原型验证、学习测试和轻量级应用开发来说已经足够。尤其是 DeepSeek V4 Flash 0731 每 5 小时 500 次的调用量,在同类型平台中算是比较慷慨的。接入成本低、接口兼容性好,值得纳入开发者的工具备选清单。
评论 按时间正序