分享
•
GLM-5.3-Flash与Qwen3.8免费编码模型接入
Z.ai 于 8 月底开源 GLM-5.3-Flash,320B 参数、1M 上下文,性能接近 Claude Opus 4.8,推理成本约为前代十分之一;同期 Qwen3.8 系列在编码与长程任务上具备竞争力。两者提供 OpenAI 兼容接口,可在 Cursor、Claude Code 等工具中直接使用。文中列举 Empero、AIHubMix、Cline 内置通道、TokenRouter、TokenHarbor 等免费或限时端点,提供配额、使用方法及注意事项,建议配置 fallback 链并根据任务选择 GLM 或 Qwen 模型,兼顾稳定性与成本。