[推广] [福利/分享] 国产大模型 API 3 折起接入: DeepSeek / Kimi K3 / GLM 5.3 等,已上线 z-china 与 zp-china 高性能通道(加入 DC 领取测试额度,每日稳定跑量 60W)

各位 V 友大家好,

为了方便开发者一次性低门槛接入国内各家最新的大模型,我们在 Koze AI 上线了国产模型聚合服务,全线兼容 OpenAI / Responses 接口规范。

  1. 核心通道与分组设计 针对不同业务场景的稳定性和延迟诉求,我们将国产模型划分为两个核心调用池:

z-china (高性价比通道):倍率极低(约官方价格 3 折左右水平),适合离线批处理、日常测试、高并发低敏感业务。

zp-china (高性能低延迟通道):专为线上生产业务与实时交互 Agent 准备,保障并发带宽与首字响应速度( TTFT ),支持高可用负载均衡。

  1. 当前重点支持模型 DeepSeek 系列:提供 deepseek-v4-flash (输入 $0.0825/M 起)与 deepseek-v4-pro (输入 $0.2475/M 起),支持峰谷定价策略与 Prompt Cache 计费减免。

智谱 GLM 系列:全面同步最新 glm-5.3 、glm-5.3-flash (低至 $0.044/M 输入)以及 5.1/5.2 等历史稳定版本。

Moonshot Kimi 系列:已上线最新的 kimi-k3 旗舰模型,同时提供面向开发场景的 kimi-k2.7-code 与高性价比的 kimi-k2.5 。

其他主流阵营:通义千问 qwen3.8-max / qwen3.7-plus 、MiniMax MiniMax-M3 / M2.7 以及字节 doubao-seed-2-1-pro 均已同批次就绪。

  1. 接入与技术特点 标准 OpenAI 协议:修改 baseURL 与 apiKey 即可无缝切换,无需更改应用层逻辑。

原生 Prompt Cache 支持:深度适配模型缓存机制,命中文档或长 Prompt 读取成本大幅下降(最低仅需 $0.0033/M )。

透明计费与监控:控制台提供实时状态监控、按 Token 消耗明细与延迟追踪。

体验与控制台: https://www.kozeai.com/zh-CN/models 加入 DC 免费领取测试额度: https://discord.gg/JuXfCcTHjk

欢迎各位开发者接入测试,若对模型延迟、并发配额或上下文窗口有任何反馈,可以直接在帖子里交流。

添加评论
点赞收藏
点踩分享查看原文
评论
?
参与讨论