找回密码
 立即注册
搜索
热搜: 活动 交友 discuz
查看: 71|回复: 0

[福利/分享] 国产大模型 API 3 折起接入: DeepSeek / Kimi K3 / GLM 5.3 等,已上线

[复制链接]

928

主题

0

回帖

3050

积分

直接发帖组

积分
3050
发表于 2026-9-4 07:11:31 | 显示全部楼层 |阅读模式
各位 大家好,

为了方便开发者一次性低门槛接入国内各家最新的大模型,我们在 Koze AI 上线了国产模型聚合服务,全线兼容 OpenAI / Responses 接口规范。

核心通道与分组设计
针对不同业务场景的稳定性和延迟诉求,我们将国产模型划分为两个核心调用池:

z-china (高性价比通道):倍率极低(约官方价格 3 折左右水平),适合离线批处理、日常测试、高并发低敏感业务。

zp-china (高性能低延迟通道):专为线上生产业务与实时交互 Agent 准备,保障并发带宽与首字响应速度( TTFT ),支持高可用负载均衡。

当前重点支持模型
DeepSeek 系列:提供 deepseek-v4-flash (输入 $0.0825/M 起)与 deepseek-v4-pro (输入 $0.2475/M 起),支持峰谷定价策略与 Prompt Cache 计费减免。

智谱 GLM 系列:全面同步最新 glm-5.3 、glm-5.3-flash (低至 $0.044/M 输入)以及 5.1/5.2 等历史稳定版本。

Moonshot Kimi 系列:已上线最新的 kimi-k3 旗舰模型,同时提供面向开发场景的 kimi-k2.7-code 与高性价比的 kimi-k2.5 。

其他主流阵营:通义千问 qwen3.8-max / qwen3.7-plus 、MiniMax MiniMax-M3 / M2.7 以及字节 doubao-seed-2-1-pro 均已同批次就绪。

接入与技术特点
标准 OpenAI 协议:修改 baseURL 与 apiKey 即可无缝切换,无需更改应用层逻辑。

原生 Prompt Cache 支持:深度适配模型缓存机制,命中文档或长 Prompt 读取成本大幅下降(最低仅需 $0.0033/M )。

透明计费与监控:控制台提供实时状态监控、按 Token 消耗明细与延迟追踪。

体验与控制台: https://www.kozeai.com

欢迎各位开发者接入测试,若对模型延迟、并发配额或上下文窗口有任何反馈,可以直接在帖子里交流。
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|中转API超市

GMT+8, 2026-9-19 06:04 , Processed in 0.026878 second(s), 22 queries .

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表