模型目录
模型与官方牌价
共 9 款目录项。价格为模型厂商公开的按量牌价,单位人民币 / 百万 tokens;实际 Novro 结算价以管理员模型路由配置为准。
官方价格核验日期:2026-08-05。厂商可能随时调整价格,结算前请复核卡片中的官方来源。
DeepSeek · deepseek-v4-flash · 2026-07-31 发布
V4 的高吞吐版本,面向在线服务与批量任务,同时支持 Responses API 和 Anthropic API。
官方输入价
¥1/ 百万 tokens
官方输出价
¥2/ 百万 tokens
缓存命中
¥0.02
上下文
1M
最大输出
384K
输入类型
Moonshot Kimi · kimi-k3 · 2026-07-16 发布
面向长程 Coding 与端到端知识工作的旗舰模型,原生视觉理解并支持可调推理强度。
官方输入价
¥20/ 百万 tokens
官方输出价
¥100/ 百万 tokens
缓存命中
¥2
上下文
1M
最大输出
官方未单列
输入类型
智谱 GLM · glm-5.2 · 2026-06-16 发布
面向长任务的旗舰基座模型,强调项目级工程上下文、长程 Coding 与稳定工具调用。
官方输入价
¥8/ 百万 tokens
官方输出价
¥28/ 百万 tokens
缓存命中
¥2
上下文
1M
最大输出
128K
输入类型
Moonshot Kimi · kimi-k2.7-code · 2026-06-12 发布
为代码场景优化的 Coding 模型,强化长上下文指令遵循、编程成功率与多模态输入。
官方输入价
¥6.5/ 百万 tokens
官方输出价
¥27/ 百万 tokens
缓存命中
¥1.3
上下文
256K
最大输出
官方未单列
输入类型
DeepSeek · deepseek-v4-pro · 2026-04-24 发布
V4 的高性能版本,面向复杂推理、数学、代码与科研分析,支持思考和非思考模式。
官方输入价
¥3/ 百万 tokens
官方输出价
¥6/ 百万 tokens
缓存命中
¥0.025
上下文
1M
最大输出
384K
输入类型
Moonshot Kimi · kimi-k2.6 · 2026-04-20 发布
通用多模态模型,支持思考与非思考模式,覆盖对话、代码和 Agent 任务。
官方输入价
¥6.5/ 百万 tokens
官方输出价
¥27/ 百万 tokens
缓存命中
¥1.1
上下文
256K
最大输出
官方未单列
输入类型
智谱 GLM · glm-5.1 · 2026-04-07 发布
面向 Agentic Coding、复杂指令与长文档生产的旗舰模型,支持长程规划和工程级交付。
官方输入价
¥6 起/ 百万 tokens
官方输出价
¥24 起/ 百万 tokens
缓存命中
¥1.3
上下文
200K
最大输出
128K
输入类型
输入长度 0-32K:缓存 ¥1.3 / 输入 ¥6 / 输出 ¥24
输入长度 32K+:缓存 ¥2 / 输入 ¥8 / 输出 ¥28
智谱 GLM · glm-5.2-sale
Novro 预留的优惠路由别名,不是智谱公开价目中的独立官方模型,实际映射与售价待上线后公布。
智谱 GLM · glm-5.2-fast
Novro 预留的高速路由别名,不是智谱公开价目中的独立官方模型,速度指标与售价待上线验证。