DeepSeek·GLM·Qwen·Kimi·Llama Fully Integrated, Enterprise-Grade AI Compute Platform
101+ models pre-integrated, core models listed below, continuously updated
| Model | Parameters | Context Length | Precision | Input Price (Ref.) | Output Price (Ref.) | Status |
|---|---|---|---|---|---|---|
| GPT-4.1 mini OpenAI | — | 1M | — | ¥2.80 /百万Token | ¥11.20 /百万Token | Online |
| GPT-4.1 HOT | — | 1M | — | ¥14.00 /百万Token | ¥56.00 /百万Token | Online |
| o3 Reasoning | — | 200K | — | ¥14.00 /百万Token | ¥56.00 /百万Token | Online |
| Claude Sonnet 4.5 Anthropic | — | 200K | — | ¥21.00 /百万Token | ¥105.00 /百万Token | Online |
| Claude Haiku 3.5 Anthropic | — | 200K | — | ¥5.60 /百万Token | ¥28.00 /百万Token | Online |
| Gemini 2.5 Pro Google | — | 1M | — | ¥8.75 /百万Token | ¥70.00 /百万Token | Online |
| Gemini 2.5 Flash Google | — | 1M | — | ¥1.05 /百万Token | ¥4.20 /百万Token | Online |
| DeepSeek-V4 Pro Latest | 685B MoE | 128K | BF16 | ¥12.00 /百万Token | ¥24.00 /百万Token | Online |
| DeepSeek-V4 Flash Latest | 685B MoE | 128K | BF16 | ¥1.00 /百万Token | ¥2.00 /百万Token | Online |
| DeepSeek-R1 Reasoning | 685B MoE | 128K | BF16 | ¥2.00 /百万Token | ¥5.00 /百万Token | Online |
| GLM-5 智谱 | 200B+ | 128K | BF16 | ¥1.00 /百万Token | ¥6.00 /百万Token | Online |
| GLM-5V-Turbo 多模态 | 130B+ | 128K | BF16 | ¥1.50 /百万Token | ¥3.00 /百万Token | Online |
| Qwen3.7 Max Latest | 397B MoE | 128K | BF16 | ¥2.00 /百万Token | ¥6.00 /百万Token | Online |
| Qwen3.6 Flash Fast | 235B MoE | 128K | BF16 | ¥0.30 /百万Token | ¥0.60 /百万Token | Online |
| Qwen3-Coder-Next Code | 235B MoE | 128K | BF16 | ¥1.50 /百万Token | ¥3.50 /百万Token | Online |
| Kimi-K2.5 Latest | 1T MoE | 256K | BF16 | ¥2.50 /百万Token | ¥5.00 /百万Token | Online |
| Kimi-K2 Thinking Reasoning | 1T MoE | 256K | BF16 | ¥3.00 /百万Token | ¥6.00 /百万Token | Online |
| MiniMax-M2.5 Latest | 456B MoE | 1M | BF16 | ¥2.00 /百万Token | ¥4.00 /百万Token | Online |
| MiniMax-M2.5 Highspeed Fast | 456B MoE | 1M | BF16 | ¥1.00 /百万Token | ¥2.00 /百万Token | Online |
| Doubao Seed 2.0 Pro 豆包 | — | 128K | BF16 | ¥1.50 /百万Token | ¥3.00 /百万Token | Online |
| Doubao Seed 2.0 Code Preview Code | — | 128K | BF16 | ¥1.00 /百万Token | ¥2.00 /百万Token | Online |
| Llama-4 Meta | 400B MoE | 1M | BF16 | ¥2.50 /百万Token | ¥5.00 /百万Token | Online |
| Yi-Lightning 零一万物 | — | 64K | BF16 | ¥0.50 /百万Token | ¥1.50 /百万Token | Online |
| Step-2 阶跃星辰 | — | 128K | BF16 | ¥1.50 /百万Token | ¥3.20 /百万Token | Online |
| Hy3 Preview 混元 | — | 128K | BF16 | ¥1.00 /百万Token | ¥2.00 /百万Token | Online |
| BAAI/bge-m3 Embedding | 568M | 8K | FP16 | ¥0.02 /百万Token | — | Online |
Explore KHB AI infrastructure deployment solutions across industries, the developer way
Dedicated Reserved Compute · Model Precision Guaranteed · Cost Controllable · Enterprise SLA
Unified Management · Intelligent Routing · Rate Limiting · Full-Chain Observability
Intelligence-driven security, full-chain protection from data to application
Whether you have compute or need compute, KHB provides matching partnership solutions
Four-layer architecture, data flows left to right, layer-by-layer collaboration, building an enterprise AI infrastructure closed loop
Four services orbit the core, from underlying compute to upper gateway, full-chain coverage of enterprise AI infrastructure needs
Numbers don't lie, every metric is proof of strength
Whether you're exploring AI for the first time or seeking compute and model service upgrades, KHB provides professional solutions