Beranda Layanan Arsitektur Keuntungan Skenario Tentang Kembali ke situs utama Pusat Anggota
Klaster GPU Online
Model Siap
Ketersediaan API 99.99%

200+ Model, Komputasi Masif, Satu API untuk Semua

DeepSeek·GLM·Qwen·Kimi·Llama Terintegrasi Penuh, Platform AI Compute Tingkat Enterprise

Daftar Model

Semua Model Tersedia Sekilas

101+ model terintegrasi, model inti tercantum di bawah, terus diperbarui

Model Parameter Panjang Konteks Presisi Harga Input (Ref.) Harga Output (Ref.) Status
GPT-4.1 mini OpenAI1M¥2.80 /百万Token¥11.20 /百万TokenOnline
GPT-4.1 Populer1M¥14.00 /百万Token¥56.00 /百万TokenOnline
o3 Reasoning200K¥14.00 /百万Token¥56.00 /百万TokenOnline
Claude Sonnet 4.5 Anthropic200K¥21.00 /百万Token¥105.00 /百万TokenOnline
Claude Haiku 3.5 Anthropic200K¥5.60 /百万Token¥28.00 /百万TokenOnline
Gemini 2.5 Pro Google1M¥8.75 /百万Token¥70.00 /百万TokenOnline
Gemini 2.5 Flash Google1M¥1.05 /百万Token¥4.20 /百万TokenOnline
DeepSeek-V4 Pro Terbaru685B MoE128KBF16¥12.00 /百万Token¥24.00 /百万TokenOnline
DeepSeek-V4 Flash Terbaru685B MoE128KBF16¥1.00 /百万Token¥2.00 /百万TokenOnline
DeepSeek-R1 Reasoning685B MoE128KBF16¥2.00 /百万Token¥5.00 /百万TokenOnline
GLM-5 智谱200B+128KBF16¥1.00 /百万Token¥6.00 /百万TokenOnline
GLM-5V-Turbo 多模态130B+128KBF16¥1.50 /百万Token¥3.00 /百万TokenOnline
Qwen3.7 Max Terbaru397B MoE128KBF16¥2.00 /百万Token¥6.00 /百万TokenOnline
Qwen3.6 Flash Cepat235B MoE128KBF16¥0.30 /百万Token¥0.60 /百万TokenOnline
Qwen3-Coder-Next Kode235B MoE128KBF16¥1.50 /百万Token¥3.50 /百万TokenOnline
Kimi-K2.5 Terbaru1T MoE256KBF16¥2.50 /百万Token¥5.00 /百万TokenOnline
Kimi-K2 Thinking Reasoning1T MoE256KBF16¥3.00 /百万Token¥6.00 /百万TokenOnline
MiniMax-M2.5 Terbaru456B MoE1MBF16¥2.00 /百万Token¥4.00 /百万TokenOnline
MiniMax-M2.5 Highspeed Cepat456B MoE1MBF16¥1.00 /百万Token¥2.00 /百万TokenOnline
Doubao Seed 2.0 Pro 豆包128KBF16¥1.50 /百万Token¥3.00 /百万TokenOnline
Doubao Seed 2.0 Code Preview Kode128KBF16¥1.00 /百万Token¥2.00 /百万TokenOnline
Llama-4 Meta400B MoE1MBF16¥2.50 /百万Token¥5.00 /百万TokenOnline
Yi-Lightning 零一万物64KBF16¥0.50 /百万Token¥1.50 /百万TokenOnline
Step-2 阶跃星辰128KBF16¥1.50 /百万Token¥3.20 /百万TokenOnline
Hy3 Preview 混元128KBF16¥1.00 /百万Token¥2.00 /百万TokenOnline
BAAI/bge-m3 Embedding568M8KFP16¥0.02 /百万TokenOnline
Kasus Penggunaan

Satu Perintah, Deploy AI Anda

Jelajahi solusi infrastruktur AI KHB lintas industri, cara developer

enterprise-ai.sh
$ khb deploy --scenario=enterprise --model=DeepSeek-V3.2
算力资源分配完成
模型加载完成 DeepSeek-V3.2
API网关配置完成
企业AI平台已就绪
ENDPOINT: https://api.khb.com/v1/enterprise
STATUS: RUNNING
compute-center.sh
$ khb deploy --scenario=compute --chip=ascend,nvidia
异构算力统一纳管启动
NVIDIA A100 × 128 已接入
昇腾910B × 64 已接入
弹性调度引擎就绪
UTILIZATION: 94.7%
finance.sh
$ khb deploy --scenario=finance --security=private
Deployment Privat环境初始化
数据隔离策略已启用
全链路加密传输已开启
Log Audit系统就绪
COMPLIANCE: PASSED
manufacturing.sh
$ khb deploy --scenario=manufacturing --instance=reserved
预留实例资源锁定
工业AI模型部署完成
7×24 SLA保障已启用
质检模型推理延迟 <50ms
UPTIME: 99.99%
Instance Khusus

Kunci Komputasi, Amankan Bisnis Kritis

Komputasi Khusus · Presisi Model Dijamin · Biaya Terkendali · SLA Enterprise

DeepSeek-V3.2
deepseek-ai/DeepSeek-V3.2
Harga ¥594,000/组/月
Harga Satuan Efektif ¥2.20/M tokens
TPM 1,250万
TTFT 1,600ms
TPS 45
Konteks 1M
Cocok untuk penalaran kompleks tingkat enterprise dan analisis keputusan, pembuatan kode dan bantuan pengembangan perangkat lunak, pemanggilan alat agent
GLM-5
zai-org/GLM-5
Harga ¥594,000/组/月
Harga Satuan Efektif ¥2.75/M tokens
TPM 1,000万
TTFT 1,500ms
TPS 30
Konteks 1M
Cocok untuk pengembangan agent tingkat enterprise, perencanaan tugas kompleks dan eksekusi multi-langkah, otomatisasi rekayasa perangkat lunak
Kimi-K2.5
moonshotai/Kimi-K2.5
Harga ¥594,000/组/月
Harga Satuan Efektif ¥6.88/M tokens
TPM 400万
TTFT 1,500ms
TPS 30
Konteks 256K
Cocok untuk pengembangan agent multimodal tingkat enterprise, pemahaman dan analisis konten visual, otomatisasi tugas kompleks
MiniMax-M2.5
MiniMaxAI/MiniMax-M2.5
Harga ¥297,000/组/月
Harga Satuan Efektif ¥2.75/M tokens
TPM 500万
TTFT 500ms
TPS 30
Konteks 1M
Cocok untuk analisis dokumen panjang dan basis pengetahuan tingkat enterprise, layanan pelanggan cerdas dan pembuatan konten, otomatisasi proses bisnis
* Harga satuan efektif berdasarkan TPM, dihitung dengan 30 hari/bulan dan utilisasi keseluruhan 50%. Data performa berdasarkan parameter inferensi tipikal: 24K token input, 1K token output, cache hit rate 80%. (Diperbarui 20 Mei 2026)
AI Gateway

Gateway Layanan LLM Privat

Manajemen Terpadu · Routing Cerdas · Rate Limiting · Observabilitas Full-Chain

01 Akses Multi-Model Terpadu
Akses terpadu dan pemanggilan terstandarisasi model vendor berbeda, mendukung antarmuka kompatibel OpenAI, menghilangkan manajemen titik, mudah mengelola ekosistem multi-vendor
02 Routing Cerdas & Load Balancing
Routing dinamis cerdas menggabungkan karakteristik lalu lintas dan layanan LLM, load balancing, failover fallback, memastikan stabilitas layanan dan SLA bisnis
03 Tata Kelola Fine-Grained & Rate Limiting
Konfigurasi izin model, manajemen lalu lintas dan kuota berdasarkan pengguna, API Key, proyek, dimensi organisasi, isolasi multi-tenant, mencapai tata kelola pemanggilan model fine-grained
04 Akuntansi Biaya Akurat
Transparansi biaya full-chain melalui pengguna konsumen, API Key, proyek, organisasi, model dan komputasi, mencapai akuntansi biaya akurat dan kontrol anggaran
05 Observabilitas Model Full-Chain
Observabilitas multi-dimensi volume pemanggilan model, performa dan metrik lainnya, mendukung tata kelola model presisi, manajemen siklus hidup dan penyesuaian strategi routing, mendukung A/B testing dan canary release
06 Keamanan Data Enterprise
Filter risiko privasi desensitisasi dua arah real-time, intersepsi konten sensitif terkait dan log audit, memastikan setiap transaksi bisnis LLM patuh dan dapat dilacak
Keamanan & Kepatuhan

Sistem Pertahanan Mendalam End-to-End

Keamanan berbasis kecerdasan, perlindungan full-chain dari data ke aplikasi

🔐
Enkripsi End-to-End
Transmisi terenkripsi TLS full-chain, enkripsi penyimpanan data, sistem manajemen kunci, memastikan keamanan absolut data saat transit dan saat diam
🛡️
Desensitisasi Dua Arah
Filter desensitisasi dua arah input/output real-time, mengidentifikasi dan menutupi informasi sensitif secara otomatis, mencegah kebocoran data privasi
📋
Log Audit
Audit operasional full-chain, setiap panggilan API dapat dilacak dan diaudit, memenuhi persyaratan kepatuhan di keuangan, kesehatan dan industri lainnya
🏢
Isolasi Multi-Tenant
Isolasi data ketat antar tenant, kontrol izin fine-grained, mendukung kontrol akses multi-dimensi berdasarkan organisasi, proyek dan pengguna
🔒
Deployment Privat
Data tidak pernah meninggalkan domain, semua inferensi selesai dalam intranet enterprise, memenuhi persyaratan kedaulatan data dan kepatuhan paling ketat
🚨
Deteksi Keamanan Konten
实时防御潜在攻击,Deteksi Keamanan Konten准确率超99%,敏感内容自动拦截,保障输出合规
Kemitraan

Model Kolaborasi Fleksibel

Baik Anda memiliki sumber daya komputasi atau membutuhkannya, KHB menyediakan solusi kemitraan yang sesuai

🤝 Operasi Bersama
Cocok untuk yang memiliki sumber daya komputasi dan ingin mendapatkan kemampuan layanan Token dengan cepat dan melayani pelanggan akhir bersama KHB
Mitra Khas
Operator IDC, pusat komputasi cerdas regional, penyedia layanan GPU cloud, produsen chip domestik
Nilai Manfaat
✓ Kemampuan produksi Token lengkap, tidak perlu membangun tim teknologi sendiri
✓ Di bawah komputasi setara, throughput inferensi meningkat signifikan
✓ Berbagi pendapatan berdasarkan volume layanan aktual
✓ Endorsement merek KHB dan dukungan pasar
⚡ Penyerapan Komputasi / Compute-as-a-Service
Cocok untuk yang memiliki klaster GPU yang dibangun sendiri dan ingin meningkatkan efisiensi inferensi, mengurangi biaya O&M, atau mengkonversi sumber daya berlebih menjadi pendapatan layanan Token
Mitra Khas
Klien pemerintah/enterprise dengan komputasi mandiri, perusahaan internet besar, lembaga keuangan, operator telekomunikasi
Nilai Manfaat
✓ Efisiensi inferensi meningkat signifikan, komputasi setara mendukung skala bisnis lebih besar
✓ Performa GPU dimanfaatkan penuh, mengatasi tantangan adaptasi
✓ Data berjalan di lingkungan Anda, memenuhi persyaratan kepatuhan keamanan
✓ Komputasi berlebih dapat menyediakan layanan Token secara eksternal, menghasilkan pendapatan tambahan
Arsitektur Teknis

Arsitektur Aliran Data dari Komputasi ke Aplikasi

Arsitektur empat lapisan, data mengalir kiri ke kanan, kolaborasi per lapisan, membangun loop tertutup infrastruktur AI enterprise

Layer 01
Lapisan Sumber Daya Komputasi
NVIDIA A100/H100
Huawei Ascend 910B
Muxi GPU
Moore Threads GPU
Layer 02
Lapisan Layanan Inferensi
Pemuatan & Penjadwalan Model
Optimasi KV Cache
Continuous Batching
Kuantisasi & Akselerasi
Layer 03
Lapisan API Gateway
Antarmuka Kompatibel OpenAI
Gateway Routing Cerdas
Rate Limiting & Circuit Breaking
Pengukuran & Penagihan Token
Layer 04
Lapisan Aplikasi
Layanan Pelanggan Cerdas
Pembuatan Konten
Analisis Data
Solusi Industri
0
Model Terintegrasi
0
Dukungan Arsitektur Chip
0
Pengurangan Latensi Inferensi %
0
Peningkatan Throughput x
Layanan Inti

Matriks Layanan Mengelilingi Inti KHB·AI

Empat layanan mengorbit inti, dari komputasi dasar hingga gateway atas, cakupan penuh kebutuhan infrastruktur AI enterprise

KHB·AI
INFRASTRUCTURE
Operasi Komputasi
Token Factory
Operasi komputasi GPU, mengkonversi sumber daya GPU menjadi produktivitas Token secara efisien. Mendukung NVIDIA dan chip domestik, mencapai akses terpadu dan penjadwalan elastis komputasi multi-arsitektur
🔒
Instance Khusus
Reserved Instances
Komputasi khusus, sumber daya eksklusif memastikan operasi bisnis stabil, presisi model dijamin, biaya terkendali, komitmen SLA enterprise
🏗️
Platform MaaS
Enterprise MaaS
Platform solusi AI terpadu, manajemen komputasi heterogen, pelatihan model, cakupan penuh deployment inferensi, 100+ model terintegrasi, siap digunakan
🌐
AI Gateway
AI Gateway
Gateway layanan LLM privat, manajemen akses multi-model terpadu, routing cerdas dan rate limiting, observabilitas full-chain, keamanan data enterprise terjamin
Operasi Komputasi
TOKEN FACTORY
GPU算力运营,将GPU资源高效转化为Token生产力。支持NVIDIA及国产芯片(昇腾、沐曦、摩尔线程),实现多架构算力统一接入与弹性调度
🔒
Instance Khusus
RESERVED INSTANCES
专属预留算力,独占式资源保障业务稳定运行。模型精度有保障,成本可控,企业级SLA承诺
🏗️
Platform MaaS
ENTERPRISE MAAS
Platform solusi AI terpadu, manajemen komputasi heterogen, pelatihan model, cakupan penuh deployment inferensi, 100+ model terintegrasi, siap digunakan
🌐
AI Gateway
AI GATEWAY
Gateway layanan LLM privat, manajemen akses multi-model terpadu, routing cerdas dan rate limiting, observabilitas full-chain, keamanan data enterprise terjamin
Keunggulan

Mengapa Memilih KHB

Angka tidak berbohong, setiap metrik adalah bukti kekuatan

0
Model Terintegrasi
DeepSeek, GLM, Qwen, Kimi, GPT-4.1, Claude, Gemini dan LLM mainstream global lainnya dengan akses satu klik, pembaruan mirror model dinamis, model baru diadaptasi segera, API siap dipanggil
0
Pengurangan Latensi Inferensi
自研推理加速引擎,KV Cache深度优化与Continuous Batching,首Token延迟降低70%,无损精度动态量化,推理计算量减少60-80%
0
Peningkatan Throughput
异构算力弹性调度,单卡Token产出深度优化,同等算力下Peningkatan Throughput3至5倍,GPU集群利用率提升300%
0
Dukungan Arsitektur Chip
Mendukung secara bersamaan NVIDIA A100/H100, Huawei Ascend 910B, Muxi GPU, Moore Threads GPU, manajemen terpadu multi-arsitektur dan penjadwalan cerdas, menghindari ketergantungan vendor tunggal
0
SLA Ketersediaan Layanan
Komitmen SLA enterprise ketersediaan 99.9%, deployment multi-AZ, failover otomatis dan degradasi fallback, dukungan teknis 7x24 memastikan kelangsungan bisnis
0
Deteksi Keamanan Konten
Desensitisasi Dua Arah实时过滤隐私风险,Deteksi Keamanan Konten准确率超99%,联动敏感内容拦截与Log Audit,数据泄露风险降低99%
0
Mulai Cepat
可视化配置界面,3分钟内完成操作,30+开箱即用预置模板,Antarmuka Kompatibel OpenAI,无需深厚技术背景即可跨场景调用
0
Pengiriman Instance Khusus
Instance khusus standar dideploy dalam 1-7 hari kerja, platform menangani deployment model dan verifikasi performa, dukungan tuning performa inferensi, memastikan onboarding bisnis stabil
Pertanyaan Umum

Pertanyaan Umum

Seberapa kuat kemampuan teknis infrastruktur AI KHB?
KHB memiliki mesin operasi komputasi AI dan akselerasi inferensi yang dikembangkan sendiri, dengan kemampuan teknis inti termasuk manajemen terpadu komputasi heterogen, deployment model berkinerja tinggi, dan penjadwalan routing cerdas. Kami telah melayani ratusan klien enterprise di sektor keuangan, manufaktur, kesehatan dan lainnya, menyediakan layanan infrastruktur AI full-chain dari sumber daya komputasi hingga deployment aplikasi.
Apa perbedaan antara Instance Khusus dan bayar sesuai pemakaian?
Instance Khusus adalah sumber daya komputasi khusus yang tidak dibagi dengan orang lain, memastikan presisi model dan stabilitas inferensi, cocok untuk beban kerja produksi dengan persyaratan latensi dan ketersediaan ketat. Bayar sesuai pemakaian menggunakan pool sumber daya bersama yang ditagih berdasarkan penggunaan aktual, cocok untuk pengembangan/pengujian dan skenario bisnis elastis. Penggunaan Instance Khusus jangka panjang lebih hemat biaya.
Chip domestik apa yang didukung?
Saat ini mendukung Huawei Ascend 910B, Muxi GPU, Moore Threads GPU dan arsitektur chip domestik lainnya, serta NVIDIA A100/H100 dan GPU mainstream internasional lainnya. Melalui manajemen terpadu komputasi heterogen, enterprise dapat memilih solusi chip secara fleksibel, menghindari ketergantungan vendor tunggal.
Bagaimana AI Gateway memastikan keamanan data?
AI网关支持Deployment Privat,所有数据在企业内网流转,不经过公网。提供数据脱敏、访问控制、全链路加密传输、操作Log Audit等企业级安全能力,满足金融、医疗等行业的合规要求。
MaaS平台支持Deployment Privat吗?
支持。MaaS平台提供公有云SaaS和Deployment Privat两种模式。Deployment Privat可将完整平台部署在企业数据中心,数据完全不出域,适合对数据安全有严格要求的行业客户。
Bagaimana cara memulai layanan KHB?
Anda dapat menghubungi kami melalui informasi kontak di bagian bawah halaman. Tim solusi kami akan memberikan proposal yang disesuaikan berdasarkan kebutuhan bisnis Anda. Dari diskusi persyaratan, desain solusi, deployment lingkungan hingga operasi dan pemeliharaan, kami menyediakan dukungan profesional sepanjang proses.
Mengapa enterprise membutuhkan AI Gateway jika sudah memiliki LLM API?
Saat enterprise memperkenalkan beberapa LLM, masalah umum muncul dengan cepat: sumber model yang beragam menyebabkan protokol API tidak konsisten, rantai panggilan yang tersebar kurang manajemen terpadu, aplikasi berbeda memiliki persyaratan SLA yang bervariasi sulit dipenuhi secara holistik, dan volume penggunaan serta biaya sulit diukur. AI Gateway memecahkan masalah ini secara terpusat, menyediakan akses terpadu, routing cerdas, tata kelola fine-grained dan observabilitas full-chain.
Apakah AI Gateway menambah overhead jaringan?
AI Gateway menggunakan arsitektur proxy berkinerja tinggi, latensi tambahan biasanya dalam 1-3ms, yang dapat diabaikan dibandingkan latensi inferensi LLM itu sendiri (ratusan milidetik hingga detik). Sementara itu, routing cerdas dan optimasi connection pool gateway dapat mengurangi latensi keseluruhan secara nyata.
Bagaimana mengontrol biaya penggunaan LLM melalui gateway?
Gateway mendukung konfigurasi kuota lalu lintas dan kebijakan rate limiting berdasarkan pengguna, API Key, proyek, organisasi dan dimensi lainnya, menyediakan transparansi biaya full-chain dan akuntansi akurat, membantu enterprise memantau biaya penggunaan LLM secara real-time dan menghindari pembengkakan anggaran.
Kapan enterprise harus mendeploy platform MaaS privat?
Enterprise harus mempertimbangkan ketika: 1) Bisnis melibatkan data sensitif dengan persyaratan kedaulatan data yang ketat; 2) Perlu mendeploy kemampuan AI berskala besar dalam banyak skenario dengan persyaratan performa dan stabilitas inferensi yang sangat tinggi; 3) Lingkungan komputasi domestik atau heterogen yang beragam memerlukan manajemen terpadu dan pemanfaatan efisien; 4) Ingin mengikuti perkembangan teknologi AI tetapi tidak memiliki tim teknik untuk adaptasi dan optimasi model secara berkelanjutan.
Bagaimana layanan AI internasional dan domestik KHB dibagi dan diterapkan?
I. Pembagian Entitas Layanan
KHB INC (Perusahaan AS): Menyediakan layanan API model AI luar negeri semua kategori, secara eksklusif untuk enterprise dan individu luar negeri dengan identitas luar negeri. Persyaratan akses: menyelesaikan sertifikasi kualifikasi, mendukung kartu kredit USD, USD dan penyelesaian USDT. Layanan ini terbatas pada skenario luar negeri dan tidak boleh ditransfer secara tidak semestinya ke domestik.
Hangzhou Kaihabesi Ecological Technology Co., Ltd.: Mengoperasikan terutama layanan API proxy LLM domestik yang patuh, semua data diproses secara domestik, mematuhi semua hukum dan peraturan domestik secara ketat.

II. Deklarasi Hak, Tanggung Jawab & Kepatuhan
Kedua entitas beroperasi secara independen, masing-masing bertanggung jawab hukum atas layanan mereka, tanpa tanggung jawab bersama.
Aktivitas terkait layanan AI luar negeri mengikuti peraturan lokal. Pengguna dilarang keras menggunakan antarmuka luar negeri untuk menyediakan layanan secara domestik atau mentransmisikan data domestik secara tidak semestinya. Pelanggar menanggung konsekuensi sendiri.
Layanan domestik dilarang keras digunakan dalam skenario ilegal atau tidak patuh. Pengguna harus mematuhi persyaratan peraturan nasional.
Platform berhak memverifikasi kualifikasi penggunaan dan dapat menangguhkan atau mengakhiri layanan untuk akun yang tidak patuh.

KHB INC
Hangzhou Kaihabesi Ecological Technology Co., Ltd.
Luncurkan Infrastruktur AI Anda

Baik Anda menjelajahi AI untuk pertama kalinya atau mencari peningkatan komputasi dan layanan model, KHB menyediakan solusi profesional

Luncurkan LAUNCH
Pertanyaan Bisnis: ai@khb.hk