ホーム サービス アーキテクチャ 利点 ユースケース 概要 メンバーセンター
GPUクラスター稼働中
モデル準備完了
API可用性 99.99%

200以上のモデル、大規模コンピュート、すべてを一つのAPI

DeepSeek·GLM·Qwen·Kimi·Llama完全統合、エンタープライズグレードAIコンピュートプラットフォーム

モデル一覧

利用可能な全モデル一覧

101以上のモデルを事前統合、主要モデルを以下に掲載、継続的に更新

モデル パラメータ数 コンテキスト長 精度 入力価格(参考) 出力価格(参考) ステータス
GPT-4.1 mini OpenAI1M¥2.80 /百万Token¥11.20 /百万Tokenオンライン
GPT-4.1 人気1M¥14.00 /百万Token¥56.00 /百万Tokenオンライン
o3 推論200K¥14.00 /百万Token¥56.00 /百万Tokenオンライン
Claude Sonnet 4.5 Anthropic200K¥21.00 /百万Token¥105.00 /百万Tokenオンライン
Claude Haiku 3.5 Anthropic200K¥5.60 /百万Token¥28.00 /百万Tokenオンライン
Gemini 2.5 Pro Google1M¥8.75 /百万Token¥70.00 /百万Tokenオンライン
Gemini 2.5 Flash Google1M¥1.05 /百万Token¥4.20 /百万Tokenオンライン
DeepSeek-V4 Pro 最新685B MoE128KBF16¥12.00 /百万Token¥24.00 /百万Tokenオンライン
DeepSeek-V4 Flash 最新685B MoE128KBF16¥1.00 /百万Token¥2.00 /百万Tokenオンライン
DeepSeek-R1 推論685B MoE128KBF16¥2.00 /百万Token¥5.00 /百万Tokenオンライン
GLM-5 智谱200B+128KBF16¥1.00 /百万Token¥6.00 /百万Tokenオンライン
GLM-5V-Turbo 多模态130B+128KBF16¥1.50 /百万Token¥3.00 /百万Tokenオンライン
Qwen3.7 Max 最新397B MoE128KBF16¥2.00 /百万Token¥6.00 /百万Tokenオンライン
Qwen3.6 Flash 高速235B MoE128KBF16¥0.30 /百万Token¥0.60 /百万Tokenオンライン
Qwen3-Coder-Next コード235B MoE128KBF16¥1.50 /百万Token¥3.50 /百万Tokenオンライン
Kimi-K2.5 最新1T MoE256KBF16¥4.00 /百万Token¥6.00 /百万Tokenオンライン
Kimi-K2 Thinking 推論1T MoE256KBF16¥3.00 /百万Token¥6.00 /百万Tokenオンライン
MiniMax-M2.5 最新456B MoE1MBF16¥2.10 /百万Token¥8.40 /百万Tokenオンライン
MiniMax-M2.5 Highspeed 高速456B MoE1MBF16¥1.00 /百万Token¥2.00 /百万Tokenオンライン
Doubao Seed 2.0 Pro 豆包128KBF16¥1.50 /百万Token¥3.00 /百万Tokenオンライン
Doubao Seed 2.0 Code Preview コード128KBF16¥1.00 /百万Token¥2.00 /百万Tokenオンライン
Llama-4 Meta400B MoE1MBF16¥2.50 /百万Token¥5.00 /百万Tokenオンライン
Yi-Lightning 零一万物64KBF16¥0.50 /百万Token¥1.50 /百万Tokenオンライン
Step-2 阶跃星辰128KBF16¥1.50 /百万Token¥3.20 /百万Tokenオンライン
Hy3 Preview 混元128KBF16¥1.00 /百万Token¥2.00 /百万Tokenオンライン
BAAI/bge-m3 Embedding568M8KFP16¥0.02 /百万Tokenオンライン
ユースケース

ワンコマンドでAIをデプロイ

KHB AIインフラデプロイソリューションを業界横断で探索、開発者の流儀で

enterprise-ai.sh
$ khb deploy --scenario=enterprise --model=DeepSeek-V3.2
算力资源分配完成
模型加载完成 DeepSeek-V3.2
API网关配置完成
企业AI平台已就绪
ENDPOINT: https://api.khb.com/v1/enterprise
STATUS: RUNNING
compute-center.sh
$ khb deploy --scenario=compute --chip=ascend,nvidia
异构算力统一纳管启动
NVIDIA A100 × 128 已接入
昇腾910B × 64 已接入
弹性调度引擎就绪
UTILIZATION: 94.7%
finance.sh
$ khb deploy --scenario=finance --security=private
プライベートデプロイ环境初始化
数据隔离策略已启用
全链路加密传输已开启
監査ログ系统就绪
COMPLIANCE: PASSED
manufacturing.sh
$ khb deploy --scenario=manufacturing --instance=reserved
预留实例资源锁定
工业AI模型部署完成
7×24 SLA保障已启用
质检模型推理延迟 <50ms
UPTIME: 99.99%
予約インスタンス

コンピュートを確保、ビジネスを守る

専用予約コンピュート・モデル精度保証・コスト管理・エンタープライズSLA

DeepSeek-V3.2
deepseek-ai/DeepSeek-V3.2
価格 ¥594,000/组/月
実効単価 ¥2.20/M tokens
TPM 1,250万
TTFT 1,600ms
TPS 45
コンテキスト 1M
エンタープライズグレードの複雑な推論・意思決定分析、コード生成・ソフトウェア開発支援、エージェントツール呼び出しに適用
GLM-5
zai-org/GLM-5
価格 ¥594,000/组/月
実効単価 ¥2.75/M tokens
TPM 1,000万
TTFT 1,500ms
TPS 30
コンテキスト 1M
エンタープライズグレードのエージェント開発、複雑なタスク計画・マルチステップ実行、ソフトウェアエンジニアリング自動化に適用
Kimi-K2.5
moonshotai/Kimi-K2.5
価格 ¥594,000/组/月
実効単価 ¥6.88/M tokens
TPM 400万
TTFT 1,500ms
TPS 30
コンテキスト 256K
エンタープライズグレードのマルチモーダルエージェント開発、視覚コンテンツ理解・分析、複雑タスク自動化に適用
MiniMax-M2.5
MiniMaxAI/MiniMax-M2.5
価格 ¥297,000/组/月
実効単価 ¥2.75/M tokens
TPM 500万
TTFT 500ms
TPS 30
コンテキスト 1M
エンタープライズグレードの長文ドキュメント・ナレッジベース分析、インテリジェントカスタマーサービス・コンテンツ生成、ビジネスプロセス自動化に適用
* TPMに基づく実効単価、月30日・全体利用率50%で計算。パフォーマンスデータは一般的な推論パラメータに基づく:入力24K Token、出力1K Token、キャッシュヒット率80%。(2026年5月20日更新)
AIゲートウェイ

プライベートLLMサービスゲートウェイ

統合管理・インテリジェントルーティング・レート制限・フルチェーン可観測性

01 統合マルチモデルアクセス
異なるベンダーのモデルをワンストップアクセス・標準化呼び出し、OpenAI互換インターフェース対応、ポイント管理を排除、マルチベンダーエコシステムを簡単管理
02 インテリジェントルーティング&負荷分散
トラフィック特性とLLMサービス特性を組み合わせたインテリジェント動的ルーティング、負荷分散、Fallbackフェイルオーバー、サービス安定性とビジネスSLAを確保
03 きめ細かいガバナンス&レート制限
ユーザー、API Key、プロジェクト、組織次元でモデル権限・トラフィック・クォータ管理を設定、マルチテナント分離、きめ細かいモデル呼び出しガバナンスを実現
04 正確なコスト計算
消費ユーザー、API Key、プロジェクト、組織、モデル、コンピュートにわたるフルチェーンコスト透明性、正確なコスト計算と予算管理を実現
05 フルチェーンモデル可観測性
モデル呼び出し量・パフォーマンスなどの多次元可観測性、精密モデルガバナンス、ライフサイクル管理・ルーティング戦略調整をサポート、A/Bテスト・カナリアリリース対応
06 エンタープライズデータセキュリティ
双方向脱感作リアルタイムプライバシーリスクフィルタリング、連動センシティブコンテンツ傍受・監査ログ、すべてのLLMビジネストランザクションのコンプライアンスとトレーサビリティを確保
セキュリティ&コンプライアンス

エンドツーエンド多層防御システム

インテリジェンス駆動セキュリティ、データからアプリケーションまでフルチェーン保護

🔐
エンドツーエンド暗号化
フルチェーンTLS暗号化伝送、データストレージ暗号化、鍵管理システム、転送中・保管中のデータの絶対的セキュリティを確保
🛡️
双方向脱感作
入出力双方向リアルタイム脱感作フィルタリング、機密情報を自動識別・マスキング、プライバシーデータ漏洩を防止
📋
監査ログ
フルチェーン操作監査、すべてのAPI呼び出しが追跡・監査可能、金融・医療などのコンプライアンス要件に対応
🏢
マルチテナント分離
テナント間の厳格なデータ分離、きめ細かい権限制御、組織・プロジェクト・ユーザーによる多次元アクセス制御をサポート
🔒
プライベートデプロイ
データはドメイン外に出ず、すべての推論は企業イントラネット内で完了、最も厳格なデータ主権とコンプライアンス要件に対応
🚨
コンテンツセキュリティ検出
实时防御潜在攻击,コンテンツセキュリティ検出准确率超99%,敏感内容自动拦截,保障输出合规
パートナーシップ

柔軟なコラボレーションモデル

コンピュートをお持ちの方にも、コンピュートをお探しの方にも、KHBが最適なパートナーシップソリューションを提供

🤝 共同運用
コンピュートリソースをお持ちで、Tokenサービス能力を迅速に獲得し、KHBと共にエンド顧客にサービスを提供したい方向け
代表的パートナー
IDC事業者、地域知能コンピューティングセンター、GPUクラウドサービスプロバイダー、国産チップメーカー
バリュー・メリット
✓ 完全なToken生産能力、自社技術チーム構築不要
✓ 同等コンピュートで推論スループット大幅向上
✓ 実際のサービス量に基づく収益分配
✓ KHBブランド推薦・市場サポート
⚡ コンピュート吸収 / Compute-as-a-Service
自社構築GPUクラスターをお持ちで、推論効率の向上、運用保守コストの削減、または余剰リソースのTokenサービス収益化を図りたい方向け
代表的パートナー
自社構築コンピュートを持つ政府/エンタープライズクライアント、大手インターネット企業、金融機関、通信事業者
バリュー・メリット
✓ 推論効率大幅向上、同等コンピュートでより大規模なビジネスをサポート
✓ GPUパフォーマンスを完全活用、適応課題を解決
✓ データは自社環境で実行、セキュリティコンプライアンス要件に対応
✓ 余剰コンピュートで外部にTokenサービスを提供、追加収益を創出
技術アーキテクチャ

コンピュートからアプリケーションまでのデータフローアーキテクチャ

4層アーキテクチャ、データは左から右へ流れ、層ごとに連携し、エンタープライズAIインフラのクローズドループを構築

Layer 01
コンピュートリソース層
NVIDIA A100/H100
Huawei Ascend 910B
Muxi GPU
Moore Threads GPU
Layer 02
推論サービス層
モデルロード&スケジューリング
KV Cache最適化
Continuous Batching
量子化&高速化
Layer 03
APIゲートウェイ層
OpenAI互換インターフェース
インテリジェントルーティングゲートウェイ
レート制限・サーキットブレーカー
Token計量・課金
Layer 04
アプリケーション層
インテリジェントカスタマーサービス
コンテンツ生成
データ分析
業界ソリューション
0
事前統合モデル数
0
チップアーキテクチャ対応
0
推論レイテンシ削減%
0
スループット向上倍率
コアサービス

KHB·AIコアを囲むサービスマトリックス

4つのサービスがコアを周回、基盤コンピュートから上位ゲートウェイまで、エンタープライズAIインフラニーズをフルチェーンでカバー

KHB·AI
INFRASTRUCTURE
コンピュート運用
Token Factory
GPUコンピュート運用、GPUリソースを効率的にToken生産力に変換。NVIDIA・国産チップ対応、マルチアーキテクチャコンピュート統合アクセス・弾性スケジューリングを実現
🔒
予約インスタンス
Reserved Instances
専用予約コンピュート、専有リソースで安定したビジネス運用を確保、モデル精度保証、コスト管理、エンタープライズSLAコミットメント
🏗️
MaaSプラットフォーム
Enterprise MaaS
ワンストップAIソリューションプラットフォーム、ヘテロジニアスコンピュート管理、モデル訓練、推論デプロイフルプロセス対応、100以上のモデル事前統合、すぐに利用可能
🌐
AIゲートウェイ
AI Gateway
プライベートLLMサービスゲートウェイ、統合マルチモデルアクセス管理、インテリジェントルーティング・レート制限、フルチェーン可観測性、エンタープライズデータセキュリティ確保
コンピュート運用
TOKEN FACTORY
GPU算力运营,将GPU资源高效转化为Token生产力。支持NVIDIA及国产芯片(昇腾、沐曦、摩尔线程),实现多架构算力统一接入与弹性调度
🔒
予約インスタンス
RESERVED INSTANCES
专属预留算力,独占式资源保障业务稳定运行。模型精度有保障,成本可控,企业级SLA承诺
🏗️
MaaSプラットフォーム
ENTERPRISE MAAS
ワンストップAIソリューションプラットフォーム、ヘテロジニアスコンピュート管理、モデル訓練、推論デプロイフルプロセス対応、100以上のモデル事前統合、すぐに利用可能
🌐
AIゲートウェイ
AI GATEWAY
プライベートLLMサービスゲートウェイ、統合マルチモデルアクセス管理、インテリジェントルーティング・レート制限、フルチェーン可観測性、エンタープライズデータセキュリティ確保
利点

KHBを選ぶ理由

数字は嘘をつかない、すべての指標が実力の証

0
事前統合モデル数
DeepSeek、GLM、Qwen、Kimi、GPT-4.1、Claude、Geminiなどグローバル主要LLMにワンクリックアクセス、動的モデルミラー更新、新モデル即時適応、API即時呼び出し可能
0
推論レイテンシ削減
自研推理加速引擎,KV Cache深度优化与Continuous Batching,首Token延迟降低70%,无损精度动态量化,推理计算量减少60-80%
0
スループット向上
异构算力弹性调度,单卡Token产出深度优化,同等算力下スループット向上3至5倍,GPU集群利用率提升300%
0
チップアーキテクチャ対応
NVIDIA A100/H100、Huawei Ascend 910B、Muxi GPU、Moore Threads GPUを同時サポート、マルチアーキテクチャ統合管理・インテリジェントスケジューリング、単一ベンダーロックイン回避
0
サービス可用性SLA
エンタープライズSLA 99.9%可用性コミットメント、マルチAZデプロイ、自動フェイルオーバー・Fallback劣化、7x24テクニカルサポートでビジネス継続性を確保
0
コンテンツセキュリティ検出
双方向脱感作实时过滤隐私风险,コンテンツセキュリティ検出准确率超99%,联动敏感内容拦截与監査ログ,数据泄露风险降低99%
0
クイックスタート
可视化配置界面,3分钟内完成操作,30+开箱即用预置模板,OpenAI互換インターフェース,无需深厚技术背景即可跨场景调用
0
予約インスタンス納期
標準予約インスタンス1-7営業日以内デプロイ、プラットフォームがモデルデプロイ・パフォーマンス検証を処理、推論パフォーマンスチューニングサポート、安定したビジネスオンボーディングを確保
よくある質問

よくある質問

KHBのAIインフラ技術力はどの程度ですか?
KHBは自社開発のAIコンピュート運用・推論高速化エンジンを持ち、ヘテロジニアスコンピュート統合管理、高性能モデルデプロイ、インテリジェントルーティングスケジューリングなどのコア技術力を備えています。金融、製造、医療など数百のエンタープライズクライアントにサービスを提供し、コンピュートリソースからアプリケーションデプロイまでフルチェーンAIインフラサービスを提供しています。
予約インスタンスと従量課金の違いは何ですか?
予約インスタンスは他者と共有しない専用コンピュートリソースで、モデル精度と推論安定性を確保し、レイテンシと可用性に厳格な要件があるプロダクションワークロードに適しています。従量課金は実際の使用量に基づき課金される共有リソースプールを使用し、開発/テストや弾性ビジネスシナリオに適しています。長期的に安定して予約インスタンスを使用する方がコスト効率が良いです。
どの国産チップに対応していますか?
現在、Huawei Ascend 910B、Muxi GPU、Moore Threads GPUなどの国産チップアーキテクチャ、およびNVIDIA A100/H100などの国際的主流GPUに対応しています。ヘテロジニアスコンピュート統合管理により、エンタープライズは柔軟にチップソリューションを選択でき、単一ベンダーロックインを回避できます。
AIゲートウェイはデータセキュリティをどのように確保しますか?
AI网关支持プライベートデプロイ,所有数据在企业内网流转,不经过公网。提供数据脱敏、访问控制、全链路加密传输、操作監査ログ等企业级安全能力,满足金融、医疗等行业的合规要求。
MaaS平台支持プライベートデプロイ吗?
支持。MaaS平台提供公有云SaaS和プライベートデプロイ两种模式。プライベートデプロイ可将完整平台部署在企业数据中心,数据完全不出域,适合对数据安全有严格要求的行业客户。
KHBのサービスをどのように始めればよいですか?
ページ下部の連絡先情報からお問い合わせいただけます。ソリューションチームがビジネスニーズに基づいたカスタマイズ提案を提供します。要件検討、ソリューション設計、環境デプロイから運用保守まで、プロフェッショナルなサポートを全プロセスで提供します。
すでにLLM APIがある場合、なぜエンタープライズはAIゲートウェイが必要ですか?
エンタープライズが複数のLLMを導入すると、一般的な問題がすぐに顕在化します:多様なモデルソースによるAPIプロトコルの不統一、分散した呼び出しチェーンの統合管理不足、異なるアプリケーションの多様なSLA要件の全体的な対応困難、使用量とコストの把握困難。AIゲートウェイはこれらの問題を一元解決し、統合アクセス、インテリジェントルーティング、きめ細かいガバナンス、フルチェーン可観測性を提供します。
AIゲートウェイはネットワークオーバーヘッドを増やしますか?
AIゲートウェイは高性能プロキシアーキテクチャを採用し、追加レイテンシは通常1-3ms以内で、LLM推論レイテンシ自体(数百ミリ秒〜数秒)と比較して無視できます。同時に、ゲートウェイのインテリジェントルーティングとコネクションプール最適化により、全体的なレイテンシを実際に削減できます。
ゲートウェイを通じてLLM利用コストをどのように管理しますか?
ゲートウェイはユーザー、API Key、プロジェクト、組織などの次元でトラフィッククォータとレート制限ポリシーを設定でき、フルチェーンコスト透明性と正確な計算を提供し、エンタープライズがLLM利用コストをリアルタイムで監視し、予算超過を回避するのに役立ちます。
エンタープライズはいつプライベートMaaSプラットフォームをデプロイすべきですか?
以下の場合に検討してください:1)ビジネスにセンシティブデータが含まれ、データ主権要件が厳格;2)多数のシナリオでAI機能を大規模デプロイする必要があり、推論パフォーマンスと安定性要件が極めて高い;3)多様な国産またはヘテロジニアスコンピュート環境があり、統合管理と効率的利用が必要;4)AI技術の発展に追いつきたいが、継続的なモデル適応と最適化のためのエンジニアリングチームがない。
KHBの国際AIサービスと国内AIサービスの区分と適用はどうなっていますか?
一、サービス主体の区分
KHB INC(米国法人):フルカテゴリの海外AIモデルAPIサービスを提供、海外身分を持つ海外企業・個人専用。アクセス要件:資格認証完了、USDクレジットカード、USD、USDT決済対応。本サービスは海外シナリオに限定され、国内への不適切な転用は禁止。
杭州凱哈ベシ生態科技有限公司:主に国内コンプライアントLLMプロキシAPIサービスを運営、全データは国内で処理、国内の全法律法規を厳格に遵守。

二、権利・義務・コンプライアンス宣言
両主体は独立して運営し、それぞれのサービスに対して法的責任を負い、連帯責任は負いません。
海外AIサービス関連活動は現地法規に従います。ユーザーは海外インターフェースを使用して国内でサービスを提供したり、国内データを不適切に伝送することを厳禁。違反者の責任は自己負担。
国内サービスは違法・非コンプライアンスシナリオでの使用を厳禁。ユーザーは国家規制要件を遵守する必要があります。
プラットフォームは利用資格を確認する権利を留保し、非コンプライアンスアカウントのサービスを一時停止・終了することがあります。

KHB INC
杭州凱ハベシ生態科技有限公司
AIインフラを始めよう

初めてAIを探索する方にも、コンピュートやモデルサービスのアップグレードをお探しの方にも、KHBがプロフェッショナルなソリューションを提供

始める LAUNCH
ビジネスお問い合わせ:ai@khb.hk