2026年最もコスト効率の高い中国LLM API
2026年8月時点で最も安価な中国製LLM API:入力単価が文句なしの最安を誇るQwen3.5 Flash($0.029/1M input tokens)、最安の米国製モデルすら下回り総合最安のDeepSeek V4 Flash($0.22/$0.66 off-peak)、米国フラッグシップの1/4の価格でフロンティア級コーディングを実現するGLM-5.3($1.40/$4.40)。
検証済み料金一覧(2026年8月)
すべての料金は1Mトークンあたり(入力/出力)の公式定価であり、2026年8月23日にプロバイダー公式ドキュメントおよびアグリゲーターと照合済みです。入力価格順にソートされています。
| 課金方式 | プロバイダー | 入力 $/1M | 出力 $/1M | 最適な用途 |
|---|---|---|---|---|
| DeepSeek V4 Flash | DeepSeek | 0.22* | 0.66* | 総合最安:分類、抽出、大量のチャット処理 |
| GPT-5.6 Luna (米国基準) | OpenAI | 0.20 | 1.20 | 米国最安の選択肢 — 比較用 |
| Kimi K2.5 | Moonshot AI | 0.45 | 2.25 | エージェントループ、ビジュアルコーディング、262Kコンテキスト |
| MiniMax M3 | MiniMax | 0.60 | 2.40 | SWE-benchで>80%を記録した最安モデル — コーディングのコスパ最高 |
| GLM-5.3 / GLM-5.2 | Zhipu / Z.ai | 1.40 | 4.40 | フロンティア級コーディング + 1Mコンテキスト、同クラスで最安 |
| Qwen3.8-Max | アリババ | 2.00 | 6.00 | フラッグシップの「cowork」タスク、多言語対応 |
| Kimi K3 | Moonshot AI | 3.00 | 15.00 | プレミアム2.8Tマルチモーダルフラッグシップ、1Mコンテキスト |
情報源: Z.ai pricing docs (GLM) · Alibaba Model Studio (Qwen3.8-Max) · OpenRouter (Kimi K2.5) · MorphLLM 12-API comparison (V4 Flash, MiniMax M3) · Apidog price-war analysis (V4-Pro, MiMo) · LLM Abacus (Qwen3.5 Flash) · BenchLM (Kimi K3) · Live JSON dataset on GitHub。料金は毎週変動します — 大規模な利用開始前に再確認してください。
部門別チャンピオン
- あらゆるLLM APIで最安の入力単価:Qwen3.5 Flash — $0.029/1M input tokens(¥0.20、LLM Abacus調べ)。分類や抽出のパイプラインに最適です。
- 最安のフロンティア級出力:DeepSeek V4-Pro — $0.87/1M output tokens(Apidogの価格競争分析によると、フロンティア級モデルの中で最安)。
- 長文コンテキスト定額:Xiaomi MiMo V2.5 Pro — 1Mトークンのコンテキストでも出力一律 $3/1M(段階的な従量課金なしで巨大なコンテキストウィンドウが必要な場合に最適)。
定価以上に重要なコスト削減のポイント
- プロンプトキャッシュ / システムプロンプトの短縮 — GLM-5.3のキャッシュ入力は$0.26/1M(通常$1.40から引き下げ)、Kimi K3のキャッシュヒット時は$0.30(通常$3.00から引き下げ)に低下します。ベンダーを乗り換える以上の節約になることも少なくありません。
- 難度の高いタスクのみルーティング — 難関ステップにはKimi K3やR1級モデルを使用し、リクエスト全体の90%にはV4 Flash / Qwen Flashを割り当てます。
- チャンク分割 + 検索 — 多くのRAGタスクにおいて、巨大モデルよりも小さめのコンテキストを活用する方が効果的です。
- 非対話型ジョブのバッチ処理 — オフライン要約は柔軟に処理できます。一部のプラットフォームではDeepSeekの週末オフピーク料金が適用されます。
実践的なスタック構成(推奨)
大量のチャット/RAG: deepseek-v4-flash または qwen-flash ティア — GPT-Luna未満のコストで、より優れた多言語品質を実現
エージェント/コーディング: kimi-k2.5 または minimax-m3、高度なフロンティアステップには glm-5.2/5.3 へエスカレーション
動画生成(秒単位課金): seedance-2.5(480pで約$0.10/秒)/ happyhorse-1.1(720pで$0.0988/秒)
請求・決済: USDTチャージ、ChinaModelAPI経由の単一のOpenAI互換APIキー
FAQ
2026年で最も安い中国製LLM APIは何ですか?
入力単価で見ると、AlibabaのQwen3.5 Flashが100万入力トークンあたり$0.029で最安の中国製LLM APIです。入出力バランスの取れた料金では、DeepSeek V4 Flash(1Mトークンあたり入力$0.14 / 出力$0.28)が総合的に最も安価な選択肢であり、最安の米国製モデルであるGPT-5.6 Luna($0.20/$1.20)を入力・出力の両面で下回っています。
中国製LLM APIはGPTと比べてどれくらい安いですか?
最も安価な米国の基準モデル(1Mトークンあたり$0.20/$1.20のGPT-5.6 Luna)と比較すると、DeepSeek V4 Flashは入力が約30%安く、出力は約77%安価です。本格的な米国フラッグシップモデルと比較した場合、その価格差は5〜10倍に広がり、GLM-5.3なら$1.40/$4.40でフロンティア級のコーディング性能を利用できます。
コーディングやエージェント用途で最も安い中国製モデルはどれですか?
エージェントループには、1Mトークンあたり$0.45/$2.25のMoonshot Kimi K2.5がコストパフォーマンスに優れた選択肢です。MiniMax M3($0.60/$2.40)はSWE-benchで80%超を記録した最安モデルです。負荷の高い最先端コーディングには、フロンティアモデルの中で最も安い出力トークン単価($0.87/1M)を提供するDeepSeek V4-Proが適しています。
価格が安いと品質も劣るのでしょうか?
いいえ。多くのRAGやサポート業務において、中国の最先端オープンウェイトモデルは欧米の中位モデルと同等以上の性能をわずかなコストで発揮します。切り替える前に、必ず自社ドメインの20〜50件の評価プロンプトセットで検証してください。
これらは公式料金ですか、それともリレー(中継)サービスの料金ですか?
本表には、プロバイダー(GLM-5.3のZ.ai、Qwen3.8-MaxのAlibaba Model Studio、KimiのMoonshot)の公式定価を掲載しており、2026年8月23日時点でアグリゲーター(OpenRouter、MorphLLM、LLM Abacus)と照合済みです。ChinaModelAPIのようなリレーサービスを利用すれば、これらすべてを単一のOpenAI互換APIキーかつUSDTチャージで利用できます。
OpenAIからより安価な中国製モデルに移行するにはどうすればよいですか?
OpenAI SDKはそのまま使用できます。base_url を https://api.chinamodelapi.com/v1 に変更し、APIキーを差し替え、glm-5.2、deepseek-v4-pro、qwen-plus などのモデルIDを指定するだけです。コードの書き換えは不要です。ステップ別のコード例については、qwen-api-guide および deepseek-v3-api をご覧ください。
関連ガイド
ひとつのOpenAI互換キー · 中国製モデル · USDT即時チャージ
早期アクセスを取得