MiMo-V2.6-Flash

XiaomiのMiMo-V2.6シリーズに属する、エージェント型の処理向けに構築された効率と性能のバランスが取れたモデル。
$0.003 キャッシュ済み、$0.14 入力、$0.28 出力 / 1M
高速
必要なときにすぐ使える、柔軟なAI推論。
発表 · 2026年5月
500 GlobalとGeorges Harikが共同で主導し、A.Capital Ventures、Crescent Cove、Felicis、NVIDIA、Peak6、Samsung Next、Supermicro、Upper90が参加しました。
低価格の従量課金制。長期契約も隠れた手数料も、予想外の請求もありません。スタートアップにも大企業にも対応します。シンプルなAPIと技術者による直接サポートで、お客様を支えます。
お客様のニーズに応える推論パートナー。コスト、レイテンシ、スループット、規模のどれを重視する場合も、優先事項に合わせてソリューションを設計します。Deepinfraは、幅広いニーズに応える100+のモデルを提供します。
データを保持しない方針により、入力、出力、ユーザーデータのプライバシーを守ります。DeepinfraはSOC 2およびISO 27001の認証を取得し、情報セキュリティとプライバシー保護のベストプラクティスに従っています。
Deepinfraは、米国内の安全なデータセンターで、自社の最先端の推論向けインフラを運用しています。より高い性能と信頼性をお届けします。
モデル

XiaomiのMiMo-V2.6シリーズに属する、エージェント型の処理向けに構築された効率と性能のバランスが取れたモデル。
$0.003 キャッシュ済み、$0.14 入力、$0.28 出力 / 1M

長期にわたる高度なコーディングや複数のツールを使うエージェント向けの、MiMo-V2.6のフラッグシップモデル。
$0.004 キャッシュ済み、$0.435 入力、$0.87 出力 / 1M

長いコンテキストに対応したマルチモーダルな混合エキスパートモデル。
$0.004 キャッシュ済み、$0.14 入力、$0.42 出力 / 1M

複雑なソフトウェア開発や長時間にわたるタスクに対応する大規模推論モデル。
キャッシュ済み $0.125、入力 $0.563、出力 $2.50 / 1M

効率的なコーディングや長期にわたるエージェントタスクに適した高速モデル。
キャッシュ済み $0.015、入力 $0.075、出力 $0.25 / 1M

複雑なコーディング向けに構築された、Moonshot AIの重みが公開されたマルチモーダル推論モデル。
キャッシュ済み $0.285、入力 $2.85、出力 $14.25 / 1M

Qwenのオープンウェイトなスパース混合エキスパートモデル。
キャッシュ済み $0.20、入力 $2.00、出力 $6.00 / 1M

高度な推論やエージェントタスク向けのDeepSeek-V4-Proリリース。
キャッシュ済み $0.20、入力 $1.30、出力 $2.60 / 1M

日常的な推論処理向けの効率的なDeepSeek-V4-Flashリリース。
キャッシュ済み $0.015、入力 $0.06、出力 $0.18 / 1M

長期にわたるタスクやエージェント型アプリケーション向けのフラッグシップモデル。
キャッシュ済み $0.105、入力 $0.563、出力 $1.80 / 1M

最先端の推論、オーケストレーション、コーディングエージェント、詳細な調査向けに構築。
キャッシュ済み $0.10、入力 $0.50、出力 $2.20 / 1M

応答性が求められるアプリケーション向けの、効率性を重視した混合エキスパートモデル。
キャッシュ済み $0.018、入力 $0.09、出力 $0.18 / 1M
速度、規模、安定性、コストを測る重要な指標
1秒あたりのトークン数
最初のトークンまでの時間
1秒あたりのリクエスト数
大規模インフラストラクチャ
DeepCluster
Deepinfraが調達・運用する専用ハードウェア。完全所有、Tier 3データセンター、稼働率99.982%のSLA。
GPUクラスターを見るNVIDIA B300 · 5年間の契約
パブリッククラウドの$6.50 /GPU-hrと比較