人間的なクロード
-
Claude Opus 4.7
主要な推論、長いコンテキスト、アーキテクチャ、および戦略の作業。
-
Claude Opus 4.6
安定した高品質の分析を実現する前世代の Opus。
-
Claude Sonnet 4.6
毎日のドライバー - コーディング、書き込み、および複数ステップのエージェント ループ。
-
Claude Sonnet 4.5 / 4
サポートされているワークロードでのプロンプト キャッシュを備えた高速 Sonnet 層。
-
Claude Haiku 4.5
低遅延の下書き、分類、および大量のサブタスク。
B2B SaaS Web サイトの UI ラベル。自然言語に翻訳: OpenAI
-
GPT-5.5 / GPT-5.4 / GPT-5.2
一般およびエージェントのワークロード用の最新の GPT-5 ファミリ。
-
GPT-4.1 & GPT-4o
実稼働エージェント向けの信頼性の高いマルチモーダル チャットとツールの使用。
-
GPT-4o mini
サマリーと軽量ステップのためのコスト効率の高いルーティング。
-
o3 / o3-pro / o3-mini / o4-mini
数学、計画、検証のための推論に重点を置いたモデル。
-
GPT-5.3 Codex & Codex mini
コード生成、リファクタリング、およびリポジトリ対応エージェントのスキル。
Google ジェミニ
-
Gemini 2.5 Pro
長期にわたるコンテキストの調査と構造化された抽出。
-
Gemini 2.5 Flash
競争力のあるトークン レートによる高スループットのエージェント ステップ。
-
Gemini 2.0 Flash
解析、タグ付け、バッチ ジョブの超高速パス。
オープンかつ専門的な API
-
DeepSeek Chat & Reasoner
チャットや思考連鎖スタイルのタスクに大きな価値があります。
-
Mistral Large
多言語エージェント チーム向けのヨーロッパホストのオプション。
-
Llama 3.3 70B
API を介したオープンウェイト クラス モデル - プライベート GPU とうまく組み合わせます。
-
Grok 3
ニュースおよびソーシャル監視エージェント向けのリアルタイム指向モデル。
-
Sonar Pro
研究エージェント向けの検索に基づいた回答。
-
Command R+
RAG フレンドリーなエンタープライズ チャットおよび検索ワークフロー。
Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in
pricing.
-
1
GPUを予約する
VRAM、リージョン、稼働時間 (バーストまたは常時オン) を選択します。ウェイト用のストレージはインスタンスに付属するか、バケットにマウントされます。
-
2
スタックをデプロイする
提供イメージまたは SSH を開始し、CUDA ドライバーをインストールし、チェックポイントをロードします。ヘルスチェックにより、モデルの準備ができていることが確認されます。
-
3
エンドポイントの登録
ワークスペース設定にベース URL、API キー、モデル ID を追加します。 Digio は、稼働前にレイテンシとトークン形式を検証します。
-
4
エージェントに割り当てる
選択したエージェントのデフォルトとしてプライベート モデルを選択します。管理対象の Claude/GPT モデルは引き続き並行して利用できます。
GPU のレンタルは、Digio プランのサブスクリプションとは別に請求されます。キャパシティ プランニング、SLA、既存の推論クラスターからの移行については、お問い合わせください。