ModelDock リサーチ

ベンチマークデータ

通常レーンのハードウェア · 情報源中央値 · 調整可能な経済性

ワークロード

読み取りはプロンプト、ファイル、履歴の取り込み、書き込みは回答生成です。長文書やコーディングは読み取り寄りのため、既定値は 75% 読み取り / 25% 書き込みです。安定した MTP は別シナリオではなく通常経路として扱います。

モデル量子化

0 件のハードウェア構成元のカタログ順 · 数値列をクリックして並べ替え

2× GPU 構築メモ デュアルカード構成では、幅広カード用のケース余裕とスロット間隔、余裕ある安定電源と冷却が必要です。導入とマルチ GPU スケジューリングも単一カードより複雑です。

ハードウェア能力ワークロードの経済性根拠市場
能力 効率 費用 ~ 帯域幅換算の推定値または根拠未完

前提

75% reading / 25% writing · 24 active h/day
システム全体の電力 · Qwen3.8 27B · 通常のローカル利用

透明な計算

GPU システム総額 = GPU 価格 + $1,000 ホスト
ローカル $/MM =(電力費 + ハードウェア配賦)/ 1 日の処理量
損益分岐日数 = システム総額 /(API 相当額/日 − 電力費/日)単一ユーザーの逐次モデル:読み取り時間 + 書き込み時間。同時実行や重なりは想定しません。

根拠データ

公開済みハードウェアレコードの情報源分布を開きます。

方法

表の背後にある条件。

性能には、情報源を確認できる MTP 対応中央値を使用します。経済性はベンチマーク実行ではなく利用方法を表すため調整可能です。

既定経路

Qwen3.8 27B をローカル、単一ユーザー、単一ストリームで使い、安定した MTP/投機的ドラフトを通常経路とします。SGLang と DFlash/DFlash2 は既定中央値に含めません。

指標別中央値

読み取り(prefill)と書き込み(decode)は別々に中央値を取ります。Median をクリックすると、量子化、コンテキスト、ランタイム、トポロジー、ドラフト深度を確認できます。

根拠ラベル

Median は情報源分布にリンクします。~ 速度推定は測定・報告済みデータから帯域幅換算した値で、情報源中央値とは分離します。Pending は通常レーンの情報源指標が未収集であることを示します。

価格基準

単体 GPU 構成のシステム総額には、記録された GPU 価格に $1,000 のホスト/プラットフォーム予算を加えます。損益分岐は、システム総額を 1 日の API 相当額から直接電力費を引いた値で割ったもので、投資収益を保証しません。

市場検索

同等品の販売情報

リンクは指定マーケットプレイスを開きます。アフィリエイトリンク、リアルタイム価格フィード、出品者ランキングは使用しません。