比較可能な作業。明示的な前提条件。
KCI Economics v1は、レビュー済みのベンチマークと、互換性のある元のUSD建て計算資源価格を、参考用に再現可能な形で変換したものです。KCIのフィキシング方法論や公表権限を変更するものではありません。
1. バージョン管理された比較契約
モデルとその正確な改訂版、精度、量子化、ランタイムとそのバージョン、ベンチマークのプロトコルとそのバージョン、品質目標が一致している必要があります。推論ではさらに、入出力の長さ、バッチサイズ、同時実行数、キャッシュ、トークンの基準、レイテンシーの制約を固定します。トレーニングでは、データセットとその改訂版、作業の定義、完了基準を固定します。
GPUモデル、GPU数、ハードウェア、インターコネクト、並列化は、その契約内の結果ごとに異なっていてもかまいませんが、各結果は測定時の構成を保持している必要があります。V1の価格紐付けは単一ノードのみに対応しています。ハードウェア性能のスケーリングは推定しません。
2. 一つの計算式、明示的な単位
システム全体の時間あたりコストC、互換性のある合計スループットT(トークン/秒)の場合:
1MトークンあたりのUSD = C × 1,000,000 / (T × 3,600)
GPUあたりの時間単価には、測定されたGPU数を一度だけ掛けます。インスタンス全体の時間単価は、すでにシステム価格です。GPUあたりのスループットには測定されたGPU数を一度だけ掛け、合計スループットはそのまま使用します。比較契約によって、入力、出力、合計のどのトークンかが特定されます。
トレーニングの場合:定義された実行あたりのコスト = システムの時間あたりコスト × 測定された実行時間。経過時間を見積もるため、実行あたりのGPU-hoursを測定されたGPU数で割ります。これは会計上の見積もりであることを明示しています。繰り返し実行のシナリオでは、同一の実行を順番に行うことを前提とします。
3. 価格の互換性とコスト
公開されている価格の観測データが、測定された構成と掲載されている計算資源料金に正確に対応していることを、創業者が証明する必要があります。元のUSD建てのGPU/時間およびインスタンス時間の単位に対応しています。その他の通貨や単位は利用不可のままです。公開されているKCIの集計フィキシングを、購入可能なシステム価格の代わりに使用することはできません。
含まれるのは掲載されている計算資源料金のみです。セットアップ、別途請求されるCPU/RAM、ストレージ、ネットワーク/エグレス、税金、サポートは除外されます。基本スナップショットでは、最低コミット額、請求単位、稼働率の損失、在庫状況はモデル化されないため、実際の支出はこれより高くなる場合があります。これらはAPIのトークン価格や総コストの見積もりではありません。
4. 鮮度、レビュー、改訂
ベンチマークの観測データには、既存の180日間という性能データの鮮度上限が引き続き適用されます。Economics v1では、古い掲載価格の観測データを現在のコストとして示さないよう、30日間の価格の上限を適用しています。これらは適格性の期間であり、信頼度のスコアではありません。出典の区分は、プロバイダー申告、独立、内部のいずれかです。
インポートまたは取り込みによって下書きが作成され、明示的なレビューによって承認されます。取り下げや承認済みの置き換えがあると、新しい計算はブロックされます。変更不可のスナップショットには、元の入力、測定日、取得日、ベンチマークの改訂、グループのバージョン、計算式のバージョン、計算時刻が保存されます。出典を非公開にすると、保持されている内部記録を削除することなく、公開アクセスを取り除くことができます。
5. 履歴と意思決定ツール
経済性の履歴は参考用の台帳です。インデックスの水準ではなく、KCIのフィキシング履歴に自動的に挿入されることもありません。訂正は以前のスナップショットを参照します。構成、契約のバージョン、ベンチマークの改訂、計算式が変わると、別個のセグメントが設定されます。過去にさかのぼる補完は生成されません。
ユーザーの数量シナリオでは、選択したワークロードの条件が保持されます。時間は、持続的に測定されたスループット、または同一のトレーニングの繰り返し実行から見積もられます。商取引の詳細を確認するにはオファリングのリンクをたどり、追加の前提条件で計画するにはWorkload Economicsを開いてください。予約や調達の操作は一切行われません。
コストと期限のシナリオ
意思決定ワークスペースでは、明示的に選択した二つのスナップショットを、同じ契約、計算式、単位、コストの範囲で比較します。異なる商取引条件や出典の区分は開示されます。期限切れ、取り下げ、訂正済みの入力は、新しい比較の根拠にはなりません。
実稼働時間 = 指標単位あたりのスナップショット時間 × 要求単位数 経過時間 = 実稼働時間 / (稼働率(%) / 100) 請求時間 = max(経過時間, ユーザー指定の最低請求時間) 計算資源小計 = 請求時間 × システムの時間あたりUSD料金 モデル化された合計 = 計算資源小計 + 明示的に入力された追加のUSDコスト
各シナリオでは、測定された一つのシステムを使用し、アイドル時間中も課金されることを前提とします。最低請求時間はコストを変えますが、完了時間は変えません。空欄のままの追加コストは不明のままとなり、モデル化された合計は表示されません。期限の見積もりには、待ち時間、起動の遅延、キャパシティの制約は含まれません。契約上の義務の全体、入力されていない料金、プロバイダーの在庫状況は未検証のままです。この結果は、完全なTCOでも見積もりでもありません。
ダウンロード可能なシナリオのJSONには、正確なエビデンスのスナップショット、出典のタイムスタンプ、ユーザーの前提条件が保持されます。これはある時点のレポートであり、現時点での有効性を保証するものではありません。意思決定の前にエビデンスを更新してください。シナリオはアカウントに保存されません。
6. 読み取り専用のデータアクセス
GET /api/index/economics?limit=50&format=json GET /api/index/economics?group=GROUP_UUID&format=csv
制限:1–100件のスナップショット。デフォルトは50件。不明、重複、または不正な形式のパラメーターは拒否されます。レスポンスには、元の入力、単位、出典、タイムスタンプ、改訂、現在のステータス、理由コードが含まれます。読み取りでは公開範囲が適用され、レビュー担当者やメモは除外され、内部の実行台帳は公開されません。上限で打ち切られたレスポンスには、切り捨てを示すフラグが明示的に付きます。
観測時刻と計算時刻
APIのeffective_atフィールドには、元の価格の観測時刻が記録されます。calculated_atには、レビュー済みの入力が組み合わされた時刻が記録されます。後のベンチマークによって、それより前の価格日における経済性が確定することはありません。この台帳は、過去の性能をさかのぼって補完しません。