비교 가능한 작업. 명시적 가정.
KCI 경제성 v1은 검토된 벤치마크와 호환되는 원래 USD 컴퓨팅 가격을 바탕으로 한, 참고용이며 재현 가능한 변환입니다. KCI 픽싱 방법론이나 게시 권한을 변경하지 않습니다.
1. 버전 관리되는 비교 계약
모델과 정확한 개정판, 정밀도, 양자화, 런타임과 버전, 벤치마크 프로토콜과 버전, 품질 목표가 일치해야 합니다. 추론의 경우 입력/출력 길이, 배치 크기, 동시성, 캐싱, 토큰 기준, 지연 시간 제약도 고정합니다. 학습의 경우 데이터 세트/개정판, 작업 정의, 완료 기준을 고정합니다.
GPU 모델, GPU 수, 하드웨어, 인터커넥트, 병렬화 방식은 해당 계약 내 결과마다 다를 수 있지만, 각 결과는 측정된 구성을 유지해야 합니다. V1 가격 연결은 단일 노드만 지원합니다. 하드웨어 성능 스케일링은 추론하지 않습니다.
2. 하나의 공식, 명시적 단위
시스템 전체 시간당 비용 C와 호환되는 집계 처리량 T(토큰/초)에 대해:
토큰 1M개당 USD = C × 1,000,000 / (T × 3,600)
GPU당 시간당 가격에는 측정된 GPU 수를 한 번 곱합니다. 인스턴스 전체 시간당 가격은 이미 시스템 가격입니다. GPU당 처리량에는 측정된 GPU 수를 한 번 곱하고, 집계 처리량은 그대로 사용합니다. 비교 계약은 입력, 출력, 전체 토큰 중 무엇인지 명시합니다.
학습의 경우: 정의된 실행당 비용 = 시스템 시간당 비용 × 측정된 실행 시간. 실행당 GPU-hour를 측정된 GPU 수로 나누어 경과 시간을 추정하며, 이는 회계상 추정치로 명시됩니다. 반복 실행 시나리오는 동일한 실행이 순차적으로 진행된다고 가정합니다.
3. 가격 호환성 및 비용
공개 가격 관측값이 측정된 구성과 게시된 컴퓨팅 요금을 정확히 포괄한다는 사실을 창립자가 증명해야 합니다. 원래 USD GPU/시간 및 인스턴스-시간 단위를 지원합니다. 다른 통화와 단위는 이용 불가로 남습니다. 공개 KCI 집계 픽싱은 구매 가능한 시스템 가격을 대신할 수 없습니다.
게시된 컴퓨팅 요금만 포함합니다. 설정, 별도 청구되는 CPU/RAM, 스토리지, 네트워킹/아웃바운드 전송, 세금, 지원은 제외됩니다. 기본 스냅샷은 최소 약정, 청구 단위, 활용률 손실, 가용성을 모델링하지 않으므로 실제 지출은 더 높을 수 있습니다. 이는 API 토큰 가격이나 총비용 추정치가 아닙니다.
4. 최신성, 검토 및 개정
벤치마크 관측값은 기존의 180일 성능 최신성 상한을 유지합니다. 경제성 v1은 오래된 정가 관측값이 현재 비용으로 표시되지 않도록 30일 가격 상한을 적용합니다. 이는 적격성 기간이며 신뢰도 점수가 아닙니다. 출처 분류는 제공업체 신고, 독립, 내부입니다.
가져오기 또는 수집으로 초안이 생성되며, 명시적 검토를 통해 승인됩니다. 철회와 승인된 대체는 새 계산을 차단합니다. 변경 불가능한 스냅샷은 원래 입력값, 측정 날짜, 취득 날짜, 벤치마크 개정판, 그룹 버전, 공식 버전, 계산 시각을 보존합니다. 출처 게시를 취소하면 보존된 내부 기록을 삭제하지 않고도 공개 접근을 제거할 수 있습니다.
5. 이력 및 의사 결정 도구
경제성 이력은 참고용 원장입니다. 지수 수준이 아니며 KCI 픽싱 이력에 자동으로 삽입되지 않습니다. 정정은 이전 스냅샷을 참조합니다. 구성, 계약 버전, 벤치마크 개정판, 공식이 바뀌면 별도의 구간이 만들어집니다. 과거 소급 데이터는 생성하지 않습니다.
사용자 물량 시나리오는 선택한 워크로드 조건을 유지합니다. 시간은 지속적으로 측정된 처리량이나 동일한 학습 실행의 반복을 바탕으로 추정합니다. 상업적 세부 사항은 상품 링크에서 확인하거나, 추가 가정으로 계획하려면 Workload Economics를 여세요. 예약이나 조달 작업은 수행되지 않습니다.
비용 및 기한 시나리오
의사 결정 워크스페이스는 명시적으로 선택한 두 스냅샷을 같은 계약, 공식, 단위, 비용 범위에서 비교합니다. 서로 다른 상업 조건과 출처 분류는 공개됩니다. 만료, 철회, 정정된 입력값은 새 비교의 근거가 될 수 없습니다.
생산 시간 = 지표 단위당 스냅샷 시간 × 요청 단위 경과 시간 = 생산 시간 / (활용률 퍼센트 / 100) 청구 시간 = max(경과 시간, 사용자 최소 청구 시간) 컴퓨팅 소계 = 청구 시간 × 시스템 시간당 USD 요금 모델링 합계 = 컴퓨팅 소계 + 명시적으로 입력한 추가 USD 비용
각 시나리오는 측정된 시스템 하나를 사용하며 유휴 시간에도 요금이 청구된다고 가정합니다. 최소 청구 기준은 완료 시간이 아니라 비용을 바꿉니다. 비워 둔 추가 비용은 알 수 없음으로 남으며, 이 경우 모델링 합계는 표시되지 않습니다. 기한 추정에는 대기열, 시작 지연, 용량 제약이 포함되지 않습니다. 전체 계약상 의무, 입력하지 않은 요금, 제공업체 가용성은 검증되지 않은 상태로 남습니다. 결과는 전체 TCO도, 견적도 아닙니다.
다운로드 가능한 시나리오 JSON에는 정확한 근거 스냅샷, 출처 타임스탬프, 사용자 가정이 담깁니다. 특정 시점의 보고서이며 현재 유효성을 보장하지 않습니다. 결정하기 전에 근거를 새로 고치세요. 시나리오는 계정에 저장되지 않습니다.
6. 읽기 전용 데이터 접근
GET /api/index/economics?limit=50&format=json GET /api/index/economics?group=GROUP_UUID&format=csv
제한: 스냅샷 1–100개, 기본값 50. 알 수 없거나, 중복되거나, 형식이 잘못된 매개변수는 거부됩니다. 응답에는 원래 입력값, 단위, 출처, 타임스탬프, 개정판, 현재 상태, 사유 코드가 포함됩니다. 읽기 요청에는 공개 범위 제한이 적용되어 검토자/메모는 제외되며, 내부 실행 원장은 노출되지 않습니다. 제한된 응답에는 잘림 여부가 명시적으로 표시됩니다.
관측 및 계산 시각
API의 effective_at 필드는 원래 가격 관측 시각을 기록합니다. calculated_at은 검토된 입력값이 결합된 시각을 기록합니다. 나중의 벤치마크가 이전 가격 날짜의 경제성을 성립시키지는 않으며, 이 원장은 과거 성능을 소급해 채우지 않습니다.