Trabajo comparable. Supuestos explícitos.
KCI Economics v1 es una transformación informativa y reproducible de un benchmark revisado y de un precio original compatible en USD de la capacidad de cómputo. No modifica la metodología de fixing del KCI ni la autoridad de publicación.
1. Un contrato de comparación con versión
El modelo y su revisión exacta, la precisión, la cuantización, el entorno de ejecución y su versión, el protocolo del benchmark y su versión, y el objetivo de calidad deben coincidir. La inferencia fija además las longitudes de entrada/salida, el tamaño del lote, la concurrencia, el almacenamiento en caché, la base de tokens y la restricción de latencia. El entrenamiento fija el conjunto de datos y su revisión, la definición del trabajo y el criterio de finalización.
El modelo de GPU, el número de GPU, el hardware, la interconexión y el paralelismo pueden variar entre resultados dentro de ese contrato, pero cada resultado debe conservar su configuración medida. En V1, la vinculación de precios admite un solo nodo. No se infiere ningún escalado del rendimiento del hardware.
2. Una fórmula, unidades explícitas
Para un costo horario del sistema completo C y un rendimiento agregado compatible T en tokens/segundo:
USD por 1M de tokens = C × 1,000,000 / (T × 3,600)
Un precio horario por GPU se multiplica una sola vez por el número de GPU medido. Un precio horario de la instancia completa ya es un precio de sistema. El rendimiento por GPU se multiplica una sola vez por el número de GPU medido; el rendimiento agregado se usa directamente. El contrato de comparación indica si se trata de tokens de entrada, de salida o totales.
Para el entrenamiento: costo por ejecución definida = costo horario del sistema × horas de ejecución medidas. Las GPU-hour por ejecución se dividen entre el número de GPU medido para estimar las horas transcurridas, indicadas explícitamente como una estimación contable. Los escenarios de ejecuciones repetidas suponen ejecuciones idénticas en secuencia.
3. Compatibilidad de precios y costos
Un fundador debe atestiguar que la observación pública de precios abarca exactamente la configuración medida y el cargo listado por la capacidad de cómputo. Se admiten las unidades originales en USD por GPU/hora y por hora de instancia. Las demás monedas y unidades siguen no disponibles. Un fixing agregado público del KCI no puede sustituir el precio de un sistema adquirible.
Solo se incluye el cargo listado por la capacidad de cómputo. Quedan excluidos la configuración inicial, la CPU/RAM facturada por separado, el almacenamiento, las redes/egress, los impuestos y el soporte. Las instantáneas base no modelan mínimos de compromiso, incrementos de facturación, pérdidas de utilización ni disponibilidad; el gasto efectivo puede ser mayor. No son precios de tokens de API ni estimaciones del costo total.
4. Frescura, revisión y revisiones
Las observaciones de benchmark mantienen el tope de frescura del rendimiento ya existente, de 180 días. Economics v1 aplica un tope de 30 días al precio para evitar presentar observaciones de lista antiguas como costos actuales. Son ventanas de elegibilidad, no puntuaciones de confianza. Las clases de fuente son: declarada por el proveedor, independiente o interna.
La importación o la captura crea un borrador; una revisión explícita lo aprueba. La retirada y la sustitución aprobada bloquean los nuevos cálculos. Las instantáneas inmutables conservan los datos de entrada originales, las fechas de medición, las fechas de adquisición, las revisiones del benchmark, las versiones de los grupos, la versión de la fórmula y el momento del cálculo. La despublicación de una fuente puede retirar el acceso público sin eliminar el registro interno conservado.
5. Historial y herramientas de decisión
El historial de la economía es un registro informativo. No es un nivel del Index y no se inserta automáticamente en el historial de fixings del KCI. Las correcciones remiten a instantáneas anteriores. Los cambios de configuración, de versión del contrato, de revisión del benchmark o de fórmula establecen segmentos separados. No se genera ninguna reconstrucción retroactiva del historial.
Los escenarios de volumen del usuario conservan las condiciones de la carga de trabajo seleccionada. El tiempo se estima a partir del rendimiento medido sostenido o de ejecuciones de entrenamiento idénticas repetidas. Sigue el enlace de la oferta para examinar los detalles comerciales o abre Workload Economics para planificar con supuestos adicionales. No se realiza ninguna acción de reserva ni de adquisición.
Escenarios de costo y de fecha límite
El espacio de trabajo de decisión compara dos instantáneas elegidas explícitamente, con el mismo contrato, la misma fórmula, las mismas unidades y la misma cobertura de costos. Cuando las condiciones comerciales o las clases de fuente son distintas, se indican. Los datos de entrada caducados, retirados o corregidos no pueden respaldar una nueva comparación.
Horas productivas = horas de la instantánea por unidad de métrica × unidades solicitadas Horas transcurridas = horas productivas / (porcentaje de utilización / 100) Horas facturadas = max(horas transcurridas, horas mínimas facturadas indicadas por el usuario) Subtotal de cómputo = horas facturadas × cargo horario del sistema en USD Total modelado = subtotal de cómputo + costos adicionales en USD indicados explícitamente
Cada escenario usa un único sistema medido y supone que se factura también durante los tiempos de inactividad. El mínimo de facturación cambia el costo, no el tiempo de finalización. Los costos adicionales que se dejan en blanco siguen siendo desconocidos; no se muestra ningún total modelado. Una estimación de fecha límite excluye las colas, los retrasos de inicio y las restricciones de capacidad. Las obligaciones contractuales completas, los cargos no indicados y la disponibilidad del proveedor siguen sin verificar. El resultado no es un TCO completo ni una cotización.
El JSON descargable del escenario conserva las instantáneas exactas de la evidencia, las marcas de tiempo de las fuentes y los supuestos del usuario. Es un informe de un momento concreto, no una garantía de validez actual. Actualiza la evidencia antes de decidir. Los escenarios no se guardan en una cuenta.
6. Acceso a los datos de solo lectura
GET /api/index/economics?limit=50&format=json GET /api/index/economics?group=GROUP_UUID&format=csv
Límites: 1–100 instantáneas; valor predeterminado: 50. Los parámetros desconocidos, duplicados o mal formados se rechazan. Las respuestas incluyen los datos de entrada originales, las unidades, las fuentes, las marcas de tiempo, las revisiones, el estado actual y los códigos de motivo. Las lecturas aplican la visibilidad pública, excluyen a los autores y las notas de la revisión y no exponen el registro interno de ejecuciones. Las respuestas acotadas indican explícitamente el truncamiento.
Momentos de observación y de cálculo
El campo effective_at de la API registra el momento de la observación del precio original. calculated_at registra cuándo se combinaron los datos de entrada revisados. Un benchmark posterior no establece la economía en una fecha de precio anterior; este registro no reconstruye retroactivamente el rendimiento histórico.