La unidad correcta es el modelo
ChatGPT, Claude o Gemini son productos que pueden cambiar de modelo según el plan, la fecha y la herramienta usada. Una comparativa reproducible conserva el ID de API, el canal, la versión y la fecha de consulta.
La ficha también debe guardar contexto, modalidades, precio, herramientas, licencia y disponibilidad. Si falta un campo, es mejor mostrar la limitación que rellenarlo con una estimación.
Separa las señales
Las especificaciones vienen del proveedor; los benchmarks miden tareas estandarizadas; los votos capturan preferencia; las pruebas propias miden un flujo concreto. Un ranking puede mostrar las cuatro capas sin convertirlas en una falsa cifra universal.
El coste debe calcularse por tarea: tokens de entrada, tokens de salida, caché, llamadas a herramientas, reintentos y revisión. El precio por millón es sólo el comienzo.
Cómo leer una página de versus
Comprueba la fecha del corte, los modelos exactos, las fuentes enlazadas y los criterios de decisión. En comparaciones de tres o cuatro modelos, la demanda de la combinación debe justificar la página para no crear URLs sin utilidad.
Si la evidencia es insuficiente, la conclusión correcta es «no concluyente». Esa neutralidad protege al lector y hace que una actualización futura pueda cambiar el resultado sin reescribir la historia.
Siguiente paso