Metodología
Aquí está, campo por campo, de dónde sale cada número y qué tan lejos puede estar de la realidad. Si algo no se puede sostener, se dice.
Cuatro clases de dato
Todo número del sitio lleva una etiqueta:
- Verificado — copiado tal cual de una fuente oficial de acceso público. Se muestra con el nombre de la fuente, la fecha de consulta y un enlace al documento original.
- Verificado por OCR— misma fuente oficial que "verificado", pero el catálogo está escaneado (imagen, no texto): el número se leyó con reconocimiento óptico de caracteres en vez de copiarse directo del texto del documento. El OCR puede confundir caracteres parecidos (por ejemplo 8 y B, o 0 y O), así que lleva su propio badge en vez de mezclarse con "verificado" — para que sepas que ese número específico vale la pena confirmar contra el documento si te importa la precisión exacta.
- Estimado — calculado por nosotros a partir de supuestos. Es un cálculo teórico y puede tener error. Cada estimado enlaza a la sección de esta página que explica su fórmula.
- Manual — capturado o corregido a mano, normalmente porque la fuente traía un error evidente o porque la comunidad propuso una corrección y un administrador la aprobó.
Los estimados se muestran con toda la precisión que arroja el cálculo, sin redondeos cosméticos: la intención es dar el número más cercano posible a la realidad. Lo que los distingue de un dato verificado es la etiqueta, no una imprecisión artificial.
De dónde salen las fichas técnicas
Del Catálogo de rendimiento de combustible en vehículos ligeros de venta en México, que publica la Comisión Nacional para el Uso Eficiente de la Energía (CONUEE). De ahí vienen potencia, torque, cilindrada, número de cilindros, transmisión, relación de compresión, rendimiento en ciudad, carretera y combinado, y emisiones de CO₂.
La propia CONUEE advierte que esos valores se obtienen en pruebas de laboratorio, en condiciones controladas de altura, humedad, temperatura y viento, y que pueden no ser reproducibles en condiciones reales de manejo. Sirven para comparar autos entre sí, no para predecir cuánto va a rendir el tuyo.
Qué años están cubiertos y por qué
Hoy el sitio publica los años-modelo 2023 a 2026 con etiqueta verificado. Los catálogos de 2010 a 2022 existen y son públicos, pero sus tablas históricas están escaneadas (imagen, no texto) y el parser de texto devuelve cero filas. También revisamos si datos.gob.mx tenía esos años en formato de texto (CSV) aparte del PDF escaneado: no los tiene — su API sólo publica 2025 y 2026 para este catálogo.
Para incorporar 2010–2022 usamos OCR local de macOS. Cada candidato queda primero en la cola protegida de /admin/ocr, con su página, nivel de confianza y advertencias. Sólo después de una revisión humana se publica con la etiqueta verificado por OCR; no se publica directamente ni se presenta como "verificado" a secas.
Cómo se calculan las barras
La barra de cada característica representa el percentil del vehículo dentro del catálogo completo. Una barra llena al 80% significa que ese auto supera al 80% de las versiones registradas en esa característica.
No es “porcentaje del mejor de los tres que elegiste”. Esa forma, la más común en comparadores, sólo dice cuál de los tres gana y engaña cuando los tres son mediocres o los tres excelentes.
Detalles que cambian el resultado:
- Dirección. En rendimiento, más km/L es mejor. En emisiones, menos g/km es mejor. La barra se invierte en las métricas donde menos es mejor, para que estar llena siempre signifique estar bien.
- Empates. Se usa el rango medio: si muchas versiones comparten el mismo valor, todas quedan en el mismo punto y ninguna sale beneficiada por el orden en que se cargó.
- Huecos.Un dato faltante no cuenta como cero ni participa en la comparación. Se muestra como “sin dato”.
- Combustible y energía. km/L sólo se muestra cuando la fuente declara un rendimiento de combustible. El consumo eléctrico se guarda y muestra como kWh/100 kmcuando la fuente declara una unidad energética explícita; una cifra ambigua no se convierte por intuición y queda como “sin dato”. Un híbrido puede tener ambos campos. Cada dominio tiene sus propias métricas y distribuciones: nunca se compara energía contra km/L.
Cómo se obtiene el índice técnico
El índice que aparece en una comparación es un estimado: promedia las barras de las métricas disponibles para cada versión y lo expresa sobre 100. Potencia, torque, cilindrada, cilindros, combustible, energía y emisiones pesan igual cuando existen; por eso un híbrido con ambos campos aporta ambos datos. Las métricas ausentes no se convierten en cero.
Los campos sin dato se excluyen del promedio; nunca se convierten en cero. El ganador es la versión con el índice más alto usando el cálculo completo, sin redondear antes de decidir. El índice sirve para ordenar la evidencia, no sustituye tus prioridades de compra.
Por qué todavía no distinguimos Magna de Premium
El catálogo de la CONUEE reporta el combustible como “GASOLINA”, sin especificar si el motor requiere 87 o 91 octanos. Es un dato que importa mucho al bolsillo y que pensamos incorporar desde las fichas de cada fabricante. Mientras tanto preferimos dejarlo vacío antes que suponerlo.
Datos que decidimos no publicar
En los vehículos eléctricos, el catálogo rellena las columnas de cilindrada, relación de compresión y emisiones de CO₂ con marcadores de nota al pie (“1”, “NA”). No son mediciones. Guardarlos como si lo fueran haría creer, por ejemplo, que un auto eléctrico emite 1 g/km de CO₂. Esos campos se muestran como “sin dato”.
Precio de salida y precio actual
Son dos datos distintos. El precio de salida es el monto nominal publicado para ese año-modelo; el precio actual es la lista vigente en la fecha de captura. Cada uno se guarda con su momento, fecha de vigencia, fecha de consulta y enlace a una página oficial pública.
La captura se hace manualmente desde la fuente; no raspamos páginas de fabricantes ni copiamos sus fotografías o textos. Si no existe evidencia pública suficiente para una versión, se muestra sin dato. No convertimos el precio actual de otra versión en un precio de salida: esa equivalencia sería engañosa.
Cómo estimamos el precio de segunda mano
No usamos Libro Azul, Kavak, Mercado Libre ni auto-data.net. Por política de datos y por las condiciones de esos servicios no extraemos sus tabuladores ni anuncios. En vez de eso calculamos un rango propio, siempre marcado como estimado, a partir de un precio público de referencia (preferimos el de la versión exacta y, si no existe, el de otra versión del mismo modelo):
- Partimos del precio de referencia, lo llevamos a pesos actuales con el INPC de INEGI cuando existen ambos índices mensuales.
- Aplicamos una curva de depreciación compuesta por segmento:
valor = precio_salida × (1 − tasa)^edad, con un piso de valor residual (un auto usado real nunca vale $0). Las pickups deprecian menos que los subcompactos porque así se comportan en el mercado mexicano; los eléctricos se castigan un poco más por la incertidumbre de degradación de batería. - Publicamos un rango, no un punto: ±15% alrededor del valor central por defecto, porque el precio real depende de kilometraje, estado y plaza — cosas que no sabemos.
Sólo se muestra para versiones con al menos un año de antigüedad: si la versión es del año en curso, el rango de segunda mano coincidiría con el de salida y no aportaría nada nuevo.
Los coeficientes de cada segmento son un punto de partida razonado, no una medición, y se pueden consultar y ajustar desde el panel de administración conforme tengamos mejor información. Si el modelo todavía no está clasificado por segmento, se usa un coeficiente general.
Cómo separamos modelo y versión
El catálogo publica modelo y versión juntos en un solo texto (“FRONTIER DOBLE CABINA 4X2 MT”). Para poder agrupar, tomamos la primera palabra como modelo y conservamos la cadena completa como nombre de la versión. Es una heurística: acierta en la gran mayoría de los casos y falla en modelos de nombre compuesto. Las correcciones se hacen a mano y quedan marcadas como dato manual.
