Benchmarks

Más rápido. Más barato. Verificado.

87 casos emparejados de corrección de errores en checkouts idénticos, Codna frente a Cursor. Codna verificó 87 de 87 a unos 0,02 $ por corrección, con 5× menos tokens y 1,7× más rápido.

MétricaCodnaCursor
Correcciones verificadas87 / 8787 / 87
Casos emparejados8787
Tiempo promedio13.39s22.57s
Tokens promedio por corrección16,15980,971
Coste de modelo promedio por corrección$0.021n/d
Comprensión del repo0 tokensContexto del modelo
5×menos tokens que Cursor por corrección: 16.159 frente a 80.971.
1.7×más rápido que Cursor por corrección: 13,39 s frente a 22,57 s.
$0.02por corrección verificada de media: 0,021 $ en 87 casos.

Metodología

Errores reales. Repos reales. Casos emparejados.

Cada caso corrió en un checkout idéntico para ambos agentes. Un caso cuenta solo cuando la corrección se verificó. La tabla muestra promedios de los 87 casos emparejados.

87

Casos emparejados

Los mismos 87 casos de corrección corrieron frente a ambos agentes en checkouts idénticos.

16.2K

Tokens promedio por corrección

Codna promedió 16.159 tokens totales por corrección. Cursor promedió 80.971.

13.4s

Tiempo promedio

Codna promedió 13,39 segundos por corrección. Cursor promedió 22,57 segundos.

$0.02

Por corrección verificada

Codna promedió 0,021 $ de gasto en modelo por corrección verificada.

Promedios de 87 casos emparejados de corrección de errores en checkouts idénticos. Un caso cuenta solo cuando la corrección se verificó. Descargar el resumen (JSON) →

Preguntas frecuentes

Codna corrió cara a cara frente a Cursor en 87 casos emparejados de corrección de errores, cada uno en un checkout idéntico. Se registraron y promediaron los tokens totales, el tiempo y el coste de modelo por caso.

Un caso cuenta solo cuando la corrección se verificó. Codna verificó 87 de 87. Cursor verificó 87 de 87.

16.159 tokens totales por corrección de media, frente a 80.971 de Cursor. Codna también imprime el tamaño de contexto bruto-a-paquete en cada ejecución, así puedes ver el número en tu propio repo.

Codna mapea el grafo de dependencias y radio de impacto sin modelo, por cero tokens. El agente recibe solo la evidencia relevante, así que hay menos que leer antes de producir una corrección.

0,021 $ de gasto en modelo por corrección verificada de media en los 87 casos. Con tu propia clave pagas a tu proveedor directamente.

Codna funciona con tu propia clave, así que eliges el modelo para tus ejecuciones. Configura el proveedor con codna key set o pasa --model proveedor/modelo. El planificador por defecto es repository.verified_agentic_v1.

Compruébalo en tu repo.

codna fix . --issue "the failing test"