ベンチマークレポート
87 件の対応バグ修正ケースにおける Codna 対 Cursor の手法と結果。
Cursor との 87 件の対応ケースで、Codna はトークンを 5 分の 1 に抑え、1.7 倍速く動作しました。両者とも 87 件中 87 件の修正を検証。Codna の修正あたりモデル費用は平均約 $0.02 でした。
ケースごとの総トークン数、実時間、モデル費用、検証済み修正を、同一チェックアウト上で実行した 87 件の対応ケースで平均したものです。
Codna はモデルなし・トークンゼロでリポジトリをマップし、Issue に絞ったエビデンスバンドルをエージェントに渡します。毎回の実行で「生のサイズ→バンドル」の比率を表示します。
リポジトリマップはインポートパターンから構築されるため、特定の言語に縛られません。codna impact は diff を影響しうるテストに絞り込みます。オンデバイスリコールは Python、JavaScript、TypeScript、Go、Rust、Java、C、C++、C#、PHP、Ruby に対応します。
Codna は依存関係と影響範囲のグラフで対象コードを特定し、エビデンスバンドルから修正して、根本原因、確信度、影響範囲、回帰リスクを報告します。GitHub では自らを説明するプルリクエストを開きます。マージはあなたが行います。
理解はあなたのマシン上で行われます。モデルプロバイダーに届くのはエビデンスバンドルまたは diff だけで、あなたのキーで送られます。codna.yaml で privacy.egress を fail-closed に設定すると、Codna はカーネルレベルのネットワーク遮断の下でのみテストを実行します。