エージェントが読んだファイルは、請求書に居座り続けます。リファクタリング1件で14.29ドルでした

Surya Pratap
By Surya Pratap

2026年9月2日

11分で読めます

AI・テクノロジー
コンテキスト税の仕組みをSonar自身の言葉で示した図。エージェントが読んだファイルは実行が終わるまで会話の文脈に居座り続ける、という説明の横に、個別のリファクタリングタスクで計測された中央値コストが並ぶ。Javaの変更が14.29ドルから9.38ドルへ下がり削減率34%と最大である一方、TypeScriptの変更は9.45ドルから8.89ドルへとしか動かず、最小の6%にとどまる仕組みと、メーターHover to explore
削減率はタスクの性質次第で6%から34%まで開きます。頭に入れる価値があるのは各矢印の左側の数字、つまりリファクタリングのコミット1件を実行する実際の費用です。

Sonarが今週、自社が売っている製品よりも有用なコスト計測を公開しました。

見出しは、セマンティックなコードナビゲーションによってコーディングエージェントが安くなる、というものです。それは事実で、効果の大きさは控えめかつタスク依存です。私が書き留めるのは基準値のほうです。オープンソースのJavaクラスに対する、振る舞いを変えないリファクタリング1件で、モデル費用14.29ドルでした。

スプリントではありません。機能でもありません。コミット1件です。

1. 何を、どれだけ丁寧に測ったのか

結果より先に方法論を評価すべきです。ベンダーのベンチマークとしては異例に厳格だからです。

Sonarの実験設定

実在のオープンソースプロジェクトから6件のリファクタリングコミット

  • プロジェクト:Apache Commons Collections、SQLAlchemy、TanStack Query、AssertJ、QuartzNET。
  • 言語:Java、Python、TypeScript、C#。
  • 基準エージェント:Claude Opus 4.8、高エフォート、サブエージェント有効。
  • 実行回数:タスクごとに片側10回。
  • 絞り込み条件コンパイルが通り、対象のテストに合格した場合にのみその実行を数える。

最後の一行が、残り全部を読む価値のあるものにしています。安いほうが失敗してよいコスト比較は、コスト比較ではありません。どれだけ速く誤ったものを作れるかの計測です。コンパイルとテストで絞り込むのは、Thinkingboxがトランスクリプトではなくデータベースを採点したのと同じ規律であり、いまなお名指しする価値があるほど珍しいものです。

2. 仕組み:読み取りではなく、居座り

この現象すべてを説明する一文が、Sonar自身の言葉にあります。

その地図を作るためにエージェントが読んだファイルは、実行が終わるまで会話の文脈に居座り続ける。

コストの議論のほとんどが取り違えるのがここです。高くつくのはファイルを読むことではありません。一度読まれたファイルが文脈に運ばれ、ループの以降のあらゆるターンで再課金されることです。

40ターンの実行の3ターン目で8ファイル読んだなら、支払ったのは8回の読み取りではありません。8ファイル×37ターンぶんです。

そしてエージェントがファイルを丸ごと読むのは構造的な理由からです。テキスト検索はシンボルがどこに現れるかは見つけられますが、「これは実際にどこで使われているのか」には答えられません。だからエージェントは候補を開いて確かめます。Sonarが作ったのは、コードの問い合わせ可能なグラフ(クラス、メソッド、フィールド、インターフェースとその関係)で、trace-callersget-type-hierarchyに直接答えます。結果として文脈に入るファイルが減ります。

なぜこれがMCPのツールカタログと同じ病なのか

MCPロードマップの記事では、費用の源はツールカタログでした。セッション開始時に、そのタスクが必要とするかどうかに関わらず、すべてのツール、説明、パラメータスキーマが文脈へ読み込まれ、次のタスクでもまた支払われる。ここではそれがソースファイルです。同じ病で、運び手が違うだけ。無条件に読み込まれた内容が、繰り返し課金される。治療法も同じです。読み込みを条件付きにし、必要になった時点でエージェントに取りに行かせることです。

3. タスク1件の実費

絶対値こそ創業者が向き合うべき部分です。自社の数字を測ったことのある人はほとんどいないからです。

Java・BloomFilterの自己型付け

14.29ドル → 9.38ドル
セット内でもっとも高いタスクであり、削減幅も最大の−34%。共有された抽象のすべての実装に対して、振る舞いを変えない同じ変更を繰り返す形——ナビゲーションが支配的になる作業の典型です。

C#・QuartzNETの戻り値型

10.20ドル → 8.11ドル
−20%。中央値のみの計測です。基準値に注目してください。コードベース全体の戻り値型を変えるのに10ドルです。

TypeScript・TanStackのmutation context

9.45ドル → 8.89ドル
−6%、本研究で最小の改善です。実行費用は高いのに、ナビゲーションを改善してもほとんど下がりません。高くしていた原因がナビゲーションではなかったからです。

Java・BloomFilterのパッケージ改名

1.86ドル → 1.40ドル
−25%。タスク間のばらつきがおよそ8倍あることの証拠であり、タスク単位の数字は——この数字を含めて——予算の根拠としては不適切だという注意でもあります。

トークンの動きは金額に追随しました。入力トークンは11〜31%減、出力トークンは4〜35%減です。

4. 「最大36%」は「わずか6%」でもある

この成果に付いたマーケティング上の数字は「最大36%安く」です。計測された範囲はおよそ**−6%から−34%**で、著者たちはその理由をはっきり書いています。

ナビゲーションが制約でないタスクでは、このナビゲーションエンジンは役に立たない。

さらに踏み込み、効果が出たのは「共有された抽象のすべての実装に対して繰り返される、振る舞いを変えない同じ小さな変更」であり、「効果は作業の種類に結びついているため、すべてのタスクで約束されるものではない」と述べています。

ベンダーの調査としては異例に誠実であり、嘲笑ではなく評価に値します。Sonarは解決策を売っているので枠組みは割り引くべきです。ただし彼らは、自社製品が6%しか出せなかったタスクを公開し、まったく効かない条件を名指しし、さらに自分たちのグラフが鮮度と引き換えにコンパイラに対する型解決の精度を譲っていることまで開示しました。ベンダーのベンチマークで、この3つのいずれかをやるものすら稀です。

5. エージェントで出荷しているなら、これが意味すること

削減率は教訓ではありません。教訓は、タスク単位のコストがいまや実在の数字であり、おそらくあなたは自社の数字を知らないということです。

完了したタスク1件あたりの費用

測る
月あたりのトークン数ではありません。チームが実際に走らせているタスクを5つ取り、最初のプロンプトからテストが通るまでのモデル費用をそれぞれ記録し、ばらつきを見てください。Sonarのタスクは1.71〜14.29ドル、同じ設定で8倍の開きです。あなたのほうがもっと広がります。

読み取りではなく、文脈への居座り

見張る
費用を生むのは取得したものではなく、文脈に残り続けるものです。早い段階でファイルを開き、最後まで手放さない長いループが高くつくパターンであり、実行が長引くほど悪化します。「後半のターンは安い」という直感の逆です。

自分が実際に抱えている制約

先に直す
タスクを高くしているのがナビゲーションでないなら、ナビゲーションツールが買えるのは6%です。解決策を買う前に、トークンがどこへ行っているかを見てください。この助言はこのカテゴリーのあらゆるツールに当てはまります。今回の製品も含めて。

昨日のMcKinseyの結果——32%の組織がコーディングエージェントで作るためにソフトウェアの購入を見送った——とも直接つながります。リファクタリング1件でモデル費用が10ドルかかるなら、「自分たちで作ればいい」という事業計画には、その判断の多くが持っていなかった費目が必要です。それで判断が誤りになるわけではありません。デモで見えるほど算数が自明ではなくなる、ということです。

6. 読みすぎないこと

6件は6件です。 実在プロジェクトの実在のリファクタリングであり、合成課題よりはるかに優れています。それでもこの規模の標本が支えるのは方向であって比率ではありません。誠実な主張は「この6件では、ナビゲーション負荷の高いリファクタリングが目に見えて安くなった」であって、「あなたの請求が3分の1減る」ではありません。

基準は高価な構成です。 高エフォートかつサブエージェント有効のOpus 4.8は、設計上コスト曲線の上端に近い位置にあります。上限を測るには正しい選択であり、同時に、これらのドル額はより安いモデルや小さなコードベースで出る数字ではないということでもあります。

費用だけが軸ではありません。 ファイルを読む量が少ない構成は安く、同時に情報が乏しい可能性もあります。コンパイルとテストの絞り込みはその最も粗い形からは守ってくれますが、その変更が良かったかどうかまでは教えてくれません。ビルドが通り、対象のテストが緑のままだった、というだけです。

率直なまとめ

Sonarは、実在のリファクタリングコミットをコーディングエージェントが完了させるのにいくらかかるかを、コンパイルとテスト合格を条件に計測し、その範囲を公開しました。高エフォートのフロンティア構成で、タスクあたり1.71〜14.29ドルです。セマンティックナビゲーションはそれを6%から34%削りました。ナビゲーションが律速だったかどうかに応じて、です。

製品を買わないとしても、この仕組みは持ち帰る価値があります。エージェントが読んだファイルは1回課金されるのではなく、実行が終わるまで毎ターン課金されます。 長いエージェントループが、こなした作業量に不釣り合いなほど高くつくのはそのためであり、MCPのツールカタログ問題とまったく同じ形です。

自社のタスクを5つ、端から端まで測ってください。興味深い数字は、誰かが売っている割引率ではありません。一度も見たことのない、自分の基準値のほうです。

出典: Sonar「Cut your coding agent's cost with semantic code navigation」 · Sonar Vortex 製品ページ · Sonar Vortex コンテキストのドキュメント · タスク別費用、トークンの増減、方法論、引用した留保はいずれも、計測対象のツールを販売するSonarの公表値です。読み解きと第6節の注意は筆者によるものです。

IdeaToMVP Academy

Want to build with AI — not just read about it?

4-week live cohort for founders. Learn to ship AI agents, scope MVPs, and automate your business — taught by the same team that writes these guides.

Explore the Academy →
Share this post :