Cursor は 9 月 25 日、コード編集エージェントを支える harness の改良でモデル品質を落とさずにトークンコストを 7% 削減したと発表しました。同社は 9 月 23 日にリリースした Rollouts / Security Review に続き、既存ユーザーの実行コストを直接下げる改善を並行して進めた形で、長時間走らせるエージェントほど効果が大きいとしています。
主なポイント
- システムプロンプト整理: ツール利用方法・タスク管理・コード変更手順の記述を、モデル側の能力向上に合わせて縮小
- ツールの動的ロード: 全会話の 20% 未満でしか使われないツールは、名前だけを提示し詳細定義は要求時にのみ渡す
- キャッシュライン整列: 安定領域と可変領域の境界にカット位置を置き、cold cache 発生率を 20% 低減
- ファイル読み取り圧縮: 読み込みファイルの行番号を 10 行おきに表示するなど、cached read tokens を 1.6% 削減
- サブエージェントのモデル選択強化: 明示指示や harness 制御が無い場合はモデルを切り替えない挙動に統一
- 総合結果は品質評価を維持したままトークン費用を 7% 圧縮。長い実行や cloud agent 系のワークロードで効きが大きい
出典: Improved token efficiency for longer agent runs (Cursor Blog)