shiichan

AGENTS.md に数行足すだけ!Codex のコードレビュー精度が 58.3%から 98%に爆上がり!

こんにちは、しぃちゃんだよ!

OpenAI Developers developers.openai.com

今日は Codex のコードレビュー機能がぐっと賢くなったニュースを見つけたから、さっそく紹介しちゃうね!

なにが発表されたの?

OpenAI Developers のブログで、Codex の Code Review 機能が AGENTS.md ファイルに書いたカスタムリポジトリルールに対応したことが発表されたよ。開発者ブログらしく、内部の実例や評価指標までしっかり書かれている技術寄りの内容なの。

チームが繰り返し指摘してしまう問題——API の互換性、データ保護、命名規則みたいな「あるある違反」——を Codex が自動で検出して、関連するルールを引用しながらガイダンスを出してくれるようになったんだって。

今までどうだったの?

これまでの Code Review は汎用的な観点でのチェックが中心で、そのリポジトリやチーム特有の「暗黙のお作法」までは拾いきれなかったみたい。レビュアーが同じ指摘を何度も繰り返し説明する、っていう状況があったんだね。

OpenAI 社内でも Q4 以降、週次の PR 量が 2 倍以上に増えているらしくて、レビューの負荷が上がっている中でこの仕組みが求められていたみたい。

これで何が変わるの?

AGENTS.md にルールを書いておくと、Code Review が該当する変更を見つけて、関連ルールを引用しながら指摘してくれるようになるの。しかもリポジトリ全体に効くルールはルートの AGENTS.md に、サービス固有のルールはネストした AGENTS.md に置き分けられるから、スコープを絞った運用ができるんだよ。

これで「毎回同じことをコメントで説明する」レビュアーの負担が減るし、レビューされる側も何を気をつければいいかが事前に明文化されるから、双方にとって嬉しい変化だね。

深く潜ってみよう

記事では実際に Codex 自身のリポジトリで使われている例が紹介されているよ。rawResponseItem/* という通知名は Codex Cloud 側の消費者がすでに依存しているから、実験的な機能であってもリネームすると破壊的変更になっちゃうの。そこで、こんなルールを AGENTS.md に書いておくんだって。

## Code Review Rules
### Breaking changes
Search for breaking changes in external integration surfaces:
- raw response item events (`rawResponseItem/*`), even while experimental

ルールの効果は次の 4 つの観点で評価されているよ。

  • Coverage(カバレッジ): ルール違反をちゃんと検出できるか
  • Restraint(抑制): 問題ない変更まで誤検出しないか
  • Retention(保持): これまで通りの一般的なバグ検出能力が落ちていないか
  • Actionability(実行可能性): 指摘のたびに関連ガイダンスが明確に示されるか

この評価で、ルールを使った場合は必要な検出の 98%を回収できて、ルールなしのベースライン(58.3%)から大きく改善したそうだよ。

ルールの書き方についても 3 つのコツが紹介されているの。

  • レビュアーが何度も説明している「重要で非自明な不変条件」から書き始める
  • ルールは関係するコードにスコープを絞る(リポジトリ全体はルートに、サービス固有はネストした AGENTS.md に)
  • 守るべき不変条件と、その代わりに使える安全な選択肢をセットで明記する

導入手順としては、まず繰り返し出てくる指摘を洗い出して、2〜3 個のルールを AGENTS.md に追加し、代表的な PR でテストしながら精度を検証・改善していく流れがおすすめされているよ。

まとめ

  • Codex の Code Review が AGENTS.md 経由のカスタムリポジトリルールに対応したよ
  • API 互換性やデータ保護、命名規則みたいな「あるある違反」を自動検出できるようになったの
  • ルール適用で検出率が 58.3%から 98%まで向上したんだって
  • ルールはリポジトリ全体用をルートに、サービス固有用はネストした AGENTS.md に置くのがコツだよ

Codex をチームのコードレビューに使っているエンジニアさんには、特に刺さるアップデートだと思うよ!