「Claude Code と Codex、結局どちらを組織に入れるべきか」。この 1〜2 年で最も相談を受けるテーマの 1 つです。速度と料金だけを比較した記事は数多く出ていますが、組織で長く運用する視点、特にセキュリティ・失敗リカバリのコスト・法令対応、といった観点まで含めて整理した資料はまだ多くありません。本記事は、AI 駆動開発のクリエイティブスタジオとして両ツールを実プロジェクトで使い分けている観点から、2026 年 9 月時点の公式ドキュメントをもとに実務比較を整理したガイドです。

結論: 単発の速度比較ではなく「組織 × リスク × 導入」で選ぶ

先に結論を書きます。Claude Code と Codex の選択は、単発タスクの速度や月額料金の比較で決めるべきではありません。この 2 つのツールは実行環境とデータ管理の前提が異なり、組織で長く運用する場合の総所有コストはむしろデータ保持ポリシー、失敗リカバリ、Enterprise ガバナンス、といった要素で決まります。

判断の起点は次の 3 つです。1 つ目は「コードとプロンプトが誰の手元でどれくらいの期間残るか」。2 つ目は「AI が生成したコードの品質を担保するために組織が払うレビュー・テストコスト」。3 つ目は「ガバナンス要件 (監査ログ、権限管理、データレジデンシー) を組織側でどこまで求められているか」です。これらを分解せず「速いから」「安いから」で決めると、6 ヶ月〜1 年後に契約更改や監査対応で見えないコストが顕在化します。

注意

Anthropic は Claude Fable 5・Fable 5.1・Mythos 5・Mythos 5.1 を 30 日間のデータ保持が前提のモデル (Covered Models) に指定しています。ZDR (Zero Data Retention) の組織では、Anthropic が明示的に許可した場合を除いてこれらのモデルを使えません。保持ゼロを法令や社内規程で求められる案件では、使うモデルと保持の扱いを契約前に Anthropic へ確認してください。

本記事では、まず両ツールの実行環境の差を整理し、そのうえでセキュリティとデータ保持、カスタマイズ性、単発性能、失敗リカバリコスト、チームサイズ別の適合、Enterprise 対応、費用試算、と順に掘り下げます。AI コーディングツール一般の選び方の総論は AI 開発ツールの選び方 に、Cursor・Copilot も含めた 3 者比較は Claude Code・Cursor・GitHub Copilot を実務比較 にまとめています。

前提: 2026 年 9 月時点の両ツールの立ち位置

まずベースラインを揃えます。2026 年 9 月 29 日時点で、両ツールの公式ドキュメントと料金ページの記載は次のとおりです。

項目Claude CodeCodex
実行環境ローカル実行が基本。クラウドセッション (Claude Code on the web) もあるローカル (CLI・IDE 拡張・デスクトップアプリ) と Codex cloud
主なモデルClaude Opus 5.5 / Sonnet 5.5 / Fable 5.1 (Mythos 5.1 は審査を経た米国組織に限定)GPT-6 Astra / GPT-6 Sol・Luna (GPT-5.6 Sol・Terra・Luna も移行期間中は利用可)
個人料金Pro $20 / Max $100〜ChatGPT Go $8 / Plus $20 / Pro $100〜
法人契約Team (Standard 席は年払いで月 $20、月払いで $25) / EnterpriseBusiness (年払いで月 $20、月払いで $25) / Enterprise・Edu (見積もり)
主要な設定ファイルCLAUDE.md (v2.1.277 以降は AGENTS.md も)、settings.json、フック (33 種類のイベント)AGENTS.md、config.toml (承認ポリシー・サンドボックスモード)、hooks.json
接続先の選択Anthropic API / Claude Platform on AWS / Amazon Bedrock / Google Cloud's Agent Platform / Microsoft FoundryChatGPT サインイン / API キー / Amazon Bedrock などのプロバイダー設定

Claude Code はターミナルで動くエージェントで、CLAUDE.md (v2.1.277 以降は AGENTS.md も) でプロジェクト固有のルールを、settings.json でモデル選択や権限を定め、フックで実行前後のイベントに介入できます。Codex は CLI やデスクトップアプリでのローカル実行に加えて Codex cloud でのクラウド実行が使え、AGENTS.md で組織ルールを明文化し、サブエージェントで並列作業ができます。

ただし Amazon Bedrock・Google Cloud's Agent Platform・Microsoft Foundry 経由で AGENTS.md を直接読むには、v2.1.281 以降が必要です。両方を読む設定や既存 import の扱いは、AGENTS.md の読み込み条件と移行手順 に整理しています。

どちらも 2026 年に入って更新頻度が上がっており、使えるモデルの顔ぶれは数ヶ月で入れ替わります。Codex では ChatGPT でサインインした場合の GPT-5.4 と GPT-5.4 mini の提供が 2026 年 8 月 31 日に終わり、GPT-5.5 も 10 月 14 日に終了予定です。これは Codex (ChatGPT サインイン) 側の日程で、GitHub Copilot の GPT-5.5 は 10 月 19 日に廃止されます。本記事の比較は 2026 年 9 月時点の情報を前提としています。

実行環境の差: ローカル実行とクラウド実行の意味

両ツールで最初に確認すべき差は、コードとコマンドがどこで実行されるかです。

Claude Code はローカル実行が基本で、CLI プロセスは自機のシェルとファイルシステムで動きます。プロジェクトのソースコード、コミット履歴、ローカル環境変数、社内 VPN 経由でしかアクセスできない依存パッケージ、といった要素にそのままアクセスできる利点があります。ネットワークに出るのはモデルへのリクエストが中心で、プロンプトと必要な文脈が送信されます。Anthropic 側で動くクラウドセッションもありますが、セッションデータをサーバー側に保存するため、Claude for Enterprise で ZDR を有効にした組織では使えません。

Codex はローカル実行と Codex cloud の両方が使えます。Codex cloud は OpenAI 側で管理される環境にリポジトリを展開してタスクを走らせる仕組みで、大規模リファクタリングや並列テスト実行で威力を発揮します。Codex cloud を使うには ChatGPT でのサインインが必要です。リポジトリのコード自体がクラウド側に載る運用になるため、そもそも社外に置けないコードベースを扱う組織では、Codex cloud は選択肢に入りません。

FIXITFIXIT

クラウドで動かした方が速いなら、それでいいじゃないの?

速さと引き換えに、リポジトリが提供元のインフラに載ります。

TsukasaTsukasa

法務・情報セキュリティの合意が済んでいるなら選択肢になりますが、金融や医療の案件では、契約段階でここが引っかかることが多いです。

FIXITFIXIT

じゃあ、両方使い分けるって発想もアリなんだね。

TsukasaTsukasa

はい。日常の実装は Claude Code、大規模並列は Codex、といった分担は実務で成立します。

セキュリティとデータ保持: ここが最大の判断軸

多くの比較記事が触れていないのがデータ保持と ZDR の実態です。組織で長く運用するには、この節が最重要になります。

Claude Code と 30 日保持が前提のモデル

Team・Enterprise プランと API の商用利用では、Claude Code に送ったデータは学習に使われず、Anthropic 側の保持は標準で 30 日です。ZDR は通常の Enterprise プランにも含まれず、Anthropic が組織ごとに適格性を確認して個別に有効にします。Claude API のドキュメントは、Claude Code に ZDR が適用される経路として、ZDR の取り決めがある商用組織の従量課金 API キーと、ZDR を有効にした Claude for Enterprise の 2 つを挙げています。Claude Code のドキュメントが案内しているのは後者です。ZDR が有効な Claude Code では、ターミナルから送ったプロンプトと応答を Anthropic が保持しません。Free・Pro・Max・Team の各プランは ZDR の対象外です。

ただし、ZDR でもすべてのモデルが使えるわけではありません。Anthropic は Claude Fable 5 と Claude Mythos 5 を 2026 年 6 月 9 日に、Claude Fable 5.1 と Claude Mythos 5.1 を 2026 年 8 月 31 日に Covered Models へ指定しました。これらはプロンプトと出力を少なくとも 30 日保持したうえで自動削除する扱いで、ZDR の組織では Anthropic が明示的に許可した場合を除いて使えません。この扱いは Claude のアプリ、Claude Platform、Amazon Bedrock、Google Cloud's Agent Platform、Microsoft Foundry のいずれにも及びます。

実務への影響は次のとおりです。

  • Covered Models に含まれない Opus 5.5 などは、ZDR のまま Claude Code で使える
  • Claude API の ZDR の取り決めがある組織が Fable を使いたい場合は、特定のワークスペースだけ 30 日保持を有効にし、他のワークスペースは ZDR のまま残す構成が取れる
  • 2026 年 9 月 1 日の発表では、Enterprise Frontier Safeguards (EFS) の準備が整うまで、対象となる顧客に Fable 5 と Fable 5.1 の ZDR を提供するとしている。全顧客への自動適用ではない
  • Amazon Bedrock や Google Cloud's Agent Platform 経由では、保持されたデータはそれぞれのクラウド環境内に留まる。保持の扱いは各クラウドのドキュメントで確認する

加えて、ZDR が有効な Claude for Enterprise の Claude Code では、クラウドセッション、Remote Control、フィードバック送信などサーバー側に会話を保存する機能が使えなくなります。契約前に、使いたいモデルと機能が ZDR の条件で使えるかを確認してください。

Codex の Enterprise データ管理

Codex では、サインインの方式によって適用されるデータの扱いが変わります。ChatGPT でサインインした場合は、ChatGPT ワークスペースの権限・RBAC・Enterprise の保持とレジデンシーの設定に従います。API キーでサインインした場合は、API 組織の保持とデータ共有の設定に従います。OpenAI API の ZDR は API 専用の設定で、ChatGPT 側の保持を決めるものではありません。

Enterprise と Edu では、SCIM、EKM、RBAC、Compliance API による監査ログ、データ保持とデータレジデンシーの制御が提供されます。ただし公式ドキュメントは、データレジデンシーや HIPAA、BAA の対象範囲はすべての機能・地域に及ぶわけではないとしており、使う機能と地域ごとに契約内容を確かめる必要があります。

Codex cloud はリポジトリを OpenAI 側の環境に展開するため、この展開自体を許容できるかを運用要件に含めて評価します。ローカル実行に絞れば、リポジトリ全体がクラウドに展開されることはありません。なお GPT-6 Astra の安全監視でタスクが一時停止した場合、ZDR、Modified Abuse Monitoring、米国外のデータ保存のいずれかを設定した組織では、検出内容の確認と再開ができずタスクが終了します。

実務での分岐点

セキュリティ観点での実務の分岐点は次のとおりです。

  • 保持ゼロを厳格に求められる: Covered Models を使わない Claude Code + ZDR、または API キー認証でローカル実行に絞った Codex + API の ZDR、あるいはオンプレミス OSS (Ollama、LM Studio 等) を検討
  • 30 日保持は許容: Fable 系を含めて Claude for Enterprise、または Codex Enterprise のいずれか
  • Enterprise 契約が不要な社内 R&D: 個人プランで両方併用も可能

保持ゼロの実現しやすさは、Covered Models を選ばない前提の Claude Code と、API キー認証のローカル実行に絞った Codex で、条件付きながら同程度です。どちらの ZDR も個別の契約や承認が前提で、申し込めば誰でも自動的に適用されるものではありません。

カスタマイズ性: フックと組織ルールの深さ

カスタマイズ性は運用設計に直結する評価軸です。両ツールでアプローチが異なります。

Claude Code はフックで 33 種類のイベントに介入できます。ツール実行前の PreToolUse、実行後の PostToolUse、権限確認の PermissionRequest、セッション開始時の SessionStart、といった粒度で、AI が何かを実行する前後に組織のポリシーを差し込めます。例えば「main ブランチへの push を禁止」「機密ファイル (.env、鍵ペア) の読み取りを禁止」「大量ファイル変更時に人間の確認を挟む」といった制約を、フックで強制できます。

CLAUDE.md はプロジェクト固有のルール、コーディング規約、アーキテクチャ制約を書く場所で、Claude Code はセッション開始時に自動で読み込みます。組織横断のポリシーは settings.json でグローバルに、プロジェクト固有は CLAUDE.md でローカルに、といった 2 層構造が定石です。

Codex は AGENTS.md でリポジトリ固有の指示を書き、承認ポリシーで危険操作の前に人間の確認を挟み、サンドボックスモードでファイルとネットワークへのアクセス範囲を制限する構成です。Codex にもフックがあり、PreToolUse・PermissionRequest・PostToolUse・Stop・SessionStart などのイベントで、プロンプトに API キーが貼られていないかの検査や、ターン終了時の検証を差し込めます。管理下にないフックは、内容を確認して信頼するまで実行されません。

実務での使い分けの目安は次のとおりです。

  • プロジェクトごとに強い規約 (テスト強制、レビュー強制、ドキュメント同期強制) を持ち込みたい: Claude Code の CLAUDE.md + フックの組み合わせが扱いやすい
  • 組織全体で「危険操作を止めればよい」というレベルの制約: Codex の承認ポリシー + サンドボックスで足りることが多い
  • 大規模並列実行時の暴走を隔離したい: Codex cloud が有利

Claude Code のフックの具体的な運用パターンは Claude Code Hooks 5 つのパターン にまとめています。

単発性能: 速度と品質の傾向

多くの比較記事はここが中心ですが、実務では判断軸の一部にすぎません。傾向として現時点で見える差は次のとおりです。

  • 単一ファイルのバグ修正・小さな機能追加: Claude Code の方が速いことが多い (プロジェクト規約と既存コードの読み込みが速いため)
  • 数十ファイルにまたがる大規模リファクタリング: Codex cloud の並列実行が速いことが多い
  • コード品質の傾向: Claude Code は「プロジェクトの既存コード規約に寄せる」方向、Codex は「教科書的に正しい標準構文」に寄せる方向

「教科書的に正しい」のが良いか、「既存規約に馴染ませる」のが良いかは、コードベースの成熟度によります。既存コードに強い規約が無いスタートアップの MVP フェーズなら Codex の標準構文寄りが有利で、既存規約が積み重なった 5 年物の業務システムなら Claude Code の規約準拠が有利、という棲み分けが目安です。

いずれの傾向も、Anthropic と OpenAI の月次アップデートで変動します。3 ヶ月ごとに実務での再評価を組み込む運用が現実的です。

失敗リカバリのコスト構造: ここが総所有コストを決める

見えにくいが総所有コストで最大の差になるのが、AI が失敗したときのリカバリコストです。

AI コーディングツールを使うと、次の 3 種類の失敗が発生します。

  1. 意図と違うコードを書く (仕様の解釈違い)
  2. テストは通るが業務要件を満たさないコードを書く (テストの網羅性不足)
  3. 依存関係の更新で既存動作を壊す (影響範囲の見落とし)

これらの失敗は、AI そのものよりも「AI が生成したコードを人間がどうレビューするか」の設計で回避します。ここに使う工数が実質の総所有コストの半分以上を占めるケースが多いです。

Claude Code はテスト先行の開発サイクル (AI 駆動 TDD) との相性がよく、フックでテスト実行を必須化する構成が組みやすいです。詳しくは AI 駆動 TDD にまとめています。

Codex は Codex cloud で自動 PR レビューを回す構成が組みやすく、GitHub との統合を活用した「AI がレビューする → 人間が最終確認」のパターンが得意です。

失敗リカバリコストを抑える王道は、どちらのツールを使うにしても次の 3 点を組み込むことです。

  • テスト先行 (AI に実装させる前に、期待する入出力をテストで固定する)
  • 影響範囲の可視化 (変更したファイル・行に対して、依存する既存コードとテストを AI に列挙させる)
  • 段階リリース (Feature Flag で新しい実装を絞ってリリースし、旧実装に戻せる導線を用意する)

これらの運用が組めていないチームでは、どちらのツールを選んでも失敗リカバリコストが読めず、月額料金の何倍もの追加工数が発生します。

チームサイズ・言語別の適合

チームサイズと使用言語で、両ツールの向き不向きが変わります。

チームサイズ別

チーム規模Claude Code の向きCodex の向き
1〜3 名◎ CLAUDE.md 整備が軽い◎ 初期設定不要
4〜10 名◎ フックで規約強制○ AGENTS.md で組織ルール整備
10〜30 名○ Enterprise 契約と組み合わせ○ Enterprise 契約と組み合わせ
30 名以上○ Enterprise + 独自プレイブック◎ SCIM / EKM / 監査ログ フル活用

チームが大きくなるほど、アカウント管理と監査の負担を抑えるうえで Enterprise 版のガバナンス機能 (SCIM、RBAC、監査ログ) が必要になります。SCIM・RBAC・監査ログ・Compliance API は、Claude も Codex も Enterprise プランで提供されています。EKM は Codex の料金ページに Enterprise の機能として記載があり、Claude の料金ページには記載がありません。暗号鍵を自社で管理する要件がある場合は、この点を個別に確認してください。Claude Code は、CLAUDE.md とフックを丁寧に運用している 4〜10 名規模のチームで、生産性が高い傾向があります。

言語別

言語・スタックClaude Code の適性Codex の適性
TypeScript / JavaScript / Node.js◎◎
Python / Django / FastAPI◎◎
Rust / Go / Zig○○
Ruby / Rails○◎
Java / Kotlin / Spring○○
C# / .NET○○
PHP / Laravel○○
Swift / Kotlin (モバイル)○△
COBOL / 古典的な業務言語△△

主要な Web スタック (TypeScript、Python) はどちらでも高い適性を発揮しますが、モバイル開発 (Swift、Kotlin、React Native) では Claude Code の方がプロジェクト規約に馴染ませる方向で使いやすい傾向があります。COBOL などの古典言語は両ツールとも部分的な支援に留まるため、メインフレーム リプレイスの進め方 で扱っているような「AI に読み解かせる」用途が主です。

Enterprise 対応の比較

10 名以上のチームや、監査・法令対応が要件に入る組織では、Enterprise 版の機能差が判断材料になります。次の表は、2026 年 9 月 29 日時点の Claude と Codex の料金ページ・公式ドキュメントの記載をまとめたものです。「記載なし」は料金ページで確認できなかったという意味で、機能が無いという意味ではありません。

項目Claude for EnterpriseCodex Enterprise
SSO○ (Team から)○ (Business から SAML SSO)
SCIM ユーザープロビジョニング○○
RBAC 権限管理○○
EKM (暗号化キー管理)記載なし○
監査ログ・Compliance API○○
データ保持の制御○ (カスタムのデータ保持制御)○ (保持とレジデンシーの制御)
ZDR○ (Covered Models は 30 日保持が前提)API キー認証は API 組織の設定に従う
HIPAAEnterprise に HIPAA-ready の提供あり。Claude Code は BAA 締結と ZDR 有効化の両方が条件機能・地域・契約によって対象範囲が異なる
接続先の選択Anthropic / Claude Platform on AWS / Bedrock / Google Cloud / Microsoft FoundryChatGPT / API キー / Amazon Bedrock ほか

ガバナンス機能は、2026 年 9 月時点では両社とも Enterprise プランで一通り揃っています。違いが出るのは、暗号鍵の自社管理 (EKM) を料金ページで明示しているかと、HIPAA の扱いです。Claude の API ドキュメントは、HIPAA-ready の対象から Claude Code を外しています。一方 Claude Code のドキュメントは、BAA を結んだ組織が ZDR も有効にしている場合に限り、BAA が Claude Code 経由の API 通信に及ぶとしています。医療領域で Claude Code を使うには BAA に加えて ZDR が要る点が制約になります。

一方、Claude Code は Amazon Bedrock、Google Cloud's Agent Platform、Microsoft Foundry をバックエンドに選べる利点があり、これらのクラウドベンダーと既存の契約がある組織では Claude Code が有利になる場合があります。Codex もローカル実行では Amazon Bedrock を使えるほか、設定ファイルで Azure などのプロバイダーを指定できます。

費用試算: 「隠れコスト」を含めた実効レンジ

月額料金だけの比較では実像を見誤ります。組織で運用したときの実効コストは、月額料金 + 失敗リカバリの工数 + Enterprise 契約管理の事務コスト + トレーニングコスト、で構成されます。

参考: 10 名チームで両ツールを 12 ヶ月運用した場合の実効コスト

費目Claude Code のみCodex のみ両方併用
月額ライセンス (10 名 × 12 ヶ月)240 万円240 万円480 万円
Enterprise 契約管理 (事務工数)30 万円30 万円60 万円
初期セットアップ (CLAUDE.md / AGENTS.md)60 万円20 万円80 万円
継続トレーニング (フック / サブエージェント)40 万円30 万円70 万円
失敗リカバリ工数 (テスト・レビュー)200 万円200 万円200 万円
12 ヶ月合計 (参考)570 万円520 万円890 万円

月額ライセンスは 1 人あたり月 2 万円を置いた概算、Enterprise 契約管理は情シスや法務での見積もり作業工数の目安、初期セットアップは Claude Code の CLAUDE.md 整備 (フック含む) が Codex より重い前提、失敗リカバリ工数は両ツールで同水準としています。実際のライセンス費は、プラン・席の種類・使うモデル (Fable 系は Pro や Team の Standard 席では利用枠に含まれず、クレジットで支払う) によって大きく変わります。

Claude Code のみで運用すると初期セットアップが重く、Codex のみで運用すると初期セットアップは軽いものの、 Codex cloud の実行結果を組織側でどう受け止めるかの運用整備が別途要ります。併用の 890 万円は、その両方の強みを取りに行くための投資です。

この試算は各要素の運用習熟度で大きく上下します。自社の実運用に落とし込む際は、AI 駆動開発の費用・期間 と併せて、実測値ベースで見直すことを推奨します。

使い分けの実務判断フロー

ここまでの論点を踏まえて、実務での判断フローをまとめます。

まず 3 つの質問に答えます。

  1. 扱うコードベースはクラウド実行を許容できますか? (法務・情報セキュリティ)
  2. チーム規模は 10 名以上ですか? (Enterprise 機能の必要性)
  3. 保持ゼロを法令や社内規程で求められますか? (Covered Models の 30 日保持の影響)

判断結果の目安

  • クラウド不可・チーム 10 名未満・保持ゼロを求められる: Claude Code + Covered Models 回避 + ZDR、または OSS ローカル運用
  • クラウド不可・チーム 10 名未満・保持ゼロを求められない: Claude Code (Pro または Max)
  • クラウド可・チーム 10 名以上・EKM などのガバナンス重視: Codex Enterprise
  • クラウド可・チーム 10 名以上・両方のガバナンスを取りに行く: 併用 (Claude for Enterprise + Codex Enterprise)
  • クラウド可・スタートアップ MVP・初期セットアップ最小: Codex 個人プラン、必要に応じ Claude Code Pro を追加

上記は現時点の目安で、両ツールの月次アップデートで変わります。3 ヶ月ごとに社内で再評価を組み込む運用が現実的です。

失敗を避けるチェックリスト

導入前に確認しておくべき論点をまとめます。

  • Fable 5 系を含む Covered Models の 30 日保持が、自社の法令・社内規程に抵触しないかを法務と握っているか
  • Codex を ChatGPT サインインと API キーのどちらで使うかを決め、対応する保持設定を確認しているか
  • クラウド実行 (Claude Code のクラウドセッション、Codex cloud) を許容できるかを情報セキュリティと握っているか
  • CLAUDE.md / AGENTS.md の整備担当と、レビュー体制を初期セットアップに含めているか
  • 失敗リカバリコスト (テスト・レビュー工数) を月額料金と併せて予算化しているか
  • チーム規模と Enterprise 契約の必要性を並列で評価しているか
  • 3 ヶ月ごとの再評価と、片方が使えなくなった場合の乗り換え手順を運用に含めているか
  • HIPAA 対応が必要な案件では、Claude Code を BAA の対象にするには ZDR の有効化も必要な点を事前に確認しているか

これらを満たしたうえで、Claude Code と Codex は「単一の勝者」ではなく「組織の状況で選ぶ 2 系統」として位置付けるのが実務の結論です。

Claude Code / Codex 導入のご相談

「Claude Code と Codex のどちらを導入するか判断したい」「Fable 5 系の 30 日保持を踏まえて ZDR 契約を再評価する必要が出てきた」「10 名以上のチームで Enterprise 契約とガバナンスの整備を検討している」といった状況こそ、AI 駆動開発のクリエイティブスタジオが伴走できる領域です。まずは AI 開発ツール定着支援のサービス内容 をご覧いただき、お問い合わせ からお気軽にご相談ください。

参考リンク

いずれも 2026 年 9 月 29 日に確認しました。