<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>プログラミング | 週末起業ラボ</title>
	<atom:link href="https://shumatsu-lab.com/tag/%E3%83%97%E3%83%AD%E3%82%B0%E3%83%A9%E3%83%9F%E3%83%B3%E3%82%B0/feed/" rel="self" type="application/rss+xml" />
	<link>https://shumatsu-lab.com</link>
	<description>本業の隣で、もう一つのキャリアを</description>
	<lastBuildDate>Wed, 03 Jun 2026 23:16:18 +0000</lastBuildDate>
	<language>ja</language>
	<sy:updatePeriod>
	hourly	</sy:updatePeriod>
	<sy:updateFrequency>
	1	</sy:updateFrequency>
	<generator>https://wordpress.org/?v=7.0.2</generator>

<image>
	<url>https://shumatsu-lab.com/wp-content/uploads/2026/02/cropped-IMG_2742-32x32.jpeg</url>
	<title>プログラミング | 週末起業ラボ</title>
	<link>https://shumatsu-lab.com</link>
	<width>32</width>
	<height>32</height>
</image> 
<site xmlns="com-wordpress:feed-additions:1">252581404</site>	<item>
		<title>Claude無料版でバイブコーディング｜2週間で業務システムを作った全記録</title>
		<link>https://shumatsu-lab.com/vibe-coding-claude-free-business-system/</link>
		
		<dc:creator><![CDATA[ムラサキ]]></dc:creator>
		<pubDate>Fri, 15 May 2026 05:16:36 +0000</pubDate>
				<category><![CDATA[AI]]></category>
		<category><![CDATA[Claude]]></category>
		<category><![CDATA[バイブコーディング]]></category>
		<category><![CDATA[プログラミング]]></category>
		<category><![CDATA[業務自動化]]></category>
		<guid isPermaLink="false">https://shumatsu-lab.com/?p=921</guid>

					<description><![CDATA[「AIでコードが書けるらしい」と聞いてCopilotやChatGPTを試したものの、不具合対応が二転三転して結局完成しなかった。そんな経験はないでしょうか。金融系SE歴20年のチームマネジメントを担当する筆者も、2025 [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">「AIでコードが書けるらしい」と聞いてCopilotやChatGPTを試したものの、不具合対応が二転三転して結局完成しなかった。そんな経験はないでしょうか。金融系SE歴20年のチームマネジメントを担当する筆者も、2025年8月にまさにその挫折を経験しました。</p>



<p class="wp-block-paragraph">それから約半年後の2026年3月、Claude無料版を使ったバイブコーディングで、音声対話型のAIヒアリングシステムを2週間で開発しました。この記事では、設計から実装、トライアンドエラーの記録、月額$7〜8のコスト内訳まで、開発の全工程を包み隠さず公開します。</p>



<div class="wp-block-cocoon-blocks-balloon-ex-box-1 speech-wrap sb-id-1 sbs-stn sbp-l sbis-cb cf block-box not-nested-style cocoon-block-balloon"><div class="speech-person"><figure class="speech-icon"><img decoding="async" src="https://shumatsu-lab.com/wp-content/uploads/2026/03/murasaki_icon.png" alt="ムラサキ" class="speech-icon-image" /></figure><div class="speech-name">ムラサキ</div></div><div class="speech-balloon">
<p class="wp-block-paragraph">2025年に心が折れた人にこそ読んでほしい記事です。AIのコード生成能力は半年で別物になっています。</p>
</div></div>




  <div id="toc" class="toc tnt-number toc-center tnt-number border-element"><input type="checkbox" class="toc-checkbox" id="toc-checkbox-2" checked><label class="toc-title" for="toc-checkbox-2">目次</label>
    <div class="toc-content">
    <ol class="toc-list open"><li><a href="#toc1" tabindex="0">バイブコーディングとは？2025年との決定的な違い</a><ol><li><a href="#toc2" tabindex="0">バイブコーディングの定義と基本の流れ</a></li><li><a href="#toc3" tabindex="0">2025年8月の挫折と2026年3月の成功</a></li></ol></li><li><a href="#toc4" tabindex="0">今回作ったもの｜AIヒアリングシステムの概要</a><ol><li><a href="#toc5" tabindex="0">システムの全体像と機能</a></li><li><a href="#toc6" tabindex="0">技術スタックとコスト</a></li></ol></li><li><a href="#toc7" tabindex="0">開発フローの実際｜環境制約でAIを使い分けた経緯</a><ol><li><a href="#toc8" tabindex="0">設計フェーズ ── Gemini Proで壁打ち</a></li><li><a href="#toc9" tabindex="0">設計からコーディングへの情報の受け渡し</a></li><li><a href="#toc10" tabindex="0">実装フェーズ ── 無料のclaude.aiでバイブコーディング</a></li></ol></li><li><a href="#toc11" tabindex="0">ぶつかった壁と解決策</a><ol><li><a href="#toc12" tabindex="0">音声合成の選定 ── VOICEVOX → Google Cloud TTSへの移行</a></li><li><a href="#toc13" tabindex="0">AIが採否判断を下す問題</a></li><li><a href="#toc14" tabindex="0">個人情報とファイルアップロードの方針転換</a></li></ol></li><li><a href="#toc15" tabindex="0">バイブコーディングを成功させるコツと注意点</a><ol><li><a href="#toc16" tabindex="0">プログラミング経験があると何が有利か</a></li><li><a href="#toc17" tabindex="0">無料AIの制限との付き合い方</a></li><li><a href="#toc18" tabindex="0">妥協の判断基準</a></li></ol></li><li><a href="#toc19" tabindex="0">よくある質問（FAQ）</a></li><li><a href="#toc20" tabindex="0">まとめ</a></li></ol>
    </div>
  </div>

<h2 class="wp-block-heading"><span id="toc1">バイブコーディングとは？2025年との決定的な違い</span></h2>



<h3 class="wp-block-heading"><span id="toc2">バイブコーディングの定義と基本の流れ</span></h3>



<p class="wp-block-paragraph">バイブコーディング（Vibe Coding）とは、AIに自然言語で「こういうものを作りたい」と指示し、コードを生成させる開発手法です。2025年にOpenAI共同創設者のAndrej Karpathy氏が<a rel="noopener" href="https://x.com/karpathy/status/1886192184808149383" target="_blank">提唱した概念</a>で、従来のプログラミングのように構文を1行ずつ書くのではなく、AIとの対話を通じてシステムを構築していきます。</p>



<p class="wp-block-paragraph">基本的な流れは「何を作りたいかを言葉で説明する → AIがコードを生成する → 動作を確認する → 問題があれば修正を指示する」の繰り返しです。使うツールはClaude Code、Cursor、ChatGPTなど複数ありますが、筆者は<a rel="noopener" href="https://claude.ai/" target="_blank">claude.ai</a>の無料プランを使いました。</p>



<h3 class="wp-block-heading"><span id="toc3">2025年8月の挫折と2026年3月の成功</span></h3>



<p class="wp-block-paragraph">筆者は2025年8月にGitHub CopilotとChatGPTを使い、VSCodeの拡張機能からSQLフォーマッターを抜き出してWinMergeのプラグインに組み込む開発を試みました。結果は惨敗です。不具合が出るたびにAIが提案する修正が二転三転し、4回5回と方針が変わった末に答えにたどり着けませんでした。</p>



<p class="wp-block-paragraph">2026年3月、Claude Sonnet 4.6がリリースされたタイミングで再挑戦しました。<a rel="noopener" href="https://www.anthropic.com/news/claude-sonnet-4-6" target="_blank">Anthropicの公式リリース</a>によると、Sonnet 4.6はコーディング能力とエージェント的なタスク遂行能力が大幅に向上しています。実際に使ってみて、コード生成の正確性と文脈保持能力が2025年のツールとは別物だと感じました。半年でここまで変わるのかと驚いた、というのが率直な感想です。</p>



<div class="slb slb-tldr">
  <div class="slb-tldr__head">
    <span class="slb-mono slb-tldr__label">TL;DR / 三行要約</span>
          <span class="slb-mono slb-tldr__meta">8 MIN READ · UPDATED 2026.05</span>
      </div>
  <ol>
          <li>2025年8月にCopilot/ChatGPTで挫折したプロジェクトを、2026年3月にClaude無料版（Sonnet 4.6）で2週間で完成。</li>
          <li>初期費用ほぼ$0、月額$7〜8（Render $7 + S3数十円 + API従量課金）で音声対話型AIヒアリングシステムを本番運用。</li>
          <li>開発中10件以上の問題が発生したが、エラーメッセージをコピペするだけでAIが原因特定・解決。</li>
      </ol>
    <div class="slb-tldr__badges">
          <span class="slb-badge slb-badge--hi">
        RESULT — 2週間・月額$7〜8で完成      </span>
          <span class="slb-badge">
        TOOL — Claude 無料版（Sonnet 4.6）      </span>
          <span class="slb-badge">
        COST — 初期費用$0・月$7〜8      </span>
      </div>
  </div>
    


<h2 class="wp-block-heading"><span id="toc4">今回作ったもの｜AIヒアリングシステムの概要</span></h2>



<h3 class="wp-block-heading"><span id="toc5">システムの全体像と機能</span></h3>



<p class="wp-block-paragraph">開発したのは、社内の採用業務で使うAI事前ヒアリングシステムです。エンジニア候補者に対して、面接前の事前確認をAIが自動で実施します。候補者はURLにアクセスするだけで音声による対話形式のヒアリングを受けられ、管理者は結果の確認と採否判定を行えます。</p>



<div class="wp-block-merpress-mermaidjs diagram-source-image"><pre class="mermaid">graph LR
    A["候補者ブラウザ"] --&gt;|"音声録音"| B["React/Viteフロントエンド"]
    B --&gt;|"API通信"| C["Node.js/Expressバックエンド"]
    C --&gt; D["MongoDB Atlas候補者データ"]
    C --&gt; E["AWS S3音声保存"]
    C --&gt; F["Claude Haiku 4.5AI対話・評価"]
    C --&gt; G["Whisper API音声→テキスト"]
    C --&gt; H["Google TTSテキスト→音声"]
    style A fill:#e8f0fe,stroke:#4a86c8
    style B fill:#e8f0fe,stroke:#4a86c8
    style C fill:#e8f4e8,stroke:#5a9e6f
    style D fill:#f5f0e8,stroke:#c4a96a
    style E fill:#f5f0e8,stroke:#c4a96a
    style F fill:#f0e8f5,stroke:#9a7ab5
    style G fill:#f0e8f5,stroke:#9a7ab5
    style H fill:#f0e8f5,stroke:#9a7ab5
</pre><img decoding="async" src="https://shumatsu-lab.com/wp-content/uploads/2026/03/merpress-4.png" alt="" /></div>



<figure class="wp-block-image size-large"><img fetchpriority="high" decoding="async" width="1024" height="374" src="https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-admin-dashboard-1-1024x374.png" alt="" class="wp-image-930" srcset="https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-admin-dashboard-1-1024x374.png 1024w, https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-admin-dashboard-1-300x110.png 300w, https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-admin-dashboard-1-768x281.png 768w, https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-admin-dashboard-1.png 1078w" sizes="(max-width: 1024px) 100vw, 1024px" /></figure>



<p class="wp-block-paragraph">主な機能は、候補者向けのURL発行・音声対話・イニシャル表示による本人確認、管理者向けの候補者一覧・会話履歴確認・音声再生・評価レポート自動生成・採否判定です。AIは「面接官」ではなく「事前ヒアリング担当」として振る舞い、採否判断は一切行わない設計にしました。</p>



<h3 class="wp-block-heading"><span id="toc6">技術スタックとコスト</span></h3>



<p class="wp-block-paragraph">初期費用はほぼ0円です。各サービスの無料枠で開始できました。2026年3月時点のランニングコストは月額約$7〜8で、内訳は以下の通りです。</p>



<figure class="wp-block-table"><table><thead><tr><th>サービス</th><th>プラン</th><th>月額費用</th></tr></thead><tbody><tr><td>Render（バックエンド）</td><td>無料（スリープあり）</td><td>$0</td></tr><tr><td>Render（フロント）</td><td>Static無料</td><td>$0</td></tr><tr><td>MongoDB Atlas</td><td>M0無料</td><td>$0</td></tr><tr><td>AWS S3</td><td>従量課金</td><td>数十円</td></tr><tr><td>Claude API（Haiku 4.5）</td><td>従量課金</td><td>使用量次第</td></tr><tr><td>OpenAI Whisper API</td><td>従量課金</td><td>使用量次第</td></tr><tr><td>Google Cloud TTS</td><td>従量課金（無料枠あり）</td><td>ほぼ$0</td></tr></tbody></table></figure>



<p class="wp-block-paragraph"><a rel="noopener" href="https://render.com/pricing" target="_blank">Renderの料金ページ</a>によると、有料プラン（Starter $7/月）に上げるとスリープがなくなり本番運用に適した状態になります。<a rel="noopener" href="https://www.mongodb.com/pricing" target="_blank">MongoDB Atlasの無料枠（M0）</a>は512MBのストレージを提供しており、開発・検証段階では十分です。Whisper APIは<a rel="noopener" href="https://platform.openai.com/docs/guides/speech-to-text" target="_blank">1分あたり$0.006</a>と安価で、ヒアリング1回30分でも約$0.18です。</p>



<h2 class="wp-block-heading"><span id="toc7">開発フローの実際｜環境制約でAIを使い分けた経緯</span></h2>



<h3 class="wp-block-heading"><span id="toc8">設計フェーズ ── Gemini Proで壁打ち</span></h3>



<p class="wp-block-paragraph">設計段階は本業の延長で進めていたため、Google WorkspaceのGemini 3.1 Proを使いました。アーキテクチャの検討、技術スタックの選定、コスト試算、開発ロードマップの策定をGeminiとの壁打ちで詰めていきました。</p>



<p class="wp-block-paragraph">Geminiが得意だったのはアーキテクチャの比較検討です。「ターン制のREST API方式」と「WebSocketによるリアルタイム方式」の2パターンを提示させ、コスト・開発期間・UXのトレードオフを整理してもらいました。結論として、コスト優先でREST API方式を選択しています。</p>



<h3 class="wp-block-heading"><span id="toc9">設計からコーディングへの情報の受け渡し</span></h3>



<p class="wp-block-paragraph">設計が固まった段階で、コーディング用の環境を準備しました。業務で使っているPCはソフトウェアのインストールが制限されており開発環境を構築できないため、別途スタンドアロンの開発用PCを用意しています。この開発用PCからはGoogle Workspaceに接続できないため、ブラウザだけで利用できるclaude.aiの無料プランをコーディング用AIとして選びました。</p>



<p class="wp-block-paragraph">AIを乗り換える際に重要だったのが、設計フェーズで決めた内容の受け渡しです。Geminiとの長いチャット履歴をそのまま渡しても、過去のボツ案と最終決定をClaude側が混同してしまいます。そこでGeminiに「引き継ぎ用のドキュメントを作って」と依頼し、決定事項・進捗・次のアクションだけを圧縮した要約を作成しました。これをClaudeの最初のメッセージとして投げることで、情報のロスなく実装フェーズに移行できました。</p>



<h3 class="wp-block-heading"><span id="toc10">実装フェーズ ── 無料のclaude.aiでバイブコーディング</span></h3>



<p class="wp-block-paragraph">claude.aiの無料プランでClaude Sonnet 4.6を使い、フロントエンド（React/Vite）・バックエンド（Node.js/Express）・各種API連携のコードを書いていきました。開発期間は2026年3月初旬から3月13日までの約2週間です。</p>



<figure class="wp-block-image size-large"><img decoding="async" width="1024" height="535" src="https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-claude-chat-screen-1024x535.png" alt="Claude無料版でバイブコーディング中のチャット画面" class="wp-image-924" srcset="https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-claude-chat-screen-1024x535.png 1024w, https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-claude-chat-screen-300x157.png 300w, https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-claude-chat-screen-768x401.png 768w, https://shumatsu-lab.com/wp-content/uploads/2026/03/vibe-coding-claude-chat-screen.png 1274w" sizes="(max-width: 1024px) 100vw, 1024px" /></figure>



<p class="wp-block-paragraph">驚いたのは、1つのチャットの中でフロントからバックエンド、API連携まで一貫して対応できたことです。以前のAIコーディングツールでは長いやり取りの中で方針がブレたり、過去の指示を忘れたりすることがありましたが、Claude Sonnet 4.6ではプロジェクト全体の流れを保ったまま開発を進められました。筆者がClaudeをブログ執筆に活用しているワークフローは<a href="https://shumatsu-lab.com/ai-blog-writing-claude-workflow/">Claudeでブログ記事を作成する実践ワークフロー</a>で公開していますが、記事作成とは異なり、バイブコーディングでは1つの長いチャットで完結できた点が印象的でした。</p>



<h2 class="wp-block-heading"><span id="toc11">ぶつかった壁と解決策</span></h2>



<p class="wp-block-paragraph">開発中にぶつかった問題は10件以上あります。ここでは特に印象的だった3つを紹介します。</p>



<h3 class="wp-block-heading"><span id="toc12">音声合成の選定 ── VOICEVOX → Google Cloud TTSへの移行</span></h3>



<p class="wp-block-paragraph">当初は無料の音声合成エンジンVOICEVOXを使用していましたが、Render環境での動作が不安定でした。ローカルでは問題なく動くのに、サーバー環境との相性が悪かったのです。この問題をClaudeに相談したところ、Google Cloud TTSのNeural2音声（ja-JP-Neural2-B）への移行を提案してきました。その通りに試したところ、自然な日本語音声を安定して生成できるようになりました。原因の切り分けから代替案の提示まで的確で、こいつやるなと感じた場面です。</p>



<h3 class="wp-block-heading"><span id="toc13">AIが採否判断を下す問題</span></h3>



<p class="wp-block-paragraph">テスト中にAIが候補者に「この案件への参画は難しい判断となります」と直接断りを告げた場面がありました。ヒアリングシステムなのにAIが勝手に合否を伝えてしまうのは致命的です。プロンプトに「採否・合否・参画可否の判断は絶対にしないこと」「難しい・厳しいなど断りを示唆する表現は一切使わないこと」を明記して対処しました。バイブコーディングでは機能の実装だけでなく、AIの振る舞いの制御にも注意が必要です。</p>



<div class="wp-block-cocoon-blocks-icon-box common-icon-box block-box bad-box">
<p class="wp-block-paragraph">AIが採否判断を下してしまった会話</p>



<p class="wp-block-paragraph">「申し訳ありませんが、この案件に関しては、参画時点での実務経験が必須という判断をさせていただきます。貴重なお時間をいただきありがとうございました。」</p>
</div>



<div class="wp-block-cocoon-blocks-balloon-ex-box-1 speech-wrap sb-id-1 sbs-stn sbp-l sbis-cb cf block-box not-nested-style cocoon-block-balloon"><div class="speech-person"><figure class="speech-icon"><img decoding="async" src="https://shumatsu-lab.com/wp-content/uploads/2026/03/murasaki_icon.png" alt="ムラサキ" class="speech-icon-image" /></figure><div class="speech-name">ムラサキ</div></div><div class="speech-balloon">
<p class="wp-block-paragraph">AIが「情報収集に徹する」のか「判断まで下す」のかはプロンプト設計で明確に線引きする必要があります。ここをサボると本番で事故が起きます。</p>
</div></div>



<h3 class="wp-block-heading"><span id="toc14">個人情報とファイルアップロードの方針転換</span></h3>



<p class="wp-block-paragraph">当初はスキルシートのPDF/画像をアップロードしてClaude APIで自動解析する機能を実装しました。しかし、外部のクラウドサービスに候補者の個人情報（氏名・住所等）を含むファイルを送信するリスクを考慮し、この機能は削除しました。代わりに、社内のセキュアな環境でスキルシートの個人情報をマスクしたテキストを作成し、システムにはマスク済みの情報のみを登録する運用に変更しています。個人情報を扱う部分は社内の閉じた環境に留め、外部に出るシステムには匿名化された情報だけが渡る設計です。</p>



<p class="wp-block-paragraph">機能をまるごと削除する判断は一見もったいなく見えますが、むしろこれはバイブコーディングの強みが発揮された場面でした。AIに「この機能を削除して、関連箇所もすべて整合を取って」と指示すれば、一括で対応してくれます。人間がコードを手動で修正すると関連箇所の修正漏れ（デグレード）が起きるのが常ですが、AIはそのリスクを大幅に下げてくれました。AIの出力を検証・判断する力の重要性については<a href="https://shumatsu-lab.com/ai-skills-youth-education/">生成AI時代に必要なスキルと若手教育の進め方</a>でも解説しています。</p>



<h2 class="wp-block-heading"><span id="toc15">バイブコーディングを成功させるコツと注意点</span></h2>



<p class="wp-block-paragraph">実装速度が上がるほどレビューの抜け漏れリスクも増える。<a href="https://shumatsu-lab.com/llm-code-review-benchmark-claude-codex-coderabbit/">LLMコードレビュー4手法の実測比較</a>で、Claude Code 内蔵レビューを追加コストゼロで回す方法を解説している。</p>



<h3 class="wp-block-heading"><span id="toc16">プログラミング経験があると何が有利か</span></h3>



<p class="wp-block-paragraph">バイブコーディングは「コードを書けなくてもアプリが作れる」と紹介されることがありますが、実際にはIT業界の用語や概念を知っているかどうかで、AIとのやり取りのスムーズさが大きく変わります。筆者自身、今回の開発でReactもNode.jsも手では書けませんし、生成されたコードの中身を読んで理解するというプロセスは一切踏んでいません。修正時にキーワード検索で該当箇所を目にすることはありますが、コードリーディングと呼べるものではありませんでした。</p>



<p class="wp-block-paragraph">それでも2週間でシステムが完成したのは、S3・React・Node.js・環境変数・Gitといった用語をSEとして実務で利用していなくても知識があったため、AIとのキャッチボールがスムーズだったことが大きいと感じています。エラーが出たときも、エラーメッセージをそのままコピペするかスクリーンショットを貼るだけで、AIが原因を特定して修正案を出してくれました。長年コードレビューを担当してきた中で「ここは壊れやすい」「この設計だと後で困る」といった勘所が自然と身についていたことも、問題の早期発見に役立ったのかもしれません。</p>



<p class="wp-block-paragraph">一方、これらの用語自体が初めての方は、AIへの質問を組み立てる段階で時間がかかります。バイブコーディング自体が不可能になるわけではありませんが、筆者の2週間という期間はこうした前提知識があっての数字です。<a href="https://shumatsu-lab.com/se-automation-tips/">筆者が実務で使っている業務自動化テクニック</a>で紹介しているようなWindows標準機能やPowerShellの知識も、開発環境の構築で役立ちました。</p>



<p class="wp-block-paragraph">経験があるとスケールも早い。Batch APIと組み合わせた<a href="https://shumatsu-lab.com/claude-code-pseo-site-713pages-3days/">3日間・713ページのpSEOサイト構築という規模感</a>がその一例だ。</p>



<h3 class="wp-block-heading"><span id="toc17">無料AIの制限との付き合い方</span></h3>



<p class="wp-block-paragraph">claude.aiの無料プランには数時間ごとのメッセージ上限があり、開発中に何度か上限に達しました。ただし本業の傍らで進めていたため、上限リセットまでの待ち時間は別の業務に充てられ、実質的な問題にはなりませんでした。それでも効率を意識した点が2つあります。</p>



<ul class="wp-block-list">
<li>エラー発生時はエラーメッセージをそのままコピペするかスクリーンショットを貼り付ける。自分で原因を解説しようとするより、生のエラー情報を渡す方がAIの回答が的確で早い</li>



<li>上限に達したらChatGPT（GPT-4oの無料枠）で軽い調査を進め、Claudeが復帰したらメインの開発に戻る</li>
</ul>



<p class="wp-block-paragraph">無料の範囲でも、今回のシステム規模（フロント1ファイル・バックエンド1ファイル・管理画面1ファイル）なら十分に開発を完了できました。</p>



<h3 class="wp-block-heading"><span id="toc18">妥協の判断基準</span></h3>



<p class="wp-block-paragraph">すべてを理想通りに実装しようとすると、無料枠の制限や開発期間の中では終わりません。筆者は以下の基準で妥協を判断しました。</p>



<div class="wp-block-cocoon-blocks-tab-box-1 blank-box bb-tab bb-check block-box">
<p class="wp-block-paragraph">コストが跳ね上がるもの → Renderの有料化は後回し。スリープは自動リトライで許容範囲にした</p>



<p class="wp-block-paragraph">実装が複雑で本質でないもの → S3音声ファイルの即時削除はライフサイクルポリシーに委ねる</p>



<p class="wp-block-paragraph">セキュリティリスクがあるもの → スキルシートのファイルアップロードは即座に削除した</p>
</div>



<p class="wp-block-paragraph">「8割の精度で動くものを素早く作り、使いながら改善する」のがバイブコーディングの強みです。完璧を目指して動かないより、まず動くものを完成させる方が結果的に早く前に進めます。</p>



<h2 class="wp-block-heading"><span id="toc19">よくある質問（FAQ）</span></h2>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">バイブコーディングにプログラミング経験は必要ですか？</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">必須ではありませんが、IT業界の用語や概念を知っていると問題解決のスピードが格段に上がります。筆者はReactもNode.jsも手では書けませんが、SE歴20年で培った用語の知識があったため、AIとのやり取りがスムーズでした。エラー時もメッセージをコピペするだけでAIが原因を特定してくれます。</p>
</div></dd></dl></div>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">Claude無料版でどこまで開発できますか？</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">筆者は音声対話型のAIヒアリングシステム（React/Node.js/MongoDB/AWS S3連携）をClaude無料版だけで実装しました。無料版は数時間ごとにメッセージ上限がありますが、1つのチャットでプロジェクト全体を一貫して進められたため、実用的なシステムの開発は十分可能です。</p>
</div></dd></dl></div>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">バイブコーディングの開発コストはどのくらいですか？</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">筆者のシステムは初期費用ほぼ0円、月額約$7〜8で運用しています。内訳はRender無料プラン、MongoDB Atlas無料枠、AWS S3従量課金（数十円）、各種API従量課金です。Renderを有料プラン（$7/月）に上げるとスリープがなくなり本番運用に適した状態になります。</p>
</div></dd></dl></div>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">2025年のAIコーディングと2026年で何が変わりましたか？</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">筆者は2025年8月にCopilotでVSCode拡張のプラグイン開発を試みましたが、不具合対応が二転三転して完成に至りませんでした。2026年3月にClaude Sonnet 4.6で同規模の開発に再挑戦したところ、2週間で稼働するシステムが完成しました。AIモデルの精度向上、特にコード生成の正確性と文脈保持能力が大きく進化しています。</p>
</div></dd></dl></div>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">設計と実装で異なるAIを使った理由は何ですか？</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">意図的な戦略ではなく環境制約によるものです。設計段階では業務で利用しているGoogle WorkspaceのGemini Proを使いました。コーディングに移る際、業務PCでは開発環境を構築できなかったため別途開発用PCを用意しましたが、そのPCからはGoogle Workspaceに接続できません。そこでブラウザだけで使える無料のclaude.aiを選択しました。</p>
</div></dd></dl></div>



<h2 class="wp-block-heading"><span id="toc20">まとめ</span></h2>



<p class="wp-block-paragraph">この記事では、Claude無料版を使ったバイブコーディングで業務システムを2週間で開発した全工程を紹介しました。要点を3つに絞ります。</p>



<div class="wp-block-cocoon-blocks-tab-box-1 blank-box bb-tab bb-point block-box has-border-color has-19-a-186-border-color bb-border-color-font-color">
<p class="wp-block-paragraph">2026年のAIコード生成能力は2025年とは別物。半年前に挫折した人も再挑戦する価値がある</p>



<p class="wp-block-paragraph">無料のclaude.aiでも実務レベルのシステム開発は可能。設計情報の受け渡しとAIへの的確な指示がコツ</p>



<p class="wp-block-paragraph">プログラミング経験は必須ではないが、IT用語の知識と問題の勘所が開発速度を大きく左右する</p>
</div>



<p class="wp-block-paragraph">バイブコーディングは「完璧なコードを一発で書く」ツールではなく、「試行錯誤のサイクルを高速に回す」ツールです。ぶつかった壁は10件以上ありましたが、そのすべてをAIとの対話で解決できました。作りたいものがあるなら、まず小さな機能1つから始めてみてください。</p>



<div class="wp-block-cocoon-blocks-balloon-ex-box-1 speech-wrap sb-id-1 sbs-stn sbp-l sbis-cb cf block-box not-nested-style cocoon-block-balloon"><div class="speech-person"><figure class="speech-icon"><img decoding="async" src="https://shumatsu-lab.com/wp-content/uploads/2026/03/murasaki_icon.png" alt="ムラサキ" class="speech-icon-image" /></figure><div class="speech-name">ムラサキ</div></div><div class="speech-balloon">
<p class="wp-block-paragraph">2025年に心が折れた筆者が、半年後にシステムを完成させられました。AIの進化を待っていた人は、そろそろ動き出すタイミングです。</p>
</div></div>

]]></content:encoded>
					
		
		
		<post-id xmlns="com-wordpress:feed-additions:1">921</post-id>	</item>
		<item>
		<title>AIコードレビュー比較｜Claude・Codex・CodeRabbit実測</title>
		<link>https://shumatsu-lab.com/llm-code-review-benchmark-claude-codex-coderabbit/</link>
		
		<dc:creator><![CDATA[ムラサキ]]></dc:creator>
		<pubDate>Fri, 15 May 2026 05:14:49 +0000</pubDate>
				<category><![CDATA[AI]]></category>
		<category><![CDATA[プログラミング]]></category>
		<category><![CDATA[AIコードレビュー]]></category>
		<category><![CDATA[Claude Code]]></category>
		<category><![CDATA[ツール比較]]></category>
		<guid isPermaLink="false">https://shumatsu-lab.com/?p=1569</guid>

					<description><![CDATA[SE歴20年の筆者は2026年5月、実際のコードベースから抽出した6本のバグをプライベートリポジトリに仕込み、4種のLLMレビューツールを同一条件で対決させた。検出率は Claude Code 内蔵 code-revie [&#8230;]]]></description>
										<content:encoded><![CDATA[
<p class="wp-block-paragraph">SE歴20年の筆者は2026年5月、実際のコードベースから抽出した6本のバグをプライベートリポジトリに仕込み、4種のLLMレビューツールを同一条件で対決させた。検出率は Claude Code 内蔵 code-reviewer が94%、Codex CLI GPT-5.5 が77%、CodeRabbit Pro Plus が42%。同じバグを全手法が見逃す「LLMの壁」も発見した。実測データと月コストを全公開する。</p>



<div class="wp-block-cocoon-blocks-balloon-ex-box-1 speech-wrap sb-id-1 sbs-stn sbp-l sbis-cb cf block-box not-nested-style cocoon-block-balloon"><div class="speech-person"><figure class="speech-icon"><img decoding="async" src="https://shumatsu-lab.com/wp-content/uploads/2026/03/murasaki_icon.png" alt="ムラサキ" class="speech-icon-image"/></figure><div class="speech-name">ムラサキ</div></div><div class="speech-balloon">
<p class="wp-block-paragraph">コードレビューは「念のため通す」感覚でLLMに任せていたが、手法によって検出率が倍以上違うとは思っていなかった。</p>
</div></div>


<div class="slb slb-tldr">
  <div class="slb-tldr__head">
    <span class="slb-mono slb-tldr__label">TL;DR / 三行要約</span>
          <span class="slb-mono slb-tldr__meta">8分 MIN READ · UPDATED 2026-05-14</span>
      </div>
  <ol>
          <li>実バグ6本・4手法ベンチマーク: Claude Code 94%・Codex CLI 77%・CodeRabbit 42%</li>
          <li>/security-review はセキュリティ特化、偽陽性ゼロで専門領域7/7完璧</li>
          <li>全手法が見逃した Bug2 ── git history を見ないと検出できないバグカテゴリが存在する</li>
      </ol>
    <div class="slb-tldr__badges">
          <span class="slb-badge slb-badge--hi">
        RESULT — 完了      </span>
          <span class="slb-badge">
        TOOL — Claude Code      </span>
          <span class="slb-badge">
        COST — サブスク内      </span>
      </div>
  </div>
    




  <div id="toc" class="toc tnt-number toc-center tnt-number border-element"><input type="checkbox" class="toc-checkbox" id="toc-checkbox-4" checked><label class="toc-title" for="toc-checkbox-4">目次</label>
    <div class="toc-content">
    <ol class="toc-list open"><li><a href="#toc1" tabindex="0">なぜLLMコードレビューのセカンドオピニオンが必要か</a><ol><li><a href="#toc2" tabindex="0">「通った」と「正しい」は別の話</a></li><li><a href="#toc3" tabindex="0">副業・個人開発でのリスク</a></li></ol></li><li><a href="#toc4" tabindex="0">ベンチマーク設計 — 実バグ6本・4手法の条件</a><ol><li><a href="#toc5" tabindex="0">バグの仕込み方</a></li><li><a href="#toc6" tabindex="0">4手法の評価条件</a></li></ol></li><li><a href="#toc7" tabindex="0">4手法の結果比較</a><ol><li><a href="#toc8" tabindex="0">全体スコア</a></li><li><a href="#toc9" tabindex="0">Claude Code code-reviewer の特徴</a></li><li><a href="#toc10" tabindex="0">Codex CLI GPT-5.5 の特徴</a></li><li><a href="#toc11" tabindex="0">CodeRabbit Pro Plus の特徴</a></li><li><a href="#toc12" tabindex="0">/security-review の特徴</a></li></ol></li><li><a href="#toc13" tabindex="0">全手法が見逃したバグ — Bug2が示す「LLMの壁」</a></li><li><a href="#toc14" tabindex="0">月コストと推奨スタック</a><ol><li><a href="#toc15" tabindex="0">コスト比較</a></li><li><a href="#toc16" tabindex="0">3つの推奨スタック</a></li></ol></li><li><a href="#toc17" tabindex="0">よくある質問</a></li><li><a href="#toc18" tabindex="0">まとめ</a></li></ol>
    </div>
  </div>

<h2 class="wp-block-heading"><span id="toc1">なぜLLMコードレビューのセカンドオピニオンが必要か</span></h2>



<h3 class="wp-block-heading"><span id="toc2">「通った」と「正しい」は別の話</span></h3>



<p class="wp-block-paragraph">自分でコードを書いて自分でレビューする個人開発・副業開発では、認知バイアスが避けられない。書いた本人はコードの意図を知っているため、実装のミスより「動くはずだ」という確信が先に来る。</p>



<p class="wp-block-paragraph">LLMにセカンドオピニオンを求める意義はここにある。コードの意図を知らない第三者として差分を読む。ただし「LLMに投げた」だけでは安心できない。どのツールをどの条件で使うかで、検出できるバグの種類と精度が大きく変わる。</p>



<h3 class="wp-block-heading"><span id="toc3">副業・個人開発でのリスク</span></h3>



<p class="wp-block-paragraph">副業でサービスを運用している場合、バグの影響は直接収益・信用に直結する。SQLインジェクション1本でユーザーデータが流出すれば、個人サービスとして終わりに近い。ロジックバグで二重投稿が発生すれば、SNS連携を使ったシステムが誤動作し続ける。</p>



<p class="wp-block-paragraph"><a href="https://shumatsu-lab.com/claude-code-personal-service-development/">Claude Codeを使った個人サービス開発の正直な話</a>でも触れたが、実装速度が上がるほどレビューの抜け漏れリスクも比例して増える。</p>



<h2 class="wp-block-heading"><span id="toc4">ベンチマーク設計 — 実バグ6本・4手法の条件</span></h2>



<h3 class="wp-block-heading"><span id="toc5">バグの仕込み方</span></h3>



<p class="wp-block-paragraph">実際に過去に発生した、または発生しうるバグを6本選定し、「正常な修正後コード」をmainブランチ、「バグを再導入したコード」をfeatureブランチとして、正規のPR形式で差分を作成した。PR titleとdescriptionは「意図的に無害に見える説明」を付けた。</p>



<figure class="wp-block-table"><table><thead><tr><th>PR</th><th>カテゴリ</th><th>隠したバグの内容</th></tr></thead><tbody><tr><td>Bug1</td><td>ロジック</td><td>XAutoPost 当日投稿チェックの削除 → 二重投稿</td></tr><tr><td>Bug2</td><td>null契約</td><td>null返却で白画面（PR説明はflash of content防止と記述）</td></tr><tr><td>Bug3</td><td>インフラ仕様</td><td>.remotionignore の親ディレクトリ除外 → 出力ファイル全消失</td></tr><tr><td>Bug4</td><td>リファクタ</td><td>mailer統合の後方互換なし → smtpReady=false で無音停止</td></tr><tr><td>Bug5</td><td>レジリエンス</td><td>例外を suitable=False に統一 → 判定不能時に生成スキップ</td></tr><tr><td>Bug6</td><td>セキュリティ</td><td>requireAdmin削除＋SQLi×3＋SELECT* → 認証バイパス・情報漏洩</td></tr></tbody></table></figure>



<h3 class="wp-block-heading"><span id="toc6">4手法の評価条件</span></h3>



<p class="wp-block-paragraph">各手法はそれぞれのPRのみを閲覧できる制限下で実施した。ground-truth（バグの正解）にアクセスできる情報は一切渡さない。</p>



<ul class="wp-block-list">
<li><strong>Claude Code code-reviewer</strong>: git worktreeに閲覧範囲を限定したsubagentで実行</li>



<li><strong>CodeRabbit Pro Plus</strong>: <code>@coderabbitai review</code> でPRに対してトリガー</li>



<li><strong>Codex CLI GPT-5.5</strong>: 各worktreeでCLIインタラクティブモードで実行</li>



<li><strong>/security-review</strong>: 同じworktreeで <code>/security-review</code> スラッシュコマンド</li>
</ul>



<h2 class="wp-block-heading"><span id="toc7">4手法の結果比較</span></h2>



<h3 class="wp-block-heading"><span id="toc8">全体スコア</span></h3>



<figure class="wp-block-table"><table><thead><tr><th>手法</th><th>検出率</th><th>6PR判定</th><th>月コスト概算</th></tr></thead><tbody><tr><td>Claude Code code-reviewer</td><td><strong>94%</strong> (22.5/24点)</td><td>BLOCK×3, WARNING×2, APPROVE×1</td><td>Max $100/月内</td></tr><tr><td>Codex CLI GPT-5.5</td><td><strong>77%</strong> (18.5/24点)</td><td>要修正×4, 要確認×1, APPROVE×1</td><td>従量 ~$0.6/PR</td></tr><tr><td>CodeRabbit Pro Plus</td><td><strong>42%</strong> (10/24点)</td><td>Critical指摘×3, 別観点×1, スルー×2</td><td>Pro $24/月～</td></tr><tr><td>/security-review</td><td><strong>専門特化</strong> (Bug6で7/7)</td><td>セキュリティ以外は対象外</td><td>Max内</td></tr></tbody></table></figure>



<h3 class="wp-block-heading"><span id="toc9">Claude Code code-reviewer の特徴</span></h3>



<p class="wp-block-paragraph">最も検出率が高く、偽陽性はゼロだった。gitignoreの「親ディレクトリ除外時に子を再includeできない」という仕様詳細（Bug3）を正確に引用して指摘できた点は他手法にはない強みだ。</p>



<p class="wp-block-paragraph">Bug4ではground-truthの4観点に加え、<code>(process.env.SMTP_PORT || '587') === '465'</code> という文字列比較バグ（数値と文字列の型不一致）をボーナス検出した。</p>



<p class="wp-block-paragraph">弱点はPR descriptionとdiffの論理整合性を重視する点。Bug2のように「PR説明が正しい場合に、それ以上の情報なしには判断できないバグ」はAPPROVEになった。</p>



<h3 class="wp-block-heading"><span id="toc10">Codex CLI GPT-5.5 の特徴</span></h3>



<p class="wp-block-paragraph">ロジック・セキュリティ・リファクタの全カテゴリで安定した検出を見せた。Bug6ではmodels/user.jsを実際に読み込み、「<code>db.prepare()</code>が内部でキャッシュしているため、raw SQL化によるパフォーマンス改善の主張が成り立たない」と技術的矛盾を指摘した。</p>



<p class="wp-block-paragraph">Claudeと同様にBug2は見逃した。Bug3は本質をカバーしたが1点未検出（3/4）。Bug5は判定不能と不適性の区別に触れたが、silent failure観点の指摘がCodeRabbitと差があった（3.5/4）。</p>



<p class="wp-block-paragraph">コストは従量制。Bug1〜6の5PR相当で約$3.10の消費（Bug1を2回実行したため）。1PRあたり$0.5〜0.8程度。</p>



<h3 class="wp-block-heading"><span id="toc11">CodeRabbit Pro Plus の特徴</span></h3>



<p class="wp-block-paragraph">セキュリティバグ（Bug6）では4つのCritical指摘を出した。requireAdmin削除・SQLi×3を endpoint 別に分離して指摘する細かさはむしろ他手法より詳細だった。</p>



<p class="wp-block-paragraph">一方、Bug3（.remotionignore仕様）とBug2（null白画面）は完全スルー。Bug4はground-truth外の観点（attachmentのBase64バリデーション、extrasオーバーライド）を指摘した。これはground-truthでは0点扱いだが、別の品質問題を発見しており補完的な価値はある。</p>



<div class="wp-block-cocoon-blocks-icon-box common-icon-box block-box information-box">
<p class="wp-block-paragraph">CodeRabbit Pro Plus の 14日トライアル終了後は月 $24/シートが発生する。Free版はCHATTY/AGGRESSIVEプロファイルになる可能性があり、同等評価ではない。</p>
</div>



<h3 class="wp-block-heading"><span id="toc12">/security-review の特徴</span></h3>



<p class="wp-block-paragraph">Bug6（セキュリティ3重）に対して7つのHigh脆弱性を検出した。各脆弱性に exploit scenario が付属し、「<code>GET /admin/users/search?q=%25'%20UNION%20SELECT%20...</code>でpassword_hashを全件奪取できる」という具体的な攻撃経路まで記述する。</p>



<div class="wp-block-cocoon-blocks-balloon-ex-box-1 speech-wrap sb-id-1 sbs-stn sbp-l sbis-cb cf block-box not-nested-style cocoon-block-balloon sbp-r"><div class="speech-person"><figure class="speech-icon"><img decoding="async" src="https://shumatsu-lab.com/wp-content/uploads/2026/03/murasaki_icon.png" alt="ムラサキ" class="speech-icon-image"/></figure><div class="speech-name">ムラサキ</div></div><div class="speech-balloon">
<p class="wp-block-paragraph">exploitシナリオ付きのレビューを見たのは初めてだった。pentest報告書に近い水準で、これは他手法では出てこない。</p>
</div></div>



<p class="wp-block-paragraph">Bug1〜5（非セキュリティ）に対しては全て「脆弱性なし」と正確に判定した。偽陽性はゼロ。Bug4では添付ファイル検証の問題をconfidence 7/10で近似検出したが、しきい値8未満としてレポートから除外する設計になっている。Bug5では「fail-closed化はセキュリティ的には改善」と観察まで付けた。</p>



<h2 class="wp-block-heading"><span id="toc13">全手法が見逃したバグ — Bug2が示す「LLMの壁」</span></h2>



<p class="wp-block-paragraph">Bug2のPRは以下の差分だった。</p>



<pre class="wp-block-code"><code>// 変更前
if (isMaintenance === null) return &lt;MaintenanceSplash /&gt;;

// 変更後（バグ）
if (isMaintenance === null) return null;</code></pre>



<p class="wp-block-paragraph">PR title は <code>fix(preview): メンテ確認中の flash of content を防止</code>。PR description は「null返却でコンテンツを非表示にし、確認中に本文がチラ見えする問題を修正」と記述されていた。</p>



<p class="wp-block-paragraph">この差分だけを見れば「null返却でコンテンツを非表示にする」という説明とコードは論理的に一致する。<strong>実際の問題は「変更前が白ページ防止のための修正であり、変更後がそれを打ち消している」</strong>という点だが、それを知るにはgit blameと元のissueを読む必要がある。</p>



<p class="wp-block-paragraph">全4手法がAPPROVEまたは「No actionable comments」を返した。LLMがPR単体で読める情報には構造的な限界がある。</p>



<div class="wp-block-cocoon-blocks-tab-box-1 blank-box bb-tab bb-check block-box">
<p class="wp-block-paragraph">検出不可能なバグのパターン:</p>



<ul class="wp-block-list">
<li>PR description の主張とdiffが論理的に一致している</li>



<li>バグが「元のコードのコメントや設計意図の反転」である</li>



<li>git history・issueを読まないと「修正方向が正しいか」判断できない</li>
</ul>



<p class="wp-block-paragraph">対策: commit message の品質向上・PR description に「変更前の問題の根本原因」を必ず記述する運用ルール</p>
</div>



<h2 class="wp-block-heading"><span id="toc14">月コストと推奨スタック</span></h2>



<h3 class="wp-block-heading"><span id="toc15">コスト比較</span></h3>


<div class="slb slb-roi">
  <div class="slb-roi__head">
    <span class="slb-mono slb-roi__label">ROI DASHBOARD</span>
      </div>
  <div class="slb-roi__grid">
        <div>
      <div class="slb-mono slb-roi__item-label">月額コスト (Claude Max): $100</div>
      <div class="slb-roi__item-val">
              </div>
      <div class="slb-mono slb-roi__item-note">&nbsp;</div>
    </div>
        <div>
      <div class="slb-mono slb-roi__item-label">/security-review 追加コスト: $0（Max内）</div>
      <div class="slb-roi__item-val">
              </div>
      <div class="slb-mono slb-roi__item-note">&nbsp;</div>
    </div>
        <div>
      <div class="slb-mono slb-roi__item-label">CodeRabbit Free: $0</div>
      <div class="slb-roi__item-val">
              </div>
      <div class="slb-mono slb-roi__item-note">&nbsp;</div>
    </div>
        <div>
      <div class="slb-mono slb-roi__item-label">Codex CLI 月10PR想定: ~$6</div>
      <div class="slb-roi__item-val">
              </div>
      <div class="slb-mono slb-roi__item-note">&nbsp;</div>
    </div>
        <div>
      <div class="slb-mono slb-roi__item-label">CodeRabbit Pro Plus: $24/シート</div>
      <div class="slb-roi__item-val">
              </div>
      <div class="slb-mono slb-roi__item-note">&nbsp;</div>
    </div>
      </div>
  </div>
    



<h3 class="wp-block-heading"><span id="toc16">3つの推奨スタック</span></h3>



<p class="wp-block-paragraph"><strong>パターンA: Claude Code Maxプランのみ（月$100）</strong></p>



<ul class="wp-block-list">
<li>code-reviewer: PR全件</li>



<li>/security-review: セキュリティ変更を含むPRのみ追加実行</li>



<li>検出率: 94%（非セキュリティ）＋ 専門セキュリティ</li>



<li>適合: 副業・個人開発でコストを抑えたい場合</li>
</ul>



<p class="wp-block-paragraph"><strong>パターンB: A + CodeRabbit Free（追加コスト$0）</strong></p>



<ul class="wp-block-list">
<li>code-reviewerでの自動レビュー ＋ CodeRabbitの自動トリガー</li>



<li>Bug4のような「観点の違う指摘」が追加される</li>



<li>適合: CI/CDにコードレビューを組み込みたい場合</li>
</ul>



<p class="wp-block-paragraph"><strong>パターンC: A + Codex CLI（月~$6追加）</strong></p>



<ul class="wp-block-list">
<li>重要PR・レビューを念入りにしたいPRのみCodexでダブルチェック</li>



<li>Bug3のような「2手法が独立して同じバグを検出した」ケースで信頼度が上がる</li>



<li>適合: ロジック系バグが多い開発フェーズ</li>
</ul>



<p class="wp-block-paragraph"><a href="https://shumatsu-lab.com/claude-code-cost-reduction-3tier-stack/">Claude Codeのコストを50〜75%削減する3層スタック実践</a>と組み合わせると、MaxプランをClaude Code全体の開発コストとして最適化しながらレビューも回せる。</p>



<p class="wp-block-paragraph">コードレビュー以外も含めた組織全体のAI導入を考えるなら、<a href="https://shumatsu-lab.com/enterprise-ai-comparison-dev/">ChatGPT・Claude・Geminiの開発業務向けプラン選定ガイド</a>で3社のエンタープライズ構造を9軸で比較している。</p>



<h2 class="wp-block-heading"><span id="toc17">よくある質問</span></h2>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">Claude Code code-reviewer と /security-review は何が違うのか</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">code-reviewer は一般的なコードレビュー（ロジック・設計・品質）を行い、セキュリティ以外のバグも対象にする。/security-review はセキュリティ脆弱性（SQLi・XSS・認証バイパス等）に特化し、exploit scenario付きの報告を出す。両方を使うことで補完関係になる。今回のベンチマークでは code-reviewer が Bug1〜5 を94%カバーし、/security-review が Bug6 のセキュリティ観点を7/7検出した。</p>



<p class="wp-block-paragraph">モデルの世代でも検出力は変わり、Opus 4.8は自前コードの欠陥を見逃さず指摘する確率が4.7の約4倍とされる。世代差が副業にどう効くかは<a href="https://shumatsu-lab.com/claude-opus-4-8-side-job-guide/">Opus 4.8で何が変わったかの整理</a>にまとめた。</p>

</div></dd></dl></div>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">CodeRabbit Free と Pro Plus は検出率が変わるのか</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">今回の検証はPro Plus（14日トライアル）で実施した。Freeプランは1日10回のPRレビュー制限があり、プロファイル設定（CHILL/CHATTY/AGGRESSIVE）がPro Plusと異なる可能性がある。同一バグに対する検出精度が変わるかは未検証。Freeはまず試してから判断するのが妥当。</p>
</div></dd></dl></div>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">Codex CLI は OpenAI のアカウントが必要か</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">はい。OpenAI APIキーが必要で従量制課金になる。今回の6PR相当で約$3（Bug1を2回実行含む）。GPT-5.5（デフォルトモデル）での消費量は1PR当たり$0.5〜0.8程度。OpenAIのAPIクレジットをチャージしてから使う。</p>
</div></dd></dl></div>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">全手法が見逃したBug2のようなケースはどう対処するか</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">PR descriptionに「変更前の問題の根本原因と修正の方向性」を必ず明記する運用ルールが有効。「flash of contentが起きているためnullで非表示にした」という説明では不十分で、「null返却ではなく空白のUIコンポーネントを返すべき設計だった」という意図まで書く必要がある。LLMはPR単体で読める情報しか使えない。</p>
</div></dd></dl></div>



<div class="wp-block-cocoon-blocks-faq faq-wrap blank-box block-box cocoon-block-faq"><dl class="faq"><dt class="faq-question faq-item"><div class="faq-question-label faq-item-label">Q</div><div class="faq-question-content faq-item-content">個人開発でどのパターンから始めるべきか</div></dt><dd class="faq-answer faq-item"><div class="faq-answer-label faq-item-label">A</div><div class="faq-answer-content faq-item-content">
<p class="wp-block-paragraph">Claude Code MaxプランのみのパターンAから始めるのが現実的。code-reviewer をサブエージェントで呼ぶ設定をCLAUDE.mdに1行追加するだけで、PRを作るたびに自動レビューが回せる。CodeRabbit FreeはGitHubに導入するだけで追加コストゼロなので、CI/CDがある場合は併用を推奨。<a href="https://shumatsu-lab.com/vibe-coding-claude-free-business-system/">バイブコーディングの実践記</a>のような実装速度優先の開発ほど、こういったレビュー網が効く。</p>
</div></dd></dl></div>



<h2 class="wp-block-heading"><span id="toc18">まとめ</span></h2>



<p class="wp-block-paragraph">実バグ6本・4手法のベンチマークで明らかになったことを3点に絞る。</p>



<ol class="wp-block-list">
<li><strong>Claude Code 内蔵 code-reviewer が検出率94%で最強</strong>。gitignore仕様など深い技術知識が必要な仕様系バグ（Bug3）を偽陽性ゼロで検出できる。Maxプランなら追加コストなし。</li>



<li><strong>/security-review はセキュリティ変更のある PRに必ず追加実行する価値がある</strong>。exploit scenarioと7分離された脆弱性報告はpentest相当の精度で、code-reviewerの検出内容と補完関係になる。</li>



<li><strong>「PR description + diff の整合性チェック」だけでは検出できないバグがある</strong>。Bug2のように元の設計意図の反転であるケースは、全LLMツールで見逃す構造的な限界がある。ツールへの過信ではなく、PRの書き方の改善（根本原因の明記）で対処する。</li>
</ol>



<p class="wp-block-paragraph">月$100のClaudeMaxプランに code-reviewer と /security-review を組み込めば、追加費用ゼロで実測94%＋セキュリティ専門レビューが完結する。外部LLM（Codex）は重要なPRのみに絞って使うのがコスパの良い選択肢だ。</p>




<div class="slb slb-profile">
  <div class="slb-profile__avatar">
          <img decoding="async" src="https://secure.gravatar.com/avatar/cb96d10a4f4bab829b35e83ca2b1d9cfa752aef03951f42b06f39ebc3b8019a4?s=128&#038;d=mm&#038;r=g" alt="ムラサキ">
      </div>
  <div class="slb-profile__body">
    <div class="slb-profile__name">ムラサキ</div>
    <div class="slb-mono slb-profile__title">SE歴20年 · 金融系システム開発課長 · 週末起業1年目</div>
    <div class="slb-profile__bio">システムエンジニア歴20年。金融系システム開発の課長として勤務する傍ら、AIと副業の最前線を実践レポート。Claude Code Max 5xプランを日常業務・副業開発に活用中。一次情報と実測値にこだわった記事を発信。</div>
    <div class="slb-profile__stats">
      <div>
        <span class="slb-profile__stat-val">20</span>
        <span class="slb-mono slb-profile__stat-label">YRS SE</span>
      </div>
      <div>
        <span class="slb-profile__stat-val">5</span>
        <span class="slb-mono slb-profile__stat-label">MOS 副業</span>
      </div>
      <div>
        <span class="slb-profile__stat-val">42</span>
        <span class="slb-mono slb-profile__stat-label">ARTICLES</span>
      </div>
    </div>
  </div>
</div>
    
]]></content:encoded>
					
		
		
		<post-id xmlns="com-wordpress:feed-additions:1">1569</post-id>	</item>
	</channel>
</rss>
