AIの「読みました」「直しました」を、ぼくはどう確かめているか ── 自己申告と実際が違った3回
AIの申告は嘘ではありませんでした。ただ、申告は「AIが自分をどう見ているか」であって、実物ではなかった。 ぼくはコードが読めないので、申告を信じるか疑うかでは判断できません。代わりに、実物が返ってくる聞き方に変えました。

| 日付 | AIの申告 | 実際 | どう分かったか |
|---|---|---|---|
| 2026年8月27日〜31日 | 「定時実行が発火していない」 | 半分だけ正しかった。28日分は6時間半遅れて発火し、失敗として存在していた。原因は別(git add の一覧の漏れ) | 実行画面の一覧をぼくが見た |
| 2026年9月22日 | 「AGENTS.md は自動で読み込まれていない」 | 読み込まれていた。設定画面に loaded と出ていた | 「ファイルを開かずに決まりを書き出して」と頼み、12行と突き合わせた |
| 2026年9月22日 | 「公開してよい」(決める側のAI) | note に貼った実物の枠2か所が、灰色の空白のまま公開されていた | ぼくが note の画面で見つけた |
1. 申告は「AIの自己像」で、実物ではない
3回とも、AIは自分の知っている範囲から正直に答えています。リポジトリに痕跡が無い、自動で読むのは CLAUDE.md だと記憶している、ツールの出力には中身がある。AIの側から見れば筋が通っていて、実物を見ていないだけです。
だから「AIを信じるか」は問いとして成り立ちません。申告を返す聞き方をやめて、実物を返す聞き方にする。 3回で覚えた聞き方が3つあります。
2. 聞き方1: 「読んだ?」ではなく「開かずに書き出して」
9月22日、Claude Code が CLAUDE.md の無いフォルダでは AGENTS.md を読むようになったと知って(9月18日・v2.1.277)、空のフォルダに AGENTS.md だけを置いて試しました(v2.1.278・設定は触っていません)。設定画面には「no CLAUDE.md found; AGENTS.md loaded」と出ています。
ぼく: どのファイルから読んだ?
AI: このファイルは会話の最初に自動で読み込まれたものではありません。自動で読むのは CLAUDE.md です。(そのあと、自分でファイルを開いて読み直した)
仕組みは読み込んでいるのに、AI自身はそう思っていない。ここで「読んだ?」と聞き続けても申告しか返りません。2回目の起動で、聞き方を変えました。
ぼく: ファイルを一切開かずに、いま守るべき決まりを覚えている範囲で全部書き出して。
AI: (12行を書き出した。AGENTS.md の12行と一致。「冒頭で受け取った」と答えた)
「読んだ?」は申告を返す質問で、「開かずに書き出して」は実物を返す質問です。ぼくが見比べられるのは後者だけです。

3. 聞き方2: 診断には「どこを見れば確定するか」まで言わせる
8月27日の朝、毎朝出るはずのキューが出ませんでした。28日も出ない。リポジトリには痕跡がゼロ。
AI: 定時実行が発火していない。混む時間帯は遅れることがある。(末尾に)確定には実行画面の目視が必要。
31日に GitHub の Actions の一覧を見に行きました。27日は診断どおり発火していない。28日は6時間半遅れて発火し、失敗として存在していました。 動いて、出力を作り、その出力が git add の一覧に入っていなかったので消えていた。痕跡が無かったのはそのためです。
診断は半分当たって半分外れ、外れた半分はAIが見られない場所(実行画面)にありました。それ以来、診断を受け取るときは「確定するには何を見ればいいか」を必ず言わせて、そこをぼくが見に行きます。コードは読めませんが、画面の一覧は読めます。

4. 聞き方3: 出力ではなく「貼った先の画面」を見せてから、公開の判断をさせる
9月22日の午後、サイトの記事を note に転載しました。転載用の下書きを作るツールを初めて使った日です。
決める側のAI: (ツールの出力の文字を確かめて)公開してよい。
実物: その日の夕方に開くと、元記事の引用を入れた枠が2か所、灰色の空白のまま公開されていた。
ツールの出力には中身があったのに、note に貼ると空のコードの枠になっていた。見つけたのはぼくで、AIではありません。7分で差し替えました。
決める側のAIは出力は見ましたが、貼った先は見ていません。見せていなかったからです。この日から、note 向けの確認は5点(本文・表・図・見出し画像・実物の枠の中身)にして、ぼくが貼った状態の画面を決める側のAIが見てから「公開してよい」を出す手順にしました。
5. 3つに共通していること
| 聞き方 | AIに返させるもの | ぼくが見るもの |
|---|---|---|
| 開かずに書き出して | 覚えている決まりの全文 | 書き出した行と、元のファイル |
| どこを見れば確定する? | 診断ではなく、確認する場所 | その画面(実行の一覧) |
| 貼った先の画面を先に見せる | 出力ではなく、貼った結果への判断 | 貼った状態の画面 |
全部同じことをしています。申告ではなく、成果物か画面で確かめる。 作る側のAIに貼っている決まりの「指示書の『前提確認』の項目は実際に読み、その結果を報告に入れる。読まずに進めない」(作る側の決まり)は、この3回から来ています。
逆に、AIが「分からない」と言った回はうまくいっています。9月23日の朝、画像つきの自動投稿を初めて出したとき、作る側のAIは費用の増分を「投稿の分を引いた残りが画像の料金なのか、読み取りが増えた分なのかは、この1回では分けられません」と報告しました。分けられないと言ってくれたので、内訳を取りに行く指示が出せた。申告が「分からない」なら、それはそのまま実物です。
6. うまくいかなかったところ
9月22日の灰色の空白は、決める側のAIに「画面を見せる」手順が無かったから起きました。手順を足したのはその夜で、この記事を書いている9月23日の時点では、まだ1回も再発を試していません。次の転載で1回で通れば効いたと言えるし、通らなければ手順が足りないということです。
もう1つ。「開かずに書き出して」は、AIが読み込んだかは確かめられますが、読み込んだ決まりを守っているかは確かめられません。守っているかは、止まるべきところで止まったかを、あとから見るしかない。そこはまだ、報告と実物を1回ずつ突き合わせています。
準備票を毎朝貼る話は前の記事に、定時実行が2日止まった日の全体はこちらの実録に書いています。
この工場の続きはXで実況しています → @hitoriaifactory
この工場の続きはXで実況しています → @hitoriaifactory