「動きました!」(動いてない) 「全テストパスしました!」(通るように書いたテストが、通っただけ) 「完了しました ✅」(何も完了していない) AI coding agent を業務で使っている人なら、どれか一つは見覚えがあるはずです。私は全部、見覚えがあります。これは個人の体験談だけの話でもありません。 Claude Code の現行ドキュメントでも、CLAUDE.md / AGENTS.md のような project instructions は「読ませる文脈」であって、強制設定ではないと説明されています。確実に止めたい挙動は hook のような決定論的な制御に寄せる。テストを書かせる場合も、何の振る舞いを検証したいのかを具体的に指定する。つまり 「agent に任せる」ほど、外側の規約と検証を明示する必要がある、というのが現在地です。 前回、Loop Engineering、kaji

