はじめに ここ数ヶ月で開発の流れがかなり変わった。 リファインメントで grill して認識を合わせ、実装は LLM に任せられる範囲が増え、多層モデルのレビュー と 厚い CI を通し、babysit-pr で green になるまで面倒を見させる。この流れが回り始めてから、かなりの信頼度の change list が安定して生産できるようになった。 全体の流れ リファインメント(grill) → プランニング(順番とキャパシティを詰めるだけ) → 実装(Claude Code が書く) → 多層 AI レビュー(Copilot / Codex)+ 厚い CI → babysit-pr(green になるまでループ) → PR を open にして人間のコードオーナーへレビュー依頼 → マージ リファインメント: grill grill-us という skill を作って、リファインメン

