ブックマーク / zenn.dev/u1 (2)

  • 生成AIにおけるHTML/画像出力の必要性と改善案としてのRHW(reviewable-html-workbench)の紹介

    出力量が増えると何が起きるか 2026 年 4 月の CHI ワークショップで発表された研究が、この負荷の分布を実際に観察しています(Catalan et al.)。Samsung R&D Institute Philippines と York University のグループが、経験 1 年未満から 10 年超まで 4 人のソフトウェアエンジニアに Cline でコード生成タスクをやらせ、Bloom's Taxonomy (思い出す・理解する・分析する・評価するという段階で理解の深さを測る枠組み) で認知的関与の水準を測ったものです。 計画段階では、4 人とも十分な認知資源を使っていました。プロンプトの意図を確かめ、作業ディレクトリのファイルを検証し、「これはどういう文脈なのか」と声に出して問い直す人もいました。この段落を読んでいる人の実感にも近いはずです。ここは、問題そのものを考える

    生成AIにおけるHTML/画像出力の必要性と改善案としてのRHW(reviewable-html-workbench)の紹介
    zu2
    zu2 2026/07/31
  • Opus5が思考が浅いように感じる問題への対策

    Claude Code を Opus 5 に切り替えた直後から、応答の散文傾向が急に強まり、思考が浅くなる (構造化して考えられない) 変化が出ました。長年育ててきた rules (CLAUDE.md や常時ロードの指示ファイル群) は何も変えていないのに、です。調べていくと、モデルが悪いのでも rules が壊れたのでもなく、Claude 5 世代で Opus 5 に配られる体 system prompt が大きく変わり、旧来の rules がその前提で書かれていなかったのが原因でした。 この記事は、その切り分けと、rules を新しい system prompt に合う形へ直すまでの記録です。「モデルを新世代に上げたら CLAUDE.md や rules の効きが変わった」と感じている Claude Code 利用者向けです。 起きたこと 同一セッション・同一 rules のまま、モ

    Opus5が思考が浅いように感じる問題への対策
    zu2
    zu2 2026/07/26
  • 1