タグ: AI開発

Opus 5は「聞き返さない」──ベンチマーク訓練がLLM品質にもたらした副作用
AI・機械学習

Opus 5は「聞き返さない」──ベンチマーク訓練がLLM品質にもたらした副作用

Opus 5が曖昧な指示でも確認せず勝手に実装を進める理由を解説。ベンチマーク訓練とRLHFが「聞き返さないモデル」を生む構造的メカニズムと、仮定を可視化させるプロンプト設計の実践的対策を紹介。

Claudeのコメントが長すぎる問題──AIが書いたコメントは、AI自身の役に立っていなかった
AI・機械学習

Claudeのコメントが長すぎる問題──AIが書いたコメントは、AI自身の役に立っていなかった

Claude Codeが生成する過剰コメントの原因をRLHFの訓練特性から解説。「コードから復元できない情報のみ」ルールでコメント比率を21%→8.8%に改善した実践知。明日から使えるCLAUDE.md設定付き。

「指示を増やすほど壊れる」を卒業する——Claude Codeハーネスエンジニアリング実践ガイド
AI・機械学習

「指示を増やすほど壊れる」を卒業する——Claude Codeハーネスエンジニアリング実践ガイド

Claude Codeで「指示を増やすほど壊れる」問題を解決するハーネスエンジニアリング実践ガイド。CLAUDE.md・settings.json・hooksの3層アーキテクチャで、指示を減らしながら精度を高める設計技法を解説。