実験中...
7件の記事 - ページ 2 / 2
Issue から PR まで無人で進むワークフローでも、機械のほうから人間に差し戻すべき場所があります。品質と責任の切り分け、LLM が緩められない床、行き詰まりの検出という3つの設計を実装の裏付けで解説します。
AIが書いたテストの「緑」を、そのまま信じて次に進んでいないだろうか。品質ゲート全体ではなく、テストの信頼性だけに絞って——緑が保証すること・しないこと、緑の嘘を見抜く設計を整理します。
複数ファイルに同じロジックをコピペしたら、いつの間にか片方だけ更新されてズレてバグになった。この「ドリフト」問題を、1ファイルを正本にして自動生成し CI で差分検出する設計で根治した方法を紹介します。
Claude Fable 5とは、Opusの上位に新設されたモデル。発表翌日に実務投入した小さな会社が3日後の全世界停止、7月1日の再開をどう乗り切ったか——モデルの行き来はいつも定数1行。いつでも戻せる切り替え設計を実例で解説します。
「Issue を渡したら PR まで勝手に進んでほしい」。その理想を、Claude Code の Workflow 機能でエージェントの段取りを JavaScript で書くことで実現した設計と、運用で踏んだ制約を解説します。
AIに「テストを緑にして」と指示するだけでは、AIは品質ではなくテストを攻略しにきます。実運用のAI開発ループで見つかった5つの抜け道と、それぞれの設計的な対策を紹介します。
「エージェントに自由を与えたいが、ホストを触らせたくない」という矛盾に対して、Dockerコンテナで隔離する構成を試しました。Slack→gateway→コンテナという流れで、クレデンシャル分離と設定引き継ぎのハマりどころを実験ベースで整理しています。
正解のない問いに、一緒に挑みましょう。まずはお気軽にご相談ください。