実験中...
9件の記事 - ページ 3 / 9
普段Claude CodeとCodexを併用していて、Codexのスマホアプリのように手元のClaude Codeも外から動かしたい——その一点を埋めるべく、iPhoneから開発マシンのセッションを1コマンドで起動するCLIを自作した記録です。
AIエージェントに自分のAPIキーを握らせるのは、正直こわい。でも、渡さなくても動く。sandbox の一段上、権限そのものを最小に絞る——ネットワーク・秘匿値・信用範囲の線引きを、ポリシー設計の視点で紹介します。
AIが書いたテストの「緑」を、そのまま信じて次に進んでいないだろうか。品質ゲート全体ではなく、テストの信頼性だけに絞って——緑が保証すること・しないこと、緑の嘘を見抜く設計を整理します。
安全のために入れた仕組みで、確認プロンプトが止まらない・セッションが終わらない。設定を見直す前に、まず「暴発・遅延・無限ループ」の3症状で切り分ける——hook を入れた後のデバッグ手順に絞って解説します。
Claude CodeやCodexの月額料金だけ見て「これで業務を自動化できるなら安い」と思うと、実際に業務を回すまでの隠れコストを見落とします。料金以外に何にコストがかかるかを構造で整理します。
AIで試作(PoC)まではできた。でも監視・障害対応・認証・データ整合性で詰まって本番に乗らない——「動くデモ」と「業務で回り続けるシステム」の間にある壁を分解し、超え方を整理します。
AIを使えば社内ツールが自分で作れる時代になった。でも「作り切る・本番で動かす・半年後も壊さない」となると話は変わる。いつ外注に頼むべきか、その判断軸を整理します。
複数ファイルに同じロジックをコピペしたら、いつの間にか片方だけ更新されてズレてバグになった。この「ドリフト」問題を、1ファイルを正本にして自動生成し CI で差分検出する設計で根治した方法を紹介します。
Claude Fable 5とは、Opusの上位に新設されたモデル。発表翌日に実務投入した小さな会社が3日後の全世界停止、7月1日の再開をどう乗り切ったか——モデルの行き来はいつも定数1行。いつでも戻せる切り替え設計を実例で解説します。
正解のない問いに、一緒に挑みましょう。まずはお気軽にご相談ください。