俺のAIプログラミング手法(2026/10/05)
ARANK

棚卸し的な記事です。人間の役割を定義するモデルの性能を評価する無茶振りしてどこまで出来るか観察何ができて、何ができなかったことがドメイン知識になるループを構築する自動化して得られた時間で、評価指標を改善する評価指標を作るどの数値を改善すべきか、トレードオフは何を優先すべきかループのイテレーションを評価するAI の行動ログを観察して、評価指標を正しく終えているか、テストとCIをチューニングする(その優先度を与える)評価指標が増えると、そのためのCIが長くなる何を優先して、何をやらないかを明確にする考える順番これはAIに任せられる仕事か与えられない場合、そのブロッカーは何かこの仕事の完了の定義・評価指標は何か数値化できるものならAIで自動化できるAIに指示して、一度やらせてみるまずやらせて、どういう振る舞いをするかを観察するできたとき、このワークフローは自動化できるか?人間がつきっきりではなく、判断基準自体を作れるかできなかったとき、その理由は何か?コンテキストの不足なら、その指示や守るべきテストを追加権限の不足なら、それを与えられるか検討性能の不足(半年寝て待つ)常にアンラーニングするプロンプトは高速…

zenn.dev
Related Topics: AI