Hi there 👋

GitHub で大企業の AI コーディング導入支援をしています。現場での学びと、エージェント設計の試行錯誤を書いています。

いま書いているのは AI エージェント設計の連載 です。2012〜2023 年の Azure・Kubernetes・Dev 環境の記事は アーカイブ にあります。

エージェントに数時間任せたいなら、先にテストとビルドが合否を返す状態にする

@iwashi86 さんが X に投稿した、AWS の Clare Liguori 氏の講演メモ「このAWSの方の発表はかなり面白い」(2026-09-02 投稿、2026-09-03 取得)を読みました。講演本体は AI Engineer が公開した「From AI-Assisted to AI-Native: Building a Frontier Development Team」(2026-08-28 公開、2026-09-03 に説明文のみ取得)です。 ...

2026年9月3日 · 8 分 · nnasaki

エージェントが繰り返し直せなかった場所は、人間にも読みにくい場所。命令ファイルではなくコードにコメントを足す

Cloudflare のブログに「How we built a software factory to drive Astro’s GitHub issue count to zero」という記事が出ました(Matthew Phillips、2026-08-04 公開、2026-08-21 取得)。Astro のリポジトリで自動トリアージを数か月回して、未解決 issue を 200 件超から約 30 件まで減らした話です。 ...

2026年8月21日 · 6 分 · nnasaki

トークン削減ツールは「どの無駄を削るか」で選ぶ。シェル出力の圧縮を手元で測ったら、減ったのはファイル読みだけだった

Shin | Decision-OS さんの X の記事「なぜ同じAIを使っているのに、差が開いていくのか」(2026-08-13 投稿、2026-08-21 取得)を読みました。AI のトークン消費を減らすツールを4本並べた記事ですが、ツールの優劣ではなく「それぞれが AI の仕事の別の場所にある摩擦を減らしている」という並べ方をしています。 ...

2026年8月21日 · 6 分 · nnasaki

CLAUDE.md に書くのは「モデルが自力で分からないこと」だけ。.NET ブログの選別基準を手元のファイルに当てた

.NET のブログに「Instructions Hygiene: What Frontier Models Still Need You to Say」という記事が出ました(Wendy Breiding、2026-08-12 公開、2026-08-21 取得)。copilot-instructions.md や AGENTS.md、CLAUDE.md のような、エージェントに毎回読ませる指示ファイルをどう手入れするか、という話です。 ...

2026年8月21日 · 8 分 · nnasaki

「受け入れた」は品質の証拠にならない。残存率という指標を手元のリポジトリで数えた

VS Code のブログに「MAI-Code-1-Flash: early results from real developer workflows」という記事が出ました(2026-07-29 公開、2026-07-30 取得)。新しいコーディングモデルのローンチ記事なのですが、目を引いたのはモデルの性能ではなく、性能の測り方のほうでした。 ...

2026年8月18日 · 9 分 · nnasaki

エージェント運用をグラフとして設計する。14段ロードマップの主張を2つ、手元で実測した

0xMovez AI さんの「Graph Engineering with Claude: 14-Step roadmap from 0 to graph architect」(2026-07-25 公開、2026-07-30 取得)を読みました。直線的に走らせているエージェント運用を、処理の単位(節点)とデータが流れる経路(辺)からなるグラフとして設計し直す、という記事です。 ...

2026年8月18日 · 11 分 · nnasaki

エージェントに「なんで?」と聞くのをやめて、作業のときに書かせる

エージェントが妙な変更をしたとき、「なんでこうしたの?」と聞いている人向けです。返ってくる答えが何なのか、代わりにどこを読めばよいのかを書きます。あわせて、手元の Claude Code のセッションログに思考の中身が残っているかを数えたので、そのコマンドと出力をそのまま載せます。 ...

2026年8月15日 · 17 分 · nnasaki

エージェントハーネスの grep は grep ではなかった。「0件でした」を信じていたら、本文は全文入っていた

エージェントに調べ物をさせて、その結果を信じてよいか確かめている人向けです。 「原文を取ってきて、この語句を grep して件数を報告せよ」という指示は、裏取りのやり方としてかなり筋がよく見えます。実際、私はそれを規約に書いて1週間ほど運用していました(明文化したのは 2026-07-26 です)。その規約が破れたので、破れ方と直し方を書きます。手元で最小再現まで取れたので、コマンドと出力をそのまま載せます。 ...

2026年8月15日 · 8 分 · nnasaki

CLAUDE.md のどの行を消してよいか、ビルドの Red/Green で決める

CLAUDE.md や AGENTS.md、copilot-instructions.md が膨らんできて、削りたいが怖くて削れない人向けです。 削ってよい行を、勘ではなく CI の終了コードで判定する方法を書きます。手元のリポジトリで9通り実測したので、その手順と結果をそのまま載せます。 ...

2026年8月7日 · 14 分 · nnasaki

MCP がステートレスになった — リモートサーバを運用する側から見て何が変わるか

MCP の新しい仕様 2026-07-28 が出ました。告知の一文が「MCP is now stateless, making it easier to deploy and scale remote servers」です(@ClaudeDevs、2026-07-29 取得)。 リモート MCP サーバを自分で運用する側から読むと、これは仕様の話というより配置の話でした。実際に最小のサーバを書いて確かめたので、その結果まで書きます。 ...

2026年7月29日 · 12 分 · nnasaki