AIに任せる前に、境界を設計するローカルLLM辞書・Agent SOP・Strands Agent SOPs を貫く運用統治の思想― 運用統治の観点からの技術概観 ―
目 次
概要(要旨).................................................................................. 3
第一章 三本を貫く問い ―― 実行・型・標準............................... 4
第二章 ローカルLLM「実行しない辞書」という設計........................ 6
第三章 評価をタスク固有の問題として扱う.................................. 8
第四章 過去ログから手順書を抽出する..................................... 10
第五章 Strands Agent SOPs ―― 背景としての「揺り戻し」........ 12
第六章 Agent SOP の構造 ―― 制約語・パラメータ・進捗・連鎖. 14
第七章 移植性 ―― 一つの手順書を複数の実行系へ....................... 17
第八章 限界と安全設計 ―― 手順書は安全装置そのものではない.... 19
第九章 汎用運用環境への応用....................................................... 21
終章 総括 ―― 振り子と、任せる前の設計.................................... 24
付記 出典・AI開示・注記.......................................................... 26
概要(要旨)
本稿は、二〇二五年から二〇二六年にかけて相次いで公開された三つの技術的話題を、一本の連続した主張として読み解く概観である。第一は、ローカルLLMに対して「実行させず候補だけを返す」小型CLIの設計。第二は、過去の作業ログから反復手順を抽出して標準作業手順書(Agent SOP)へ資産化する試み。第三は、AWSがオープンソース公開した Strands Agent SOPs という自然言語ワークフロー規格である。
結論を先に置く。三つの話題はいずれも、高性能AIそのものを称える話ではない。むしろ、AIに作業を委ねる前に、目的・制約・権限・記録要件という「仕事の境界線」を人間側が先に設計しておくことこそが、AIを一過性の便利さではなく長期の運用資産へ変換する条件だ、という同一の主張の三変奏である。
〔事実〕本稿で扱う一次情報は、AWS Open Source Blog(二〇二五年十一月二十日、James Hood・Nicholas Clegg による投稿)、およびそれを報じた InfoWorld(同年十一月二十四日)、公式リポジトリ strands-agents/agent-sop、加えて産業向けSOP実行を評価した研究ベンチマーク SOP-Bench である。技術的事実はこれらに基づき、評価・推論は〔考察〕として明示的に区別する。
〔考察〕本稿の含意は単純である。派手なモデル性能の更新よりも、手順・制約・成果物・証跡という地味な統制レイヤーの方が、長期の無人運用では効いてくる。AIを「賢い作業者」ではなく「手順と証跡の中で動く作業主体」として扱う設計思想が、静かに主流化しつつある。本稿は、この静かな移行を、小さなCLIから大手クラウドの規格公開までの三つの断面で確認していく。
なお本稿は、特定の個人開発環境ではなく、長期の無人運用を志向する運用一般に当てはめられるよう、環境例を一般化して記述する。技術的主張の骨格は変えず、応用例のみを匿名化・汎用化した公開版である。
〔考察〕本稿を貫く視点をあらかじめ一つ提示しておく。三つの話題は、いずれも「AIの能力を上げる」話ではなく、「AIの能力をどう囲うか」という話である。能力の向上は市場が勝手に進める。だが、その能力を安全かつ再現可能に業務へ流し込む配管は、各運用者が自分で設計しなければならない。本稿が扱うのは、この配管の設計思想である。
