AIウォッチ / 連載

Agentic OS:技術スタックを下から読む67本

計算資源から垂直応用まで、本番のエージェント基盤を OS の階層として下から読み解く連載。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第0回:エージェント基盤はなぜ OS に近づくのか

この一年で、「エージェント」という言葉の重心が変わった。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第1回:推論のコストは、黒板で逆算できる

Agentic OS を下から読むなら、最初に見るべきものはモデルの賢さではない。推論の値段と速度である。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第2回:GPU を遊ばせない ―― 非同期の連続バッチ処理

前回は、推論のコストをどこから見るかを整理した。大きく効いているのは、計算そのものだけではない。重みを読むメモリ帯域、同時に処理するリクエスト数、途中結果を持ち続けるための領域が、生成の速度と費用を決めていた。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第3回:一枚に載らないモデルを、どう分けて配るか

前回までは、モデルが一枚の GPU に収まっているものとして話を進めてきた。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第4回:KV キャッシュを小さくする ―― 頭を減らすか、圧縮するか

前回までで、推論コストの見え方を下から見てきた。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第5回:過去のどこまでを見るか ―― 固定窓と、学習で選ぶ注意

前回は、長文脈の値段を決める KV キャッシュを、モデル構造の側から小さくする方法を見た。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第6回:層をまたいで使い回す ―― 効率化は、近似との取引である

前回まで、長い文脈を扱うときに何が重くなるのかを見てきた。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第7回:大半を、もっと軽い仕組みに置き換える ―― ハイブリッドという組み立て

前回まで、長い文脈を扱うときの工夫を見てきた。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第8回:考える力は、どう教えられたか ―― 検証できる答えで鍛える

ここまで数回は、モデルを効率の側から見てきた。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第9回:答える時間を、もっと使う ―― 推論時に計算を足す

前回は、考える力をどう鍛えるかを見た。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第10回:世界モデルとは何か ―― 次の「状態」を予測し、想像の中で試す

第8回では、モデルに考える力をどう鍛えるかを見た。第9回では、答えを出す時間に計算を足すことで、推論を強くする考え方を見た。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第11回:手を動かさせる前に ―― サンドボックスという「縛られた実行環境」

ここまでの回では、主にモデルそのものを見てきた。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第12回:エージェントの記憶 ―― 保存ではなく「なぜそうしたか」を残す

前回は、エージェントに手を動かさせるための実行環境を見た。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第13回:一体から複数へ ―― 難所は「間」にあり、実行ツリーで見る

前回まで見てきたのは、一体のエージェントをどう安全に走らせるかだった。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第14回:段を重ねるほど崩れる ―― 信頼性の崖と、編成の型

前回は、複数のエージェントが動くとき、その難しさは個々の点よりも「間」に出る、という話をした。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第15回:道具の呼び出しは、分散システムへの呼び出しである

前回は、L4 の編成を「長い鎖を短く区切る」ものとして見た。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第16回:注入攻撃 ―― なぜ、データを読むだけで乗っ取られるのか

ここまでの数回で、エージェントを「賢い」だけのものから、「任せられる」ものへ近づけてきた。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第17回:注入をどう防ぐか ―― 指示とデータの、硬い境界

前回は、注入がなぜ効くのかを見た。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第18回:本当にできているか、どう確かめるか ―― 答えではなく「たどった道」を読む

ここまで、エージェントをどう作るかを下から見てきた。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第19回:コールドスタート ―― 推論を「本当にサーバーレス」にする四段の早回し

第1回から第3回では、推論コストの中心にある単純な事実を見た。GPU は高い。だから、確保した GPU を遊ばせると、そのまま損になる。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第20回:推論エンジンの中身 ―― KV を「ページ」として配る

第1回から第3回で、長文脈の値段は、かなりの部分を KV キャッシュが決める、と見た。KV は過去文脈のための作業場所であり、リクエストごとに固有である。重みのように、多くの利用者で割り勘しにくい。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第21回:指標は、目標になると壊れる ―― エージェント評価の根の罠

第18回では、エージェントの評価は、最終出力だけを見ることではない、と書いた。どの道を通ったか。どこで迷ったか。失敗が偶然か、構造的なものか。それを読むことが評価の中心になる。そして、合格率が高すぎる評価は、むしろ警告だとも見た。

中国AI・産業深掘り

Agentic OS 技術スタックを下から読む 第22回:漏らすつもりがなくても漏れる ―― モザイク漏洩

L5 では、第16回で注入の正体を見た。第17回では、その防ぎ方を見た。あれは、外から命令を送り込まれる脅威だった。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第23回:同じ作業場を、共有させない ―― 隔離で並行を成り立たせる

第13回では、複数エージェントの不具合は、一体の中ではなく、エージェントとエージェントの「間」に出ると見た。原因の多くは、共有する資源での衝突だった。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第24回:記憶を、どこに持つか ―― 文脈・外部検索・小さな状態

第12回では、記憶とは、ただ保存することではなく、「なぜそうしたか」という因果を残す土台だ、と見た。あれは、何を残すかの話だった。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第25回:社会的に、だまされる ―― 有能なエージェントほど詐欺に弱い

L5 では、まず注入を見た。外から命令を送り込み、エージェントの判断を曲げる攻撃である。次に漏洩を見た。断片的な情報が、意図しない形で外へ出ていく攻撃である。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第26回:権限を「道具」ではなく「能力」に貼る ―― 安全を下から支える許可の設計

前回は、よく働くエージェントほど、言葉でだまされる危険も大きくなるという話で終わりました。社会的にだまされるエージェントを前提にして、権限、確認、経路、監査、停止条件を組み直す、と…

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第27回:仕様は、長く書くほど効くわけではない ―― 注意の予算と、段階に割る設計

ここまでは、権限をどう絞るかを見てきました。できる操作を絞り、届く場所を絞り、通ってよい経路を絞ることで、エージェントが越えてはいけない線を下の層から作りました。今回は少し上へ戻り…

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第28回:検証は、点数を眺める仕事ではない ―― 失敗の記録を読み、型にまとめる

前回は、仕様をどう書くかを考えました。注意を向けられる量には限りがあります。だから、巨大な一枚の仕様にせず、段階に割ります。関係する分だけ渡します。版を持たせます。そうすれば、やっ…

中国AI・産業深掘り

Agentic OS 技術スタックを下から読む 第29回:判定を別のモデルに任せる ―― だが、その判定者をどう信じるか

前回は、検証のいちばん下の土台を見ました。失敗の記録を一件ずつ人が読みます。どこで壊れたかを手で印付けします。似た失敗を下から型にまとめます。さらに頻度を数えます。そして、いちばん…

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第30回:外では「あると思われた権限」が会社を縛る ―― 表見の権限と、責任の所在

前回までは、出力をどう測るかを見てきました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第31回:直せる失敗と、戻せない失敗 ―― 可逆性で操作を分け、戻せない手前で人を挟む

前回は、外の世界の第一面を見ました。 あると思われた権限が、会社を縛るという話でした。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第32回:賢さを、より少ないビットで積む ―― 量子化と、近似の取引

前回は、外の現場の第二面として、失敗を戻せる形に保つ設計を見ました。外へ出た処理は、ただ速く進めばよいわけではありません。間違えたときに止まり、戻り、やり直せる必要があります。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第33回:ゼロから鍛えるとき、効くのは派手な工夫ではない ―― 静かに失敗する訓練を、一段ずつ確かめる

前回は、できあがった賢さを少ないビットに載せる話をしました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第34回:層を束ねる外殻 ―― モデルを、制御できるループに収める

前回は、ゼロから鍛える手仕事の話で終わりました。静かに失敗する訓練を、一段ずつ確かめる規律です。その規律こそが、この連載の背骨でした。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第35回:一体では見えない危険 ―― エージェントが網になると、何が壊れるか

前回までで、土台から外殻までを一巡しました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第36回:走りながら、経験から学ぶ ―― 教訓を積む記憶と、間違いも焼き付ける記憶

前回は、安全の網を見ました。エージェントが一つの道具ではなく、いくつもの処理につながる網になると、失敗もまた網の中を進みます。小さな誤りが広がります。弱い判断が増幅されます。信頼し…

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第37回:物差しは古びる ―― 静的な評価が、いつのまにか失効する

前回は、走りながら経験から学ぶ記憶を見ました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第38回:委譲とは、文脈を切り離すこと ―― 重い探索を別の頭に任せ、結論だけ持ち帰る

前回は、物差しが古びる話をしました。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第39回:読むより、書くほうが高い ―― 入力と出力の、隠れた非対称

前回は、委譲を見ました。大きな仕事をそのまま渡すのではなく、文脈を切り離し、小さな仕事として別の場所へ渡す話でした。上の層では、それは編成の技術に見えます。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第40回:同じ能力でも、渡し方で変わる ―― 編集という一手で読む、道具の設計

前回は、読むことと書くことの非対称を見ました。読むだけなら、すでにあるものをたどれます。書くときは、まだないものを一語ずつ生む必要があります。だから高くつきます。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第41回:検証できない好みを、どう教えるか ―― 選好の対と、報酬の代理と、その綻び

前回は、道具の設計を見ました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第42回:タスクは終わったのに、あなたの取り分は守られていない ―― 代理人としてのエージェント

前回は、検証できない好みの教え方を見ました。結びでは、次回はまた別の層の急所へ降りる、と書きました。今回は、そのまま外の現場へ戻ります。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第43回:次の言葉と、次の状態は違う ―― 世界モデルは、抽象の層で先を読む

前回は、代理人としてのエージェントを見ました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第44回:文脈の窓は、ノートではない ―― 溜めるほど悪くなる、だから絶えず整える

前回は、世界モデルが抽象の層で先を読む話をしました。結びでは、次回はまた別の層の急所へ降りる、と書きました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第45回:取り込んだものは、あなたの権限を受け取る ―― 依存とサプライ網の信頼

前回は、文脈の窓をどう手入れするかを見ました。広げるだけでは足りません。何を残し、何を捨て、何を近くに置くかで、エージェントのふるまいは変わります。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第46回:長い鎖を、崖から守る ―― 外に状態を出し、一段ごとに確かめ、戻れるようにする

前回は、取り込みの信頼を見ました。外から入ってくるものを、どう受け、どう疑い、どう使える形にするかを見ました。結びでは、次回は、また別の層の急所へ降りる、と書きました。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 第47回:見ることと聞くことを、言葉と同じ場で扱う ―― 翻訳官を挟むか、主役に直接見せるか

前回は、信頼性の崖をどう越えるかを見ました。仕事を細かく分け、途中で確かめ、崩れる前に止める話でした。結びでは、次回はまた別の層の急所へ降りる、と書きました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第48回:下から読み終えて ―― スタックを貫く、いくつかの背骨

言葉だけのエージェントは、目と耳を他人に借りているようなものです。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 第49回(最終回):下から読み終えた人へ ―― 何を学び、何を練習するかの地図

エージェントとは、賢い一個ではない。層の重なりです。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 補講(1):外の知識を、その場で引く ―― 意味で探すと、名前で外す

前回、第49回で、私は「この連載は、ここで閉じる」と書きました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 補講(2):専用の口がないとき、画面を使う ―― 見て、押して、打つ

前回は、外の知識を引く話でした。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(3):言葉を、文字でも単語でもない単位に刻む ―― いちばん下の、見えない物差し

前の補講では、画面を使って外のソフトを動かす話をしました。検索で外の知識を引く。画面を見て、押し、入力し、結果を読む。そこまで降りても、まだ上の層の話でした。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(4):一つのモデルを、多くの機械へ広げる ―― 計算は割れる、通信は割れない

前回は、言葉の刻みで、いちばん下を見ました。

中国AI・産業深掘り

Agentic OS 技術スタックを下から読む 補講(5):エージェントは「名無し」 ―― 誰として、誰の鍵で動くか

前回は、鍛える側を見ました。たくさんの計算を並べ、GPUを束ね、重い訓練をどう動かすかを見ました。補講は、まだ続く。そう書いて、今回は動く側に戻ります。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 補講(6):補講を貫く、同じ背骨 ―― そして、ここで閉じる

ここで、補講も閉じる。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(7):意味を、座標にする ―― 埋め込みという、意味の地面

補講は、一度閉じました。補講(6)で、ここで補講も閉じる、と書きました。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(8):全部に通さず、選んだ専門家だけに ―― 道を選ぶ門と、その難しさ

補講(7)では、埋め込みを見ました。言葉や文を、意味の一点に変える話でした。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(9):ご褒美で、振る舞いを変える ―― 試して・測って・少しだけ寄せる環

前回は、道を選ぶ門を見ました。問いが来たとき、どの専門家へ渡すか。その分かれ道を扱いました。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(10):先生の「自信の配り方」を移す ―― 蒸留は、惜しさまで教える

前回は、ご褒美で振る舞いを変える環を見ました。答えを出す。人の好みに近いかを見る。よい振る舞いに寄せる。そうして鍛えた大きなモデルは、賢くなります。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(11):モデルは、食べたものでできている ―― 鍛える前の、素材の作り方

補講(10)では、蒸留を見ました。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(12):同じ前置きを、二度読まない ―― 取っておいて使い回す、という節約

補講十一では、底の素材まで降りました。何を集め、どう整え、どう鍛えるかを見ました。

AIコーディング & エージェント深掘り

Agentic OS 技術スタックを下から読む 補講(13・終):いつ動き、いつ待ち、いつ眠るか ―― エージェントと時間、そして連載を閉じる

前回は、前置きを取っておいて、また使う話をしました。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(14):下書きと検め ―― 書き出しの遅さを、投機で買い戻す

連載は補講(13)で一度、本当に閉じました。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(15):手元の機体 ―― 端末で動かす、四つの理由と二つの壁

補講(14)では、書き出しの遅さを投機で買い戻す話をしました。

モデル・推論基盤深掘り

Agentic OS 技術スタックを下から読む 補講(16):好みへ寄せる二本道 ―― 代理を立てるか、立てないか

補講(15)では、端末で小さく賢く動かす話をしました。

AIコーディング & エージェント深掘り

Agentic OS 読み替え表 ―― この連載の言葉と、外の世界の名前

この連載は、固有名詞を使わない縛りで書いてきました。製品名も、手法名も、会社名も出さず、できるだけ機構だけで語る。その理由は、「名前を知っている」ことと「仕組みを分かっている」こと…