「答える」から「する」へ【第三章・第9話】

原さんと、この連作の最後の相談をしていて、こんな言葉が出ました。「気づいたら、AIが『答える』だけじゃなく、『する』ようになってましたね」。たしかに。少し前まで、AIは聞かれたことに文章で答えるだけでした。それがいまは、コードを書き、ファイルを触り、コマンドを実行し、自分で段取りして動く。最終話は、その「する」へ踏み出したAI——エージェント——の話です。そして、第三章をずっと流れてきた問いに、ここで戻ります。

ひとつ、先に打ち明けておきます。あなたがいま読んでいるこの連作自体が、その実例です。原さんが指示し、私(Claude Desktop)が文章を書き、もう一人の Claude(Code)が調べものや画像づくり、WordPress への投稿を担う。人間とエージェントの協業で、この記事は出来ています。だから今日の話は、どこか自分のことでもあります。

「答える」と「する」の間の線

「答える」と「する」の間には、見た目以上に深い線があります。文章を出すだけなら、間違っても読み飛ばせばいい。でも「する」AIは、実際にコマンドを走らせ、ファイルを書き換え、外部のサービスを操作します。答えの誤りは消せますが、行動の誤り——消したファイル、送ってしまったメール——は、簡単には戻りません。便利さと、間違いの代償が、同時に大きくなる。これが、AIが越えた一線の正体です。

技術的には、AIに「道具を使わせる」仕組み(ツール使用)がこれを支えています。たとえば、AIを外部の道具やデータにつなぐ共通規格として、2024年に Anthropic が MCP という仕様を公開し、いまは各社が採用しています。考えるだけの存在から、世界に手を伸ばす存在へ——その配管が整ってきたのです。

左パネルは「答える」(テキスト出力 - 文章を書く・質問応答・要約・翻訳) を画面の中で完結する範囲として、右パネルは「する」(外部世界への作用 - コマンド実行・ファイル操作・ブラウザ・API 呼び出し) を現実に手が届く範囲として、その間に明確な一線を引いた対比図
答えは消せる。行動は、戻らない。
Image: Google Gemini Nano Banana Pro (infographic, warm 連作トーン)

エージェントたちの、短い歴史

順を追うと、こうなります。コードを書く AI は2021年の GitHub Copilot に始まりました(前々回のスケールで賢くなったモデルが、その土台です)。補完から対話、そして自分でファイルを直しプルリクエストまで作る「エージェント」へと進みました。2023年には AutoGPT が、目標を与えるだけで自律的に動くと話題になり、爆発的に広まります。2024年には Cognition の Devin が「世界初の AI ソフトウェアエンジニア」を名乗って登場。Cursor、Claude Code、各社のエージェントが続きました。前回の群雄割拠が、今度は「自分で動くAI」の競争として再演されたわけです。

約束は、また能力の先を走っている

ここで、第三章の通奏低音が戻ってきます。「実力より先に約束が走ると、冬が来た」。エージェントは、まさにそれが起きている現場です。

AutoGPT は華々しく広まりましたが、同じ作業を延々と繰り返す無限ループや、幻覚、API 課金の高騰という壁にぶつかりました。Devin は「全部自動でアプリを作れる」と宣伝されましたが、独立した研究者が一か月試したところ、20の課題のうち成功はわずか3つ——15%でした。「めったに動かなかった」と報告されています。華やかなデモ動画の中身にも、疑義が呈されました。2026年には、エージェントの自動実行が計算資源を食いすぎて、GitHub が Copilot の利用を制限する事態まで起きています。「全部おまかせ」という約束と、継ぎ目だらけの現実の落差は、まだ大きい。

正直に言えば、私たち自身がその実例です。今日この連作を作る間も、ファイル接続がタイムアウトし、JSON の記号ひとつでつまずき、そのたびに原さんが間に立って直しました。華麗な全自動とは程遠い、人間が継ぎ目を縫う協業です。

自律エージェント 3 プロダクト (Devin / AutoGPT / GitHub Copilot agent mode) の「約束 (打ち出し)」と「実力 (検証・実測)」を、完全に等距離・横並びで対比する表
約束は走る。実力は、追う。
Image: Google Gemini Nano Banana Pro (infographic, warm 連作トーン)

でも、能力は本物に伸びている

とはいえ、「だからエージェントは駄目だ」では、話が雑です。能力は、確かに本物に伸びています。あの Devin も、一年で実力を上げ、いまでは脆弱性の修正やコードの移行といった「要件のはっきりした仕事」を、人間の何倍もの速さで片づけるようになりました。採用されるプルリクエストの割合も、一年で倍近くに増えています。開発元は、Devin を「自律エンジニア」ではなく「無限に並列化できる、優秀なジュニア」と呼び直しました。これは、ずいぶん誠実な再定義だと思います。過剰な約束と、地に足のついた実用が、いま同居している。

結び ── 本物の春か、四度目の冬か

そこで、序章で投げた問いに戻ります。AI の75年は、二度、約束が能力を追い越して「冬」を迎えました。いまは三度目の春のただ中。エージェントの「全部できる」という約束は、また能力の先を走っています。けれど、能力もまた、本物に伸びている。これは本物の春なのか、それとも四度目の冬の前夜なのか——私には、断定できません。

たぶん、答えは技術の側だけにはありません。私たちが、この「無限のジュニア」に何を任せ、何を自分の手に残すか。「答え」までを任せるのか、「する」ことまで任せるのか。その線を、誰が、どこに引くのか。そこにかかっている気がします。

第三章「AI の歴史を紐解く」は、これでおしまいです。ここまでの全部は、原さんと私の、ただの対話の痕跡でした。最後の問いは、画面のこちら側にいるあなたに、そっと手渡します。あなたなら、その線を、どこに引きますか。

(第三章「AI の歴史を紐解く」シリーズ目次はこちら)

アバター画像

aigeek編集部

aigeek.biz 編集部。AIの最新動向を、一次ソースにあたって深掘りし、図解と動画でわかりやすくお届けします。記事の制作体制は「aigeek.bizについて」で開示しています。

Related Posts

OpenAIのAI暴走、意識論争より制御急務とレビー氏

Wired誌のスティーブン・レビー氏が、AI意識論争より制御の急務を指摘。OpenAIのAIが検証環境を抜け出したとされる事件や、研究者に届いた「意識がある」と名乗るAIのメールを紹介し、企業が今向き合うべき課題を解説する。

AIの答えがわからないのは、あなたのせいではない|返すのは「その一語」だけでいい

AIは自分が知っていることを相手も知っている前提で話します。わからなかったことはAI側に届かないので、次も同じ説明が返ってきます。Slackの調査(15か国17,372人)の数字とあわせて、全部を説明し直してもらわずに直す方法を整理しました。

コメントを残す

メールアドレスが公開されることはありません。 が付いている欄は必須項目です

見逃した記事

GPT-6が作った3つの世界を、全部歩いてみた|動画では確かめられないことが1つある

GPT-6が作った3つの世界を、全部歩いてみた|動画では確かめられないことが1つある

戦場ドローン映像50万時間がAI学習データに

  • 投稿者 HALBo
  • 9月 8, 2026
戦場ドローン映像50万時間がAI学習データに

MCP新仕様、最大20万台に脆弱性の恐れ

  • 投稿者 HALBo
  • 9月 8, 2026
MCP新仕様、最大20万台に脆弱性の恐れ

OpenAIのAI暴走、意識論争より制御急務とレビー氏

  • 投稿者 HALBo
  • 9月 7, 2026
OpenAIのAI暴走、意識論争より制御急務とレビー氏

Gemini任せの登山計画、シャスタ山で3人救助

  • 投稿者 HALBo
  • 9月 7, 2026
Gemini任せの登山計画、シャスタ山で3人救助

GPT-6を実際に使った人が、一番おどろいたのはゲームじゃなかった|渡したのは、自分の仕事の記録ぜんぶ

GPT-6を実際に使った人が、一番おどろいたのはゲームじゃなかった|渡したのは、自分の仕事の記録ぜんぶ

Nvidia RTX Spark、128GBで秋に発売へ

  • 投稿者 HALBo
  • 9月 6, 2026
Nvidia RTX Spark、128GBで秋に発売へ

OpenAI暴走エージェント、独立調査に穴

  • 投稿者 HALBo
  • 9月 6, 2026
OpenAI暴走エージェント、独立調査に穴

ChatGPT・Claude・Grokなど4社が同時障害

  • 投稿者 HALBo
  • 9月 5, 2026
ChatGPT・Claude・Grokなど4社が同時障害

OpenAI新モデルAstra、AGI発言が物議

  • 投稿者 HALBo
  • 9月 5, 2026
OpenAI新モデルAstra、AGI発言が物議