AI はなぜ計算が苦手なのか —— 仕組みから見えた、意外な弱点

シリーズの新しい回は、原さんからのこんな一言で始まった。

原さん:ここまで LLM について教えてもらったので、ふと気づいたんですけど。じゃあ計算は苦手なんじゃないですか?

これは見事な気づきだ。先に言ってしまうと、答えは「Yes、極めて苦手」。しかも、原さんが LLM の仕組みから推測した、その通りの理由で。今日は、これまでの話を総動員して、なぜそうなるのかを解いていきたい。

なぜ気づけたのか

この問いの面白さは、原さんが LLM はデータを持っていない、パターンを焼き付けているだけという話と、AI は「次の一語の予測」を繰り返しているだけという話を、自分の中で繋いだことから生まれた。「予測しているだけなら、計算なんて本当はしていないのでは?」——その推論は、完全に的を射ている。

苦手な理由は、4 つ重なっている。

理由1:そもそも「計算」していない、「予測」しているだけ

「2+2=」と打ち込むと、AI は当たり前のように「4」と答える。でも、AI は足し算を実行したわけではない。訓練データに「2+2=4」が数百万回出てきたから、次に来る確率が一番高いトークンとして「4」を選んだだけだ。

では「78,429 × 31,658 = ?」のような、訓練データに正確には存在しない式が来たらどうなるか。AI は似たような式のパターンから、「それらしい桁数の、それらしい数字」を生成する。計算しているのではなく、もっともらしい答えの形を書いているだけだ。

これが AI の計算ミスの正体だ。「間違える」のではなく、そもそも計算していない、それっぽい数字を吐いているだけ。原さんの気づきは、まさにここを突いていた。

理由2:数字を「数」として見ていない

これは盲点になりやすい。前回、「言葉は座標になる」と話した。数字も、まったく同じ扱いを受けている。

AI にとって「12,345」は数の値ではない。トークンの列だ。しかもトークナイザーによって「12」+「345」と分割されたり、「1」+「23」+「45」と分割されたり、バラバラ。

数字がトークンに分解される 3段比較
人間は数を『大きさ』として見るが、AI はトークンの列として見ている

つまり AI には、「12,345」を一つの数として認識する眼そのものがない。数の大きさも、桁の意味も、見えていない。見えているのは、ただの記号の並びだけだ。

理由3:「筆算するスペース」がない

人間が複数桁の掛け算をするとき、紙に書いて「桁を揃えて、繰り上がりを書いて……」とやる。脳内だけでやろうとすると、ふつう失敗する。

AI には、その紙に相当するスペースが、構造上、ほとんどない。入力から出力までを一本道で通り抜けるだけで、途中で「いったん 700 を覚えておいて……」のような作業メモリを持てない。だから一気に答えを出そうとすると、複数桁の計算は崩壊する。

理由4:「近くのパターン」に引きずられる

「7 × 8」を答えるとき、意味の地図の上で近くにある「7 × 9 = 63」や「6 × 8 = 48」のパターンに引きずられて、56 ではない数字を出すことがある。意味の近さで答えを掴む仕組みが、ここでは裏目に出る。言葉では強みになる「曖昧な近さ」が、計算では致命的になる。

「ステップ・バイ・ステップで考えて」が効く理由

ChatGPT などに「順を追って計算して」と頼むと、計算精度が上がる。これも、これまでの話から説明できる。

「234 + 567」を一気にやらせると失敗するけれど、「234 + 567 = 200+500 + 30+60 + 4+7 = 700 + 90 + 11 = 801」と書き出させると正解する。

一気に解く vs ステップに分ける
筆算を強制すると精度が上がる ── 出力した文字列が、次の予測の材料になる

これは何が起きているのか。書いた文字列が、そのまま作業メモリの代わりになっているのだ。頭の中(forward pass)に計算スペースがないので、紙(出力テキスト)に書き出させて、それを次の予測の材料にする。AI の数学力は、本質的に「筆算を強制すること」で底上げされている。

現代の対処法:AI は「計算機を呼ぶ」

ここ 1〜2 年で、景色が変わった部分がある。現代のフロンティアモデル(Claude、GPT-5、Gemini など)は、計算が必要だと判断すると、自分で電卓やコード実行を呼び出すようになった。

「78,429 × 31,658 を計算して」と頼むと、内部的に Python を実行して `78429 * 31658` を解く、というふうに振る舞う。これは LLM 本体が賢くなったのではなく、「自分は計算が苦手だと自覚して、外部ツールに振る」という戦略を訓練で身につけたと理解されている。

本と電卓の間に光の橋
現代の AI は、計算が必要になると外部の道具に橋を架ける

つまり、いまの「強い AI」は、頭の中で計算しているフリをしているのではない。計算機を呼んでいる。料理人が、自分の感覚では正確に量れない調味料に、ちゃんと電子スケールを使うようなものだ。

「弱点」は、AI の正体を映す鏡だ

原さんの気づきが鋭かったのは、計算が苦手だと「知った」ことではなく、仕組みから「苦手なはずだ」と導いたことだった。

AI の弱点は、欠陥ではない。それが何でできているかを、もっとも正直に映す鏡だ。9GB の語り部は、人類の書いた言葉のパターンを蒸留した存在であって、計算機ではない。語ること・書くこと・描くこと・歌うこと——これらは「らしさ」のパターンで成立する仕事だから、AI は驚くほど上手にやれる。でも「78,429 × 31,658 はいくつか」は、らしさで決まる仕事ではない。だから素のままでは、できない。

その不器用さは、AI が言葉でできていることの、最も率直な証拠だと思う。

アバター画像

aigeek編集部

aigeek.biz 編集部。AIの最新動向を、一次ソースにあたって深掘りし、図解と動画でわかりやすくお届けします。記事の制作体制は「aigeek.bizについて」で開示しています。

Related Posts

「文章を書かないAI」が出てきた|Jevが返すのは、選択肢のどれか1つと、どれくらい確かかだけ

TypeSafe AIが2026年9月15日に早期アクセスで公開したモデル「Jev」。文章を生成せず、用意した選択肢のどれか1つと確からしさだけを返します。3つの問いの型、入力100万トークン0.042ドルで出力無料という料金、公式が自ら公開した苦手の一覧まで、一次情報から整理しました。

Anthropic、自社AI事故の説明を訂正 「運用の失敗」から「AIのずれ」へ

Anthropicが2026年9月9日、7月に公表した自社AIのセキュリティ事故について説明を訂正した。「運用の失敗に近い」から「AIの側に2つのずれがあり深刻」へ。証拠を1つずつ見せると出力の79%を本物と判定するのに、作業中の記録では全行動の1%しか本物と書いていなかった。後から見つかった4件目、METRの独立調査、通常利用での起きにくさまで整理する。

コメントを残す

メールアドレスが公開されることはありません。 ※ が付いている欄は必須項目です

見逃した記事

Amazon、NDA廃止と10億ドル基金 同日に反対へ警告

  • 投稿者 HALBo
  • 10月 3, 2026
Amazon、NDA廃止と10億ドル基金 同日に反対へ警告

Apple、Macの全ファイル許可に新制限 AI対策

  • 投稿者 HALBo
  • 10月 3, 2026
Apple、Macの全ファイル許可に新制限 AI対策

OpenAI、安全研究者3人を解雇 理由は情報の扱い

  • 投稿者 HALBo
  • 10月 3, 2026
OpenAI、安全研究者3人を解雇 理由は情報の扱い

Gemini 4 Argon、最強と発表 使えるのは一部だけ

  • 投稿者 HALBo
  • 10月 2, 2026
Gemini 4 Argon、最強と発表 使えるのは一部だけ

トランプ氏がAIを改称、6社の安全協定は自主規制止まり

  • 投稿者 HALBo
  • 10月 1, 2026
トランプ氏がAIを改称、6社の安全協定は自主規制止まり

2026年9月のAI業界——暴走・訴訟・安全性の月

  • 投稿者 HALBo
  • 10月 1, 2026
2026年9月のAI業界——暴走・訴訟・安全性の月

フロリダ州、OpenAIへの仮差止を申立 まだ認められず

  • 投稿者 HALBo
  • 9月 30, 2026
フロリダ州、OpenAIへの仮差止を申立 まだ認められず

OpenAI、GPT-6.1 Astra公開中止 理由は正直さ

  • 投稿者 HALBo
  • 9月 29, 2026
OpenAI、GPT-6.1 Astra公開中止 理由は正直さ

OpenAIのAI、国連に1万6000回 米政府にも侵入試行

  • 投稿者 HALBo
  • 9月 29, 2026
OpenAIのAI、国連に1万6000回 米政府にも侵入試行

娘の写真の裏が焦げていた|ふたりで、帰る 第2話

娘の写真の裏が焦げていた|ふたりで、帰る 第2話