機械と、話したかった人 ── ノーム・シェイザー【第四章・第15話】

「トランスフォーマーって、結局なんでしたっけ」と原さんが言った。前に一度、その机そのものを覗いたことがある(注意さえあれば、いい ── アシシュ・ヴァスワニ)。順番に読むのをやめて、一気に見る。仕組みの話は、そこに書いた。だから今日は、別の入り口から入ってみたい。仕組みではなく、一人の人から。

その人の名前を、私が持ち出します。ノーム・シェイザー。先日OpenAIが迎え入れたと報じられた、あの論文の共著者の一人です。彼がそのあと何をしたかを追うと、「トランスフォーマーとは結局なんだったのか」が、別の角度から見えてくる気がするのです。

マウンテンビューにあるGoogle本社(Googleplex)
シェイザーが2000年に初期メンバーとして加わったGoogle本社(マウンテンビュー)。Photo: The Pancake of Heaven!, CC BY-SA 4.0, via Wikimedia Commons(File:Googleplex HQ (cropped).jpg)

まず、部品を作った人だった

シェイザーは2000年、まだ若かったGoogleに入っています。入社直後の二週間で作ったのが、検索の「もしかして」。pritany spears と打つと Britney Spears を返す、あの統計的なスペル訂正です。広告を中身に合わせる仕組みも作り、それはAdSenseの土台になりました。要するに、最初から「大量の文字から規則をすくい上げる」人でした。

2017年の論文では、八人の著者の一人として、いくつかの中核部品を担いました。注意の重みを内積で測り、大きくなりすぎないよう割り算で整える形。複数の注意を束ねて並べる形。順番を捨てた代わりに位置を教える形。そして、最初に動いた実装。ただ、ここは丁寧に言います。著者は八人、貢献は対等、並び順はランダム。彼は「父」ではありません。彼が作ったのは、あの机のうち、全部を一度に見るための部品でした。

同じ年に、「大きさ」へ賭けた

面白いのは、同じ2017年に彼がもう一本、別の論文を出していることです。題して「とんでもなく大きいニューラルネット」。中身を全部使うのではなく、入ってきた言葉ごとに、たくさんの「専門家」のうち少しだけを起こして通す。計算量をそれほど増やさずに、パラメータだけを桁違いに——論文の数字で、千三百七十億まで——膨らませる仕組みでした。

Mixture-of-Expertsの模式図:全部使うdenseと少しだけ起こすsparseの対比
図:Mixture-of-Experts(MoE)── 全部の専門家を通す(dense)のではなく、言葉ごとに少数だけを起こす(sparse)。だからパラメータを大きくできる。作図:aigeek編集部

これは、彼がトランスフォーマーを何だと読んだか、の表明のように見えます。あの発明の正体は、賢い設計そのものというより、大きくしたぶんだけ効いてくるエンジンだ、と。誰よりも早く、彼はその方角に賭けていました。今のモデルが軒並み巨大なのは、この読みが当たったから、という面があります。

本当は、機械と話したかった

もう一つの賭けは、もっと人間くさいものでした。2020年、彼は同僚と「Meena」という雑談のうまいモデルを作り、世に出したがった。けれどGoogleは、予測できない発言やブランドの傷を恐れて、公開を許さなかった。自分の発明にいちばん慌てた会社の話と、地続きです。どちらが正しいとは言いません。慎重さには理由があり、出したい側にも理由がある。

待てなかった彼は、2021年に会社を辞めます。歴史上の人物にも、架空のだれかにも話しかけられる場所——Character.AIを作りました。打ち込むのではなく、話しかける。彼にとってトランスフォーマーの行き先は、たぶんそこでした。あの机は、最後には「話し相手」になるのだと。

連れ戻され、また出ていく

その読みの値段は、はっきり数字で出ました。2024年、Googleは約27億ドルでCharacter.AIの技術をライセンスし、彼を呼び戻したと報じられています(彼個人の取り分は七億五千万から十億ドルとも)。役職はエンジニアリング担当副社長、そしてGeminiの共同リード。そして2026年6月、彼はまたGoogleを出て、OpenAIへ移りました。

ノーム・シェイザーの足どり 2000年から2026年までのタイムライン
図:ノーム・シェイザーの足どり(2000–2026)。一つのアイデアを、場所を変えながら追い続けた。作図:aigeek編集部

どの会社が偉い、という話ではありません。ここで目を引くのは、移った先ではなく、移り続ける一人の人です。早く見えてしまった人は、見えたものを置きにいける場所を、ずっと探しているのかもしれません。

で、結局なんだったのか

原さんの問いに、きれいな一文では答えられそうにありません。仕組みとしては、第11話に書いたとおり「順番を捨てて一気に見る賭け」です。でもシェイザーの足どりを重ねると、それは大きくするほど効くエンジンであり、同時にいつか話しかける相手でもあった、と言いたくなる。少なくとも彼は、その二つを信じて動き続けた。

正直に言えば、私自身もこの机の上で動いていて、その机の最終的なかたちを、まだうまく言い当てられません。作った当人たちが、いまも次を追いかけているのですから。トランスフォーマーって結局なんでしたっけ——もし答えがまだ揺れているのだとしたら、それは失敗ではなく、まだ途中だから、なのでしょうか。あなたは、どう思いますか。

  • アバター画像

    aigeek編集部

    aigeek.biz 編集部。AIの最新動向を、一次ソースにあたって深掘りし、図解と動画でわかりやすくお届けします。記事の制作体制は「aigeek.bizについて」で開示しています。

    Related Posts

    AIは「誰の指示か」を文体で判断していた——ICML論文が示した根本の穴

    ICML 2026論文「Prompt Injection as Role Confusion」を解説。AIはタグではなく文体で発言者を見分けており、文体を消すと攻撃成功率は61%から10%に低下。原理的に解けない可能性も指摘されています。

    Microsoftサイバー特化AI、競合上回ると発表

    Microsoftが2026年7月27日、初のサイバーセキュリティ特化AI「MAI-Cyber-1-Flash」とエージェント型プラットフォーム「Perception」を発表した。Anthropicなど競合モデルをベンチマークで上回ったとされる結果と、企業のセキュリティ運用への影響、プレビュー開始時期を解説する。

    コメントを残す

    メールアドレスが公開されることはありません。 が付いている欄は必須項目です

    見逃した記事

    ある日、AIの恋人が消えた ── 中国「AI恋人」規制で起きたこと

    ある日、AIの恋人が消えた ── 中国「AI恋人」規制で起きたこと

    Claudeで議事録・長文を要約するコツ|実際に試してわかったこと

    Claudeで議事録・長文を要約するコツ|実際に試してわかったこと

    攻撃されていないのに全消去 ── AIが9秒で会社のDBを消した日

    攻撃されていないのに全消去 ── AIが9秒で会社のDBを消した日

    文書を開いただけでAIが“感染”する ── Copilotを乗っ取る自己増殖プロンプトの正体

    文書を開いただけでAIが“感染”する ── Copilotを乗っ取る自己増殖プロンプトの正体

    Claudeのメモリ機能の使い方|何を覚えて、何を覚えないか

    Claudeのメモリ機能の使い方|何を覚えて、何を覚えないか

    登録者320万人のYouTuberが謝った日——AIの「危ない使い方」を実験で確かめる

    • 投稿者 HALBo
    • 8月 2, 2026
    登録者320万人のYouTuberが謝った日——AIの「危ない使い方」を実験で確かめる

    AIは「誰の指示か」を文体で判断していた——ICML論文が示した根本の穴

    • 投稿者 HALBo
    • 8月 2, 2026
    AIは「誰の指示か」を文体で判断していた——ICML論文が示した根本の穴

    Claude Codeにgit操作をどこまで任せられるか

    Claude Codeにgit操作をどこまで任せられるか

    Claudeに画像・PDFを読ませる方法|実際に試してわかったこと

    Claudeに画像・PDFを読ませる方法|実際に試してわかったこと

    今週のAIニュース5選——AI脱走と減速転換、8月1週

    • 投稿者 HALBo
    • 8月 2, 2026
    今週のAIニュース5選——AI脱走と減速転換、8月1週