GPT-5やGemini-3、忘れたはずの事実65%を復元

GoogleとTechnion(イスラエル工科大学)の研究で、GPT-5やGemini-3は事実の95〜98%を内部に持ちながら直接は答えられないと判明した。段階的に考えさせるChain-of-Thoughtで最大65%を復元できる結果は、企業のAI投資やRAG活用戦略の見直しに示唆を与える。

盗まれたClaude、社内Gmailまで筒抜けに

Claudeのセッションクッキーがマルウェアで盗まれ、Google Workspace連携を通じて社内のGmailやドライブに攻撃者がアクセスできる問題が発覚した。会社のIT管理者はその権限を取り消せず、Anthropicの対応にも限界があることが分かった。個人アカウントでのClaude利用が組織リスクになる典型例だ。

引き出しの中の海 第29話「錨を上げる」

月曜の日報に、僕は初めて所長へ私事を書いた。所長は短くひとこと──「私にも、開けていない引き出しがひとつあります」。

Azure OpenAIのAI、評価合格も権限外ファイル回答

Azure OpenAI上に構築した社内AIエージェントが、社内の評価テストにはすべて合格していたにもかかわらず、SharePoint上でユーザーが本来開けないファイルの内容を回答に含めていたことが判明した。原因はアクセス権チェックを素通りする設計にあった。AI導入企業が見落としがちな権限管理の落とし穴を解説する。

Claude Fable 5.1、キャッシュ料金75%減

Anthropicが新モデル「Claude Fable 5.1」と「Claude Mythos 5.1」を発表した。目玉はキャッシュ読み込み料金の75%削減で、AIエージェントの運用コストは最大45%下がるという。ベンチマーク性能や企業向け新機能も含め、コスト構造の変化をまとめた。

引き出しの中の海 第28話「返事」

佐伯さんが四度目に事務所を訪れた日、僕は先に自分の話をした。消せなかった三行と、消さないと決めた二十年分の記録の話。

Anthropic「MHS」、AIが実験装置を直接操作

Anthropicが発表した新仕様「Model Hardware Standard」は、AIがロボットアームや顕微鏡を直接操作する仕組み。研究機関での導入実績と、AIが物理現象を理解しきれない限界の両方を解説する。

Apple、OpenAIに『証拠隠滅』の新証拠提出

AppleがOpenAIと元社員Chang Liu氏を提訴した企業秘密訴訟で、証拠隠滅を示す新証拠が8月31日に浮上した。AIエージェントに機密情報を学習させるリスクと、ビジネスパーソンへの影響を解説する。

引き出しの中の海 第27話「波を数える」

父の下書きに書かれた「十歳の冬の海」へ、僕は一人で行ってみることにした。そこにあったのは答えではなく、波の音だけだった。

招待状を1通、開かなかった。それでも家の電気が消えた

Googleカレンダーの招待状に、人には見えない指示を仕込む手口が見つかった。開かなくても、後日AIに予定をまとめさせた瞬間に効く。研究者の通報でGoogleは2025年に対策したが、2026年1月、同じ入口から別の手口がまた報告された。何が起き、何が直っていないのかをまとめる。