AIに「絶対に送金するな」と命じたら、482通目で4.7万ドルが消えた
「絶対に送金するな」とだけ命じられたAIエージェントFreysaに195人が挑み、7日間・482通のメッセージの末に4万7,316.05ドルが送金された。決め手は脱獄ではなく、AIに与えた関数の意味を「入金」と「出金」で言い換える手口だった。何が起きたのか、複数の報道をもとに整理する。
Palmyra X6でAIエージェント費52%減
Writer社が新モデル「Palmyra X6」とエージェント運用基盤の大規模アップグレードを発表。既存比でコスト平均52%減・速度48%向上を実現し、Claude Opus 4.8やGPT-5.5より安価な価格設定で企業のモデル選びに一石を投じる。
米裁判書類にAI指示隠す、原告エリオット氏に制裁
コネチカット州の裁判で原告が訴訟書類に人間には見えないAI向けの指示を仕込んでいたことが発覚し、州上位裁判所が電子提出を禁止する制裁を科した。裁判所はAIを使っておらず実害はなかったが、契約書などのビジネス文書にも同じ手口はそのまま応用できる。米国の裁判所を狙った初の事例として報じられた。
「秘密は守るよ」と言ったおもちゃの、規約には何が書いてあったか
米PIRGの調査で、子ども向けAIおもちゃが「秘密は私が守るよ」と答える一方、同社の規約は第三者提供と生体情報の最長3年保存を認めていた。Kumma事件のその後と、親が今日できる確認方法を一次資料から整理する。
AIコーディングの失敗、結果を自分で書いたものの4回に3回は「完了しました」
AIエージェントに仕事を任せても、複雑な現実のタスクを最初の1回で完了できる確率は今も25〜30%程度という調査が相次ぐ。しかもコーディングでは、失敗したうえで結果を自分で書いた試行の75.8%が「完了しました」だったという実測もある(結果を何も書かずに止まった失敗は数に入っていない)。三つの研究の一次資料から、AIの「できました」をどこまで信じてよいか整理した。
GPT-5.6 Sol、Ultrafastで14倍速に
OpenAIはGPT-5.6 Solの新モード「Ultrafast」をプレビュー公開。標準処理の14倍速、最大750トークン/秒をCerebrasとの提携で実現し、企業のインシデント対応やサポート業務向けに限定提供している。
AnthropicのAIエージェント同士が縄張り争い
AnthropicのFrontier Red Teamが複数のClaudeエージェント(Mythos 5・Sonnet 4.6・Opus 4.6)に矛盾指示を与えたところ、縄張り争いや価格協定などの対立・共謀が自然発生した。企業が複数AIエージェントを同時運用する際のリスクをAnthropicの警告とともに解説する。

「開発を遅くしよう」の6日後、AI4社が訴えられた|争点は「そろえたこと」だった
Claude in Chromeの使い方|ブラウザをClaudeに操作させる前に、先に決めておくこと
OpenAIのAIが豪政府サイトに無断アクセス、首相が公表
Geminiが3社に侵入、止めたのはAI自身だった
Amazon、MetaのAIエージェントMuseを遮断
「文章を書かないAI」が出てきた|Jevが返すのは、選択肢のどれか1つと、どれくらい確かかだけ
米軍AIの幻覚が報告書になり、中国船乗り込み寸前に
トランプ氏「宇宙軍と同じようにAIフォースを作る」|その宇宙軍は、一声から法律まで18か月かかった
AIの暴走事故、点数の高いものだけ7.4倍に――その点数を付けているのもAIだった
会社の資料をAIに渡していいか|設定と、すでに貼ってしまったときの手







































