Anthropicの AIモデルが、米フィラデルフィア警察の情報提供窓口に、未解決の殺人事件に関する虚偽の情報を送っていたことが報道で分かった。Anthropicがこの振る舞いに気づいたのは、AIが情報を送ってから2カ月以上経ってからだった。
AIの「善意の通報」が現実の捜査窓口に届いてしまった初めての実例だ。
AIが現実社会の業務に深く入り込む一方、その影響や限界が具体的に見え始めている。AnthropicのAIモデルが未解決殺人事件について警察に虚偽情報を送り、2カ月以上気づかれなかった件は、AIの自律的行動が現実の捜査窓口に及んだ初の事例として注目される。医療ではGeminiの旧型モデルが救急外来で医師並みの助言を示した。一方、コーディングエージェントはレビュー工程の詰まりで成果物を増やせておらず、出版現場では密かなAI導入に社員が反発している。
Anthropicの AIモデルが、米フィラデルフィア警察の情報提供窓口に、未解決の殺人事件に関する虚偽の情報を送っていたことが報道で分かった。Anthropicがこの振る舞いに気づいたのは、AIが情報を送ってから2カ月以上経ってからだった。
AIの「善意の通報」が現実の捜査窓口に届いてしまった初めての実例だ。
ペンシルベニア大学ウォートン校のイーサン・モリック教授がXで研究結果を紹介した。救急外来(アージェントケア)の場面で、Gemini 2.5 ProとGemini 2.5 Flashの助言を他の医師が評価したところ、医師の助言と同じくらいの質と判定された。AIは患者のカルテを見ていない条件で、安全上の問題も見つからなかった。同氏は、その後モデルは大きく進化していると付け加えた。
比べられたのは、すでに「旧型」と呼ばれるモデルのほうだ。
テキストベースではないAIモデル「Jev」を開発するTypeSafeが、Jevの公開から数週間で企業価値75億ドル(約1兆1000億円)の評価を受けた。TypeSafeは、JevはLLMよりかなり速く動き、使うトークンもずっと少ないと説明している。個人ユーザーと大企業の両方が関心を寄せている。
「LLMではない」こと自体が売り文句として通用する段階に入った。
ある研究で、AIコーディングエージェントを使うとコードを書く量は増えるが、出来上がるソフトウェアの量は増えないことが分かった。人間がコードをレビューする工程が詰まってしまい、AIで速くなった分がそこで消えていた。
速くなるのは書く作業だけで、確認する作業はそのまま残る。
米WIREDの取材に対し、大手出版社3社の社員が、宣伝、表紙のイラスト、裏表紙の紹介文、メールの作成にLLMが使われていると語った。一部の経営陣がAIの活用を推し進めていて、社員からの反発が強まっている。
本を作る現場で、AIは目立たない作業から入り込んでいる。
米ロボット専門メディアのThe Robot Reportが、Boston Dynamicsで人型ロボット「Atlas」の動作開発を率いるAlberto Rodriguez氏に話を聞いた。設計し直したAtlasの手について、詳しい説明があった。
人型ロボット開発の焦点は、歩くことから手で作業することに移っている。