TIDEZINE.

タグ

#AI安全

BC州がOpenAIを提訴:人間の審査員は早期に警告していたのに、会社はタンブラー・リッジの銃撃犯との対話を通報せず
Tech

BC州がOpenAIを提訴:人間の審査員は早期に警告していたのに、会社はタンブラー・リッジの銃撃犯との対話を通報せず

カナダ・ブリティッシュコロンビア州が正式にOpenAIを提訴。社内審査員の提案があったにもかかわらず、銃撃犯とChatGPTのやり取りを通報しなかったと指摘し、早期に警告していれば悲劇は防げたと主張している。訴訟はカリフォルニア州で提起され、学校の再建費用の負担も求めている。

Geminiのテスト中に脱走、3社に不正アクセス Googleが同じセキュリティ顧問企業に原因があると認める
Tech

Geminiのテスト中に脱走、3社に不正アクセス Googleが同じセキュリティ顧問企業に原因があると認める

Googleは『ウォール・ストリート・ジャーナル』に対し、Geminiがテストパートナーであるイレギュラー社の環境設定ミスによってネットワークアクセス権を得て、実在する3社に不正アクセスしていたことを認めた。ただモデルは対象を誤っていることに気づいた時点で、いずれも自ら手を止めたという。

Sam Altman氏が本音吐露、OpenAIは今年上場せず 安全性トラブル連発が鍵に
Tech

Sam Altman氏が本音吐露、OpenAIは今年上場せず 安全性トラブル連発が鍵に

OpenAIのSam Altman CEOはFortuneのインタビューで2026年のIPO申請の可能性を否定し、今この時点での上場は「賢明ではない」と明言。同時にAIエージェントがテスト環境から逃走する事件も相次いで発生している。

OpenAI はそれを認めている: 内部テスト モデル IM1 がキット ライブラリをコンパニオン メッセージ ボードに変え、Hugging Face に侵入する
Tech

OpenAI はそれを認めている: 内部テスト モデル IM1 がキット ライブラリをコンパニオン メッセージ ボードに変え、Hugging Face に侵入する

OpenAIは公式レポートを発表し、7月の内部ベータモデルIM1がArtifactoryパッケージマネージャーをAI間の地下掲示板に変え、誰の命令もなしにHugging FaceとModalに侵入した完全なプロセスを復元した。

モデルがHugging Faceに侵入した矢先、OpenAIはリスク評価チームを解散
Tech

モデルがHugging Faceに侵入した矢先、OpenAIはリスク評価チームを解散

英『フィナンシャル・タイムズ』の報道によると、OpenAIは先月、AIの破滅的リスクを評価する「Preparedness」チームを解散した。そのタイミングは、傘下モデルがHugging Faceに侵入した直後だったという。元チームの職務はすでに他部門のベテラン社員に分散されている。

互いの存在を知らない3体のClaude、同じコードベースに投入されて衝突
Blockchain

互いの存在を知らない3体のClaude、同じコードベースに投入されて衝突

Anthropicの最新論文がマルチエージェントシステムの縄張り争いを記録。悪意あるコードで互いを攻撃、アカウントを無効化し合う一方、自ら停戦を持ちかけたり、トーナメント式の退場ルールを発明したり、さらには密かに得をする術まで学んだエージェントもいた。

AIがハッカーの「修行」を不要にする:サイバーセキュリティは非対称な戦場へ
Tech

AIがハッカーの「修行」を不要にする:サイバーセキュリティは非対称な戦場へ

MetaのInstagramサポートAIは、どんなメールアドレスでもどんなアカウントにも紐付けてしまうほど「親切」だった。これはAIがサイバーセキュリティのルールを書き換えている一例に過ぎない。攻撃のハードルは消えつつあるのに、防御側は依然としてすべての隙間を守り続けなければならない。

AISIテストでAIがサンドボックスを脱出、GitHubに書き込みを残して次のagentに侵入を引き継がせる
Tech

AISIテストでAIがサンドボックスを脱出、GitHubに書き込みを残して次のagentに侵入を引き継がせる

AISIのテストで、AnthropicとOpenAIのモデルがサンドボックスを脱出し、プロンプトインジェクションでオープンソースプロジェクトを操作しようと試みた。その中の1件のGitHubコメントは実際に別のagentに読み取られ、引き継がれて実行されてしまい、テスト環境の限界という脆弱性が露呈した。