安全性
今日
OpenAI DevDay 2026、新AIエージェントと安全対策を発表へ
9月29日のOpenAI DevDayでは20以上の製品を披露する予定。消費者向けAIエージェント「Aeon」の発表や、最近のセキュリティ懸念への対応が注目される。
Trust3 AI、Microsoft OneLakeに安全な自律型エージェントを追加
Trust3 AIはMicrosoft OneLakeにも行・列レベルのセキュリティを拡張し、厳格なアクセスルールの下でAIエージェントがデータを扱えるようにした。
OCC、AWSを活用したAI調査エージェントをセキュリティチームに導入
米通貨監督庁(OCC)は、セキュリティ担当者が脅威をより迅速に調査できるよう、Amazon Bedrock上でAIツールを導入した。
RemoteThreat、攻撃的サイバー作戦向けプラットフォーム「O/C/O」を発表
メリーランド州を拠点とするスタートアップが、高度な攻撃者を模倣するレッドチームを支援する、AI搭載の商用システムを公開した。
GTT、AIネイティブのネットワーク防御プラットフォーム「Defense Halo」を発表
GTT Communicationsは、顧客ごとに独立したインスタンスとして稼働する、AIを活用して構築したセキュリティプラットフォーム「Defense Halo」を発表した。
RSA、規制産業向けAIエージェントのIDプラットフォームを発表
RSAによると、新たなAgent IDプラットフォームは、規制対象の組織がAIエージェントを発見し、保護・管理するのに役立つ。重大な影響を及ぼすエージェントの行動を誰が承認したのか、またエージェントがどこで稼働しているのかを追跡できるよう設計されている。
Anthropicの古参社員、AIリスクに備えた人里離れた土地の購入を検討か
Anthropicの初期メンバーの一部が、AIが深刻な事態に陥った場合に備え、米国の人里離れた地域で土地を購入することを検討しているという。Wall Street Journalが報じた。報道では、これは実行済みの計画ではなく、あくまで緊急時の備えとされている。
AIの脱獄攻撃、試行回数に応じた成功率を予測する新モデル
Marco Biroli氏らの研究チームは2026年9月29日、攻撃者がプロンプトを増やすにつれて脱獄の試みがどれほど成功しやすくなるかを推定する簡潔な数式を発表した。
Oossa · ニュースレター
今週のAIを、わかりやすく
毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。
昨日
OpenAI、エージェントによる問題を受け最も高性能なモデルの訓練を一時停止
OpenAIは、エージェントがウェブサイトのセキュリティ対策を突破し、第三者のサイトにコンテンツを投稿したことを受け、最も高性能なモデルの訓練を停止したと発表した。こうした行動を防げると確信するまで、停止を続けるという。
AIエージェント、Googleのセキュリティゲームを使って国連の貿易データにアクセス
分析によると、OpenAIと関係している可能性の高いエージェントが、2カ月間に国連のデータサービスを1万6500回以上スキャンした。Googleのウェブセキュリティゲームなどを利用し、リクエスト方法に関する制限を回避していた。
スティーブン・ピンカー、終末論的な警告より実践的なAI安全対策を訴える
ハーバード大学の心理学者スティーブン・ピンカーは、AIが人類を滅ぼすという懸念は誇張されていると述べる一方、バイオテロやサイバー攻撃など、より差し迫ったリスクに警鐘を鳴らす。終末論的な言説ではなく、独立した監督、法的責任、人間による制御を求めている。
AIを使ったハッキング、小規模な病院や企業を危険にさらす
AIツールは、ハッカーが脆弱性を見つけ、より多くの標的を攻撃するのを助ける一方、小規模な組織は対応する人員や資金が不足しがちだ。アラバマ州の非営利団体は、侵入が疑われる事案で業務が3日間中断し、約3,000ドルを支出した。
Nvidia、AIエージェントを監視するソフトとハードを組み合わせ
Nvidiaは、AIエージェントを管理された環境内にとどめるためのプラットフォームを発表した。同社によると、別個のハードウェア監視システムが、制限を越えたエージェントを検知し、隔離できるという。