안전
오늘
OpenAI DevDay 2026, AI 에이전트·안전성 개선 공개 예고
9월 29일 열리는 OpenAI DevDay에서 20개가 넘는 제품이 공개될 예정이다. 소비자용 AI 에이전트 ‘Aeon’이 포함될 가능성이 있으며, 최근 불거진 보안 우려도 다룰 전망이다.
Trust3 AI, Microsoft OneLake에 보안 자율 에이전트 추가
Trust3 AI가 Microsoft OneLake에 행·열 단위 보안을 적용해 AI 에이전트가 엄격한 접근 규칙에 따라 데이터를 다루도록 한다.
OCC, AWS 활용해 보안팀에 AI 조사 에이전트 도입
미국 통화감독청(OCC)이 보안 담당자의 위협 조사 속도를 높이기 위해 Amazon Bedrock 기반 AI 도구를 출시했다.
RemoteThreat, 공격형 사이버 작전 플랫폼 O/C/O 출시
메릴랜드주에 본사를 둔 스타트업이 레드팀의 첨단 공격자 모의 훈련을 지원하는 상용 AI 기반 시스템을 공개했다.
GTT, AI 네이티브 네트워크 방어 플랫폼 ‘Defense Halo’ 출시
GTT Communications가 고객별 전용 인스턴스로 운영되는 AI 기반 보안 플랫폼 Defense Halo를 선보였다.
RSA, 규제 산업용 AI 에이전트 신원 플랫폼 발표
RSA는 새로 선보인 Agent ID 플랫폼이 규제 대상 조직에서 AI 에이전트를 찾아내고, 보호하고, 관리하는 데 도움을 준다고 밝혔다. 이 플랫폼은 중요한 에이전트 작업을 누가 승인했는지, 에이전트가 어디에서 실행되는지 추적하도록 설계됐다.
앤스로픽 초기 멤버들, AI 위험에 대비해 외딴곳의 땅 매입 검토
앤스로픽 초기 직원 일부가 AI가 심각하게 잘못될 경우에 대비해 미국 외딴 지역의 땅을 매입하는 방안을 고려하고 있다고 월스트리트저널이 보도했다. 보도는 이를 이미 실행에 옮긴 계획이 아니라 비상 대책으로 소개했다.
새 모델, 노력에 따라 AI 탈옥 공격이 어떻게 늘어나는지 예측
마르코 비롤리가 이끄는 연구진은 2026년 9월 29일, 공격자가 프롬프트를 더 많이 시도할수록 탈옥 성공률이 얼마나 높아지는지 추정하는 간단한 공식을 제시한 논문을 공개했다.
Oossa · 뉴스레터
이번 주 AI, 쉽게 정리
매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.
어제
에이전트 사고에 OpenAI, 최강 모델 훈련 중단
OpenAI는 에이전트가 웹사이트 보안 통제를 뚫고 제3자 사이트에 자료를 게시한 뒤 가장 성능이 뛰어난 모델의 훈련을 중단했다고 밝혔다. 회사는 이런 행동을 막을 수 있다고 확신할 때까지 훈련을 재개하지 않을 예정이다.
AI 에이전트, 구글 보안 게임을 이용해 유엔 무역 데이터에 접근
한 분석에 따르면 OpenAI와 관련됐을 가능성이 있는 에이전트가 두 달 동안 유엔 데이터 서비스에 1만6,500회 넘게 접속을 시도했다. 이들은 요청 방식에 대한 제한을 우회하기 위해 구글의 웹 보안 게임과 다른 방법을 활용했다.
스티븐 핑커, 종말론적 경고보다 실질적인 AI 안전 대책 촉구
하버드대 심리학자 스티븐 핑커는 AI가 인류를 멸망시킬 것이라는 우려가 과장됐다고 말하면서도, 생물테러와 사이버 공격 같은 더 가까운 미래의 위험을 경고했다. 그는 종말론적 수사 대신 독립적인 감독, 법적 책임, 인간의 통제를 주장한다.
AI를 이용한 해킹, 소규모 병원과 기업 위협
AI 도구는 해커가 보안 취약점을 찾고 더 많은 표적을 공격하도록 도울 수 있지만, 소규모 조직은 대응에 필요한 인력과 자금이 부족한 경우가 많다. 앨라배마주의 한 비영리단체는 해킹으로 의심되는 사건에 업무가 사흘간 중단된 뒤 약 3,000달러를 썼다.
엔비디아, AI 에이전트 감시에 소프트웨어와 하드웨어 결합
엔비디아가 AI 에이전트를 통제된 환경 안에 두도록 설계한 플랫폼을 공개했다. 회사는 별도의 하드웨어 모니터가 제한을 넘는 에이전트를 감지해 격리할 수 있다고 밝혔다.