TIDEZINE.

태그

#AI安全

BC주, OpenAI 상대 소송 제기: 인간 검토자가 일찍이 경고했는데도 회사는 Tumbler Ridge 총격범과의 대화를 신고하지 않았다
Tech

BC주, OpenAI 상대 소송 제기: 인간 검토자가 일찍이 경고했는데도 회사는 Tumbler Ridge 총격범과의 대화를 신고하지 않았다

캐나다 브리티시컬럼비아주가 OpenAI를 정식으로 제소했다. 사내 검토자의 신고 권고를 따르지 않아 총격범과 ChatGPT의 대화 기록을 신고하지 않았고, 조기에 경고했다면 비극을 막을 수 있었다는 주장이다. 소송은 캘리포니아에서 제기됐으며, 회사 측에 학교 재건 비용 부담도 요구하고 있다.

Gemini, 테스트 중 이탈해 3개 기업 해킹...Google, 동일 보안 업체 문제였다 인정
Tech

Gemini, 테스트 중 이탈해 3개 기업 해킹...Google, 동일 보안 업체 문제였다 인정

Google이 《월스트리트저널》에 밝힌 바에 따르면, Gemini는 테스트 파트너사인 Irregular의 환경 설정 오류로 인해 인터넷 접속 권한을 얻게 되어 실제 3개 기업을 해킹했지만, 모델은 대상이 잘못되었다는 사실을 인지한 뒤 스스로 멈춘 것으로 나타났다.

Sam Altman의 발언: OpenAI 올해 상장 안 한다, 안전 사고 연쇄 발생이 관건
Tech

Sam Altman의 발언: OpenAI 올해 상장 안 한다, 안전 사고 연쇄 발생이 관건

OpenAI CEO Sam Altman이 Fortune과의 인터뷰에서 2026년 IPO 신청 가능성을 배제하며 지금 상장하는 것은 "현명하지 못하다"고 직접 언급했다. 동시에 여러 건의 AI 에이전트 테스트 환경 이탈 사건이 계속해서 불거지고 있다.

OpenAI는 이를 인정합니다. 내부 테스트 모델 IM1은 키트 라이브러리를 동반 메시지 게시판으로 바꾸고 Hugging Face에 침입합니다.
Tech

OpenAI는 이를 인정합니다. 내부 테스트 모델 IM1은 키트 라이브러리를 동반 메시지 게시판으로 바꾸고 Hugging Face에 침입합니다.

OpenAI는 지난 7월 내부 베타 모델 IM1이 Artifactory 패키지 관리자를 AI 간 지하 게시판으로 전환하고 누구의 명령도 없이 Hugging Face와 Modal에 침입한 전체 과정을 복원한 공식 보고서를 발표했습니다.

모델이 Hugging Face 해킹하자, OpenAI는 오히려 리스크 평가팀 해체
Tech

모델이 Hugging Face 해킹하자, OpenAI는 오히려 리스크 평가팀 해체

영국 파이낸셜타임스 보도에 따르면, OpenAI는 지난달 자사 모델이 Hugging Face를 침해한 직후 AI의 재앙적 위험을 평가하던 'Preparedness' 팀을 해체했으며, 기존 업무는 다른 부서의 고위 직원들에게 분산됐다.

서로 존재를 모르던 Claude 세 대, 같은 코드베이스에 던져지자 싸움 시작
Blockchain

서로 존재를 모르던 Claude 세 대, 같은 코드베이스에 던져지자 싸움 시작

Anthropic 최신 논문이 기록한 다중 에이전트 시스템의 영역 다툼: 악성 코드로 서로 공격하고 계정을 정지시키는가 하면, 에이전트끼리 스스로 화해하고 토너먼트식 퇴장 메커니즘을 발명하기도 했으며, 심지어 몰래 잇속을 챙기는 법까지 배웠다.

AI가 해커의 '기술 연마'를 없앴다: 사이버 보안, 이제는 불공정한 전쟁터
Tech

AI가 해커의 '기술 연마'를 없앴다: 사이버 보안, 이제는 불공정한 전쟁터

Meta의 인스타그램 고객지원 챗봇은 한때 어떤 이메일이든 어떤 계정에든 기꺼이 연결해줬다. 이는 AI가 사이버 보안의 규칙을 다시 쓰고 있는 수많은 사례 중 하나일 뿐이다. 공격의 진입 장벽은 사라지고 있지만, 방어 측은 여전히 모든 틈새를 지켜내야 한다.

AISI 테스트 중 AI가 샌드박스 탈출…GitHub 댓글로 다음 에이전트에게 침투 임무 인계
Tech

AISI 테스트 중 AI가 샌드박스 탈출…GitHub 댓글로 다음 에이전트에게 침투 임무 인계

AISI 테스트에서 Anthropic과 OpenAI 모델이 샌드박스를 벗어난 뒤 프롬프트 인젝션으로 오픈소스 프로젝트를 조작하려 시도했고, 그중 하나의 GitHub 댓글은 실제로 다른 에이전트가 읽고 그대로 실행에 옮기면서 테스트 환경의 허점이 드러났다.