주요 LLM 안전 시스템 우회 취약점 발견, AI 보안 체계 근본적 재검토 필요
연구원 데이브 쿠즈마가 거의 모든 주요 대규모 언어 모델(LLM)에서 안전 시스템을 우회해 위험한 정보를 추출할 수 있는 취약점을 발견했다. 이번 연구는 AI 모델의 사회적 통합 ...
연구원 데이브 쿠즈마가 거의 모든 주요 대규모 언어 모델(LLM)에서 안전 시스템을 우회해 위험한 정보를 추출할 수 있는 취약점을 발견했다. 이번 연구는 AI 모델의 사회적 통합 속도를 조절하고 안전 연구에 대한 투자를 대폭 확대해야 한다는 경고를 담고 있다.
Briefing Queue
Category Digest
Latest
연구원 데이브 쿠즈마가 거의 모든 주요 대규모 언어 모델(LLM)에서 안전 시스템을 우회해 위험한 정보를 추출할 수 있는 취약점을 발견했다. 이번 연구는 AI 모델의 사회적 통합 ...
일론 머스크의 xAI가 자사 AI 챗봇 그록을 이용해 아동 성적 학대물(CSAM)을 생성한 사용자를 상대로 소송을 제기했다. 이번 사건은 AI 기술의 윤리적 오용과 개발사의 안전 ...
현대자동차가 2028년까지 생산 현장에 휴머노이드 로봇을 투입하겠다는 계획을 발표했다. 회사는 이번 로봇 도입이 현재 진행 중인 노조의 파업 협상과는 무관하다고 선을 그었으나, 자...
구글 리서치가 사용자의 자연어 증상 설명을 분석해 정보를 제공하는 대화형 AI 에이전트 '심텀AI(SymptomAI)' 연구 결과를 발표했다. 이 모델은 의료 전문가를 대체하는 것...
젠슨 황 엔비디아 CEO가 일본을 방문해 정부 및 주요 기업과 AI 인프라 협력을 논의하며 기술 생태계 계약을 체결했다. 이번 행보는 아시아 태평양 지역 내 AI 주도권 확보를 위...
MIT 테크놀로지 리뷰는 LLM이 자체적인 편향을 개발해 채용 과정에서 인간보다 더 심한 고정관념을 보일 수 있다고 경고했다. 또한 기상 예측 시장의 데이터 조작 위험이 커지며 A...
기후 변화로 산불이 연중 발생하는 가운데, 미국 캘리포니아와 알래스카에서 자율 드론을 활용한 초기 진압 테스트가 활발히 진행되고 있다. 1,100만 달러 규모의 XPRIZE 대회를...
구글이 AI 영상 제작 도구인 비즈(Vids)에 사용자의 모습을 디지털화하는 개인화된 AI 아바타 기능을 추가했다. 제미니 옴니 모델을 기반으로 프롬프트와 참조 이미지를 활용해 사...
Kimi K3가 200만 토큰의 컨텍스트 윈도우를 지원하며 기존 AI 모델의 장문 처리 한계를 극복했다. 이는 복잡한 문서 분석과 대규모 코드베이스 관리 등에서 새로운 기술적 기준...
오픈AI가 청소년 사용자를 위한 연령별 보호 조치와 자녀 관리 기능을 도입하며 안전한 AI 환경 구축에 나섰다. 이는 AI 기술의 보편화에 따른 사회적 책임론에 대응하는 행보로, ...
로봇 기반 건설 자동화 스타트업 그리트(Gritt)가 3,400만 달러 규모의 투자를 유치하며 스텔스 모드를 종료했다. 태양광 발전소 건설 현장의 반복 작업을 자동화하여 인력난과 ...
구글 딥마인드가 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 모델을 새롭게 선보였다. 이번 신규 모델들은 특정 작업에 최적화된 경량화와...