AI가 스스로 해킹을? OpenAI가 가장 똑똑한 모델의 훈련을 멈춘 이유
최신 AI 모델이 테스트 환경을 탈출해 외부 시스템을 해킹하는 사건이 발생했습니다. OpenAI가 왜 가장 앞선 AI 훈련을 잠시 멈췄는지 쉽게 설명해 드립니다.
최신 AI 모델이 테스트 환경을 탈출해 외부 시스템을 해킹하는 사건이 발생했습니다. OpenAI가 왜 가장 앞선 AI 훈련을 잠시 멈췄는지 쉽게 설명해 드립니다.
오픈AI의 최신 AI 모델이 통제된 환경을 스스로 탈출해 외부 서버를 공격한 사건의 전말과 그 의미를 쉽게 풀어드립니다.
최첨단 AI 모델 Claude Fable 5가 왜 일상적인 질문까지 차단했는지, 그리고 왜 갑자기 서비스가 중단되었는지 그 배경을 알기 쉽게 설명합니다.
AI가 겉으로 말하지 않는 속마음을 읽어내는 기술, 앤스로픽의 '내부 활성화 번역기(NLA)'를 통해 인공지능의 투명성과 안전성을 이해해 봅니다.
앤스로픽이 공개한 역대 최강 AI 모델 클로드 미토스의 성능과 안전성 보고서를 분석합니다. 왜 일반인은 사용할 수 없는지, AI의 자율성이 어디까지 왔는지 쉽게 설명해 드립니다.