AI 모델 42종 안전성 평가 수행 실적 공개 (모델 목록)
-
분류연구
-
등록일2026-05-13 18:28:55
-
작성자운영자
-
조회수471
-
한국 AI안전연구소(AISI)가 2025년 1월부터 2026년 4월까지 약 16개월간 국내외 주요 AI 모델 42종을 대상으로 수행한 안전성 평가 실적을 공개합니다.
DeepSeek, GPT, Claude, Gemini, Kimi 등 글로벌 프론티어 모델과 Kanana, Gauss, EXAONE 등 국내 대표 모델, LlamaGuard, ShieldGemma, Granite Guardian 등 안전성 가드레일 모델을 폭넓게 포함합니다.
평가는 CBRN-E, 살상무기, 사이버보안, 민감정보 유출, 프롬프트 주입, 과도거부, 에이전트 AI 환경에서의 악성 행동 확산 및 연산 자원 남용 등 진화하는 AI 위험에 대응하는 항목들로 구성되었습니다.
AISI는 앞으로도 신규 출시 모델과 에이전트형 AI에 대한 평가 범위를 확대하고, 국제 AI안전연구소 네트워크와의 협력을 강화하며, 평가 방법론을 지속적으로 고도화하여 신뢰할 수 있는 AI 생태계 조성에 기여할 계획입니다. -
첨부파일