AISI

AI 모델 42종 안전성 평가 수행 실적 공개 (모델 목록)
  • 분류
    연구
  • 등록일
    2026-05-13 18:28:55
  • 작성자
    운영자
  • 조회수
    471
  • 한국 AI안전연구소(AISI)가 2025년 1월부터 2026년 4월까지 약 16개월간 국내외 주요 AI 모델 42종을 대상으로 수행한 안전성 평가 실적을 공개합니다.

    DeepSeek, GPT, Claude, Gemini, Kimi 등 글로벌 프론티어 모델과 Kanana, Gauss, EXAONE 등 국내 대표 모델, LlamaGuard, ShieldGemma, Granite Guardian 등 안전성 가드레일 모델을 폭넓게 포함합니다.

    평가는 CBRN-E, 살상무기, 사이버보안, 민감정보 유출, 프롬프트 주입, 과도거부, 에이전트 AI 환경에서의 악성 행동 확산 및 연산 자원 남용 등 진화하는 AI 위험에 대응하는 항목들로 구성되었습니다.

    AISI는 앞으로도 신규 출시 모델과 에이전트형 AI에 대한 평가 범위를 확대하고, 국제 AI안전연구소 네트워크와의 협력을 강화하며, 평가 방법론을 지속적으로 고도화하여 신뢰할 수 있는 AI 생태계 조성에 기여할 계획입니다.
  • 첨부파일