AI Safety란?
AI 활용 분야에서 쓰이는 용어로, 인공지능 시스템이 의도와 다르게 동작해 일으킬 수 있는 피해를 줄이기 위해 모델·운영·정책 전 단계에서 적용하는 기술과 절차를 통칭하는 표현입니다.
CARD NEWS · 보안·윤리
SNS·수업 자료·발표 슬라이드에 붙여 쓰기 좋은 4장 세트입니다. 각 카드는 스크린샷·다운로드해 그대로 공유하실 수 있습니다.
AI 활용 분야에서 쓰이는 용어로, 인공지능 시스템이 의도와 다르게 동작해 일으킬 수 있는 피해를 줄이기 위해 모델·운영·정책 전 단계에서 적용하는 기술과 절차를 통칭하는 표현입니다.
AI 안전은 인공지능이 잘못된 답을 내거나 위험한 행동을 하지 않도록 미리 점검하고 막아두는 일이에요. 조별 과제에서 친구가 자료를 들고 왔을 때, 출처와 사실관계를 함께 확인하는 과정과 비슷합니다. AI가 점점 더 많은 결정에 끼어들수록 "이 답을 믿어도 되는가"를 검증하는 절차가 중요해지기 때문에, 모델을 만드는 회사뿐 아니라 쓰는 사람도 알아둘 필요가 있어요. 학과 첫 시험 직전 룸메이트에게 "이 답안 한번 봐줘" 부탁하는 장면을 떠올리면 가깝습니다.
**케이스 1: Anthropic — Responsible Scaling Policy(RSP)로 모델 출시 게이트 운영** Anthropic은 2023년 9월 첫 RSP를 공개한 뒤 v3.3(2026년 5월 기준)까지 13회 개정했습니다 [2]. 모델 능력이 일정 임계점(CBRN 무기 개발 보조, AI R&D 자동화 등)을 넘으면 ASL-3 수준의 보안·배포 안전장치를 가동해야 출시할 수 있
카드를 스크린샷하거나 브라우저 인쇄 → PDF로 저장하면 인스타·수업 자료에 바로 쓸 수 있습니다. 출처 (AI for Everyone by Percent · ai.percent.ac)만 밝히면 상업적 이용도 가능합니다.