2

Model Card
모델 카드
AI 모델의 용도·성능·한계·편향 평가 결과를 정해진 항목으로 정리해 모델과 함께 공개하는 문서 표준입니다. 구글 연구진(Mitchell, Gebru 외)이 2019년 공정성 학회 FAT*에서 논문 'Model Cards for Model Reporting'으로 제안했습니다. 식품 영양성분표처럼 모델의 성분과 주의사항을 표준 양식으로 밝히자는 취지입니다. 현재 허깅페이스 저장소의 문서 표준으로 자리 잡았고, OpenAI·앤트로픽의 시스템 카드처럼 안전 평가 보고서로도 확장됐습니다.
보안·윤리
AI 평가
AI Evals
개발 분야에서 쓰이는 말로, AI 모델이나 AI 시스템의 품질을 정해진 과제와 지표로 반복 가능하게 측정하는 평가 절차와 도구를 뜻합니다. 평가를 뜻하는 evaluations를 줄여 이밸(evals)이라 부릅니다. 정확도만 보지 않습니다. 효율·편향·유해성처럼 정확도 너머의 여러 축을 함께 잽니다. 표준 평가 하네스를 쓰면 같은 프롬프트로 여러 모델을 비교할 수 있어, 논문과 제품 사이에 재현성과 비교가능성이 생깁니다. LLM을 서비스에 올리기 전 품질을 확인하는 개발 공정의 한 단계입니다.
개발
검색 · AI for Everyone