2건
BM25
비엠 이십오
정보 검색 분야에서 쓰이는 Best Matching 25(베스트 매칭 25)의 약자로, 질의어와 문서의 단어 일치도를 점수로 매기는 키워드 기반 랭킹 함수입니다. 1970년대와 1980년대에 Robertson과 Spärck Jones 등이 세운 확률적 검색 모델을 잇는 TF-IDF 계열 기법입니다 [1]. 문서 길이 정규화를 맡는 b와 용어 빈도 포화를 맡는 k1, 두 파라미터가 점수를 조절합니다 [3]. Apache Lucene과 Elasticsearch, OpenSearch가 기본 스코어링으로 채택했습니다 [2]. RAG의 하이브리드 검색에서는 의미 기반 벡터 검색과 짝을 이룹니다 [4].
데이터·DB
Foundation Model
파운데이션 모델
대규모 데이터로 사전학습한 뒤 미세조정 등으로 다양한 하위 작업에 적응시켜 쓰는 범용 AI 모델입니다. 2021년 8월 스탠퍼드대 CRFM 연구진이 보고서 'On the Opportunities and Risks of Foundation Models'에서 개념을 정립했고, BERT·GPT-3·CLIP을 대표 사례로 들었습니다. 하나의 모델이 챗봇·번역·코딩 같은 여러 응용의 공통 기반이 된다는 뜻에서 '기반 모델'로 번역됩니다. EU AI법은 이 계열을 범용 AI(GPAI) 모델로 규정하고, 학습 연산량 10^25 FLOP을 넘으면 시스템적 위험 모델로 추정해 추가 의무를 부과합니다.
기본