멀티모달란?
AI 모델 분야에서 쓰이는 용어로, 텍스트·이미지·음성·영상 같은 여러 형식(modality)을 한 모델이 함께 입력받거나 출력할 수 있도록 만든 인공지능 처리 방식입니다.
CARD NEWS · 기본
SNS·수업 자료·발표 슬라이드에 붙여 쓰기 좋은 4장 세트입니다. 화면을 캡처하거나 브라우저의 인쇄 기능으로 PDF를 저장해 공유할 수 있습니다.
AI 모델 분야에서 쓰이는 용어로, 텍스트·이미지·음성·영상 같은 여러 형식(modality)을 한 모델이 함께 입력받거나 출력할 수 있도록 만든 인공지능 처리 방식입니다.
멀티모달은 글·사진·소리·영상처럼 서로 다른 형태의 정보를 한 모델이 동시에 알아듣고 답하는 방식이에요. " 한 줄만 적어도 알아서 설명해 주는 친구처럼, 텍스트와 이미지를 따로따로 묻지 않아도 한 번에 처리해 줍니다. "라고 물어볼 수 있고, 시험 직전에는 강의 녹음 mp3를 던지면서 "30분 안에 핵심 요점 5개로 정리해 줘"라고 부탁할 수도 있어요.
[1] 콜센터 1차 응대, 외국어 회의 동시통역, 화면 공유 기반 원격 지원처럼 지연이 곧 품질인 업무가 1순위 적용처입니다. [6] 국내 공공·금융 문서가 PDF·스캔 이미지로 잠겨 있던 환경에 활용도가 높습니다. [8] 범용 멀티모달은 1차 분류·교육·리포트 초안에 우선 투입하고, 최종 판독은 전문의가 책임지는 분업 구조가 안전합니다.
카드를 캡처하거나 브라우저 인쇄 → PDF로 저장하면 인스타·수업 자료에 쓸 수 있습니다. CC BY-SA 4.0에 따라 출처(AI for Everyone by Percent · ai.percent.ac)와 라이선스를 표시하면 상업적으로도 이용할 수 있습니다. 내용을 바꿨다면 그 사실을 밝히고 같은 라이선스로 공유해 주세요.