AI for Everyone
AI 용어
플레이북
서비스 소개
SEARCH RESULTS
“SWEbench”
1
건
검색
전체
1
기본
1
SWE-bench
AI 모델 평가 분야에서 Princeton NLP팀이 2023년에 공개한 코딩 능력 벤치마크로, 실제 GitHub 이슈와 PR을 모아 LLM이 진짜 오픈소스 버그를 해결할 수 있는지 평가하는 표준 평가입니다.
기본
검색 · AI for Everyone