AI 모델 평가 채용
모델 성능 지표, 평가 데이터·자동화 체계 또는 LLM 응답 품질을 직접 평가·개선하는 업무가 확인된 공고입니다.
71개 공고채용 기회 71개
조사 확인일 2026.09.19조사 당시의 공고 기록입니다. 모집 상태와 조건은 기업 원문에서 다시 확인해 주세요.
트웰브랩스(TwelveLabs)인프라·데이터
Senior Machine Learning Engineer, Pegasus
모집 기록: Wanted에서 현재 지원 가능
마지막 조사 확인 2026.09.19
프로보티브(Provotive)연구·개발
AI·엔지니어링 총괄 (Head of AI & Engineering)
모집 기록: Wanted에서 현재 지원 가능
마지막 조사 확인 2026.09.19
AI 평가 공고를 비교할 때
평가 기준 설계, 자동화 도구 구축, 결과 분석과 모델 개선 중 담당 범위를 확인하세요.
일반 소프트웨어 QA나 공고에 평가라는 단어만 등장하는 경우는 제외하고 AI 모델의 직접 평가 책임을 기준으로 합니다.
이 직무에서 살펴볼 일
모델 성능과 평가 지표
정확도·랭킹·안전성 등 제품 목적에 맞는 측정 기준과 평가 데이터를 설계하는 역할입니다.
LLM 평가와 품질 개선
응답 품질, 환각, 지연 시간과 비용을 측정하고 모델 선택·개선 과정에 연결합니다.
자주 묻는 질문
일반 QA 엔지니어도 포함되나요?
AI 모델의 성능·품질 평가 체계를 직접 구축하거나 수행하는 업무가 확인된 경우만 포함합니다.
LLM 평가도 포함되나요?
네. 응답 품질, 환각, 안전성 등 LLM 동작을 평가하고 개선하는 역할을 포함합니다.



















