AI 모델 평가 채용

모델 성능 지표, 평가 데이터·자동화 체계 또는 LLM 응답 품질을 직접 평가·개선하는 업무가 확인된 공고입니다.

71개 공고

경력

근무 방식

직무

기술·분야

지역

직무
기술·분야
지역

채용 기회 71

조사 확인일 2026.09.19

조사 당시의 공고 기록입니다. 모집 상태와 조건은 기업 원문에서 다시 확인해 주세요.

세종분석연구원연구·개발

Senior AI Engineer

경력 5~11년공고 본문 미기재서울시 마포구재택 미확인

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
슈퍼브에이아이(Superb AI)제품·도입

Forward Deployed Engineer (5년 이상)

경력 5~11년공고 본문 미기재서울시 강남구재택 재택 근무와 사무실 근무를 병행하는 하이브리드 근무제

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
에이아이트릭스(AITRICS)인프라·데이터

HAX AI Engineer

경력 7~14년공고 본문 미기재서울시 강남구재택 미확인

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
에이젠글로벌연구·개발

DATA Scientist

경력 3~8년공고 본문 미기재서울시 영등포구재택 미확인

모집 기록: 2026-11-30 마감 예정

마지막 조사 확인 2026.09.19

채용공고 보기
원프레딕트(onepredict)제품·도입

Data Scientist (고객사 FDE)

경력 2년 이상공고 본문 미기재서울시 서초구재택 주 2회 재택근무: 물리적 제약 없는 몰입을 위해 하이브리드 근무를 기본으로 합니다.

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기

AI 평가 공고를 비교할 때

평가 기준 설계, 자동화 도구 구축, 결과 분석과 모델 개선 중 담당 범위를 확인하세요.

일반 소프트웨어 QA나 공고에 평가라는 단어만 등장하는 경우는 제외하고 AI 모델의 직접 평가 책임을 기준으로 합니다.

이 직무에서 살펴볼 일

모델 성능과 평가 지표

정확도·랭킹·안전성 등 제품 목적에 맞는 측정 기준과 평가 데이터를 설계하는 역할입니다.

LLM 평가와 품질 개선

응답 품질, 환각, 지연 시간과 비용을 측정하고 모델 선택·개선 과정에 연결합니다.

자주 묻는 질문

일반 QA 엔지니어도 포함되나요?

AI 모델의 성능·품질 평가 체계를 직접 구축하거나 수행하는 업무가 확인된 경우만 포함합니다.

LLM 평가도 포함되나요?

네. 응답 품질, 환각, 안전성 등 LLM 동작을 평가하고 개선하는 역할을 포함합니다.