AI 모델 평가 채용

모델 성능 지표, 평가 데이터·자동화 체계 또는 LLM 응답 품질을 직접 평가·개선하는 업무가 확인된 공고입니다.

71개 공고

경력

근무 방식

직무

기술·분야

지역

직무
기술·분야
지역

채용 기회 71

조사 확인일 2026.09.19

조사 당시의 공고 기록입니다. 모집 상태와 조건은 기업 원문에서 다시 확인해 주세요.

제논연구·개발

Physical AI Engineer

경력 1~10년공고 본문 미기재서울시 강남구재택 미확인

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
제로원에이아이인프라·데이터

LLMOps Ops / AI 모델 개발 엔지니어

경력 3~10년공고 본문 미기재성남시재택 유연근무제, 자율복장, 주 3일 대면 오피스 출근, 주 2일 재택근무

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
지에스에프솔루션인프라·데이터

AI/ML·LLM 엔지니어

경력 5~20년공고 본문 미기재성남시 분당구재택 미확인

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
콕스웨이브연구·개발

[AX krewa] 리서치 엔지니어

경력 3~35년공고 본문 미기재서울시 영등포구재택 자율 출근제(오전 8시~11시) 및 재택 근무(주1회) 제도 운영

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
콕스웨이브연구·개발

[AX krewa] 리서치 엔지니어 (Lead)

경력 3~35년공고 본문 미기재서울시 영등포구재택 자율 출근제(오전 8시~11시) 및 재택 근무(주1회) 제도 운영

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
크라우드웍스인프라·데이터

Physical AI 엔지니어

경력 3~8년공고 본문 미기재서울시 강남구재택 미확인

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
투모로로보틱스연구·개발

Robotics Engineer

경력 0~10년공고 본문 미기재서울시 강남구재택 미확인

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
티냅스연구·개발

AI Research Scientist

경력 5~10년공고 본문 미기재서울시 강남구재택 미확인

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
티맵모빌리티인프라·데이터

LLMOps Engineer

경력 5년 이상공고 본문 미기재서울시 중구재택 한 주의 하루는 재택근무로! 주 1회 집에서 근무할 수 있어요.

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
패스트뷰인프라·데이터

AI Engineer

경력 0~8년공고 본문 미기재서울시 서초구재택 미확인

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기
피매치연구·개발

Data Scientist

경력 2년 이상공고 본문 미기재서울시 관악구재택 미확인

모집 기록: Wanted에서 현재 지원 가능

마지막 조사 확인 2026.09.19

채용공고 보기

AI 평가 공고를 비교할 때

평가 기준 설계, 자동화 도구 구축, 결과 분석과 모델 개선 중 담당 범위를 확인하세요.

일반 소프트웨어 QA나 공고에 평가라는 단어만 등장하는 경우는 제외하고 AI 모델의 직접 평가 책임을 기준으로 합니다.

이 직무에서 살펴볼 일

모델 성능과 평가 지표

정확도·랭킹·안전성 등 제품 목적에 맞는 측정 기준과 평가 데이터를 설계하는 역할입니다.

LLM 평가와 품질 개선

응답 품질, 환각, 지연 시간과 비용을 측정하고 모델 선택·개선 과정에 연결합니다.

자주 묻는 질문

일반 QA 엔지니어도 포함되나요?

AI 모델의 성능·품질 평가 체계를 직접 구축하거나 수행하는 업무가 확인된 경우만 포함합니다.

LLM 평가도 포함되나요?

네. 응답 품질, 환각, 안전성 등 LLM 동작을 평가하고 개선하는 역할을 포함합니다.