AI 모델 평가 채용
모델 성능 지표, 평가 데이터·자동화 체계 또는 LLM 응답 품질을 직접 평가·개선하는 업무가 확인된 공고입니다.
71개 공고채용 기회 71개
조사 확인일 2026.09.19조사 당시의 공고 기록입니다. 모집 상태와 조건은 기업 원문에서 다시 확인해 주세요.
슈퍼브에이아이(Superb AI)제품·도입
Forward Deployed Engineer (5년 이상)
모집 기록: Wanted에서 현재 지원 가능
마지막 조사 확인 2026.09.19
스텝에이아이인프라·데이터
[팀 스케일업] AI 풀스택 개발자 (LLM 파이프라인 · 대규모 데이터 수집)
모집 기록: 2026-09-30 마감 예정
마지막 조사 확인 2026.09.19
업스테이지제품·도입
AI Solution Engineer - AI Pack partner success
모집 기록: Wanted에서 현재 지원 가능
마지막 조사 확인 2026.09.19
원프레딕트(onepredict)연구·개발
Data Scientist (고객사 상주 현장 기반 프로젝트)
모집 기록: Wanted에서 현재 지원 가능
마지막 조사 확인 2026.09.19
AI 평가 공고를 비교할 때
평가 기준 설계, 자동화 도구 구축, 결과 분석과 모델 개선 중 담당 범위를 확인하세요.
일반 소프트웨어 QA나 공고에 평가라는 단어만 등장하는 경우는 제외하고 AI 모델의 직접 평가 책임을 기준으로 합니다.
이 직무에서 살펴볼 일
모델 성능과 평가 지표
정확도·랭킹·안전성 등 제품 목적에 맞는 측정 기준과 평가 데이터를 설계하는 역할입니다.
LLM 평가와 품질 개선
응답 품질, 환각, 지연 시간과 비용을 측정하고 모델 선택·개선 과정에 연결합니다.
자주 묻는 질문
일반 QA 엔지니어도 포함되나요?
AI 모델의 성능·품질 평가 체계를 직접 구축하거나 수행하는 업무가 확인된 경우만 포함합니다.
LLM 평가도 포함되나요?
네. 응답 품질, 환각, 안전성 등 LLM 동작을 평가하고 개선하는 역할을 포함합니다.


















