추천 검색

AI Research Engineer - LLM Eval Internship (정규직 전환 형)
공고 요약
담당업무
벤치마크 개발 및 평가 툴킷 연구·개발
LLM 성능 평가 벤치마크 및 동향 모니터링
Work Intelligence 벤치마크 구축
데이터셋 및 메트릭 설계 포함
프론티어 모델 및 Solar 다각적 평가
대시보드 및 리더보드 구성
프로젝트 우선순위: 확장/신규 벤치마크 개발, 한국 문화·한국어 반영
대표 프로젝트: Benchmark development, Evaluation toolkit development, Diverse benchmark evaluation framework, Dashboard & leaderboard
자격요건
AI 모델 평가 기획 및 데이터 수집·생성·정제 및 평가 기준 확립 경험
최신 기술 동향 파악 및 적용 능력
Agentic flow(도구 활용) 설계 및 개발 경험
데이터 협업 프로토콜 설계 및 시스템적 사고 능력
자체적 평가 프레임워크 구축 가능 프로그래밍 능력
논리적 사고 실험 및 가설/검증 설계 능력
효과적이고 효율적으로 지식 공유 및 논의 가능
Git 활용 협업 경험
우대사항
AI 모델 평가 및 분석 관련 국제 학회 출판(공저자 포함) 우대
ML/NLP 토픽 국제 학회 논문 발표(1저자 또는 교신저자) 우대
AI 모델링 경험
컴퓨터 공학 지식 보유(데이터 구조·알고리즘, 컴퓨터 네트워크, 데이터베이스, OS 등)
LLM 활용 제품 개발 또는 운영 경험
근무환경
Anywhere On Earth But Together
카페/스터디 룸/공유 오피스 이용 비용 지원
업무 관련 소프트웨어·도서·교육 자료 비용 지원
전형절차
서류전형
알고리즘 코딩 테스트
과제 테스트
기술인터뷰 1차
기술인터뷰 2차
컬처인터뷰
최종 결과 발표
마감기한
상시채용
공고 원문
이런 공고는 어때요?

vox.ai
1년~9년 · 정규직 · 서울

엘리스그룹
6년 이하 · 정규직 · 서울

딥아이
20년 이하 · 정규직 · 부산

페이스웹
20년 이하 · 체험형인턴 · 서울

메디콜
20년 이하 · 정규직 · 서울

디피플래닝
20년 이하 · 정규직 · 서울

에이아이카데미
20년 이하 · 정규직 · 광주

엔세이피아(구 코코네)
10년 이하 · 체험형인턴 · 서울

데이터드리븐
1년~3년 · 정규직 · 서울

재미스튜디오
10년 이하 · 정규직 · 대전

팀카이
20년 이하 · 정규직 · 서울

페이스웹
9년 이하 · 정규직 · 서울

프리더스
20년 이하 · 정규직 · 경기

조코딩에이엑스파트너스
1년~20년 · 정규직 · 서울

제너러티브랩
20년 이하 · 정규직 · 서울

AMD
3년 이하 · 정규직 · 해외

바이언스
1년~8년 · 정규직 · 서울

플루이즈
1년~35년 · 정규직 · 서울

딥오토
3년 이하 · 정규직 · 서울

씽크풀
1년 이하 · 병역특례 · 서울



