Filter

직군/직무

고용형태

경력

근무지

[NAVER Cloud] AI Security RL 환경 엔지니어 (경력)

모집 부서
NAVER Cloud
모집 분야
Tech
모집 분야
Security
모집 경력
경력
근로 조건
정규
모집 기간
2026.09.30 ~ 2026.10.14 (17:00)

입사지원은 PC를 이용해주세요.



담당업무

1. 보안 과제 실행환경 설계 및 구축

• Offensive·Defensive 과제 명세 정의·난이도 계층화, Sandbox 설계 및 운영 

• IaC기반 환경 프로비저닝·온보딩 및 패키징·버전 관리·재현성 확보


2. 실행 결과 기반 Verifier 개발

• 취약점 재현·패치 유효성·탐지 규칙 판정 관련 로직 구현
• 이진 판정 및 단계별 부분 점수의 분리 적용 등의 보상 설계


3. 대규모 실행 운영 및 우회 방지

• 다수 Sandbox의 동시 Rollout 처리량 관리 및 초기화·복원 안정성 확보
• Reward Hacking·Verifier 우회 사례 분석·차단 및 자체 침투 시험을 통한 격리 경계 검증


4. Trajectory 수집 및 컨소시엄 산출물 통합

• Trajectory 수집·관측 체계 구축 및 참여기관 산출물 통합·품질 판정
• 환경-Verifier 공통 인터페이스 규격 정의 및 오픈소스 공개용 패키징·재현 레시피 구성


5. 평가 인프라 지원 및 선행 연구

• 재현 가능한 자동 평가 환경 구성 및 공개 벤치마크(CyberGym, ExCyTIn-Bench 등) 이식

• 사이버 훈련 환경 자동 생성·변형 기법 연구 및 후속 국책 과제 요건 정의 참여

자격요건

• 보안 인프라 구축, 취약점 분석, 모의해킹, 보안 도구 개발 중 하나 이상의 보안 분야 실무 경력을 3년 이상 보유하신 분 

• 다음 두 가지 경험 중 하나 이상을 보유하신 분

    - 훈련·평가 환경 구축

      : 사이버 레인지, 보안경진대회(CTF) 인프라 또는 채점 서버, Flag 검증, 실행 결과 대조 중 하나 이상의 보안 실습 환경 설계·운영 경험

      (단, 환경 프로비저닝 및 과제의 성공 여부를 자동으로 판정하는 로직 구현 경험 필수 포함)

    - 실행 기반 판정

      : 취약점 재현, 패치 시험, 탐지 규칙 실행의 결과를 자동으로 판정하는 로직 구현 경험 
      (Sanitizer 출력 대조, 빌드·테스트 자동화, 룰 실행 결과 측정 중 하나 이상) 

• Container, Virtual Machine, Sandbox 등 격리 실행환경의 구축 및 운영 경험을 보유하신 분

• Python 기반 프로덕션 코드 작성 역량을 갖추신 분

우대사항

• 보안경진대회(CTF) 출제 또는 사이버 훈련 시나리오 설계 경험을 보유하신 분

• 강화학습 환경·LLM 학습 파이프라인 구축 또는 강화학습 학습·서빙 스택(verl, TRL, Ray, vLLM, SGLang 등) 경험을 보유하신 분

• 대규모 Container Orchestration(Kubernetes 등) 운영 또는 IaC(Terraform, Ansible 등) 기반 환경 자동화 경험을 보유하신 분

• Fuzzing 인프라· OSS-Fuzz 계열 파이프라인 또는 Active Directory 기반 공격 실습 환경 구축 경험을 보유하신 분

• Digital Twin 또는 운영환경 복제 기반 검증 환경 구축 경험을 보유하신 분

• LLM as a Judge 설계 또는 Rubric 기반 자동 채점 경험을 보유하신 분

• 오픈소스 보안 도구 기여 이력 또는 관련 분야 학술 논문 게재·발표 이력을 보유하신 분

조직구성원 Talk

"AI가 스스로 보안 과제를 학습하도록 시스템을 만들고 시험 결과로 성공 여부를 판단하는 환경을 만듭니다."


이 포지션은 보안 과제의 실행환경과 자동 검증기(Verifier)를 설계하고 개발합니다. 환경을 코드로 관리해 같은 조건에서 반복 실행할 수 있도록 만들고, 과제의 목적과 난이도에 맞는 판정 기준을 구현합니다. 취약점 재현은 실행 조건과 오류 기록을 함께 확인하고, 패치는 빌드·기능·회귀 시험으로 검증합니다. 탐지 규칙은 정상과 공격 사례에 적용해 정탐·오탐·미탐을 확인합니다. 


사이버 훈련 환경을 구축해 보셨다면 기존 경험을 활용하실 수 있는 부분이 많습니다. 여기에 모델 학습을 위한 반복 실행과 자동화가 더해지고, 여러 과제를 동시에 실행해도 결과가 섞이지 않도록 작업이 끝난 환경은 초기 상태로 안정적으로 복원돼야 합니다. 필요한 경우 단계별 점수를 설계하고, 과제를 제대로 수행하지 않고도 점수를 얻을 수 있는 허점이 없는지 검토하는 일도 맡습니다.


사이버훈련장이나 보안 경진대회(CTF) 인프라를 구축한 경험, 또는 취약점 재현·패치 시험·탐지 규칙 실행 결과를 자동으로 판정하는 로직을 구현한 경험이 있다면 지원하실 수 있습니다. 강화학습에 필요한 지식은 AI 모델 개발 조직과 협업하며 넓혀갈 수 있습니다.


개발한 환경과 검증기는 오픈소스로 공개하고, 후속 과제와 네이버클라우드의 보안 서비스 검증에도 활용할 계획입니다. 실제 학습 과정에서 발생하는 오류와 재현 문제를 해결하며, 반복해서 사용할 수 있는 환경으로 발전시켜 나가려 합니다. 보안 환경 구축과 자동화 경험을 바탕으로 함께할 분을 찾습니다.

전형절차 및 기타사항

[전형절차]

서류 전형(기업문화적합도 검사 및 직무 테스트 포함) ▶ 1차 인터뷰 ▶ 레퍼런스체크 및 2차 인터뷰 ▶ 처우협의 ▶ 최종합격

※ 전형 절차는 일정 및 상황에 따라 변동될 수 있으며, 전형 별 결과에 따라 절차(추가 인터뷰 등)가 추가될 수 있습니다.

※ 정해진 결과 발표 일정은 없으며, 지원서 검토 후 면접 일정은 대상자에게 개별로 안내드릴 예정입니다.



[근무지]

경기 성남시 분당구 불정로 6 (그린팩토리) 

※ 근무지는 회사 내부 사정에 따라 변동될 수 있습니다. 



[기타 사항]

• 본 공고는 중복지원이 불가능하며, 기진행한 포지션에 대한 전형이 모두 마무리되면 다른 포지션으로 지원이 가능합니다.

• 해외 출장에 결격 사유가 없는 분만 지원 가능합니다. 

• 병역 의무를 필한 자 혹은 면제된 자에 한해 입사지원이 가능합니다. 

• 지원서 상 허위 기재가 있거나 제출 서류가 허위인 경우 합격이 취소될 수 있습니다.

• 제출된 지원서는 [My page- 지원현황]에서 확인 가능하며, 공고 마감 전까지 홈페이지에서 수정 및 지원 철회가 가능합니다.

• 본 공고는 인재 선발 완료 시 조기 마감될 수 있으며, 필요 시 모집 기간이 연장될 수 있습니다.

• 국가유공자 및 장애인 등 취업보호 대상자는 관계법령에 따라 우대합니다. 

• 국가유공자의 가산점 부여를 받기 위해서는 본인이 '취업지원 대상자 증명서'를 회사에 제출해야 합니다.

• 제출해 주신 지원서의 검토 결과 발표는 지원서에 등록하신 이메일로 개별 안내드립니다.

• 입사 후 3개월의 수습 기간을 적용하며 평가에 따라 수습 기간이 연장되거나 채용이 취소될 수 있습니다. 

• 문의사항은 NAVER Cloud 채용 홈페이지 1:1 문의로 접수해 주시기 바랍니다.

• 입사 확정 이후라도 국제 제재(Sanction) 대상자 또는 관련자로 확인될 경우, OFAC 규정 등 관련 법규에 따라 고용계약 체결이 제한될 수 있음을 안내드립니다.

• Please be advised that even after an employment offer is finalized, your employment contract may be restricted under applicable laws and regulations, including OFAC rules, if you are identified as a sanctioned individual or as being associated with any sanctioned entity.