콘텐츠로 이동

도움 받기

관리자에게 문의하기 전에 몇 가지만 빠르게 확인하면 무슨 일이 일어났는지 파악할 수 있습니다:

  • 워크스페이스 카드 / 상세 페이지: 중지 이유가 직접 표시됩니다: OOM 종료, 예기치 않게 종료됨 (코드 N), 호스트 재시작으로 중지.
  • 컨테이너 로그: 워크스페이스 상세 페이지에서 로그 불러오기를 클릭해 컨테이너 출력의 마지막 N줄을 확인하세요. 이력을 더 보려면 tail 수를 500이나 1000으로 늘리세요.
  • 브라우저 콘솔: 빈 페이지나 UI가 깨진 경우 브라우저 개발자 도구 (F12)를 열어 콘솔과 네트워크 탭에서 오류를 확인하세요.

GPU 문제라면 LabPod 터미널을 열고 nvidia-smi를 실행해 GPU 상태를 확인하세요.

도움이 필요하면 관리자에게 다음을 알려주세요:

  1. 워크스페이스 이름 또는 ID: 워크스페이스 카드와 URL (/workspaces/<id>)에서 확인할 수 있습니다.
  2. 수행한 작업: 클릭한 버튼, 실행한 명령어.
  3. 예상한 결과와 실제 결과: 오류 메시지를 정확히 붙여넣으세요. 설명보다 스크린샷이 더 빠를 때가 많습니다.
  4. 오류가 발생한 위치: 브라우저 UI, 런처 (예: Jupyter 커널 종료), 터미널, 또는 nvidia-smi.

관리자는 감사 로그 (타임스탬프가 있는 모든 시작/중지/삭제 작업)와 워크스페이스별 컨테이너 로그를 볼 수 있고 워크스페이스 ID를 기준으로 이 둘을 연결해 확인합니다.

자주 발생하는 문제 직접 해결하기

섹션 제목: “자주 발생하는 문제 직접 해결하기”
문제해결 방법
LabPod 비밀번호 분실관리자에게 root 권한으로 labpod admin set-password <username> 실행 요청. sudo 기반 시스템에서는 sudo 사용
시작할 때 image_not_present가 표시됨워크스페이스 양식에서 Pull을 확인하거나 Templates → My templates에서 비공개 템플릿을 build한 뒤 다시 시작합니다. 전역 템플릿의 공유 이미지는 관리자에게 준비를 요청하세요
런처가 시작되지 않음앱에서 새로 고침을 클릭한 후 시작 재시도; 컨테이너 로그 확인
DataLoader에서 Bus error 발생컨테이너를 직접 시작했을 가능성이 높음; podman run 명령에 --shm-size 추가
CUDA OOM배치 크기를 줄이거나 더 많은 VRAM 요청 (전체 GPU 또는 더 큰 공유 분할)
/work 가득 참오래된 체크포인트 삭제; 충분한 공간을 확보할 수 없으면 관리자에게 사용하지 않는 이미지 정리 요청

Settings (상단 내비게이션의 사용자 이름) → 비밀번호 변경으로 이동하세요. 자세한 내용은 할당량 및 사용량을 참조하세요.

터미널이나 스크립트로 자신의 워크스페이스를 다룬다면 매번 비밀번호를 입력하는 대신 개인 액세스 토큰을 발급하세요. labpod token create --name <name>으로 발급하고(토큰은 한 번만 표시되므로 바로 복사), 브라우저에서는 Settings → API tokens에서 토큰을 조회하거나 폐기할 수 있습니다. 자세한 사용법은 CLI → 개인 액세스 토큰을 참조하세요.