SRL / GPU NODE 01운영 파일럿

RTX PRO 6000 · SHARED COMPUTE NODE

96GB를
한 사람처럼
쓰지 않습니다.

개인 계정, 기기별 열쇠, 예약 실행, 지워지기 어려운 작업기록. 강력한 한 대를 팀이 안전하게 공유하는 방식입니다.

NODE TELEMETRYREFERENCE
GPU MEMORY96GB
GPURTX PRO 6000Blackwell · sm_120
CPU16C / 32TRyzen 9 9950X
RAM125.6 GBSystem memory
OSWindows 11PowerShell over SSH
검증 기준일 2026.07.20 사내 LAN 전용
01사람마다 계정 하나
02기기마다 키 하나
03GPU는 예약 후 실행
04모든 의미 있는 작업은 기록

ACCESS ONBOARDING

신청은 에이전트에게
맡기세요.

직원이 하는 일은 두 가지뿐입니다.

내 정보를 입력하고, 복사한 문장을 Claude Code 또는 Codex에 붙여넣으세요. 키 생성과 신청 JSON 작성은 에이전트가 안내합니다.

01 / 내 정보 입력
이 정보는 서버로 전송되지 않습니다. 브라우저에서 프롬프트 문장에만 채워집니다.
02 / Claude Code·Codex에 붙여넣기

신규 계정 신청 프롬프트

나는 SRL 사내 GPU 서버의 개인 SSH 계정을 처음 신청하려고 한다. 아래 절차를 가능한 한 자동으로 수행하라.

목표는 이 PC 전용 SSH 키를 만들고, 관리자에게 전달할 srl-gpu-access-request-v1 JSON을 생성하는 것이다. 서버 접속·계정 생성·메시지 전송은 하지 마라.

안전 규칙:

1. 개인키 파일, 개인키 내용, 암호, 패스프레이즈를 읽거나 채팅·로그·클립보드·요청 JSON에 출력하지 마라.
2. 공개키는 반드시 ssh-ed25519로 새로 만들고, 이 GPU 서버 접속 전용으로 사용한다. 기존 키를 임의로 재사용하거나 덮어쓰지 마라.
3. 키 생성 시 패스프레이즈 입력은 내가 터미널에 직접 하게 하라. 패스프레이즈를 채팅으로 요구하지 마라. 에이전트 터미널이 대화형 입력을 지원하지 않으면 정확한 ssh-keygen 명령 한 줄만 제시하고 내가 직접 실행할 때까지 기다려라.
4. 회사 Git 저장소나 Obsidian 볼트 안에 요청 JSON 또는 키를 저장하지 마라.
5. 비밀번호나 개인키가 입력 정보에 섞였으면 즉시 중단하고 폐기를 안내하라.

진행 순서:

1. 현재 Windows hostname을 읽어 기기명 후보로 사용한다.
2. 희망 SSH 계정명이 비어 있으면 실명 기반의 짧은 영문 소문자 계정명 하나를 제안하고 내 확인을 딱 한 번 받는다. 계정명은 영문 소문자로 시작하는 3~20자의 소문자·숫자·점·밑줄·하이픈만 사용한다. artist, sanghun, admin, administrator는 제안하지 마라.
3. %USERPROFILE%\.ssh\srl_gpu_<계정>_<기기명>을 기본 키 경로로 사용하되, 같은 이름이 이미 있으면 절대 덮어쓰지 말고 UTC 시각 접미사를 붙인다.
4. ssh-keygen -t ed25519 -a 64 -f "<개인키 경로>" -C "<계정>@<기기명>-srl-gpu"를 실행한다. 패스프레이즈는 내가 직접 입력한다.
5. 현재 작업공간 또는 연결된 SRL 볼트에서 90_System/Tools/remote_gpu_setup/New-GpuAccessRequest.ps1을 찾는다. 찾으면 아래 의미의 인자로 실행한다.
   - RequestType=NewUser
   - 나의 실명·팀·회사 이메일·확정 SSH 계정
   - 방금 생성된 .pub 공개키 경로
   - DeviceLabel=<hostname을 영문·숫자·점·밑줄·하이픈으로 정리한 값>
   - 현재 에이전트에 맞춰 PreparedBy=codex 또는 claude-code
   - CopyToClipboard
6. 스크립트를 찾지 못하면 서버를 건드리지 말고 중단한 뒤 관리자에게 remote_gpu_setup 폴더를 요청하라고 안내한다. 임의 형식의 신청서를 만들지 마라.
7. 생성된 JSON을 다시 읽어 다음만 검증한다: 요청 종류 new_user, 공개키가 한 줄의 ssh-ed25519, 계산한 SHA256 지문과 JSON 지문 일치, 개인키·암호 필드 없음, 실명·팀·이메일·기기명 정확함.
8. 마지막 답변에는 요청 파일의 절대경로, SSH 계정, 기기명, 공개키 지문, 관리자에게 전달할 JSON 코드블록만 보여준다. 개인키 경로나 내용은 보여주지 마라. “이 JSON만 관리자에게 전달하고 개인키는 이 PC에 보관”이라고 명확히 말하라.

입력 정보:

- 실명: <직원이 입력>
- 팀: <직원이 입력>
- 회사 이메일: <직원이 입력>
- 희망 SSH 계정명: <모르면 비워두기>
!
개인키와 패스프레이즈는 절대 채팅에 붙이지 마세요.

관리자에게 보내는 것은 에이전트가 만든 공개키 포함 JSON뿐입니다. 개인키는 신청한 PC 안에 남아야 합니다.

VERIFIED MACHINE PROFILE

이 한 대가 제공하는 것

마케팅 표기가 아니라 실제 노드에서 확인한 기준입니다.

G01

NVIDIA RTX PRO 6000

Blackwell Workstation Edition

97,887 MiB VRAM
  • sm_120 연산 아키텍처
  • 드라이버 596.72 검증
  • fp16 8192² 스모크 267.4 TFLOPS
C16

AMD Ryzen 9 9950X

CPU preprocessing · build · data

16 cores / 32 threads
  • CPU 작업도 WORK ID 기록
  • 코어·RAM 경합은 아직 자동 통제 안 됨
M12

System Memory

대용량 전처리와 로딩

125.6 GB RAM
  • 사용량 공유를 전제로 계획
  • 대용량 데이터는 개인 작업폴더 사용
S01

Validated Runtime

Blackwell 대응 환경

CUDA 12.8
  • Python 3.12.13
  • PyTorch 2.11.0+cu128 검증
  • 작업별 개인 venv 필수
구형 cu121 환경은 사용하지 않습니다.Blackwell(sm_120)은 PyTorch 2.7 이상 + CUDA 12.8(cu128) 빌드가 필요합니다.

OPERATING CONTRACT

GPU 작업은
네 단계입니다.

서버에 접속하면 먼저 상태를 봅니다. 예약 없이 CUDA를 실행하거나, lock을 직접 만들고 지우는 방식은 금지합니다.

1gpu-help

규칙 읽기

에이전트는 --json으로 읽습니다.

2gpu-status

상태 확인

현재 작업, 다음 예약, lock 일치 여부를 봅니다.

3gpu-reserve

시간 예약

프로젝트·목적·예상 시간을 정확히 남깁니다.

4gpu-run

worker로 실행

SSH를 닫아도 SYSTEM worker가 작업과 로그를 유지합니다.

사람이 직접 실행POWERSHELL
gpu-status
gpu-reserve --project "name" --purpose "job" --start now --hours 2 --client human
gpu-run <reservation-id> -- <runner> <arguments>
gpu-status
Codex · Claude CodeJSON MODE
gpu-help --json
gpu-status --json
gpu-reserve --project "name" --purpose "job" --start now --hours 2 --client codex --json
gpu-run <reservation-id> --json -- <runner> <arguments>

반드시 하세요

  • 프로젝트와 구체적인 목적을 예약에 적기
  • 검증·아티팩트 복사 시간까지 예상 종료에 포함
  • 자기 폴더의 venvs에 환경 만들기
  • runner와 입력을 파일로 고정한 뒤 제출
  • 지연 시 다음 사용자와 관리자에게 알리기

× 절대 하지 마세요

  • gpu.lock을 직접 생성·수정·삭제
  • 다른 사람의 프로세스·예약·출력을 변경
  • 빈 VRAM이 보여도 예약 없이 나눠 쓰기
  • 공용 검증 venv에 패키지 추가
  • 명령·purpose·note에 키·토큰·비밀번호 입력

CPU · DATA · MAINTENANCE

GPU를 안 써도,
의미 있는 작업은 남깁니다.

STARTnode-work-start

프로젝트와 작업 이유를 등록하고 WORK ID를 받습니다.

WORKCPU · DATA · INSTALL

전처리, 데이터 이동, 설치, 유지보수를 수행합니다.

FINISHnode-work-finish

성공·실패와 짧은 결과를 기록합니다.

node-work-start --project "<project>" --purpose "<what-and-why>" --client human
# 반환된 WORK ID를 기록하고 작업 수행
node-work-finish <work-id> --result completed --note "<result-summary>"
node-audit-verify --json

IDENTITY & AUDIT

누가, 무엇을,
어떻게 했는지.

에이전트가 일해도 소유자는 실제 SSH 계정의 사람입니다. 실행 주체만 codex 또는 claude-code로 함께 남습니다.

LAYER 01

Windows 구조화 감사로그

예약·작업·행위자 SID·접속 문맥·결과를 기록합니다.

일반 사용자는 clear 불가
LAYER 02

SYSTEM 봉인 hash-chain

이전 기록의 hash와 다음 기록을 연결해 수정·삭제·재정렬을 탐지합니다.

GPU-Users 읽기 전용
LAYER 03

PowerShell 명령 포렌식

실제 명령 흔적이 남으므로 시크릿을 인자에 쓰지 않습니다.

보존·자동 archive
사람개인 SSH 계정

회사 PC의 Windows 계정명이 모두 artist여도 서버에서는 사람별 계정을 씁니다.

기기기기별 ed25519 키

PC를 추가할 때 기존 개인키를 복사하지 않고 새 키를 발급합니다.

권한표준 사용자

직원은 Administrators가 아니라 GPU-Users와 GPU-SSH-Users로 등록됩니다.

BEFORE YOU CONNECT

알아두면 좋은 것

캘린더나 채팅 예약이 정본인가요?

아닙니다. 서버의 gpu-control SQLite DB가 유일한 실행 정본입니다. 캘린더·채팅·문서는 보기 위한 미러일 뿐입니다.

GPU 메모리가 남으면 동시에 써도 되나요?

현재 PRO 6000 한 장은 하나의 배타적 자원으로 취급합니다. VRAM이 남아 보여도 자동 허가 없이 공유하지 않습니다.

CPU 작업은 예약이 필요한가요?

GPU 예약은 필요 없지만 결과가 남는 전처리·데이터 이동·설치·유지보수는 WORK ID로 시작과 종료를 남깁니다.

작업이 멈추면 lock을 지워도 되나요?

안 됩니다. 상태 JSON, 예약 ID, PID, 로그 경로를 보존하고 관리자에게 알립니다. 살아 있는 작업을 kill하거나 타인의 lock을 삭제하지 않습니다.

접속 주소는 어디서 받나요?

계정 승인 후 관리자가 사내 LAN/VPN 조건과 함께 전달합니다. 외부 인터넷에 SSH나 관리 포트를 직접 노출하지 않습니다.

현재 완전히 운영 중인가요?

GPU 실행·예약·감사 계층은 파일럿 검증됐습니다. 직원 개인계정은 도구 구현이 끝났고, 관리자 sanghun 및 시험 사용자 실서버 검증 후 일반 배포합니다.

PILOT

CURRENT READINESS · 2026.07.20

신청 도구 준비 완료.
실사용자 파일럿 대기.

GPU·PyTorch·CUDA 실행 검증

예약·SYSTEM worker·보호 로그 검증

직원/관리자 신청 도구 로컬 검증

관리자 sanghun 실접속 검증

시험 직원 신규·추가기기·ACL 검증