삭제되는 LLM 모델을 P2P 토렌트로 영구 보존 — Pirate Face
Pirate Face는 Hugging Face 모델을 BitTorrent 마그넷 링크로 변환해, 원본 소스가 삭제되더라도 P2P 네트워크를 통해 영구 배포가 가능한 분산형 AI 모델 보존 인프라 서비스다.
원문: Pirate Face Rescues LLM Models from Deletion 원문 보기 →
문제: 오늘 공개된 모델이 내일 사라질 수 있다
오픈소스 AI 생태계는 Hugging Face를 중심으로 수십만 개의 모델을 공유한다. 그러나 기업 정책 변경, 저작권 분쟁, 정부 규제, 또는 단순한 서비스 종료로 인해 모델이 언제든 삭제될 수 있다. 연구자가 몇 달간 의존해온 모델이 어느 날 아침 404 오류로 돌아올 때, 그 파생 연구와 프로덕션 서비스는 한순간에 위기에 처한다.
Pirate Face의 해법
Pirate Face(pirateface.co)는 주권적 AI(Sovereign AI)의 영구성 레이어를 표방하는 P2P 인프라 서비스다. 핵심 메커니즘은 Hugging Face 모델을 체크섬이 검증된 BitTorrent로 변환하고, Hugging Face를 웹시드(web seed)로 포함시켜 두 경로에서 동시에 다운로드 가능하게 하는 것이다.
- 체크섬 보증: Hugging Face의 공식 SHA-256 해시를 그대로 사용해 모든 바이트가 원본과 일치함을 검증
- 웹시드 폴백: 원본이 살아있는 동안은 정상 다운로드. 삭제되면 P2P 스웜이 자동으로 대체
- Rescued 마킹: 삭제된 모델은 구조됨 상태로 표시되며, 토렌트 스웜이 지속 배포
드롭인 API 통합
개발 중인 핵심 기능은 환경변수 하나로 연결하는 드롭인 API다. 기존 코드를 수정하지 않고 환경변수 하나만 변경하면, Hugging Face 대신 Pirate Face의 분산 네트워크를 통해 모델을 로드할 수 있다. 기업과 연구자 입장에서는 단일 장애점(single point of failure)을 제거하는 실용적인 선택이 된다.
거버넌스 딜레마
Pirate Face가 제기하는 근본적인 질문은 간단하지 않다. 악의적으로 파인튜닝 가능한 위험한 모델도 영구 보존 대상이 되는가? 서비스는 적격 모델만 변환한다고 밝히지만, 적격 기준은 공개되지 않았다. 분산 보존과 AI 안전성 사이의 균형은 앞으로도 지속적인 논쟁의 핵심이 될 것이다.
관련 기사
텐센트 Hy4: 770B 파라미터, 1M 컨텍스트, 재귀적 자기 최적화
텐센트가 770B 총 파라미터(활성 49B)와 100만 토큰 이상의 컨텍스트 윈도우를 지원하는 Hy4 프리뷰를 오픈소스로 공개했다. 모델 자체가 추론 시스템을 자율적으로 최적화해 31.8% 성능 향상을 이끈 재귀적 자기 개선 사례다.
Qwen3.8-Flash-Next 오픈소스 공개 — Qwen4 아키텍처 미리 보기
알리바바 Qwen 팀이 Qwen4 아키텍처의 초기 프리뷰인 Qwen3.8-Flash-Next를 오픈웨이트로 공개했다. 125B 파라미터(활성 6B)와 51B N-gram 임베딩을 갖추고, Qwen3.7-Plus 대비 훈련 비용 9분의 1로 코딩·에이전트 성능에서 앞서는 결과를 보였다.
700줄 C코드로 만든 현대 LLM — gemma4.c 프로젝트 공개
개발자가 Google Gemma 4 E2B 모델을 실행하는 700줄짜리 단일 C 파일 gemma4.c를 공개했다. 외부 의존성 없이 일반 CPU에서 실행되며, 코드 전체를 읽으면 LLM 추론 원리를 이해할 수 있다.