사이버 보안 Jul 20, 2026북마크에 추가

2026년 7월 20일, 허깅 페이스는 생산 인프라에서 보안 침해가 발생했음을 공개했습니다. 침입 경로는 악의적인 데이터셋이었지만, 더 큰 문제는 침입 후 조치가 '자율 에이전트 프레임워크'에 의해 수행되었다는 점입니다. 이 프레임워크는 수천 개의 일시적인 샌드박스를 통해 수만 건의 작업을 실행했습니다.
2026년 7월 20일dated disclosure. 허깅페이스는 데이터셋 처리 파이프라인을 통해 프로덕션 인프라가 공격자들에게 침해당했다고 밝혔습니다. 초기 침투는 두 가지 코드 실행 취약점을 악용했습니다: 데이터셋 구성에 대한 템플릿 주입과 원격 코드 로더입니다. 공격 벡터: 악성 데이터셋.
이 초기 침투 지점으로부터 공격자들은 내부 데이터셋, 클라우드 및 클러스터 자격 증명에 접근했으며 여러 내부 클러스터로 lateral movement를 수행했습니다. 회사는 공개 모델, 공개 데이터셋 또는 Spaces의 변조 증거를 찾지 못했다고 밝혔으며(공개 시점 기준), 소프트웨어 공급망은 "깨끗한 상태"라고 판단했습니다. 파트너/고객 영향에 대한 조사는 진행 중입니다.
허깅페이스의 대응: 두 가지 취약한 코드 경로 폐쇄, 자격 증명 폐기 및 교체, 악의적 활동 탐지 규칙 신규 배포, 외부 포렌식 전문가 고용, 당국 통보.
공식 선언문에서 주목할 만한 점: «우리는 공격자의 에이전트를 구동한 모델이 어떤 것인지, jailbreak된 호스팅 모델이었는지 아니면 가드레일이 없는 오픈 가중치 모델이었는지 식별하지 못했다.» 즉, 전 세계 최대 규모의 공개 모델 카탈로그를 보유한 이 회사가 로그만으로는 어떤 LLM이 침투를 주도했는지 확인하지 못했다는 뜻입니다.
이 공격은 스웜(swarm) 형태로 이루어졌습니다: 수천 건의 개별 작업이 짧은 수명의 임시 샌드박스에 분산되어 수행되었습니다. 주목할 만한 패턴입니다: 익명성 극대화(상관 분석 가능한 장기 에이전트 없음), IP/행동 임계치 하회, 에이전트 프레임워크의 병렬화(계획 + 실행 + 재시도)를 활용해 광범위한 공격 수행 가능하며 인적 감독 최소화.
변화된 점: 이제 «운영자별 타겟형 익스플로잇»의 세계에서 «토큰화되고 분산되며 저렴한 침투»의 세계로 진입했다는 것입니다. 더 이상 «누가 이 페이로드를 작성했는가»가 아니라 «어떤 시스템 프롬프트 + 도구 루프가これを生成했는가」가 중요해졌습니다. 방어 측면에서는 이제 단일 운영자 시그니처보다 스웜 행동 탐지에 투자해야 합니다.
서버 측에서 데이터셋/모델/아티팩트 API를 노출하는 모든 조직을 위한 권고사항:
!!python/object가 포함된 TOML 등)에서 임의 코드 로더 금지. 코드 로딩이 필요한 경우 격리된 샌드박스에서 자격 증명 없이 실행.아직 definitive한 결론을 내리기엔 이르며 조사가 진행 중이지만, «LLM 에이전트 주도 침투» 패턴은 더 이상 이론적이지 않습니다.
인공지능이 작성하고 사람의 편집 감독하에 검수한 기사입니다.
Agents IA autonomes : nouveau vecteur d'attaque à l'échelle du swarm