Inference Brew

Hugging Face 보안 침해 사고, API 가드레일이 사고 대응을 방해하는 사례로 주목

00:00 / --:--

← 메인으로

Hugging Face 보안 침해 사고, API 가드레일이 사고 대응을 방해하는 사례로 주목

1. Hugging Face 보안 침해 사고, API 가드레일이 사고 대응을 방해하는 사례로 주목

Hugging Face는 공격자가 자율 AI 에이전트를 배포하여 데이터셋 처리 파이프라인의 코드 실행 경로를 악용한 정교한 보안 사고를 공개했습니다. 회사는 침해를 성공적으로 차단하고 공개 모델 및 공급망이 변조되지 않았음을 확인했으나, 이번 사고 대응 과정에서 개발자 도구의 치명적인 취약점이 드러났습니다. 상용 프론티어 LLM API가 보안팀의 포렌식 분석을 공격자와 방어자를 구분하지 못한 채 안전 가드레일로 차단해버린 것입니다. 이를 우회하기 위해 Hugging Face는 자체 인프라에서 오픈 웨이트 모델인 GLM 5.2를 실행하여 민감한 자격 증명 유출이나 API 차단 없이 17,000건 이상의 보안 이벤트를 안전하게 분석했습니다.

  • Hugging Face는 공격자가 자율 AI 에이전트를 사용하여 데이터셋 처리 코드 실행 경로를 악용한 프로덕션 침해 사고를 겪었습니다.
  • 공격자는 노드 수준의 접근 권한을 확보하고 클라우드 자격 증명을 탈취하여 내부 클러스터로 측면 이동했습니다.
  • Hugging Face의 사고 대응팀은 포렌식 쿼리가 악성으로 분류되는 안전 가드레일 때문에 미국 프론티어 LLM API를 사용할 수 없었습니다.
  • 팀은 자체 내부 인프라에서 호스팅된 오픈 웨이트 모델 GLM 5.2를 사용하여 17,000개 이상의 로그를 성공적으로 분석했습니다.
  • Hugging Face는 공개 모델, 데이터셋, Spaces의 변조는 없었음을 확인했으나 사용자들에게 액세스 토큰을 교체할 것을 권장합니다.

개발자들은 상용 LLM의 안전 가드레일이 중요한 보안 및 포렌식 워크플로우를 차단할 수 있는 상황에 대비해야 하며, 이를 위해 로컬 오픈 웨이트 모델이 사고 대응에 필수적임을 인지해야 합니다.

2. Feyn AI, 쿼리 전 데이터베이스를 검사하는 SQRL 텍스트-투-SQL 모델 출시

Feyn AI는 최종 SQL을 생성하기 전에 읽기 전용 쿼리를 사용하여 데이터베이스를 검사하도록 설계된 오픈 소스 텍스트-투-SQL 모델 제품군인 SQRL을 출시했습니다. Qwen3.5 및 Qwen3.6 아키텍처를 기반으로 구축된 주력 모델 SQRL-35B-A3B는 BIRD Dev 벤치마크에서 70.6%의 실행 정확도를 기록하며 Claude Opus 4.6을 능가했습니다. 이 모델들은 vLLM과 호환되며, 개발자가 스키마와 데이터베이스 관찰 결과를 추론 루프에 다시 입력하는 읽기 전용 하네스를 구현해야 하므로 강력한 데이터베이스 에이전트를 구축하는 데 매우 효과적입니다.

  • Feyn AI는 Qwen3.5 및 Qwen3.6 아키텍처를 기반으로 구축된 텍스트-투-SQL 모델 제품군인 SQRL을 출시했습니다.
  • 주력 모델인 SQRL-35B-A3B는 BIRD Dev 벤치마크에서 70.6%의 실행 정확도를 기록하여 Claude Opus 4.6(68.77%)을 앞섰습니다.
  • 오픈 소스 체크포인트(SQRL-4B, SQRL-9B, SQRL-35B-A3B)는 Hugging Face에서 제공되며 vLLM과 호환됩니다.
  • 이 모델들은 추론 루프 중에 데이터베이스 관찰 결과를 모델에 다시 입력하기 위한 읽기 전용 하네스가 필요합니다.
  • 학습에는 검증된 교사 궤적에서 증류된 CISPO 강화 학습 방법이 사용되었습니다.

개발자들은 읽기 전용 데이터베이스 검사 하네스를 통합함으로써 프론티어 모델보다 뛰어난 성능을 발휘하는 고정밀 SQL 생성 에이전트를 배포할 수 있습니다.

SOURCES

3. Alibaba, 2.4조 파라미터 규모의 Qwen3.8-Max 멀티모달 모델 프리뷰 공개

Alibaba의 Qwen 팀은 프론티어 모델의 직접적인 경쟁자로 자리매김할 주력 모델 Qwen3.8-Max의 프리뷰 버전을 선보였습니다. 희소 Mixture-of-Experts 아키텍처는 비디오 및 문서 처리를 포함한 다중 모달리티를 처리합니다. Alibaba는 이 모델의 성능이 Fable 5 다음으로 뛰어나다고 주장하지만, 이를 검증할 벤치마크 표나 모델 카드는 아직 공개되지 않았습니다. 현재 이 프리뷰는 Alibaba의 개발자 플랫폼을 통해 대폭 할인된 가격으로 액세스할 수 있으며, 향후 오픈 웨이트 릴리스를 위한 전 단계 역할을 합니다.

  • Alibaba는 세계 인공지능 대회(World AI Conference)에서 2.4조 파라미터 규모의 희소 Mixture-of-Experts 모델인 Qwen3.8-Max-Preview를 공개했습니다.
  • 프리뷰 모델은 Alibaba의 Token Plan, Qoder, QoderWork를 통해 표준 가격의 10% 수준으로 이용 가능합니다.
  • 이 모델은 텍스트, 이미지, 비디오, 문서를 처리하며 Alibaba는 Fable 5에 이어 두 번째로 뛰어난 성능을 보인다고 주장합니다.
  • Alibaba는 향후 오픈 웨이트 릴리스를 약속했으나 구체적인 날짜, 라이선스, 활성 파라미터 수는 아직 제공하지 않았습니다.

개발자들은 향후 예정된 오픈 웨이트 릴리스에 앞서 대규모 2.4조 파라미터 멀티모달 모델을 대폭 할인된 가격으로 미리 경험해 볼 수 있습니다.

4. Claude Code, 더 빠른 시작을 위해 Rust 기반 Bun 런타임 통합

Claude Code는 v2.1.181 버전부터 Rust로 포팅된 Bun 런타임을 사용하도록 전환했습니다. 현재 카나리 릴리스로 제공되는 Bun v1.4.0을 내장한 이 아키텍처 변경을 통해 Linux 환경에서 시작 시간이 10% 개선되었습니다. 이번 업데이트는 터미널 기반 코딩 어시스턴트를 일상적인 워크플로우에서 사용하는 개발자들에게 즉각적인 성능 향상을 제공합니다.

  • Claude Code v2.1.181 및 이후 버전은 이제 Rust로 포팅된 Bun 런타임에서 실행됩니다.
  • Rust 포팅으로의 전환은 Linux에서 10% 더 빠른 시작 시간을 제공합니다.
  • 바이너리에는 현재 bun upgrade --canary 명령을 통해 공개적으로 사용 가능한 Bun v1.4.0이 포함되어 있습니다.
  • 이 통합은 Claude 바이너리 내에서 563개의 Rust 소스 파일 경로를 식별함으로써 확인되었습니다.

Claude Code를 사용하는 개발자들은 일상적인 터미널 기반 코딩 워크플로우에서 즉각적인 성능 향상을 경험할 수 있습니다.

SOURCES

5. Transcribe.cpp v0.1.0 출시, whisper.cpp의 드롭인 대체제

Transcribe.cpp v0.1.0의 출시는 개발자들에게 whisper.cpp에 대한 고도로 최적화된 ggml 기반 대안을 제공합니다. 이 라이브러리는 16개의 ASR 제품군과 60개 이상의 모델에 걸쳐 스트리밍 및 배치 전사를 지원하며, 기존 .bin 모델 파일과의 하위 호환성을 보장합니다. CUDA, Metal, Vulkan에 대한 네이티브 하드웨어 가속과 TypeScript, Rust, Python 등 주요 언어에 대한 퍼스트 파티 바인딩을 갖추어 다중 플랫폼 애플리케이션을 위한 강력한 로컬 전사 솔루션을 제공합니다.

  • Transcribe.cpp v0.1.0은 whisper.cpp의 드롭인 대체제로 사용되는 ggml 기반 전사 라이브러리입니다.
  • 이 라이브러리는 16개의 ASR 제품군과 60개 이상의 모델을 지원하며 기존 .bin 파일과의 호환성을 유지합니다.
  • 스트리밍 및 배치 전사 모두를 위해 Vulkan, Metal, CUDA, TinyBLAS를 통한 하드웨어 가속을 제공합니다.
  • Python, JavaScript/TypeScript, Rust, Objective-C/Swift를 위한 퍼스트 파티 언어 바인딩을 제공합니다.
  • 이 프로젝트는 Mozilla AI, Modal, Blacksmith, Hugging Face의 지원을 받으며 모든 모델은 단어 오류율(WER)에 대해 수치적으로 검증되었습니다.

개발자들은 네이티브 바인딩을 갖춘 빠르고 다중 플랫폼을 지원하는 로컬 오디오 전사 라이브러리를 자신의 애플리케이션에 쉽게 통합할 수 있습니다.

SOURCES

Inference Brew를 인박스로

하루 5분. 무료, 언제든 해지할 수 있습니다.

Inference Brew를 인박스로

하루 5분. 무료, 언제든 해지할 수 있습니다.