News, Fast

Atom Brief

2026년 7월 15일 · 아카이브
Tech업데이트

허깅페이스, 잉클링(Inkling) 실제 구동 요구 사양 상세 공개

씽킹 머신스(Thinking Machines)의 9,750억 파라미터 모델 잉클링은 출시 당일 배포된 트랜스포머(Transformers) 업데이트를 포함해 5개 프레임워크에서 즉시 실행된다.

  • 전체 BF16 체크포인트는 2테라바이트의 메모리가 필요하며, NVFP4 버전은 600기가바이트가 필요하다.
  • 언슬로스(Unsloth)의 1비트 GGUF 빌드는 로컬 머신의 메모리 요구량을 95퍼센트까지 줄여준다.
  • 허깅페이스는 출시 직후 첫 2시간 동안 인퍼런스 프로바이더(Inference Providers)를 통해 무료 추론을 제공했다.

왜 중요한가: 무료 모델에 대한 접근성은 사실상 이를 구동하는 데 필요한 2테라바이트의 메모리에 의해 통제된다.

Hugging Face blog (Thinking Machines) — "Welcome Inkling by Thinking Machines" ↗ · 2026년 7월 15일26. 7. 15. · 업데이트 7월 15일