News, Fast

Atom Brief

2026년 7월 15일 · 아카이브
Tech업데이트

허깅페이스, 잉클링(Inkling) 실제 구동 요구 사양 상세 공개

허깅페이스, 잉클링(Inkling) 실제 구동 요구 사양 상세 공개

씽킹 머신스(Thinking Machines)의 9,750억 파라미터 모델 잉클링은 출시 당일 배포된 트랜스포머(Transformers) 업데이트를 포함해 5개 프레임워크에서 즉시 실행된다.

  • 전체 BF16 체크포인트는 2테라바이트의 메모리가 필요하며, NVFP4 버전은 600기가바이트가 필요하다.
  • 언슬로스(Unsloth)의 1비트 GGUF 빌드는 로컬 머신의 메모리 요구량을 95퍼센트까지 줄여준다.
  • 허깅페이스는 출시 직후 첫 2시간 동안 인퍼런스 프로바이더(Inference Providers)를 통해 무료 추론을 제공했다.

왜 중요한가: 무료 모델에 대한 접근성은 사실상 이를 구동하는 데 필요한 2테라바이트의 메모리에 의해 통제된다.

Hugging Face blog (Thinking Machines) — "Welcome Inkling by Thinking Machines" ↗ · 2026년 7월 15일26. 7. 15. · 업데이트 7월 15일